Pith. sign in

Paper Citation Record · LEDGER

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference

As of 17 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2608.01536.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.01536 v1

Coverage vector

measured 39 of 39 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T00:09:29.472155Z

measured 39 of 39 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

39 of 39 outbound references displayed

  • verified exact2
  • verified fuzzy2
  • unresolved35
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 90ba9164-23c6-4e8e-aa8b-16e6c04ae8a9 · outbound

This paper cites gpt-oss-120b & gpt-oss-20b Model Card.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference gpt-oss-120b & gpt-oss-20b Model Card

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:25.460411Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:25.460411Z digest=sha256:abe9d75524bbb1503a91f54fd4c66581fee27cde3e51bcccee3012d5beb1cd33

Observation 8f1a3059-cf80-4e3b-a5dd-df936e485b4f · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.760777Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:25.540124Z digest=sha256:8edc6b6d241debcf673c00a36e6c392297ec416892fee73b333d129184b29866

Observation 5b9af056-542b-4898-8531-8d25c89600bd · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.606557Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:25.640712Z digest=sha256:c734b8eb17e8adb64901b61f7582e41166a8fc3260932920e81c2014a0b386ca

Observation 09b0186b-9fc7-44c1-aead-cb42939868b5 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.461160Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:25.737432Z digest=sha256:cc015acdbcf283f8db167a0ff453e1faf97e33f6294247cc734f3cdca81700bd

Observation 518db606-ea8a-4666-8701-56654afd26c4 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.295839Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:25.909781Z digest=sha256:a7a9f97cc7fae268c28fd6bd338df50e0fbba8daf5e21eeb87255b0fa5458b7b

Observation d65fed49-ec24-48af-84c5-39d63de3fb21 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.165013Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:26.072768Z digest=sha256:c366d8ad7e54bc1f3c51032731bc9cbba88026e36f32f47d13f4c5675816e483

Observation e25114ec-a5b2-4a74-ad0f-85b41d3a8b20 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.039474Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:26.194168Z digest=sha256:2ce91052d942c0b4b5ef1e3ba52521ff49b9d5fb53086a0e53aa70f620cef722

Observation ccfd753a-087b-424f-a08b-896e51baa068 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 8

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.883572Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:26.339314Z digest=sha256:40b6e1b20fbfb017d634923b45d970260197dbb6ecd03a62cb498cfaca3c7393

Observation c52859f4-982f-485a-bb3b-f369db80bb69 · outbound

This paper cites Accelerating a Triton Fused Kernel for W4A16 Quantized Inference with SplitK work decomposition.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Accelerating a Triton Fused Kernel for W4A16 Quantized Inference with SplitK work decomposition

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:26.458557Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:26.458557Z digest=sha256:8b8d5d2d9fb34c7f7795679a714378867353eb1083965bab622e1570f5b80d1f

Observation 9f59e3ce-de8e-4108-b978-484db1da7ba5 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.722674Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:26.585936Z digest=sha256:fd856c66dfd1013a9a36b3defdc44eb219e9514f418586a40945832cdde05d42

Observation 06f33b93-039a-4106-9332-64b8cd866179 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.581372Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:26.683328Z digest=sha256:8a3648fad4421a2fcc07b8666bcd7a673c8361e7f21dff0f0f50bf7926997972

Observation fdedfe60-b2dd-4111-90df-59fe0da63113 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.428784Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:26.812192Z digest=sha256:9b91cc544a3ae389b4bda13d188eeb2d4daebca582ea3874397dd089bd30f933

Observation b4f060c8-5bf0-4d6a-b40b-794450d253fa · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.281959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:26.909656Z digest=sha256:09159d0f4e1ddd2d0b092dda59c7c930d210f47b9a7eba3b487784c83f4d060f

Observation 63e97ef6-1f2f-4019-ae54-73e2ebc2ea63 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.142263Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:27.018368Z digest=sha256:0501a355309f56beb340e0e8e03517d49bcd9ec461b069820cc0514ecf2e5545

Observation 991a5dba-6ec8-4ac7-bb73-f7138907e9db · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.971883Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:27.134374Z digest=sha256:0827022dca9c933f6a987ed7e91626a90eb78f538c242392385cda48bda4e3bb

Observation 998bed04-e576-46d0-b9bf-15059eb36691 · outbound

This paper cites Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.255209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.255209Z digest=sha256:560b43aa1e0283ac07e4445e4dc11dfd4601c7c8eacb45116e8c9de7c37ea355

Observation 8fe30705-e9bb-422d-b783-48e16e03a83e · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.815385Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:27.364607Z digest=sha256:cc43088c9eca274d0def2ee0b590dc6926e02b699775726e37a05a38c61baf23

Observation cc621830-3a20-4bb0-a2fb-9da4d1339508 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.657437Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:27.439093Z digest=sha256:54fbb6fe79e86ed6bcb58360e7cbd90a3892301201f75be41fad94abc2927197

Observation 1f8abdde-f27d-41dd-a902-9cb095c5daa6 · outbound

This paper cites 2025.CUDA Pro Tip: Increase Per- formance with Vectorized Memory Access.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2025.CUDA Pro Tip: Increase Per- formance with Vectorized Memory Access

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:09:32.498383Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:27.539068Z digest=sha256:720e8a413a090749438d566824df829c68776a7f7afdc34a6cd967b8ee26ee61

Observation bcaf8b32-8100-45c5-bc31-4c8ac214b4a4 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.631155Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.631155Z digest=sha256:d04a0b8f824d427287158ef88d043abc94d141780bb4ee3832bcef7aad3614c7

Observation abaf76ac-d623-4d99-b48a-121c41e5317b · outbound

This paper cites ShortGPT: Layers in Large Language Models are More Redundant Than You Expect.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference ShortGPT: Layers in Large Language Models are More Redundant Than You Expect

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.751477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.751477Z digest=sha256:a3dc5ba2922eabc3c28004083da636508ddd5d4073e52697ef05743bb71973c5

Observation cce07656-58c6-4f4a-94b4-7599c754c919 · outbound

This paper cites Pointer Sentinel Mixture Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Pointer Sentinel Mixture Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.834304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.834304Z digest=sha256:14176abac4607033e28c18f290b04d9105af7c24ff3ba24770099e4262e43f91

Observation eb3d8de3-1a87-47c5-8dc7-8a9734ffbb67 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.307534Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:27.958092Z digest=sha256:b0da2362bc6958f1353d93f1ce5cdc5c30462d67b9a5d73ccbba60bd09330739

Observation 7b57217b-de99-48c6-95ef-dd8d91f693eb · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.153451Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:28.035913Z digest=sha256:99228a1f2d94c8a9a68c89ef34c9f4efe7930b0294dc43fe3ac59ea37ec139b3

Observation cb4a149c-bff4-4ad0-a8b2-6282ce3c7e40 · outbound

This paper cites 2SSP: A Two-Stage Framework for Structured Pruning of LLMs.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2SSP: A Two-Stage Framework for Structured Pruning of LLMs

Reference 25

Resolution
verified exact
local_arxiv, observed 2026-08-06T00:09:29.908872Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:28.186603Z digest=sha256:e626925294167ad9c164e2ec6eb48c44a3afa133d0b9cc7a312686aded05721b

Observation 85c156e0-f35f-4210-afeb-5bb1e6942a17 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.010398Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:28.268501Z digest=sha256:6fa9ce2b16b53cea8da127beaa04e14526e25e9979090de4e7637ac1ded2c3d7

Observation 09a9ac09-0d70-45ad-b359-09e4075cff59 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.775108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:28.349277Z digest=sha256:7ae2a5b042fde6da0f75b034eed3975acada70408d7fb4150c9c71a989d967f2

Observation 9b2922f6-7837-4f7c-a652-b5696f317df0 · outbound

This paper cites A Simple and Effective Pruning Approach for Large Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference A Simple and Effective Pruning Approach for Large Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.408073Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.408073Z digest=sha256:22b31f624204ec98a47c659804739e7e212819e6cede6e54a96659182042b941

Observation 22a12d2b-b491-4ef7-b66e-b0fe35ab357d · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference LLaMA: Open and Efficient Foundation Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.494137Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.494137Z digest=sha256:e0b7d0b00e931f1775ea0dc886ed65ffd16eb9c9851beb2e72ed0b88900b6d3e

Observation 3a455e09-76e5-4004-bc0d-48311b2ed5a9 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.484732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:28.609596Z digest=sha256:cc476728d5bf4d110d4dc3c8511120ac23606f5ee9bc0cccf8cba8af2911274a

Observation 3b184a85-9f3c-4509-a578-95e4ef8985b9 · outbound

This paper cites Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.755271Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.755271Z digest=sha256:589df18b086ddb2fa026b7883267e26ebb488bc46b3b36ec4a9b10693fc66f19

Observation c4ea8b7f-a3e3-4bd3-8c41-673785a545bb · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.230643Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:28.832699Z digest=sha256:5f5265114863d18c6fd1f90620f51cd41af44c9aaa23bf73119188bee94646cc

Observation 4964a459-efbc-4f63-bd09-d2701ab4a430 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.941108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:28.938982Z digest=sha256:f2154c8caa764fc7ce988136bcb1ec5cc96d33e34e0305b99467bce4c00c19cb

Observation e36c7279-bba0-4acd-9992-3dc374a73064 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 34

Resolution
verified exact
raw_fallback, observed 2026-08-06T00:09:29.728433Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:29.058718Z digest=sha256:b2e31bc3eba9368e2381e49a1a80b3de132dd5cfbbea618c7939f5855ac3842f

Observation 0d67357a-368f-4125-8633-4370b11fa352 · outbound

This paper cites OPT: Open Pre-trained Transformer Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference OPT: Open Pre-trained Transformer Language Models

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:29.156883Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:29.156883Z digest=sha256:77b0dc590ae6770684760b0978a0e6c9a061a9c5fff7bb8be987d69fa8b252e6

Observation ec737639-aee7-439a-956b-5bd8d9519247 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 36

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.629179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:29.267647Z digest=sha256:00e1c2f6f955b537c1ecf8bf5ff7c0daf94b01d76c20b509dd4b8bed655e376b

Observation 3d213abd-06ad-48ac-9938-5a333520d90d · outbound

This paper cites 2022.{SparTA}:{Deep-Learning} Model Sparsity via{Tensor-with-Sparsity-Attribute}.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2022.{SparTA}:{Deep-Learning} Model Sparsity via{Tensor-with-Sparsity-Attribute}

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:09:30.382427Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:29.336047Z digest=sha256:d1881968336f60e5d3db7c2f471f012c38321e31309c4cf92d59569bbfb32e46

Observation eae9f883-b582-45c3-a052-d1e00201dc5e · outbound

This paper cites BlockPruner: Fine-grained Pruning for Large Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference BlockPruner: Fine-grained Pruning for Large Language Models

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:29.407949Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:29.407949Z digest=sha256:f57ddf0ac84f8aed516a6cbe50f0c7ad012a07a4040c92e7032bdd11c345a574

Observation 3c91bb2c-fc32-4948-848c-964556848b74 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.230893Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-06T00:09:29.472155Z digest=sha256:a3bbd8aff5920ddbc9af1dd68ad1eb59d8e251e8d98839c1221537f28eb4e5ed

Pith citing papers

No inbound Pith citation observations are available.