{"as_of":"2026-08-08T03:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6f8733bb96ceae612866391765ccc4d72bdb8224b7cc6f81f7fe0fbce014d4b4","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:09:29.472155Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01536/citation-record","integrity":"/paper/2608.01536/integrity","json":"/paper/2608.01536/citation-record.json","paper":"/paper/2608.01536"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-06T00:09:25.460411Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:25.460411Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:caf8350ae237fcb84a6d843b4e86ef6ced7be4609819a75123aee4cb22efab69","observation_id":"90ba9164-23c6-4e8e-aa8b-16e6c04ae8a9","resolution":{"observed_at":"2026-08-06T00:09:25.460411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:34.688876Z","title":null,"venue":null,"work_id":"e2194781-5a76-4ff5-9603-7eb9d4e0d5bb","year":2016},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:25.540124Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:340aeba35645dafa3f378963aeabf78bfba2a3e629ad592996398862bb8c9c87","observation_id":"8f1a3059-cf80-4e3b-a5dd-df936e485b4f","resolution":{"observed_at":"2026-08-06T00:09:34.760777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:34.530198Z","title":null,"venue":null,"work_id":"d575c3f1-db29-4ba4-8008-53fbd3d581da","year":2019},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:25.640712Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:103429e95b46697b7f5ac4190883ae8baa529898e45bb6a58902708362e35228","observation_id":"5b9af056-542b-4898-8531-8d25c89600bd","resolution":{"observed_at":"2026-08-06T00:09:34.606557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:34.378959Z","title":null,"venue":null,"work_id":"2ef59ad9-d53c-43ab-8ea3-6a77d39511c4","year":2022},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:25.737432Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:422499becf6bd3d6b1ca4f70421510203fda36e5e52df07b8f6ea31ee49dbbbb","observation_id":"09b0186b-9fc7-44c1-aead-cb42939868b5","resolution":{"observed_at":"2026-08-06T00:09:34.461160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:34.230121Z","title":null,"venue":null,"work_id":"c06e3d94-24bd-41d1-b160-5f90dd24ab8c","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:25.909781Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:8e83e9f1eb8881740930f9028a77a7f8fef9f6f3a6b52d55229fca8f60e864a2","observation_id":"518db606-ea8a-4666-8701-56654afd26c4","resolution":{"observed_at":"2026-08-06T00:09:34.295839Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:34.098011Z","title":null,"venue":null,"work_id":"5b7e7aa6-8a05-464d-8343-9f23c8b76dd2","year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.072768Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:f4eebb56ed50aaf046f56867079104e4e8fffcac9892a2fc899ec68841c980b2","observation_id":"d65fed49-ec24-48af-84c5-39d63de3fb21","resolution":{"observed_at":"2026-08-06T00:09:34.165013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.949828Z","title":null,"venue":null,"work_id":"6936023b-f044-4994-9f19-13e2cc1cf3de","year":2020},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.194168Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:cdd7a1044333a5ccefd3aae1a92e37793eb46c74acdce6810dbaa6723100c376","observation_id":"e25114ec-a5b2-4a74-ad0f-85b41d3a8b20","resolution":{"observed_at":"2026-08-06T00:09:34.039474Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.818037Z","title":null,"venue":null,"work_id":"83ec1980-810e-42f0-9973-d7ff11537cad","year":2016},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.339314Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:3687b01a2d476991f258d16e8285e7e75644803c1c84cf672209b4ec7dd3f002","observation_id":"ccfd753a-087b-424f-a08b-896e51baa068","resolution":{"observed_at":"2026-08-06T00:09:33.883572Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00025","last_updated":"2024-02-22T20:38:47Z","snapshot_observed_at":"2026-07-06T17:23:18.724263Z","submitted_at":"2024-01-05T19:17:55Z","title":"Accelerating a Triton Fused Kernel for W4A16 Quantized Inference with SplitK work decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00025","snapshot_observed_at":"2026-08-06T00:09:26.458557Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.458557Z"},"links":{"cited_paper":"/paper/2402.00025","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:7fefa6a04f45afe860ce71d4ee69d635f6f4b0d1e55cccffd4a0bffae7f464c5","observation_id":"c52859f4-982f-485a-bb3b-f369db80bb69","resolution":{"observed_at":"2026-08-06T00:09:26.458557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.664403Z","title":null,"venue":null,"work_id":"69a6dcdf-1345-474d-b717-b75634ad0ccb","year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.585936Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:78de1b8f8702ed94c8e28924cad46bc4709838b6180d1560a9cff5e5d7bf3f80","observation_id":"9f59e3ce-de8e-4108-b978-484db1da7ba5","resolution":{"observed_at":"2026-08-06T00:09:33.722674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.505780Z","title":null,"venue":null,"work_id":"50850594-97d0-4727-80f9-b17a14ebfd4d","year":2015},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.683328Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:bf6abda6ea178cba5c96fbfe7d5158aac2d7c68abfd818247b24797f7da25a37","observation_id":"06f33b93-039a-4106-9332-64b8cd866179","resolution":{"observed_at":"2026-08-06T00:09:33.581372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.374750Z","title":null,"venue":null,"work_id":"83ae119e-c7cf-402e-9063-388b37c6f023","year":2022},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.812192Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:da4161392070320edcc75b89bbdd055e60f1705110cbdb12a156262fdc8e62c7","observation_id":"fdedfe60-b2dd-4111-90df-59fe0da63113","resolution":{"observed_at":"2026-08-06T00:09:33.428784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.220242Z","title":null,"venue":null,"work_id":"90cc3b9a-0b3c-46e5-99a8-cd0832df6e78","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.909656Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:d107dcff5efaacbc9591a88f726647b2935cb18d81a32848c682a021abb726b4","observation_id":"b4f060c8-5bf0-4d6a-b40b-794450d253fa","resolution":{"observed_at":"2026-08-06T00:09:33.281959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.059654Z","title":null,"venue":null,"work_id":"82ef5d33-9558-4cc5-bd19-55460919e6b4","year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.018368Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:08fadb6e96ee20857eb5eb76484b6de949058ce0b79277316d040cf1d24dff73","observation_id":"63e97ef6-1f2f-4019-ae54-73e2ebc2ea63","resolution":{"observed_at":"2026-08-06T00:09:33.142263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.901029Z","title":null,"venue":null,"work_id":"5265449b-886f-4770-a996-a307bb165749","year":2020},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.134374Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:79ccbb832cd6e7f051282b2aa3713df8aa4d3554cf549d9d1f810cf981dd98a6","observation_id":"991a5dba-6ec8-4ac7-bb73-f7138907e9db","resolution":{"observed_at":"2026-08-06T00:09:32.971883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05459","last_updated":"2024-05-08T06:16:23Z","snapshot_observed_at":"2026-08-02T13:57:57.119489Z","submitted_at":"2024-01-10T09:25:45Z","title":"Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05459","snapshot_observed_at":"2026-08-06T00:09:27.255209Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.255209Z"},"links":{"cited_paper":"/paper/2401.05459","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:89bc5ef39697a8b7475d285428a9d29e352c4d648cb2f2dbbe31a61af621c9de","observation_id":"998bed04-e576-46d0-b9bf-15059eb36691","resolution":{"observed_at":"2026-08-06T00:09:27.255209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.741089Z","title":null,"venue":null,"work_id":"492982e6-8531-4c2a-860c-471cc61b6f9e","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.364607Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:fde6a4fa687b563073bcf49e09d4cb1fc1fbcd38d4948c95ac3092dcfa5f8302","observation_id":"8fe30705-e9bb-422d-b783-48e16e03a83e","resolution":{"observed_at":"2026-08-06T00:09:32.815385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.581362Z","title":null,"venue":null,"work_id":"64f21588-2323-4e1b-bfd0-71b52dccd07c","year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.439093Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:25d49295a920043db0c47e618a20ef178285a564ea5a6730263389eb83b46fa5","observation_id":"cc621830-3a20-4bb0-a2fb-9da4d1339508","resolution":{"observed_at":"2026-08-06T00:09:32.657437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.425224Z","title":"2025.CUDA Pro Tip: Increase Per- formance with Vectorized Memory Access","venue":null,"work_id":"942e308d-6638-4627-ae3e-2ddb9910f3da","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.539068Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:be89cd97978d127ea941ed7230bdfabd2ad431dc7f9003c436c9c5d3bf409b92","observation_id":"1f8abdde-f27d-41dd-a902-9cb095c5daa6","resolution":{"observed_at":"2026-08-06T00:09:32.498383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:27.631155Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.631155Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:f0b01992fb1657ba8470487458a07105535e37651183181d9b196462b6b2a8f2","observation_id":"bcaf8b32-8100-45c5-bc31-4c8ac214b4a4","resolution":{"observed_at":"2026-08-06T00:09:27.631155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-06T00:09:27.751477Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.751477Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:bdb7806df2d2eb5b04b19abda829511a9e5d0e99783e515c4ed6b6eed92c4c23","observation_id":"abaf76ac-d623-4d99-b48a-121c41e5317b","resolution":{"observed_at":"2026-08-06T00:09:27.751477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-06T00:09:27.834304Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.834304Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:3b71a3bd12f76339e1536843a9784efc8be9917fd10848219f99c50c7a33a016","observation_id":"cce07656-58c6-4f4a-94b4-7599c754c919","resolution":{"observed_at":"2026-08-06T00:09:27.834304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.231696Z","title":null,"venue":null,"work_id":"2e08c45f-95db-4eab-96f2-54552282c3d6","year":2021},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.958092Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:f237e2b4321e7075663f52bfe2ae07a5cf85edc4243e75bf4ca7df083abb22b8","observation_id":"eb3d8de3-1a87-47c5-8dc7-8a9734ffbb67","resolution":{"observed_at":"2026-08-06T00:09:32.307534Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.081009Z","title":null,"venue":null,"work_id":"1b4bfe00-fc88-407b-9903-b35cd86762c6","year":2020},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.035913Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:8486f2bbe43f62e2ad563f57af6a5cc9dfc1a3447d025a65832d78e0cf6f1417","observation_id":"7b57217b-de99-48c6-95ef-dd8d91f693eb","resolution":{"observed_at":"2026-08-06T00:09:32.153451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17771","last_updated":"2025-08-17T16:56:30Z","snapshot_observed_at":"2026-08-05T02:49:13.264759Z","submitted_at":"2025-01-29T17:05:33Z","title":"2SSP: A Two-Stage Framework for Structured Pruning of LLMs","version":2},"cited_work":{"arxiv_id":"2501.17771","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.17771","snapshot_observed_at":"2026-08-06T00:09:29.854181Z","title":"2SSP: A Two-Stage Framework for Structured Pruning of LLMs","venue":"cs.CL","work_id":"f2189d74-0f12-4f1f-89dd-3c21ab213a0e","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.186603Z"},"links":{"cited_paper":"/paper/2501.17771","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:e54e668122d50aa68b7106c55187dfbd8c224461b8c2f6fc85610e3adb74501a","observation_id":"cb4a149c-bff4-4ad0-a8b2-6282ce3c7e40","resolution":{"observed_at":"2026-08-06T00:09:29.908872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:31.914422Z","title":null,"venue":null,"work_id":"0002b962-514c-44b2-857e-382cac73178e","year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.268501Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:091927e0fddd785ec9721bfd3b3c4a59a9c2f9934d50d14e6064f418772183ee","observation_id":"85c156e0-f35f-4210-afeb-5bb1e6942a17","resolution":{"observed_at":"2026-08-06T00:09:32.010398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:31.607988Z","title":null,"venue":null,"work_id":"9edf61ae-7585-4f5e-bafc-bdf7a62f3f53","year":2017},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.349277Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:36e61b2c4f44d53edc00d39ce194316fbbc26b4342da420e930dd96dfd59a8f0","observation_id":"09a9ac09-0d70-45ad-b359-09e4075cff59","resolution":{"observed_at":"2026-08-06T00:09:31.775108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-06T00:09:28.408073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.408073Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:03b103a50511b807515b1cf08fa18ad2deea9f416a87d515fd24f8dff62c7a64","observation_id":"9b2922f6-7837-4f7c-a652-b5696f317df0","resolution":{"observed_at":"2026-08-06T00:09:28.408073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T00:09:28.494137Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.494137Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:697eee9bcb5f0a3fda48a3925da2e420dc2ea68110a075e763c7e07e774e4949","observation_id":"22a12d2b-b491-4ef7-b66e-b0fe35ab357d","resolution":{"observed_at":"2026-08-06T00:09:28.494137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:31.371030Z","title":null,"venue":null,"work_id":"7100f7b4-575e-495a-b812-b784f48ade5c","year":2021},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.609596Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:e2ac786aa4b7dfa6d4863f5397bdd1e22245983220203c1472c16487bf07ca34","observation_id":"3a455e09-76e5-4004-bc0d-48311b2ed5a9","resolution":{"observed_at":"2026-08-06T00:09:31.484732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10285","last_updated":"2023-09-19T03:20:02Z","snapshot_observed_at":"2026-08-01T16:15:23.171765Z","submitted_at":"2023-09-19T03:20:02Z","title":"Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10285","snapshot_observed_at":"2026-08-06T00:09:28.755271Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.755271Z"},"links":{"cited_paper":"/paper/2309.10285","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:5958e6a3b4b4a93b584a908e2f38f0bb302e558191e3266c4fa80d1d296e0603","observation_id":"3b184a85-9f3c-4509-a578-95e4ef8985b9","resolution":{"observed_at":"2026-08-06T00:09:28.755271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:31.054657Z","title":null,"venue":null,"work_id":"6eef13af-f0e7-49d1-afb7-37429dc73b9f","year":2024},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.832699Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:6e86b9b762921440514fbdceebe19baa8d34b0405c16a17a7849822d67cc59e6","observation_id":"c4ea8b7f-a3e3-4bd3-8c41-673785a545bb","resolution":{"observed_at":"2026-08-06T00:09:31.230643Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:30.804019Z","title":null,"venue":null,"work_id":"05be5af8-1fd1-4019-9605-0984468dbca6","year":2015},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.938982Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:af58abdb07fd63ca583f1602ebf9ca0f55d72b14a1463a1ea4271efee5274c25","observation_id":"4964a459-efbc-4f63-bd09-d2701ab4a430","resolution":{"observed_at":"2026-08-06T00:09:30.941108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.20194","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:29.671614Z","title":null,"venue":null,"work_id":"d9a65773-8af1-4bb6-bd77-33e96a75e533","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.058718Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:770323b0c031bfa2c329248d38b60bb75d07389bf344d9fecda9e4a9d37b2706","observation_id":"e36c7279-bba0-4acd-9992-3dc374a73064","resolution":{"observed_at":"2026-08-06T00:09:29.728433Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T00:09:29.156883Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.156883Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:b577b07630b5d986778576bf2240068ded2c40c30bf9aec9e671fb5637bc68d5","observation_id":"0d67357a-368f-4125-8633-4370b11fa352","resolution":{"observed_at":"2026-08-06T00:09:29.156883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:30.489414Z","title":null,"venue":null,"work_id":"4d25cdad-2cfb-4695-9242-1dc607548afe","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.267647Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:c22808bc1a7a6657d52a76e1223186a87d2b0ae9ef50c55c89c1b478ce9b73af","observation_id":"ec737639-aee7-439a-956b-5bd8d9519247","resolution":{"observed_at":"2026-08-06T00:09:30.629179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:30.306448Z","title":"2022.{SparTA}:{Deep-Learning} Model Sparsity via{Tensor-with-Sparsity-Attribute}","venue":null,"work_id":"b6353fca-2e03-48aa-af20-a51122d9e755","year":2022},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.336047Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:e0d3c810d0abcd21d00c1da619f2d15e815c8c5d7ebab256346db94c51b2a4d0","observation_id":"3d213abd-06ad-48ac-9938-5a333520d90d","resolution":{"observed_at":"2026-08-06T00:09:30.382427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10594","last_updated":"2025-05-22T04:58:06Z","snapshot_observed_at":"2026-07-06T18:31:27.512384Z","submitted_at":"2024-06-15T11:03:33Z","title":"BlockPruner: Fine-grained Pruning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10594","snapshot_observed_at":"2026-08-06T00:09:29.407949Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.407949Z"},"links":{"cited_paper":"/paper/2406.10594","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:12c82a58edc2f0ce04a479cf3fcf18dd4f2b2c58750ae8f7a0177c93a529c5b2","observation_id":"eae9f883-b582-45c3-a052-d1e00201dc5e","resolution":{"observed_at":"2026-08-06T00:09:29.407949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:30.179176Z","title":null,"venue":null,"work_id":"b4eb4677-af22-42e3-9fd6-8d117efc4342","year":2019},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.472155Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:a982eedbbbce3a1c4793b0029c8af72dd6388db36e2e6e84918e70c7622e8717","observation_id":"3c91bb2c-fc32-4948-848c-964556848b74","resolution":{"observed_at":"2026-08-06T00:09:30.230893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-07T17:44:31.814422Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2608.01536."}