{"as_of":"2026-08-18T13:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:56d3272540490355f24867384542d42a67d494cdbafc79316754f69e17243870","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":29,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:22:24.639464Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:39:45.400631Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-12T17:20:31.958949Z","title":"Training-free activation sparsity in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12692","last_updated":"2025-01-24T05:12:22Z","snapshot_observed_at":"2026-08-12T22:04:48.624816Z","submitted_at":"2024-11-19T17:59:12Z","title":"SparseInfer: Training-free Prediction of Activation Sparsity for Fast LLM Inference","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T17:20:31.958949Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2411.12692"},"observation_digest":"sha256:335e4dddc5c3878bc6cc4023cf6c7ca1fb5fc010b6805812a503ad0122e8a6b3","observation_id":"f9a0eb75-224d-473b-8ef3-892b5dbb00d9","resolution":{"observed_at":"2026-08-12T17:20:31.958949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-11T20:38:23.587766Z","title":"Training-free activation sparsity in large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05644","last_updated":"2024-12-16T12:12:19Z","snapshot_observed_at":"2026-08-17T04:45:59.341454Z","submitted_at":"2024-12-07T13:15:22Z","title":"Mixture of Hidden-Dimensions Transformer","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T20:38:23.587766Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2412.05644"},"observation_digest":"sha256:2c1ef04b92015b1289c204f5ab4e4c8f205c2d24a775beb8b88f041cb3f16e04","observation_id":"c9d39f9a-2862-4fbb-bb56-cb5a9878fac3","resolution":{"observed_at":"2026-08-11T20:38:23.587766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-11T10:26:24.161217Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16719","last_updated":"2024-12-28T17:45:12Z","snapshot_observed_at":"2026-08-18T10:16:54.461994Z","submitted_at":"2024-12-21T18:04:01Z","title":"Lillama: Large Language Models Compression via Low-Rank Feature Distillation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T10:26:24.161217Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2412.16719"},"observation_digest":"sha256:9f6e8aedb7d4b9438c7fc5b4d564a4de3f3073fcc8e15a362378a597b7929b3b","observation_id":"ea868a50-58ce-4fff-8c14-b5b99ff10258","resolution":{"observed_at":"2026-08-11T10:26:24.161217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-09T17:37:39.505073Z","title":"Training-free activa- tion sparsity in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00840","last_updated":"2025-06-10T17:24:15Z","snapshot_observed_at":"2026-08-13T15:05:06.722247Z","submitted_at":"2025-02-02T16:25:48Z","title":"Activation Approximations Can Incur Safety Vulnerabilities Even in Aligned LLMs: Comprehensive Analysis and Defense","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T17:37:39.505073Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2502.00840"},"observation_digest":"sha256:df3816a476329427e49047a93a68c38c058241dea097c4540ff431d39caf442b","observation_id":"4e6321c5-dda7-4236-96aa-7c40970326c2","resolution":{"observed_at":"2026-08-09T17:37:39.505073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-09T15:36:04.451732Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01378","last_updated":"2025-02-03T14:15:33Z","snapshot_observed_at":"2026-08-12T15:15:48.646113Z","submitted_at":"2025-02-03T14:15:33Z","title":"CE-LoRA: Computation-Efficient LoRA Fine-Tuning for Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T15:36:04.451732Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2502.01378"},"observation_digest":"sha256:40e33e13edd0435d46cd50a9229d80981b3a17f9dd0f4ae8e32882848f06868c","observation_id":"e86f556c-2ba9-45b0-9480-61098180e33a","resolution":{"observed_at":"2026-08-09T15:36:04.451732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-16T10:22:24.639464Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.18415","last_updated":"2025-06-13T05:55:26Z","snapshot_observed_at":"2026-08-16T10:14:44.627759Z","submitted_at":"2025-04-25T15:17:52Z","title":"BitNet v2: Native 4-bit Activations with Hadamard Transformation for 1-bit LLMs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:24.639464Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2504.18415"},"observation_digest":"sha256:f24bc496fa2e881203f22529597c974e7c19ca078d34068171c7f443afdd0628","observation_id":"33563ad5-77f4-4ae8-933c-8bf5281a6570","resolution":{"observed_at":"2026-08-16T10:22:24.639464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-16T05:58:46.829352Z","title":"Training- free activation sparsity in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19449","last_updated":"2025-04-28T03:30:32Z","snapshot_observed_at":"2026-08-16T23:28:50.874978Z","submitted_at":"2025-04-28T03:30:32Z","title":"R-Sparse: Rank-Aware Activation Sparsity for Efficient LLM Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T05:58:46.829352Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2504.19449"},"observation_digest":"sha256:fa87e75e2679ee02941741f24b91f1bdc1137640e9c6643956600a92d841e468","observation_id":"e47e4885-db6b-4a81-8fd1-a85ed2c1b644","resolution":{"observed_at":"2026-08-16T05:58:46.829352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-15T23:00:17.937817Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05950","last_updated":"2025-05-12T03:29:12Z","snapshot_observed_at":"2026-08-16T10:42:50.887857Z","submitted_at":"2025-05-09T10:53:47Z","title":"FloE: On-the-Fly MoE Inference on Memory-constrained GPU","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T23:00:17.937817Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2505.05950"},"observation_digest":"sha256:ca98a3959be44b4e13dc639de589c0972376f535058175e14e413be28856f128","observation_id":"721b679f-5e19-4d5b-8847-d32c9d840572","resolution":{"observed_at":"2026-08-15T23:00:17.937817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-07T11:18:55.783751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03275","last_updated":"2025-06-03T18:03:32Z","snapshot_observed_at":"2026-08-13T16:49:10.720272Z","submitted_at":"2025-06-03T18:03:32Z","title":"Chipmunk: Training-Free Acceleration of Diffusion Transformers with Dynamic Column-Sparse Deltas","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:18:55.783751Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2506.03275"},"observation_digest":"sha256:dc9b1ed0eea52af81f711fb22630510b2a2b4816d3358e4acb343beaf4f920f9","observation_id":"53c31b0e-e25b-49dc-9b1a-8400deddb2fc","resolution":{"observed_at":"2026-08-07T11:18:55.783751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-15T19:30:31.020889Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16500","last_updated":"2025-06-19T17:53:34Z","snapshot_observed_at":"2026-08-15T19:22:40.879212Z","submitted_at":"2025-06-19T17:53:34Z","title":"SparseLoRA: Accelerating LLM Fine-Tuning with Contextual Sparsity","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T19:30:31.020889Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2506.16500"},"observation_digest":"sha256:5772e55f84b2557d48541bcfc04cb6a8de8c5cba7c797caed714396b07177be5","observation_id":"60be2650-01e8-44fe-afb5-052321742ec1","resolution":{"observed_at":"2026-08-15T19:30:31.020889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-06T15:15:20.119238Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-12T16:21:25.375651Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.119238Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:016f5cad5c098e476cc0a3caf59c87e388d53071a5407af21ac362ddd5879ff7","observation_id":"6dd825a6-8241-4e40-9fc7-d789cffa74ad","resolution":{"observed_at":"2026-08-06T15:15:20.119238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-06T14:17:43.859667Z","title":"Training-free activation sparsity in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19608","last_updated":"2025-07-25T18:23:18Z","snapshot_observed_at":"2026-08-17T15:17:00.367286Z","submitted_at":"2025-07-25T18:23:18Z","title":"DeltaLLM: A Training-Free Framework Exploiting Temporal Sparsity for Efficient Edge LLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:17:43.859667Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2507.19608"},"observation_digest":"sha256:53b28074c8259bef8fec38bb05ace5d067edf0cdce74e0085bedc35cd5cbfc42","observation_id":"d75ec5c4-fa9e-4bc1-91ee-a62d1efc605f","resolution":{"observed_at":"2026-08-06T14:17:43.859667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-06T05:11:11.612043Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02128","last_updated":"2025-08-04T07:22:36Z","snapshot_observed_at":"2026-08-14T03:35:12.706919Z","submitted_at":"2025-08-04T07:22:36Z","title":"Amber Pruner: Leveraging N:M Activation Sparsity for Efficient Prefill in Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T05:11:11.612043Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2508.02128"},"observation_digest":"sha256:079c13370298a164b0cfbadd0aecf60d5a058a78ea19baa4910233e200b2ecaf","observation_id":"d2bee87a-4886-4f4a-9731-77cef304fd5d","resolution":{"observed_at":"2026-08-06T05:11:11.612043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2509.22166","last_updated":"2026-04-24T11:44:43Z","snapshot_observed_at":"2026-07-06T22:30:50.642382Z","submitted_at":"2025-09-26T10:27:55Z","title":"Motivating Next-Gen Accelerators with Flexible (N:M) Activation Sparsity via Benchmarking Lightweight Post-Training Sparsification Approaches","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T13:36:55.938673Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2509.22166"},"observation_digest":"sha256:2c66a96bf8d11cb9c7c4ad48fbe3615a4bea5b4499dbd0c049e0f7bb8bd983e8","observation_id":"42a286d6-9825-4df1-84eb-66fd99bea4dd","resolution":{"observed_at":"2026-05-18T13:41:25.916994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2512.12744","last_updated":"2026-05-21T01:18:21Z","snapshot_observed_at":"2026-08-14T14:25:19.742080Z","submitted_at":"2025-12-14T15:47:40Z","title":"Resting Neurons, Active Insights: Robustifying Activation Sparsity in LLMs via Spontaneity","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T22:19:25.483640Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2512.12744"},"observation_digest":"sha256:13c877d32a27c106429249bb0bc8b7826fb220ef4d8a039367dab9f7fb0dc108","observation_id":"2c4f5c39-bf72-4f25-91cd-7e394c36013b","resolution":{"observed_at":"2026-05-16T22:21:18.992030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2512.12744","last_updated":"2026-05-21T01:18:21Z","snapshot_observed_at":"2026-08-14T14:25:19.742080Z","submitted_at":"2025-12-14T15:47:40Z","title":"Resting Neurons, Active Insights: Robustifying Activation Sparsity in LLMs via Spontaneity","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T11:54:29.436149Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2512.12744"},"observation_digest":"sha256:e3e330c94715925ce0cb725a1a04fd6bd40b384182a63393c3c935d778b4c7bb","observation_id":"993a2a68-66fa-41a4-bb1b-73491b8b50ad","resolution":{"observed_at":"2026-05-22T11:54:51.106159Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2605.03109","last_updated":"2026-05-04T19:48:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-04T19:48:40Z","title":"Gated Subspace Inference for Transformer Acceleration","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T19:26:08.510348Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2605.03109"},"observation_digest":"sha256:9b1344e2a2f2827abf42aa6939605f4e3e57d99f239e4d73d0ef035afefebb01","observation_id":"aaa0d1d7-0b32-4453-aed1-a9f4d2dcca79","resolution":{"observed_at":"2026-05-12T10:41:31.896633Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2605.10875","last_updated":"2026-05-11T17:27:15Z","snapshot_observed_at":"2026-08-13T18:28:47.986652Z","submitted_at":"2026-05-11T17:27:15Z","title":"Compute Where it Counts: Self Optimizing Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T04:57:58.649358Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2605.10875"},"observation_digest":"sha256:96b6e5c97c10b7f2ad1daa0fcdc973ea616906cbc9cf823928dbe71e122050cb","observation_id":"2034a22f-f9a7-4bef-8a67-069eeef830b7","resolution":{"observed_at":"2026-05-12T05:46:29.451604Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2605.10933","last_updated":"2026-05-20T17:26:14Z","snapshot_observed_at":"2026-08-16T09:01:03.343803Z","submitted_at":"2026-05-11T17:58:28Z","title":"DECO: Sparse Mixture-of-Experts with Dense-Comparable Performance on End-Side Devices","version":1},"reference_index":189,"source":"arxiv_source","source_observed_at":"2026-05-12T03:36:12.915133Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2605.10933"},"observation_digest":"sha256:e004caa46c5d3eb12fa8d1953c2dd501880ecce78e57cfe3009489b84f1ad324","observation_id":"f505cd88-58d3-46d7-811b-f73ab9a60fd3","resolution":{"observed_at":"2026-05-12T03:36:20.026820Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2605.10933","last_updated":"2026-05-20T17:26:14Z","snapshot_observed_at":"2026-08-16T09:01:03.343803Z","submitted_at":"2026-05-11T17:58:28Z","title":"DECO: Sparse Mixture-of-Experts with Dense-Comparable Performance on End-Side Devices","version":2},"reference_index":189,"source":"arxiv_source","source_observed_at":"2026-05-13T07:29:14.545746Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2605.10933"},"observation_digest":"sha256:6757a48a70975ada21ca537cd948cccadaf14f3f1fcf76037e39ba79bf622122","observation_id":"3fb8a6c7-c516-43ba-b37a-09414f6ae175","resolution":{"observed_at":"2026-05-13T07:32:30.384267Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2605.10933","last_updated":"2026-05-20T17:26:14Z","snapshot_observed_at":"2026-08-16T09:01:03.343803Z","submitted_at":"2026-05-11T17:58:28Z","title":"DECO: Sparse Mixture-of-Experts with Dense-Comparable Performance on End-Side Devices","version":3},"reference_index":189,"source":"arxiv_source","source_observed_at":"2026-05-21T07:57:49.746594Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2605.10933"},"observation_digest":"sha256:f2e5adc6f86a3e8b504eb6058506e3dbd6971f7d009af1a30af07c39b3000d0d","observation_id":"b0eeae31-0726-4c42-878a-90a066666574","resolution":{"observed_at":"2026-05-21T07:59:50.178544Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2605.17659","last_updated":"2026-05-20T20:56:41Z","snapshot_observed_at":"2026-08-14T02:50:30.487943Z","submitted_at":"2026-05-17T21:29:20Z","title":"Bug or Feature$^2$: Weight Drift, Activation Sparsity and Spikes","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-20T13:46:32.405079Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2605.17659"},"observation_digest":"sha256:0ea38e7fc449f9b67890a714e171a5b18136424500d136281ee829c4950ef7cf","observation_id":"fee365af-f003-4104-8ea8-8c5eccfd92b9","resolution":{"observed_at":"2026-05-20T13:48:19.617067Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2605.17659","last_updated":"2026-05-20T20:56:41Z","snapshot_observed_at":"2026-08-14T02:50:30.487943Z","submitted_at":"2026-05-17T21:29:20Z","title":"Bug or Feature$^2$: Weight Drift, Activation Sparsity and Spikes","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-22T09:15:32.395442Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2605.17659"},"observation_digest":"sha256:fe543ac64e41c317cc385a886c4a041e14eaa0accec4c707bca461e090d09ce4","observation_id":"fb60ca70-2e4d-41a7-a076-da0c8a450ea4","resolution":{"observed_at":"2026-05-22T09:16:19.669502Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2605.26632","last_updated":"2026-08-17T08:10:10Z","snapshot_observed_at":"2026-08-18T13:18:21.551596Z","submitted_at":"2026-05-26T07:09:49Z","title":"RT-Lynx: Putting GEMM Sparsity in the Right Place for Diffusion Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T19:40:42.033793Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2605.26632"},"observation_digest":"sha256:cefb20d9572a418438c9918a6c4098433697e6a0f36f6b0736cde1a5436563eb","observation_id":"1f311371-5e46-43ae-ba22-5b46a66bfc6d","resolution":{"observed_at":"2026-06-29T19:43:54.716570Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":"2408.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-07-04T10:39:45.400631Z","title":"Training-free activation sparsity in large language models","venue":null,"work_id":"4451038a-19a5-4480-9a97-60f67d8229df","year":2024},"citing_paper":{"arxiv_id":"2606.23419","last_updated":"2026-06-22T14:42:34Z","snapshot_observed_at":"2026-08-12T12:58:28.591609Z","submitted_at":"2026-06-22T14:42:34Z","title":"GRINQH: Graded Input-based Quantization Hierarchy for Efficient LLM Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T08:38:32.577228Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2606.23419"},"observation_digest":"sha256:f8481d295db28498ff2565ae960659ec9fd174a2ce6a942ba05a74d58aa7f84c","observation_id":"de286cbe-e031-4ce6-9631-d83d694d3633","resolution":{"observed_at":"2026-07-04T10:39:45.402234Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-02T07:56:24.625241Z","title":"Training-free activation sparsity in large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08601","last_updated":"2026-07-18T12:48:55Z","snapshot_observed_at":"2026-08-13T21:48:59.742640Z","submitted_at":"2026-07-09T15:32:54Z","title":"It Takes a MAESTRO To Prune Bad Experts","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T07:56:24.625241Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2607.08601"},"observation_digest":"sha256:604f8e72bcb03b982952cabbd7d290c9e4a7dc87f3a7ea3b7d994f83f2f07769","observation_id":"996062ec-a66b-457b-a281-d25893ac8965","resolution":{"observed_at":"2026-08-02T07:56:24.625241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-02T11:58:22.293241Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-14T07:43:49.522213Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:22.293241Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:24951cd06ad749f87828e5b61f84262c62d8481b25745784f5992facb1b82387","observation_id":"713147ac-3da5-4830-9770-8dfa6e57943e","resolution":{"observed_at":"2026-08-02T11:58:22.293241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-15T19:58:17.694467Z","title":"Training-free activation sparsity in large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12953","last_updated":"2026-08-13T08:32:18Z","snapshot_observed_at":"2026-08-16T23:29:39.560410Z","submitted_at":"2026-08-13T08:32:18Z","title":"Unifying Depth and Width Pruning for LLMs via Binary Knapsack Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T19:58:17.694467Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2608.12953"},"observation_digest":"sha256:246cf3669c37b92159cb53162117d37c3c647ddbc721fb1a2907421c0ce0b2cf","observation_id":"e52f6848-aa3b-48c8-815a-a5e43eaebdba","resolution":{"observed_at":"2026-08-15T19:58:17.694467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-14T11:18:55.827503Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13426","last_updated":"2026-08-13T16:16:04Z","snapshot_observed_at":"2026-08-18T00:48:20.295234Z","submitted_at":"2026-08-13T16:16:04Z","title":"Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:55.827503Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2608.13426"},"observation_digest":"sha256:244fea24acb180e10ea56cd5094d62d3622fc56d42f6c3a9efff7682fd7459a6","observation_id":"39b881e7-adc2-4705-b610-ae0a32dd6223","resolution":{"observed_at":"2026-08-14T11:18:55.827503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2408.14690/citation-record","integrity":"/paper/2408.14690/integrity","json":"/paper/2408.14690/citation-record.json","paper":"/paper/2408.14690"},"outbound":[],"paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:23:39.871672Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 29 inbound Pith citation observations for arXiv:2408.14690."}