{"as_of":"2026-08-22T02:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2d3f7f9156ce2101ff5e5142a5a40858122ac271c087cf9d256aaf1099f20fc6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":50,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:31:46.676503Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T20:50:11.582245Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-10T23:45:06.755839Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2204.02311"},"observation_digest":"sha256:04f72ff49e48afc79993cd01c2b7b70f64924b6571efdb37d24115ecf5fe727e","observation_id":"3344081b-58ba-47be-ae60-86557f84ba0b","resolution":{"observed_at":"2026-05-10T23:45:07.215861Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2310.01801","last_updated":"2024-10-29T18:26:09Z","snapshot_observed_at":"2026-08-20T18:20:17.447831Z","submitted_at":"2023-10-03T05:17:08Z","title":"Model Tells You What to Discard: Adaptive KV Cache Compression for LLMs","version":4},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-17T11:11:21.460613Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2310.01801"},"observation_digest":"sha256:6f634a2667f3d56ac5800b5eb3357763c7001442c7fec67b7c25379f17f49022","observation_id":"0f1db7a5-d60a-42e6-bae9-81945343bed5","resolution":{"observed_at":"2026-05-17T11:11:21.691961Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2310.02277","last_updated":"2026-04-30T14:28:10Z","snapshot_observed_at":"2026-08-15T00:50:40.778054Z","submitted_at":"2023-09-29T22:55:06Z","title":"Junk DNA Hypothesis: Pruning Small Pre-Trained Weights Irreversibly and Monotonically Impairs \"Difficult\" Downstream Tasks in LLMs","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-24T06:33:48.456209Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2310.02277"},"observation_digest":"sha256:0b28afaa6cfdd2c35d06a664b7b83e2fc8e14d16feddbf928c4d3a1bb1f3d752","observation_id":"b57b6c71-058f-41b5-b3a1-0b380274211a","resolution":{"observed_at":"2026-05-24T06:34:01.026726Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2401.15077","last_updated":"2025-03-04T13:58:39Z","snapshot_observed_at":"2026-08-03T09:40:31.365295Z","submitted_at":"2024-01-26T18:59:01Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-15T00:15:49.303458Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2401.15077"},"observation_digest":"sha256:5861faa2060a41cd16211a61adc12f7bbe266ff7e075e9f8a8e9c6d746b26b8f","observation_id":"ec2d74e3-4027-4fe6-86f4-e944ffb3bd23","resolution":{"observed_at":"2026-05-15T00:15:49.387271Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-12T21:02:00.664795Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2411.09199","last_updated":"2024-11-14T05:43:42Z","snapshot_observed_at":"2026-08-20T14:51:45.975169Z","submitted_at":"2024-11-14T05:43:42Z","title":"Ghost-Connect Net: A Generalization-Enhanced Guidance For Sparse Deep Networks Under Distribution Shifts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T21:02:00.664795Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2411.09199"},"observation_digest":"sha256:3e579cd5009c2282f57037bfedc5569354ec010e85d9f9522af331b4b49c351a","observation_id":"bec35519-5992-43eb-b82b-9e4046cb22d9","resolution":{"observed_at":"2026-08-12T21:02:00.664795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-12T10:22:09.096879Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2412.00143","last_updated":"2026-06-20T01:27:51Z","snapshot_observed_at":"2026-08-21T15:12:13.276586Z","submitted_at":"2024-11-28T19:00:28Z","title":"Is Oracle Pruning the True Oracle?","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T10:22:09.096879Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2412.00143"},"observation_digest":"sha256:e3ab2978937dc4e4ac5811ecef5a050e412bc1e48e778dd5f35fac611deee58d","observation_id":"2fe0309e-92e5-4137-9114-a3e13428ce06","resolution":{"observed_at":"2026-08-12T10:22:09.096879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-11T23:42:34.534184Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.02328","last_updated":"2024-12-03T09:42:16Z","snapshot_observed_at":"2026-08-15T00:50:40.237475Z","submitted_at":"2024-12-03T09:42:16Z","title":"Efficient Model Compression Techniques with FishLeg","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T23:42:34.534184Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2412.02328"},"observation_digest":"sha256:b9a2713a17b0f78bbc7824d8f1006eef8733151d9b7400a266469e15bcc9f03c","observation_id":"1e5c65e8-4b9b-4a79-82e0-55aa1be8502f","resolution":{"observed_at":"2026-08-11T23:42:34.534184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-11T19:02:11.609913Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.07268","last_updated":"2024-12-10T07:49:07Z","snapshot_observed_at":"2026-08-18T09:55:46.673902Z","submitted_at":"2024-12-10T07:49:07Z","title":"PTSBench: A Comprehensive Post-Training Sparsity Benchmark Towards Algorithms and Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T19:02:11.609913Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2412.07268"},"observation_digest":"sha256:835d0e72b6c02812d8bbdd06acd358ab978d74c90383eacc357a2c08bf7daa80","observation_id":"f4da5441-9fe4-48ab-861a-5f827b4d5304","resolution":{"observed_at":"2026-08-11T19:02:11.609913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-11T12:53:58.417627Z","title":"The state of sparsity in deep neural networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13737","last_updated":"2024-12-18T11:14:30Z","snapshot_observed_at":"2026-08-17T13:41:07.551546Z","submitted_at":"2024-12-18T11:14:30Z","title":"On the Compression of Language Models for Code: An Empirical Study on CodeBERT","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T12:53:58.417627Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2412.13737"},"observation_digest":"sha256:b9161c4d90cfc5409cfe1e83b2c794a4fdb6b7a38fd7b4d46e63fb203f6093ab","observation_id":"970b5812-e902-4e64-9eaf-f0081296158f","resolution":{"observed_at":"2026-08-11T12:53:58.417627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-11T04:24:35.755215Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.18934","last_updated":"2025-09-09T14:27:58Z","snapshot_observed_at":"2026-08-15T23:11:36.062910Z","submitted_at":"2024-12-25T15:45:18Z","title":"Dovetail: A CPU/GPU Heterogeneous Speculative Decoding for LLM inference","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T04:24:35.755215Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2412.18934"},"observation_digest":"sha256:769afca79b049b66c9dd496ed183880a66d9fa570ddec48452f881536638e95f","observation_id":"25fb070d-426d-4e2c-b1c9-322133381b7c","resolution":{"observed_at":"2026-08-11T04:24:35.755215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-10T22:38:01.638883Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2501.01118","last_updated":"2025-01-02T07:35:53Z","snapshot_observed_at":"2026-08-14T10:23:13.592329Z","submitted_at":"2025-01-02T07:35:53Z","title":"Pruning-based Data Selection and Network Fusion for Efficient Deep Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T22:38:01.638883Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2501.01118"},"observation_digest":"sha256:6d40a035375c9c808e3d6ced3747d1dd9850529ccfe596f1247b329bcb4621e1","observation_id":"547f3d11-6f6f-4aba-9a98-949f18c5abdb","resolution":{"observed_at":"2026-08-10T22:38:01.638883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-10T20:55:24.383409Z","title":null,"venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2501.06962","last_updated":"2025-01-12T22:48:04Z","snapshot_observed_at":"2026-08-17T09:39:41.307448Z","submitted_at":"2025-01-12T22:48:04Z","title":"Compact Bayesian Neural Networks via pruned MCMC sampling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T20:55:24.383409Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2501.06962"},"observation_digest":"sha256:3a47d350c8c620de458b7c3970a876a7e7f698752046f28a49861ad28486e20c","observation_id":"274b0cc3-b844-434c-a24f-7eea21be9ee4","resolution":{"observed_at":"2026-08-10T20:55:24.383409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-10T20:14:58.764877Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.09223","last_updated":"2025-06-15T13:24:11Z","snapshot_observed_at":"2026-08-15T10:26:22.406164Z","submitted_at":"2025-01-16T01:03:56Z","title":"Foundations of Large Language Models","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-10T20:14:58.764877Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2501.09223"},"observation_digest":"sha256:db3f59162c87cdb10aa2b85c65e0ecb56b6f3652a1b3f58d4272c3109e3fe060","observation_id":"fafb59b2-8aec-422c-b692-88e2459022ff","resolution":{"observed_at":"2026-08-10T20:14:58.764877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-10T17:35:46.237458Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2501.12115","last_updated":"2025-01-21T13:25:32Z","snapshot_observed_at":"2026-08-18T08:52:00.682939Z","submitted_at":"2025-01-21T13:25:32Z","title":"Meta-Sparsity: Learning Optimal Sparse Structures in Multi-task Networks through Meta-learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T17:35:46.237458Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2501.12115"},"observation_digest":"sha256:f340a8e1bbb8d19d0f88ae87f466c65503c9d0223cf1b80fdccc2b516c5fe752","observation_id":"ddcde12d-6cfd-4def-975b-995732b15bdb","resolution":{"observed_at":"2026-08-10T17:35:46.237458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-10T17:16:59.831134Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2501.12486","last_updated":"2025-03-15T17:31:09Z","snapshot_observed_at":"2026-08-17T11:08:42.016731Z","submitted_at":"2025-01-21T20:23:22Z","title":"The Journey Matters: Average Parameter Count over Pre-training Unifies Sparse and Dense Scaling Laws","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T17:16:59.831134Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2501.12486"},"observation_digest":"sha256:59073233eaa3913edec36952532acb6cf8b3055c89a6304efcc558cc200c2369","observation_id":"4eca3aca-c646-42d9-ae2c-0888e1a9bcaf","resolution":{"observed_at":"2026-08-10T17:16:59.831134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-09T17:59:50.934363Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2502.00744","last_updated":"2025-06-13T08:18:12Z","snapshot_observed_at":"2026-08-17T20:16:22.926689Z","submitted_at":"2025-02-02T10:32:55Z","title":"CoNNect: Connectivity-Based Regularization for Structural Pruning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T17:59:50.934363Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2502.00744"},"observation_digest":"sha256:3f01389d7c0a465169bfcb959648115f6ceab0f01550044e7fff347dfea7b1f1","observation_id":"e37a2963-511b-4c3a-aa57-4ebeeeac58fb","resolution":{"observed_at":"2026-08-09T17:59:50.934363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-09T12:04:04.889372Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-15T06:53:10.972775Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.889372Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:938ba6044c8892784156d15608f92bd054bb5b5e3fadab682fb9b5060f8130f4","observation_id":"217ec8cf-c51d-4f92-830b-974e84dbe68c","resolution":{"observed_at":"2026-08-09T12:04:04.889372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-09T04:15:29.086262Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2502.03658","last_updated":"2025-02-05T22:56:55Z","snapshot_observed_at":"2026-08-19T19:02:58.477008Z","submitted_at":"2025-02-05T22:56:55Z","title":"Advancing Weight and Channel Sparsification with Enhanced Saliency","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T04:15:29.086262Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2502.03658"},"observation_digest":"sha256:72c6c62306d477111a90fabca5bfd3d747da1a97e60048201e9f5f3ff8e7d709","observation_id":"3745d38d-55a3-4f90-94c4-7cb8d8c3b6aa","resolution":{"observed_at":"2026-08-09T04:15:29.086262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-08T19:43:33.402366Z","title":"The state of sparsity in deep neural networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.05356","last_updated":"2025-02-07T22:08:12Z","snapshot_observed_at":"2026-08-15T18:43:24.196588Z","submitted_at":"2025-02-07T22:08:12Z","title":"Distillation and Pruning for Scalable Self-Supervised Representation-Based Speech Quality Assessment","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T19:43:33.402366Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2502.05356"},"observation_digest":"sha256:27f140f8132e457457b45b55644a87d031d5a0f69f22797c42d531e705182768","observation_id":"b8b55980-8ed0-4bd2-9495-955ee0c8f340","resolution":{"observed_at":"2026-08-08T19:43:33.402366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-16T11:31:46.676503Z","title":"The state of sparsity in deep neural networks,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2504.15377","last_updated":"2025-05-09T02:31:53Z","snapshot_observed_at":"2026-08-17T06:23:18.813070Z","submitted_at":"2025-04-21T18:35:35Z","title":"SCALE-Sim v3: A modular cycle-accurate systolic accelerator simulator for end-to-end system analysis","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:31:46.676503Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2504.15377"},"observation_digest":"sha256:a715054d546260a1a8286e09c0a687e9a35b8dbfed3e1f4cbf65d875f741e2e4","observation_id":"020a4ca2-4b30-4a4b-883a-4a57cc08dc4f","resolution":{"observed_at":"2026-08-16T11:31:46.676503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-16T10:50:07.978052Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17263","last_updated":"2025-04-24T05:46:25Z","snapshot_observed_at":"2026-08-21T13:54:08.610985Z","submitted_at":"2025-04-24T05:46:25Z","title":"Precision Neural Network Quantization via Learnable Adaptive Modules","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T10:50:07.978052Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2504.17263"},"observation_digest":"sha256:1ab5cbb86ab22c31c177af2ae006a821f61589908b1cd575c8ffb108054a6a57","observation_id":"82681822-783e-4e47-8b39-ed9cb72737bf","resolution":{"observed_at":"2026-08-16T10:50:07.978052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-16T06:06:57.383474Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19274","last_updated":"2025-05-26T14:20:07Z","snapshot_observed_at":"2026-08-20T03:15:43.661490Z","submitted_at":"2025-04-27T15:14:09Z","title":"TeleSparse: Practical Privacy-Preserving Verification of Deep Neural Networks","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T06:06:57.383474Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2504.19274"},"observation_digest":"sha256:2222a77ca631984d978fa5e1d6188374779db7b4c952302fe974ed35c5e9a028","observation_id":"f14f3f9d-89c6-46f3-af8b-7e5433475f17","resolution":{"observed_at":"2026-08-16T06:06:57.383474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-16T04:17:58.450167Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.01731","last_updated":"2025-05-21T01:38:25Z","snapshot_observed_at":"2026-08-18T17:32:11.138384Z","submitted_at":"2025-05-03T07:57:02Z","title":"Efficient Shapley Value-based Non-Uniform Pruning of Large Language Models","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T04:17:58.450167Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2505.01731"},"observation_digest":"sha256:35553f89725328764a15322ca558c10def46c4cbcf9448f5122dd85f3ce593a1","observation_id":"d71fe424-281d-4abc-a363-ec4955f00644","resolution":{"observed_at":"2026-08-16T04:17:58.450167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-15T23:17:28.383021Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.05143","last_updated":"2025-06-10T03:15:22Z","snapshot_observed_at":"2026-08-21T11:54:14.468122Z","submitted_at":"2025-05-08T11:27:31Z","title":"Sparse Training from Random Initialization: Aligning Lottery Ticket Masks using Weight Symmetry","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T23:17:28.383021Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2505.05143"},"observation_digest":"sha256:04f0abb576eae63f21756a97b09ae217b298ea6a583d21e10ac17e2a1e109ded","observation_id":"5f9eed83-fd55-494d-96cc-045bc4885d23","resolution":{"observed_at":"2026-08-15T23:17:28.383021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-07T15:34:37.544734Z","title":"The state of sparsity in deep neural networks,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.14797","last_updated":"2025-05-20T18:08:15Z","snapshot_observed_at":"2026-08-17T11:56:20.318280Z","submitted_at":"2025-05-20T18:08:15Z","title":"Efficient Privacy-Preserving Cross-Silo Federated Learning with Multi-Key Homomorphic Encryption","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:37.544734Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2505.14797"},"observation_digest":"sha256:319f90906b38e423c42ea0b9e36a6f8b82300b8b42772d8edcae8df50b99c79d","observation_id":"52b21aaf-e121-4ead-8a8c-0153001849c0","resolution":{"observed_at":"2026-08-07T15:34:37.544734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-07T13:54:45.153995Z","title":"The state of sparsity in deep neural networks.arXiv preprint arXiv:1902.09574,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.20698","last_updated":"2025-05-27T04:07:23Z","snapshot_observed_at":"2026-08-20T12:07:19.669872Z","submitted_at":"2025-05-27T04:07:23Z","title":"Sparsified State-Space Models are Efficient Highway Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:45.153995Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2505.20698"},"observation_digest":"sha256:22698f904e5cb57be108b883b18d7f286015388405a8a58e182f77a2f43d4d95","observation_id":"fb02a2d4-6ee1-4739-af77-d45b1cbf18bc","resolution":{"observed_at":"2026-08-07T13:54:45.153995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-07T13:26:43.019228Z","title":"The state of sparsity in deep neural networks.arXiv preprint arXiv:1902.09574, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.21817","last_updated":"2025-05-27T22:59:44Z","snapshot_observed_at":"2026-08-15T09:07:40.792757Z","submitted_at":"2025-05-27T22:59:44Z","title":"ALTER: All-in-One Layer Pruning and Temporal Expert Routing for Efficient Diffusion Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:43.019228Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2505.21817"},"observation_digest":"sha256:7b3a3ac812067dc41989dfcf84508ea022c8ce447eea5ca66d213a6b0f72bd81","observation_id":"a346b8cd-a253-4c5c-9b7b-aa2e131af6ce","resolution":{"observed_at":"2026-08-07T13:26:43.019228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-07T13:21:28.540892Z","title":"The state of sparsity in deep neural networks.arXiv preprint arXiv:1902.09574, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.22074","last_updated":"2025-05-28T07:55:51Z","snapshot_observed_at":"2026-08-15T06:56:45.035803Z","submitted_at":"2025-05-28T07:55:51Z","title":"The Resurrection of the ReLU","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:28.540892Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2505.22074"},"observation_digest":"sha256:f6daf847bc4f94633098bbb6871fc86b1d2c332f3e646f68789030e760e965bf","observation_id":"cab59ff9-327e-4ea6-ad2b-3bc796fc25d7","resolution":{"observed_at":"2026-08-07T13:21:28.540892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-07T05:27:08.003589Z","title":"arXiv preprint arXiv:1902.09574 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.07975","last_updated":"2025-06-09T17:49:29Z","snapshot_observed_at":"2026-08-20T04:16:40.790289Z","submitted_at":"2025-06-09T17:49:29Z","title":"Hyperpruning: Efficient Search through Pruned Variants of Recurrent Neural Networks Leveraging Lyapunov Spectrum","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:27:08.003589Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2506.07975"},"observation_digest":"sha256:a877a481371156fa23b6a804c0a46cc9958e6d12031c02f6e887a7eac0b4b8c0","observation_id":"b3254636-5cc6-48cf-ae36-8ae94f91928c","resolution":{"observed_at":"2026-08-07T05:27:08.003589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-15T19:48:05.747502Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.15174","last_updated":"2025-06-18T06:41:35Z","snapshot_observed_at":"2026-08-17T11:30:14.298017Z","submitted_at":"2025-06-18T06:41:35Z","title":"A Novel Compiler Transformation for Fast Sparse Matrix Multiplication in GPUs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T19:48:05.747502Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2506.15174"},"observation_digest":"sha256:b59e436dd607ccd1d4695182fd673ebe6a22241bc01aebdb024de5de7d47e384","observation_id":"d82f59c5-bb70-4f77-bdab-8ac5d963f076","resolution":{"observed_at":"2026-08-15T19:48:05.747502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-15T19:14:53.522750Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.17155","last_updated":"2025-06-26T21:55:13Z","snapshot_observed_at":"2026-08-18T17:00:41.421344Z","submitted_at":"2025-06-20T16:57:59Z","title":"Sparse-Reg: Improving Sample Complexity in Offline Reinforcement Learning using Sparsity","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T19:14:53.522750Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2506.17155"},"observation_digest":"sha256:5ec30bd74a0cdeab89de21f8f4ac9dec502e4d7234763d499ebe6b1e2401f73c","observation_id":"336b8e6b-bf68-4b5b-97b7-15a8f6d89d31","resolution":{"observed_at":"2026-08-15T19:14:53.522750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-06T22:11:58.040357Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.22255","last_updated":"2025-06-27T14:24:01Z","snapshot_observed_at":"2026-08-06T22:05:33.236884Z","submitted_at":"2025-06-27T14:24:01Z","title":"Projected Compression: Trainable Projection for Efficient Transformer Compression","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:11:58.040357Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2506.22255"},"observation_digest":"sha256:bff080d1c8313c3154dcff75589b8c044b59238930eded602fa2d25813885138","observation_id":"80b1897e-5c54-4d09-a326-0788600fe6f8","resolution":{"observed_at":"2026-08-06T22:11:58.040357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-06T14:55:28.369955Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2507.17301","last_updated":"2025-07-23T08:06:13Z","snapshot_observed_at":"2026-08-14T16:06:40.563359Z","submitted_at":"2025-07-23T08:06:13Z","title":"Efficient Column-Wise N:M Pruning on RISC-V CPU","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:55:28.369955Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2507.17301"},"observation_digest":"sha256:70a03641d732bb8c1205a9ccda23f4089a3e69eae917c013350693dcbc13055f","observation_id":"0e0005c1-dc2b-4da3-9ff5-7f4654567325","resolution":{"observed_at":"2026-08-06T14:55:28.369955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-06T12:28:40.626724Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.21749","last_updated":"2025-07-29T12:31:21Z","snapshot_observed_at":"2026-08-16T14:44:36.720305Z","submitted_at":"2025-07-29T12:31:21Z","title":"Improving Neural Network Training using Dynamic Learning Rate Schedule for PINNs and Image Classification","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T12:28:40.626724Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2507.21749"},"observation_digest":"sha256:dba1beeb1a44bc81baac62d6e532c9b456d216b1f3bfea3a7ae213426781cf86","observation_id":"769897b3-697e-4d95-963b-41d86384f150","resolution":{"observed_at":"2026-08-06T12:28:40.626724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-04T17:02:51.140018Z","title":"The state of sparsity in deep neural networks, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.11190","last_updated":"2025-09-14T09:39:32Z","snapshot_observed_at":"2026-08-13T09:26:29.767338Z","submitted_at":"2025-09-14T09:39:32Z","title":"Investigating the Lottery Ticket Hypothesis for Variational Quantum Circuits","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T17:02:51.140018Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2509.11190"},"observation_digest":"sha256:610934ce301ae372813083fa3a64dbccf5e74bbc17f570332d47e6f72289855f","observation_id":"4a2d1fa6-d4b6-4958-bcc5-cef03a417f75","resolution":{"observed_at":"2026-08-04T17:02:51.140018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2509.25606","last_updated":"2026-05-20T11:03:34Z","snapshot_observed_at":"2026-08-16T16:04:14.069918Z","submitted_at":"2025-09-30T00:01:22Z","title":"Effective Model Pruning: Measure The Redundancy of Model Components","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T21:15:02.133581Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2509.25606"},"observation_digest":"sha256:09063d01e8115ff1144186560ff89e8c94e29bbda21f018cd182850b8f75c799","observation_id":"8ea73934-14ce-4d52-a0ea-5294e691de32","resolution":{"observed_at":"2026-05-21T21:15:38.623176Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2512.12448","last_updated":"2026-04-20T18:01:43Z","snapshot_observed_at":"2026-08-15T20:13:02.077756Z","submitted_at":"2025-12-13T20:14:08Z","title":"Optimized Architectures for Kolmogorov-Arnold Networks","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T22:26:45.271900Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2512.12448"},"observation_digest":"sha256:d8bffaffccac4396aefd68456ac94e6835b61d258eaabd6fa0d8e9fc51725923","observation_id":"b6cdc5bc-0fcf-446f-a42e-0202591167c9","resolution":{"observed_at":"2026-05-16T22:28:37.032232Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2512.24558","last_updated":"2026-05-12T02:18:32Z","snapshot_observed_at":"2026-08-16T21:47:23.502940Z","submitted_at":"2025-12-31T01:42:04Z","title":"Probabilistic Computers for Neural Quantum States","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-16T19:35:39.411779Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2512.24558"},"observation_digest":"sha256:b338db4f40072701b623a77f5c57ef8a85d6a2855a128e358e22650c78080649","observation_id":"e07455ce-cc3a-48a9-aee3-4b39dd424d61","resolution":{"observed_at":"2026-05-16T19:38:20.788131Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-03T09:35:40.794015Z","title":"The state of sparsity in deep neural networks,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2601.13704","last_updated":"2026-05-28T23:47:31Z","snapshot_observed_at":"2026-08-15T00:50:38.824529Z","submitted_at":"2026-01-20T08:00:05Z","title":"Performance and Complexity Trade-off Optimization of Speech Models During Training","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T09:35:40.794015Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2601.13704"},"observation_digest":"sha256:a41fd9ede6aaf79e352352f59fd5c03d8844dbdeabff870492fbf24d46636a9e","observation_id":"7aa30c56-b1eb-450a-8417-78b80f3c2b94","resolution":{"observed_at":"2026-08-03T09:35:40.794015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2604.10560","last_updated":"2026-04-12T10:04:48Z","snapshot_observed_at":"2026-08-15T01:15:54.174681Z","submitted_at":"2026-04-12T10:04:48Z","title":"Heterogeneous Connectivity in Sparse Networks: Fan-in Profiles, Gradient Hierarchy, and Topological Equilibria","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T16:44:28.554276Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2604.10560"},"observation_digest":"sha256:54a65e9aff5b6c694d34577b7bd2fb60dce14ba3a6807959734a29f42a700e20","observation_id":"ceb099b4-009b-467c-929b-c8f508f30b2b","resolution":{"observed_at":"2026-05-11T08:16:01.310870Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2604.10627","last_updated":"2026-04-12T13:06:47Z","snapshot_observed_at":"2026-08-14T02:41:50.226241Z","submitted_at":"2026-04-12T13:06:47Z","title":"Computational Lesions in Multilingual Language Models Separate Shared and Language-specific Brain Alignment","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-10T16:50:48.088509Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2604.10627"},"observation_digest":"sha256:2955ad1232abdbd3ec597b5215c92d99683813a8b8b30a973344708b93dfee79","observation_id":"6c52a29d-b8df-4663-ac6e-3034b45965de","resolution":{"observed_at":"2026-05-11T08:05:58.980517Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2605.06402","last_updated":"2026-05-07T15:11:45Z","snapshot_observed_at":"2026-08-13T05:47:30.385277Z","submitted_at":"2026-05-07T15:11:45Z","title":"SparseForge: Efficient Semi-Structured LLM Sparsification via Annealing of Hessian-Guided Soft-Mask","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T12:46:30.820552Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2605.06402"},"observation_digest":"sha256:3b88bbbd6291cd7c10a296701333482b4d4cd954d832d5707c8b10ce7f676c2b","observation_id":"c5813177-f0c6-49cf-9712-228d2550e0b3","resolution":{"observed_at":"2026-05-11T19:06:08.437067Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2606.01117","last_updated":"2026-05-31T09:25:47Z","snapshot_observed_at":"2026-08-09T14:02:50.929521Z","submitted_at":"2026-05-31T09:25:47Z","title":"HASTE: Hardware-Aware Dynamic Sparse Training for Large Output Spaces","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-28T17:34:18.424337Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2606.01117"},"observation_digest":"sha256:e628da636379e1836bdf6e358abaaf7526b5c5179694a256084dea6ad1c47a44","observation_id":"e6578f56-6cd0-43bf-88de-62c358764aab","resolution":{"observed_at":"2026-07-01T21:06:13.176571Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2606.02608","last_updated":"2026-06-08T18:45:09Z","snapshot_observed_at":"2026-08-15T00:58:47.789107Z","submitted_at":"2026-05-23T19:44:02Z","title":"Pruning Deep Neural Networks via the Marchenko--Pastur Distribution","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T14:28:29.116748Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2606.02608"},"observation_digest":"sha256:b72fe3f8a2574f1968bc31e4ad045bc487b0518cfd2f6e35ba8e7081663f811c","observation_id":"fcc6d792-040f-4b74-a321-74f3a612f1c4","resolution":{"observed_at":"2026-06-30T14:34:45.611254Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2606.12278","last_updated":"2026-06-10T16:17:53Z","snapshot_observed_at":"2026-08-17T11:49:31.754926Z","submitted_at":"2026-06-10T16:17:53Z","title":"Finding Sparse Subnetworks in One Training Cycle via Progressive Magnitude-Based Pruning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T10:11:41.993399Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2606.12278"},"observation_digest":"sha256:554852a2e83ff74cbb831c2b9d49d929fdf3a45777246e16ba047e9a8eb8a0bf","observation_id":"78dd79c0-2f79-42c6-b1d7-4ae1614d0e17","resolution":{"observed_at":"2026-07-03T10:17:57.372651Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2606.19150","last_updated":"2026-06-17T14:56:27Z","snapshot_observed_at":"2026-08-06T08:43:49.965943Z","submitted_at":"2026-06-17T14:56:27Z","title":"Complementary Attention Head Pruning for Efficient Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T20:56:52.981010Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2606.19150"},"observation_digest":"sha256:6a6ca134436153bb8bbf9c0533f3e6da29dd97902d708dcab5b8666f0b6dd3c2","observation_id":"fc315de0-7473-4746-b838-a718887e4f3e","resolution":{"observed_at":"2026-07-04T00:49:18.745134Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"1902.09574","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-04T20:50:11.582245Z","title":"The State of Sparsity in Deep Neural Networks","venue":"cs.LG","work_id":"044b6dcc-a5e2-4f07-82c7-b92c573fd82b","year":2019},"citing_paper":{"arxiv_id":"2606.26002","last_updated":"2026-06-24T16:19:29Z","snapshot_observed_at":"2026-08-14T01:54:45.854760Z","submitted_at":"2026-06-24T16:19:29Z","title":"Hierarchical Reinforcement Learning for Neural Network Compression (HiReLC): Pruning and Quantization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-25T19:32:25.749516Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2606.26002"},"observation_digest":"sha256:d3395b2ad37ac9b5da74be83890194b4b50b484e49da6acbc020cdac198b5fba","observation_id":"9731e3c2-3dd3-4bc9-bc68-226bab5c2399","resolution":{"observed_at":"2026-07-04T20:50:11.586242Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-07-14T09:09:29.470093Z","title":"The State of Sparsity in Deep Neural Networks.arXiv preprint arXiv:1902.09574, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2607.10803","last_updated":"2026-07-12T15:21:19Z","snapshot_observed_at":"2026-08-21T23:51:44.691358Z","submitted_at":"2026-07-12T15:21:19Z","title":"Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T09:09:29.470093Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2607.10803"},"observation_digest":"sha256:87ce9edcbd14092a0ea56a4b0b8d47674abcf73f232da2adec9150ec7ad9c775","observation_id":"a1d96ac6-3ecc-4878-ae7c-46e5d24722a8","resolution":{"observed_at":"2026-07-14T09:09:29.470093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-01T05:19:32.695733Z","title":"The state of sparsity in deep neural networks,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2607.22790","last_updated":"2026-07-24T13:12:07Z","snapshot_observed_at":"2026-08-17T18:05:19.251698Z","submitted_at":"2026-07-24T13:12:07Z","title":"The Sparsity Tax: Weight Sparsity Trade-offs in Event-Driven SIMD and SIMT Neuromorphic Cores","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T05:19:32.695733Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2607.22790"},"observation_digest":"sha256:02430fb41574a417aaa55afd8ec9a0aad2d324da2b039649033b8607509b0f2f","observation_id":"5d872f14-e0d5-46b4-95f6-ed36c179fccd","resolution":{"observed_at":"2026-08-01T05:19:32.695733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-16T00:36:02.282506Z","title":"arXiv preprint arXiv:1902.09574 , year=","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2608.11749","last_updated":"2026-08-12T07:41:31Z","snapshot_observed_at":"2026-08-21T18:56:52.312659Z","submitted_at":"2026-08-12T07:41:31Z","title":"MOON: Multi-Objective OrthoNormalized Updates for Multitask Learning","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-08-16T00:36:02.282506Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2608.11749"},"observation_digest":"sha256:6a25a9169e38fbe47a6a08239f310c6cf8e0a79872623c310c3e96250017e7c7","observation_id":"0ac30512-8df6-4b48-ae00-442f9538e303","resolution":{"observed_at":"2026-08-16T00:36:02.282506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1902.09574/citation-record","integrity":"/paper/1902.09574/integrity","json":"/paper/1902.09574/citation-record.json","paper":"/paper/1902.09574"},"outbound":[],"paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T00:50:07.769538Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 50 inbound Pith citation observations for arXiv:1902.09574."}