{"as_of":"2026-08-13T00:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cdead395f2ffe72b777ff365cd0855cc821ec954103837cc889a339c97a04978","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:00:00.258418Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.17796/citation-record","integrity":"/paper/2411.17796/integrity","json":"/paper/2411.17796/citation-record.json","paper":"/paper/2411.17796"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.329305Z","title":"No pruning","venue":null,"work_id":"ed4181b7-47bc-4256-840a-5af282abdecb","year":null},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.022648Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:e41bbfef1f296b4892bd43b98bb3fff01b119dc6d5b5768243a951e82bcb5ddb","observation_id":"b03c30b9-2c31-496f-a669-13c05e88f44f","resolution":{"observed_at":"2026-08-12T12:00:01.334337Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.313479Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity","venue":null,"work_id":"96f48cf0-54ee-4f99-8ddc-7ff3be58c292","year":2022},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.029044Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:948296476d259d3f95e2bdb81ea7975f877764fe74e023e65821cb767782124a","observation_id":"c7c0d2d2-b458-438c-a969-572b9eaa374f","resolution":{"observed_at":"2026-08-12T12:00:01.318400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-12T12:00:00.034037Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.034037Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:4387bd98f1316abef41df949656fd3e29b27123cb07862ca3fd30431a6342aa0","observation_id":"923ccaab-96de-4961-8d91-7d8252d9471f","resolution":{"observed_at":"2026-08-12T12:00:00.034037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.039353Z","title":"A survey on deep neural network pruning: Taxonomy, comparison, analysis, and recommendations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.039353Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:03f860c8f84783dd52c0cc64d8871d18818d52e739d13c3a29d18ae1da95c434","observation_id":"098781a8-71bb-4b9b-83db-d0c06271bef1","resolution":{"observed_at":"2026-08-12T12:00:00.039353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.04838","last_updated":"2021-09-10T12:46:32Z","snapshot_observed_at":"2026-08-10T23:35:07.182089Z","submitted_at":"2021-09-10T12:46:32Z","title":"Block Pruning For Faster Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.04838","snapshot_observed_at":"2026-08-12T12:00:00.044803Z","title":"Block pruning for faster transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.044803Z"},"links":{"cited_paper":"/paper/2109.04838","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:33b231d811d23176a634c0e9b50abfdfacaea47d0bd4eafd3fd9d593118e316d","observation_id":"8298a851-accb-4f4e-9f5e-1621ced4ca06","resolution":{"observed_at":"2026-08-12T12:00:00.044803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.07259","last_updated":"2022-10-17T23:24:22Z","snapshot_observed_at":"2026-08-06T18:58:20.499511Z","submitted_at":"2022-03-14T16:40:31Z","title":"The Optimal BERT Surgeon: Scalable and Accurate Second-Order Pruning for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.07259","snapshot_observed_at":"2026-08-12T12:00:00.049894Z","title":"The optimal BERT surgeon: Scalable and accurate second-order pruning for large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.049894Z"},"links":{"cited_paper":"/paper/2203.07259","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:5b09d6a006ea590727cdcf682f1743f1174a2d60903c83f9ea258d7a222ff25a","observation_id":"b8f15d4d-240d-45a0-b419-51ff8fa59b4c","resolution":{"observed_at":"2026-08-12T12:00:00.049894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03635","last_updated":"2019-03-04T15:51:11Z","snapshot_observed_at":"2026-08-05T23:54:27.386622Z","submitted_at":"2018-03-09T18:51:28Z","title":"The Lottery Ticket Hypothesis: Finding Sparse, Trainable Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03635","snapshot_observed_at":"2026-08-12T12:00:00.055329Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.055329Z"},"links":{"cited_paper":"/paper/1803.03635","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:9436026752462e09f36c831cfb38843aa37a7de05ac8eb34587519828d608b41","observation_id":"a017c2c7-be8d-41e2-ad5b-58b004ac5b3c","resolution":{"observed_at":"2026-08-12T12:00:00.055329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-12T12:00:00.060913Z","title":"A simple and effective pruning approach for large language models.arXiv preprint arXiv:2306.11695, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.060913Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:2c72f16a2c4b577ba11c85ac0fdb877f82589c99c329a89d7043e5e1701e3773","observation_id":"39177a75-e63d-4347-9cf3-211cf1163d0b","resolution":{"observed_at":"2026-08-12T12:00:00.060913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.287800Z","title":"SparseGPT: Massive language models can be accurately pruned in one-shot","venue":null,"work_id":"2f9ecb4e-5080-4ef6-bfdb-60ebc1d67f53","year":2023},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.065716Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:d2f1852cca0b76f65dabd9079b89e3e989ae6be65b869affc5c9fd4c7686eb53","observation_id":"d5852f44-fb51-4304-9e62-b021b14d58ba","resolution":{"observed_at":"2026-08-12T12:00:01.292781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.272212Z","title":"A user’s guide to tabu search","venue":null,"work_id":"f57aca98-c108-46cd-b05c-ba2a89cb2189","year":1993},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.070352Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:354cfd460cc128ae3349cf300d69a319bbed270e4685c6ed97b9458fdda67316","observation_id":"954e181d-af82-4e73-ba8b-703bea6e8612","resolution":{"observed_at":"2026-08-12T12:00:01.277187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-12T12:00:00.075030Z","title":"Mistral 7b.arXiv preprint arXiv:2310.06825, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.075030Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:6a9463b90a8508b14807abe29bfb3d4db10c552e876eb7ebecea89066434e04b","observation_id":"68dc8ec0-be35-43d8-8a52-2d995938811a","resolution":{"observed_at":"2026-08-12T12:00:00.075030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.080405Z","title":"Training data-efficient image transformers & distillation through attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.080405Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:708d09fdaa08a513c56a3cca09f7d51fead9364d3029166b7755d08f747b676c","observation_id":"e7b26744-fb8b-4cde-8c4f-db2c30ecd745","resolution":{"observed_at":"2026-08-12T12:00:00.080405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.084907Z","title":"Optimal brain damage.Advances in neural information processing systems, 2, 1989","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.084907Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:6f97961689921f3404970f32f2529249bd079c0df16b529bc8e5902949ed3a76","observation_id":"d407823a-1c9b-41cf-926f-c691d9515c9f","resolution":{"observed_at":"2026-08-12T12:00:00.084907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.236282Z","title":"Optimal brain surgeon and general network pruning","venue":null,"work_id":"1ab819be-e7fb-4c00-8b72-048c2a181999","year":1993},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.089537Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:2b104baea11d51c850ca71dfefef73bea055d36c8893880fc9c6b64f7defbdd4","observation_id":"caaa28dd-2fb6-4f6b-9639-b0c8a4324747","resolution":{"observed_at":"2026-08-12T12:00:01.241449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.220352Z","title":"Thecombinatorialbrainsurgeon: Pruning weights that cancel one another in neural networks","venue":null,"work_id":"a0edd911-0254-43f5-92d3-3ac322d546a7","year":2022},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.094158Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:f5e2e63a298c5452111974d2ac4c21ce014dd5584146c64b2575b7a1642941eb","observation_id":"ebadabd7-cddc-4884-9efe-10db8f8cd344","resolution":{"observed_at":"2026-08-12T12:00:01.225322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.099602Z","title":"Learning both weights and connections for efficient neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.099602Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:a31f56164fbde269df1a43058dd84991af5c1ec1dc90fe5eeada1a3f2d146dd5","observation_id":"0db9aac4-0898-4938-a8cf-2cdcf1038b9b","resolution":{"observed_at":"2026-08-12T12:00:00.099602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.194218Z","title":"What is the state of neural network pruning? Proceedings of machine learning and systems, 2:129–146, 2020","venue":null,"work_id":"da0cec16-217b-493a-b85e-bbb039522493","year":2020},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.104857Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:817bff60c6ceaf90b09d47e2f97fdc94e76abd9eaa1e9de72a0c2a1bc27bdd15","observation_id":"d69baedb-ff98-4051-af6d-7ca31f1c189a","resolution":{"observed_at":"2026-08-12T12:00:01.199394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.178802Z","title":"Woodfisher: Efficient second-order approximation for neural network compression","venue":null,"work_id":"68178418-c5e1-4546-8a10-53e83ad5f4c5","year":2020},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.110654Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:575ccd0c1079b3a4ed0c22099bceaee0467862de3ac37b3a329c64ec12fd4078","observation_id":"0618e0bb-12be-4332-a996-497697515e6c","resolution":{"observed_at":"2026-08-12T12:00:01.183672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.162370Z","title":"Fast as CHITA: Neural network pruning with combinatorial optimization","venue":null,"work_id":"3539d419-4f76-425a-bb29-27bd0d5f2a54","year":2023},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.115670Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:76e1e42cc182b302ea010a1016b12f4558249e3826009abae7dc00ba8c0f7656","observation_id":"ff508cb5-5c17-4f59-a503-ff5a6a34bfbe","resolution":{"observed_at":"2026-08-12T12:00:01.167495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.145238Z","title":"Building an iterative heuristic solver for a quantum annealer","venue":null,"work_id":"ca6f43c8-eada-4560-9ddf-7cdcc546ddd9","year":2016},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.121400Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:754bc77d19a7b6d299709d379ca1ba97e5f31fe9cb1b57fe86110aaf33fab08c","observation_id":"6ad01f4d-178e-4dec-879a-ab33af648cba","resolution":{"observed_at":"2026-08-12T12:00:01.150763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.128230Z","title":"From local to global ground states in Ising spin glasses","venue":null,"work_id":"f8f35865-6ba5-419b-b538-97b9145972c6","year":2015},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.126040Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:e97b31be20700e2b79a360171daeb4febd58b2a6e49fd42f3a65002b49a11b98","observation_id":"c2af9f41-adea-4ff5-80c1-948dbd0974c1","resolution":{"observed_at":"2026-08-12T12:00:01.133765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.112376Z","title":"Partitioning optimization problems for hybrid classical","venue":null,"work_id":"e7cb2c44-c206-42a0-833c-7eac3a5692ff","year":2017},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.130529Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:680f86b8211059757b0403b8467af573637e47ed838285681f2a1999af2e73f1","observation_id":"2924521d-38c3-4443-9d5a-7164db6f1bc5","resolution":{"observed_at":"2026-08-12T12:00:01.117372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-12T12:00:00.135102Z","title":"The Llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.135102Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:340d1a9a8ba8a3c3cdfc2fe70f762af6826c609e730fb6bd60224481f6048d48","observation_id":"97eab937-3dd3-4921-8c09-f2676bfadf2e","resolution":{"observed_at":"2026-08-12T12:00:00.135102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.4028","last_updated":"2014-11-14T19:57:57Z","snapshot_observed_at":"2026-07-06T04:00:38.324755Z","submitted_at":"2014-11-14T19:57:57Z","title":"A Quantum Approximate Optimization Algorithm","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.4028","snapshot_observed_at":"2026-08-12T12:00:00.140301Z","title":"A quantum approximate optimization algorithm.arXiv preprint arXiv:1411.4028, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.140301Z"},"links":{"cited_paper":"/paper/1411.4028","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:086f47af22a2f488d8791ceb97ccf423aa54e27ce625613ea792d4cf91a7243b","observation_id":"89ad6c6e-67f6-4443-b8a0-cdaad1f24851","resolution":{"observed_at":"2026-08-12T12:00:00.140301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.096484Z","title":"Quantum approximate optimization with hard and soft constraints","venue":null,"work_id":"69ae97ca-a252-4f77-ac8b-910d69e76b1c","year":2017},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.145158Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:fab0fcd9c4fb0077372bf026cfeb73ec6742fe452f1c4f6fc78662bf2896b60d","observation_id":"d0595ede-bcce-49a5-a6fb-473e0dd9b665","resolution":{"observed_at":"2026-08-12T12:00:01.101390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2403.05653","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.803164Z","title":"Q-CHOP: Quantum constrained hamiltonian optimization","venue":null,"work_id":"df01652e-e3b2-4754-9209-e32c06fc11ed","year":2024},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.150499Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:701a1bf608dd058ee821c8c155629724438ff00ea6bd93f75b6850ac12ed6708","observation_id":"e75e0c08-494a-4f89-a4f9-b897556dd7a1","resolution":{"observed_at":"2026-08-12T12:00:00.810816Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.079661Z","title":"Optimal brain surgeon: Extensions and performance comparisons","venue":null,"work_id":"347f8d7e-ebd4-4719-8517-8f647df723f0","year":1993},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.155077Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:46e1aef62c22f8c6f5046d71aacca2d3af3b29e6ae8e665575fc6d87d18174f5","observation_id":"2181463f-fd49-4219-a850-3d2a27ec3e37","resolution":{"observed_at":"2026-08-12T12:00:01.085432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.062927Z","title":"Extremal optimization","venue":null,"work_id":"49b1639d-525e-42de-b2f4-c063110c5ad5","year":2004},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.160106Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:d64cbd8d2d80c5d30233ca7f613f22ed4bc9913a32e3b04b2a4501901dbb453f","observation_id":"96b85555-478c-427d-b19c-2465c101bd97","resolution":{"observed_at":"2026-08-12T12:00:01.068520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20185","last_updated":"2024-07-29T17:13:01Z","snapshot_observed_at":"2026-08-12T23:12:39.993913Z","submitted_at":"2024-07-29T17:13:01Z","title":"Solving QUBOs with a quantum-amenable branch and bound method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20185","snapshot_observed_at":"2026-08-12T12:00:00.164749Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.164749Z"},"links":{"cited_paper":"/paper/2407.20185","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:03477d03eb02325fea7499b88004e570ae2853e2c4c9667183967ced48bd15e4","observation_id":"ec569e2c-9a20-495d-a5e8-a21f85d4ce74","resolution":{"observed_at":"2026-08-12T12:00:00.164749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.169962Z","title":"Attention is all you need.Advances in Neural Information Processing Systems, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.169962Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:eed73a44fb048c36e4252e14e79fadd1ed5c836f01e1b90c8c2a8559aa50dcd1","observation_id":"342adcd6-8c9f-4376-93d7-6732c67ab65e","resolution":{"observed_at":"2026-08-12T12:00:00.169962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-07-06T07:55:12.121264Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-12T12:00:00.174502Z","title":"BoolQ: Exploring the surprising difficulty of natural yes/noquestions","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.174502Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:724c9ebf246f9545db3a859dadb7f8a6de2732ab30b73c8be6d323913d221c38","observation_id":"c2857c3e-1246-4249-b6b5-769fb03dac1c","resolution":{"observed_at":"2026-08-12T12:00:00.174502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-12T12:00:00.179715Z","title":"GLUE: Amulti-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.179715Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:b694ae1bf2c1095533ae4b78b2ff4b67df98cf12b64b0e4734b51fd213150331","observation_id":"38286718-326c-48fd-8dd5-63858f365a71","resolution":{"observed_at":"2026-08-12T12:00:00.179715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-10T16:18:23.994244Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-12T12:00:00.184900Z","title":"Hellaswag: Can a machine really finish your sentence? arXiv preprint arXiv:1905.07830 , 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.184900Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:fcd4899b6e2659122eca8b2fdf39459f91acedd44fc06bb891b95c2c87c0f674","observation_id":"7a95162a-713e-4ead-83b3-aa1fbbcec9b4","resolution":{"observed_at":"2026-08-12T12:00:00.184900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.037915Z","title":"Winogrande: An adversarial winograd schema challenge at scale","venue":null,"work_id":"303bab3b-1a53-4d12-96fe-1807e6e99dfb","year":2021},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.190014Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:34c4c52c50c24a3a64ff9715fde12c1c177f1f204207b9a3b7813f688b309205","observation_id":"2f73482e-2f5f-4a94-9770-416675cf0dbc","resolution":{"observed_at":"2026-08-12T12:00:01.042887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-12T12:00:00.194648Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.194648Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:a71fb76768650446118b3776edf2d941c502c79dd72f8eae9b28dbb7a58bf19f","observation_id":"5cb0da39-05b7-418c-90a4-bbc345dd6e42","resolution":{"observed_at":"2026-08-12T12:00:00.194648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-08T02:19:52.596062Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-12T12:00:00.200379Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.200379Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:e9312bbbe8d3c185ba7225988dc7828e11b7aab68378586c73e57799d4a3a4b9","observation_id":"b824e42c-2456-4cf9-aaaf-4a62f17d1c09","resolution":{"observed_at":"2026-08-12T12:00:00.200379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.07747","last_updated":"2017-09-15T21:29:49Z","snapshot_observed_at":"2026-07-06T05:56:41.814255Z","submitted_at":"2017-08-25T14:01:29Z","title":"Fashion-MNIST: a Novel Image Dataset for Benchmarking Machine Learning Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.07747","snapshot_observed_at":"2026-08-12T12:00:00.205244Z","title":"Fashion- MNIST:anovelimagedatasetforbenchmarkingmachine learning algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.205244Z"},"links":{"cited_paper":"/paper/1708.07747","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:2b425c7ba0046179a4abf377c100331aa6b59d5ba5c75a8f83d11b41aa25c17f","observation_id":"cbc86a49-2e5b-42ed-bdf7-c5b748e1fdfc","resolution":{"observed_at":"2026-08-12T12:00:00.205244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.210159Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.210159Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:d527ddd337a2c6663b2afd1672648b16985400e53c6c35f92fbbae8680b051b6","observation_id":"b5d84272-0257-49a4-961c-acfa70142ec8","resolution":{"observed_at":"2026-08-12T12:00:00.210159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:01.012213Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of machine learning research , 21(140):1–67, 2020","venue":null,"work_id":"0bf6f68b-3a5c-45ad-8547-f2949907d5ce","year":2020},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.214725Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:0280af1047ead46b4a302f5b6ce8d39aba7c61ca6491f2ea528adc4bdb974876","observation_id":"5700f8a5-ba9a-4165-b1b0-8905d7162e35","resolution":{"observed_at":"2026-08-12T12:00:01.017425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.219855Z","title":"A framework for few-shot language model evaluation, 12 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.219855Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:cf08bdbfe7caf2e6a0edf7aa47a5ad7ab7ea4214bff50341b6e4278ba12988ff","observation_id":"82c981e6-3655-4c64-ad38-496b8fd1ea55","resolution":{"observed_at":"2026-08-12T12:00:00.219855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.05118","last_updated":"2018-07-13T15:00:17Z","snapshot_observed_at":"2026-07-06T06:50:03.471843Z","submitted_at":"2018-07-13T15:00:17Z","title":"Tune: A Research Platform for Distributed Model Selection and Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.05118","snapshot_observed_at":"2026-08-12T12:00:00.224616Z","title":"Tune: A research platform for distributed model selection and training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.224616Z"},"links":{"cited_paper":"/paper/1807.05118","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:aac28e46e833c50c6780de5f4598621d1c9e883e7eae8e80f49c1447edfffdd1","observation_id":"c5ccb66c-e666-49e9-a4a6-fc5c5047f71b","resolution":{"observed_at":"2026-08-12T12:00:00.224616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.996224Z","title":"Making a science of model search: Hyperparameter optimization in hundreds of dimensions for vision architectures","venue":null,"work_id":"41469d10-cbb2-4b80-956a-727249d39057","year":null},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.229470Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:c21b0a65a2bc452be2ca22d895b02d72955b743c88178471e4ada3e52b78767d","observation_id":"7eac5c38-41ed-4ab5-9645-26b1801ce366","resolution":{"observed_at":"2026-08-12T12:00:01.001507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.234153Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.234153Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:84c49f8e001051eff420486304f8f22e56a9d3caf06bfcb254522496a987833b","observation_id":"02741a75-9ee5-4082-9805-009f4b99fa39","resolution":{"observed_at":"2026-08-12T12:00:00.234153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2403.07688","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.502530Z","title":"Maxwell’s demon at work: Efficient pruning by leveraging saturation of neurons","venue":null,"work_id":"40773f50-fa81-4f6a-8bea-f9f0c18422d4","year":2024},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.239301Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:9c9628588deba4880a26ba432e2510082ffaa33095289c4bc59ad42b9968ba52","observation_id":"bead7310-2f4e-4926-9c87-45616063643c","resolution":{"observed_at":"2026-08-12T12:00:00.510902Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04805","last_updated":"2024-10-27T22:50:23Z","snapshot_observed_at":"2026-08-04T06:35:25.844553Z","submitted_at":"2024-03-05T23:02:55Z","title":"Pruning neural network models for gene regulatory dynamics using data and domain knowledge","version":2},"cited_work":{"arxiv_id":"2403.04805","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.04805","snapshot_observed_at":"2026-08-12T12:00:00.322323Z","title":"Pruning neural network models for gene regulatory dynamics using data and domain knowledge","venue":"cs.LG","work_id":"0aca2b1e-be26-4728-b523-4c24c7149000","year":2024},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.243961Z"},"links":{"cited_paper":"/paper/2403.04805","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:08eeda10af0779a0e01d6a1f3b33f5fd511e9643f5bbd1dd6cff526ea6658e9a","observation_id":"1fb82e9a-66c8-4cea-9f1d-2942a901592f","resolution":{"observed_at":"2026-08-12T12:00:00.327736Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.969243Z","title":"Quantum neural network compression","venue":null,"work_id":"e8794649-4135-47f3-8160-688b91133270","year":2022},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.248771Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:0d1190d08d1650e45515ed7a4d1e49aa29ecf396dac55a4f6da5dc9011d7e24f","observation_id":"18907e00-39f2-45b5-98d7-b702538ce200","resolution":{"observed_at":"2026-08-12T12:00:00.974818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13352","last_updated":"2024-08-23T19:57:40Z","snapshot_observed_at":"2026-08-12T22:58:24.149975Z","submitted_at":"2024-08-23T19:57:40Z","title":"QAdaPrune: Adaptive Parameter Pruning For Training Variational Quantum Circuits","version":1},"cited_work":{"arxiv_id":"2408.13352","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.13352","snapshot_observed_at":"2026-08-12T12:00:00.296742Z","title":"QAdaPrune: Adaptive Parameter Pruning For Training Variational Quantum Circuits","venue":"quant-ph","work_id":"5359de6a-d972-465e-9e0e-b418630e1327","year":2024},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.253451Z"},"links":{"cited_paper":"/paper/2408.13352","citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:8c94f03f4992ad01e355aef772ee2e63a3db26678ecddfcf366c355d1d3ae7b3","observation_id":"e71ab982-a2c8-4e28-9126-6ea806b1d8c4","resolution":{"observed_at":"2026-08-12T12:00:00.304510Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:00:00.952374Z","title":"gradient accumulation","venue":null,"work_id":"a8c77b95-b3e6-4e74-a154-3f43c874c31a","year":2019},"citing_paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T12:00:00.258418Z"},"links":{"citing_paper":"/paper/2411.17796"},"observation_digest":"sha256:6b2acda7938d4cba90c2f6405db332ed7438b43bfb626427ef0096a325fb3670","observation_id":"a9049abf-e5b0-422c-bbe7-5a093093c7fc","resolution":{"observed_at":"2026-08-12T12:00:00.957725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.17796","last_updated":"2024-11-26T17:54:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T12:32:42.639485Z","submitted_at":"2024-11-26T17:54:02Z","title":"Scalable iterative pruning of large language and vision models using block coordinate descent"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":24,"verified_exact":3,"verified_fuzzy":19},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2411.17796."}