{"as_of":"2026-08-08T05:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:43157a5b9f7d85add4053b8741686cb9eaf3311b4b09e1ea4836e2c660020a0b","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:30:12.402648Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24469/citation-record","integrity":"/paper/2505.24469/integrity","json":"/paper/2505.24469/citation-record.json","paper":"/paper/2505.24469"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:18.093352Z","title":"Online embedding compression for text classification using low rank matrix factorization","venue":null,"work_id":"949f04e7-f591-4786-a470-11013607cab1","year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.115978Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:f223c34c4eba40dfeed184b62ae4f0811c6d8fee0a84777daa4a2842f12d155b","observation_id":"a92dd1a5-6e62-40f3-89c5-21273d1f2464","resolution":{"observed_at":"2026-08-07T12:30:18.201092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:17.880317Z","title":"Fluctuation-based adaptive structured pruning for large language models","venue":null,"work_id":"818d423b-1e0c-42e0-a958-5ee1e94ae139","year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.223019Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:996ba29e2fe49d0041357e002716a2e4448addf46a0555639a56902c33f063db","observation_id":"22feda92-49c6-420b-8e81-5733894f4ebf","resolution":{"observed_at":"2026-08-07T12:30:17.984589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:17.680744Z","title":"On gradient regularizers for mmd gans.Advances in neural information processing systems, 31, 2018","venue":null,"work_id":"d33c1dc4-7bcc-4035-bd0c-cb9434ecea86","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.338992Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:a9fd525b5a1cea9a51ddcaa5ac27ed407f41bd676cfb28330768682ec31d0297","observation_id":"c6b31d9b-53b6-4dc0-8c4f-ebd765cba2f0","resolution":{"observed_at":"2026-08-07T12:30:17.773468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:17.550559Z","title":"Slicegpt: Compress large language models by deleting rows and columns","venue":null,"work_id":"693c53f4-1c7a-4981-a5e2-50ebf3e91fd3","year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.463375Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:1213d15a55ca2263dc20d90444a2053818b678d82bfea1dd201aed2be0ce6f31","observation_id":"9992f729-6058-4e8a-8744-736f65062e2f","resolution":{"observed_at":"2026-08-07T12:30:17.599730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.05012","last_updated":"2018-04-16T17:07:53Z","snapshot_observed_at":"2026-07-06T06:33:20.422524Z","submitted_at":"2018-04-13T16:24:17Z","title":"Representing smooth functions as compositions of near-identity functions with implications for deep network optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.05012","snapshot_observed_at":"2026-08-07T12:30:06.566686Z","title":"Representing smooth functions as compositions of near-identity functions with implications for deep network optimization.arXiv preprint arXiv:1804.05012, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.566686Z"},"links":{"cited_paper":"/paper/1804.05012","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:6204826f6293b963a1ed06a121e1e920cf2c8cf78a2a440aedde5b875623407a","observation_id":"8e953837-908b-40ee-821e-c5dc1904f095","resolution":{"observed_at":"2026-08-07T12:30:06.566686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:17.271973Z","title":"Invertible residual networks","venue":null,"work_id":"41849e5c-efe2-4936-8e5d-843bd7495794","year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.655015Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:fa737a8b41cd54210fe81312e2c75aa6f10f33de22b7a97cb2b026e71be2a37a","observation_id":"14a5ac12-b72d-4eeb-b901-219be14c09da","resolution":{"observed_at":"2026-08-07T12:30:17.380637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09282","last_updated":"2020-06-14T19:10:03Z","snapshot_observed_at":"2026-07-06T06:05:58.275255Z","submitted_at":"2017-10-23T20:16:55Z","title":"A Survey of Model Compression and Acceleration for Deep Neural Networks","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09282","snapshot_observed_at":"2026-08-07T12:30:06.748067Z","title":"A survey of model compression and acceleration for deep neural networks.arXiv preprint arXiv:1710.09282, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.748067Z"},"links":{"cited_paper":"/paper/1710.09282","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:2bc5010a90c230af550344baa64398ceee446500b60a03cb93bc9c9156753aea","observation_id":"d83c6c19-4989-49fa-9427-1bb37040006f","resolution":{"observed_at":"2026-08-07T12:30:06.748067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:06.853913Z","title":"Parseval networks: Improving robustness to adversarial examples","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.853913Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:e3719295a17d4e3a651fb0cf7d071a5b36ab9ea0edfdf90c3b0d7b375987d962","observation_id":"6b097332-307f-4129-bb05-e3902a0bfb6e","resolution":{"observed_at":"2026-08-07T12:30:06.853913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:06.967288Z","title":"Hawq: Hessian aware quantization of neural networks with mixed-precision","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:06.967288Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:58a3fe51de8393acb866352c084b2b9723fb10d246b4662ed7f3b575a6075c59","observation_id":"edb10441-f4ed-4f3c-8c13-32250f7e9f16","resolution":{"observed_at":"2026-08-07T12:30:06.967288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:17.037332Z","title":"Improving generalization performance using double backpropagation","venue":null,"work_id":"50906a05-2de8-4e47-8e4c-119078538292","year":1992},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.030954Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:fc7af51ae13790bd21887d893ddb9255d4bd13c75c8bdec1599520cebd3e06d5","observation_id":"080d3db6-6746-4310-91d9-d5dd0b8f93d6","resolution":{"observed_at":"2026-08-07T12:30:17.159202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.896879Z","title":"The role of permutation invariance in linear mode connectivity of neural networks","venue":null,"work_id":"7beef09a-5c9f-40b5-bcbc-7a9029a5271b","year":2022},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.163063Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:3470f72d32c9f247267a53f06fa14ba095c069912cc69f3abb069d25e37dcba4","observation_id":"bb6abfdf-2676-4375-b078-d8eb7938c0dc","resolution":{"observed_at":"2026-08-07T12:30:16.969197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.733316Z","title":"Neural scene representation and rendering.Science, 360(6394):1204–1210, 2018","venue":null,"work_id":"8ddf9d80-cc56-403b-87eb-114093114434","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.302818Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:4171cd8f18eabedbb489a12cf934bec6b300c5dc12fd7fb7a3f80fb4190e8815","observation_id":"6fbd3b2e-dc0a-4c48-8558-0e2c8c43a40e","resolution":{"observed_at":"2026-08-07T12:30:16.799934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.595466Z","title":"Many paths to equilibrium: Gans do not need to decrease a divergence at every step","venue":null,"work_id":"2629ef00-77a0-44f7-bb19-c0ed0563dc6c","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.478679Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:22540719e96d0e6a042a629fde1ecf50c5b03a71a8af42345aea50f02ab8545f","observation_id":"d6ceedb8-2b9f-4386-994e-6c4b5bd36f19","resolution":{"observed_at":"2026-08-07T12:30:16.661142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.01882","last_updated":"2019-03-05T15:07:29Z","snapshot_observed_at":"2026-07-06T07:37:13.112388Z","submitted_at":"2019-03-05T15:07:29Z","title":"Learning a smooth kernel regularizer for convolutional neural networks","version":1},"cited_work":{"arxiv_id":"1903.01882","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.01882","snapshot_observed_at":"2026-08-07T12:30:12.796135Z","title":"Learning a smooth kernel regularizer for convolutional neural networks","venue":"cs.CV","work_id":"6d9d3165-878f-41ef-ad1a-a85c0423b231","year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.615112Z"},"links":{"cited_paper":"/paper/1903.01882","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:6649f4e37af5c9163d10d1eaabc3085c2669191ab9732ad0e6ef9e7dab297143","observation_id":"119d68c9-b227-4c73-9f0f-a0b7b49cc789","resolution":{"observed_at":"2026-08-07T12:30:12.875128Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:07.675759Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.675759Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:adfe2e6c1079481e69fe780aec19f27f97a2dea4cbd60a6880ec8507a52af541","observation_id":"0cb40509-e00a-4732-977e-8ae5cd3d3ce1","resolution":{"observed_at":"2026-08-07T12:30:07.675759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:07.763259Z","title":"Optimal brain compression: A framework for accurate post-training quantization and pruning.Advances in Neural Information Processing Systems, 35:4475–4488, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.763259Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:9e514fc28119af36a184e2e3539ce1b988e3f39c76a544d9af4b39ce5bb16c4c","observation_id":"5fba65e3-ca99-4396-a793-423a4cf80f28","resolution":{"observed_at":"2026-08-07T12:30:07.763259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:07.886636Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.886636Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:95400592bde3fe64ad77f496d66e95d53f33c5ff1dc97f7abfdf9257d39014d1","observation_id":"e017a3c4-a969-45c9-a433-255e8452f36d","resolution":{"observed_at":"2026-08-07T12:30:07.886636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:07.982926Z","title":"Born again neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:07.982926Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:39f026839c52e98b6403e29efa0b36916ed7c4b5e06a1dad88efe5be1f9c016b","observation_id":"60eac7ac-ce5e-43d5-b768-28cf08beaf05","resolution":{"observed_at":"2026-08-07T12:30:07.982926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.476190Z","title":"Stochastic training is not necessary for generalization","venue":null,"work_id":"4194de92-dd9f-42f1-9d94-27ae5fbb9add","year":2022},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.070431Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:dfbc1ca15344655936f62d7145c629c35a6b073efb610d915d611b47c4063e21","observation_id":"1f1aeecc-5769-449f-835e-6efd1f155fb0","resolution":{"observed_at":"2026-08-07T12:30:16.505909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.161699Z","title":"Knowledge distillation: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.161699Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:dcd349c7ba3d01987225a5612180cc8efc0bad098f20bf0c4729c3bbe32edad9","observation_id":"2805b455-d6d7-49a3-9e13-f1ab1a5be346","resolution":{"observed_at":"2026-08-07T12:30:08.161699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.363391Z","title":"Regularisation of neural networks by enforcing lipschitz continuity.Machine Learning, 110:393–416, 2021","venue":null,"work_id":"7580d707-1509-425e-9723-32d9e60a049a","year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.279348Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:ee84068316faba34c47334ecb4b3f3f66c7e2314ef2a46d264836d28114d6997","observation_id":"a85b16aa-c670-40c0-850e-ac7cac6d467d","resolution":{"observed_at":"2026-08-07T12:30:16.406220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.370851Z","title":"Improved training of wasserstein gans.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.370851Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:5a3c26711af8ccbbd8eb5971744a83b90cbc2345922d3cf73b6de7cfd8b9a598","observation_id":"d2dce5cc-2ce6-425b-84a7-835126f0f7b8","resolution":{"observed_at":"2026-08-07T12:30:08.370851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.456628Z","title":"Learning both weights and connections for efficient neural network.Advances in neural information processing systems, 28, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.456628Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:a260be59e703fb6fce50b1a90efe1f2f2c7df935c95db08cef88e4fa3e636589","observation_id":"c2942940-5a6a-466a-83f4-1aeb25cb85c2","resolution":{"observed_at":"2026-08-07T12:30:08.456628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.519624Z","title":"Optimal brain surgeon and general network pruning","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.519624Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:40ff3f427bcf556eb6b040436e2b57a6d9ebf38f130a266b0f509ab35faea8ff","observation_id":"f1558d3c-afb2-4b1c-94e7-b17ce02b5c89","resolution":{"observed_at":"2026-08-07T12:30:08.519624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.603463Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.603463Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:48080d7a21d45b43aec324fbd1e15ba257ccce3156b0457764370fbb1f63f352","observation_id":"2e695d43-01b3-4361-bf83-7d4b7b6519fa","resolution":{"observed_at":"2026-08-07T12:30:08.603463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.717050Z","title":"Bag of tricks for image classification with convolutional neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.717050Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:cfa3e4de71b9de14fb12715fcaa92c690bc15639b414f2ebe4a3d3cd290891f6","observation_id":"edc6e669-d148-4204-8180-192acfadff02","resolution":{"observed_at":"2026-08-07T12:30:08.717050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.202138Z","title":"Multi-task zipping via layer-wise neuron sharing.Advances in Neural Information Processing Systems, 31, 2018","venue":null,"work_id":"b0beb80b-ebfe-4777-a4fd-9a6c9097b074","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.788445Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:ffc130c1aca7498fa0e00308b43627e04fc76291034b68d8f27d9b7b567539d3","observation_id":"16a86be1-e712-4000-9912-a503f91ebcf2","resolution":{"observed_at":"2026-08-07T12:30:16.249679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:08.887893Z","title":"Channel pruning for accelerating very deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.887893Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:66708994106ff3c5aae8f9eeffa905629591410db4ad66900e6035029af9e0fa","observation_id":"81fc4488-3194-48c1-814e-2622eb94e84a","resolution":{"observed_at":"2026-08-07T12:30:08.887893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T12:30:08.964381Z","title":"Distilling the knowledge in a neural network.arXiv preprint arXiv:1503.02531, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:08.964381Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:022ad7f0ed521d27e3dc15c7802a102b311613fe4709b943df315caef39a5542","observation_id":"3ac37b63-8e69-40e8-a628-054d4803b5a6","resolution":{"observed_at":"2026-08-07T12:30:08.964381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.03250","last_updated":"2016-07-12T07:43:01Z","snapshot_observed_at":"2026-07-06T05:03:13.994105Z","submitted_at":"2016-07-12T07:43:01Z","title":"Network Trimming: A Data-Driven Neuron Pruning Approach towards Efficient Deep Architectures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.03250","snapshot_observed_at":"2026-08-07T12:30:09.113034Z","title":"Network trimming: A data-driven neuron pruning approach towards efficient deep architectures.arXiv preprint arXiv:1607.03250, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.113034Z"},"links":{"cited_paper":"/paper/1607.03250","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:37cb0621c0f874320adc618e962a919c86a766fa8752c0092a4f566574533e8a","observation_id":"278b3488-f7c5-4f7d-bbc2-e767d1ea16a7","resolution":{"observed_at":"2026-08-07T12:30:09.113034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:16.051652Z","title":"Quantized neural networks: Training neural networks with low precision weights and activations.journal of machine learning research, 18(187):1–30, 2018","venue":null,"work_id":"a77d4fd5-1e5a-49d8-847a-5e8ce9a53f4a","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.212080Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:eb1b3b64856ae96b0f616f6c7f5f0838b9f2fce7d69f7c03d4b76b6f5d7a2723","observation_id":"50306162-f995-4dc7-bcaf-c0e126f6d384","resolution":{"observed_at":"2026-08-07T12:30:16.100846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:09.296570Z","title":"Overcoming catastrophic forgetting in neural networks.Proceedings of the national academy of sciences, 114(13):3521–3526, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.296570Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:a4f74a2381ed8f21e25d2d9820b28f97c1115e962c533d933337aeedfb1c3901","observation_id":"b1ddef33-b2ee-4d5b-a722-13c0aa012942","resolution":{"observed_at":"2026-08-07T12:30:09.296570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:15.899445Z","title":"Literature survey on low rank approximation of matrices.Linear and Multilinear Algebra, 65(11):2212–2244, 2017","venue":null,"work_id":"64ed2edd-ca01-4c53-819f-2a13904acf6b","year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.420155Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:9cadd303cddde3e8f56d58617d538f0961e9565226c8a7b3c6849a47e4801a83","observation_id":"4c1e4203-a757-4b23-becf-199967b27638","resolution":{"observed_at":"2026-08-07T12:30:15.972351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07215","last_updated":"2017-12-10T15:24:13Z","snapshot_observed_at":"2026-07-06T05:43:27.961693Z","submitted_at":"2017-05-19T22:41:56Z","title":"On Convergence and Stability of GANs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07215","snapshot_observed_at":"2026-08-07T12:30:09.537422Z","title":"On convergence and stability of gans.arXiv preprint arXiv:1705.07215, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.537422Z"},"links":{"cited_paper":"/paper/1705.07215","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:6e93da5fb95d4531f509203518dcc88336cbad9e386585d7f6498e96e573849f","observation_id":"155468eb-1581-4e90-9792-e0ccacdf2cb1","resolution":{"observed_at":"2026-08-07T12:30:09.537422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08342","last_updated":"2018-06-21T17:32:46Z","snapshot_observed_at":"2026-07-06T06:46:08.396066Z","submitted_at":"2018-06-21T17:32:46Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.08342","snapshot_observed_at":"2026-08-07T12:30:09.614186Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.614186Z"},"links":{"cited_paper":"/paper/1806.08342","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:d83f53e2e1a0a6f09e0e3bbaae63ddd199335edb1bc447a363d3c562226cdc5b","observation_id":"20f82b6f-6b8e-4cb2-a990-f2829bcdd852","resolution":{"observed_at":"2026-08-07T12:30:09.614186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:09.697478Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.697478Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:9c10eac0c837bfe00cb3ed34917227dfbc6e025d9c561dc3689724f12548e2c7","observation_id":"14a1decc-99dc-4827-847b-b161e63961b3","resolution":{"observed_at":"2026-08-07T12:30:09.697478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:15.757831Z","title":"A fast post-training pruning framework for transformers.Advances in Neural Information Processing Systems, 35:24101–24116, 2022","venue":null,"work_id":"4bfc6807-a753-4a64-8a89-6f33694c7921","year":2022},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.768607Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:eb341745595590883627424efd09f7f1cd6ccb53132198e442565d6809ac59a2","observation_id":"9453502e-eab0-4fdf-9c83-20ba5658946e","resolution":{"observed_at":"2026-08-07T12:30:15.821019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:09.839494Z","title":"Optimal brain damage.Advances in neural information processing systems, 2, 1989","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.839494Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:882011bd15c5d894ac6d27fe57f75108fb0268bb8d124f65e5db609837ed8279","observation_id":"0ecd77aa-0b9a-47fd-a1c3-7f7fc06bc0b6","resolution":{"observed_at":"2026-08-07T12:30:09.839494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.08710","last_updated":"2017-03-10T17:57:56Z","snapshot_observed_at":"2026-07-06T05:08:42.861486Z","submitted_at":"2016-08-31T02:29:59Z","title":"Pruning Filters for Efficient ConvNets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.08710","snapshot_observed_at":"2026-08-07T12:30:09.904070Z","title":"Pruning filters for efficient convnets.arXiv preprint arXiv:1608.08710, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.904070Z"},"links":{"cited_paper":"/paper/1608.08710","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:58e2a65621dd53fb0ea70e018e44ee99b6b7f0a337b74fdeef83fe17584ca955","observation_id":"643916e0-bb91-444b-883a-d4957feedbe5","resolution":{"observed_at":"2026-08-07T12:30:09.904070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:09.971519Z","title":"Lightweight deep learning for resource-constrained environments: A survey.ACM Computing Surveys, 56(10):1–42, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:09.971519Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:4f601ceb25844d4bdd097136dfaf953a46cd0f93786538f7bd6717d2f7a91134","observation_id":"ab477372-9a03-4029-a903-ec9f3da9766a","resolution":{"observed_at":"2026-08-07T12:30:09.971519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T12:30:10.045463Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.045463Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:348ecc4b7095cf03b0b98f2dea5f1a3c6542c764fdcb644b6f0625360cf01aa7","observation_id":"fbe44390-9a28-497f-910c-3ca16038f2ce","resolution":{"observed_at":"2026-08-07T12:30:10.045463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:10.107195Z","title":"Thinet: A filter level pruning method for deep neural network compression","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.107195Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:5123413bde34b47045798fed62d624b1d7aaa2584ea980ec2961d026b69d6aed","observation_id":"832dd1f2-c743-4925-84dd-7d6e71a558ca","resolution":{"observed_at":"2026-08-07T12:30:10.107195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:15.610015Z","title":"Shortgpt: Layers in large language models are more redundant than you expect.CoRR, 2024","venue":null,"work_id":"d81a41ec-7298-45f2-b0bf-3f9b96729277","year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.179658Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:d1bf4ff120a42a2261d40d49f023bf571f3df8ca6da254166e6e02da839295c2","observation_id":"356f85e1-a875-4683-9288-d2d161d1c280","resolution":{"observed_at":"2026-08-07T12:30:15.668493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:10.243781Z","title":"Nerf: Representing scenes as neural radiance fields for view synthesis.Communications of the ACM, 65 (1):99–106, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.243781Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:e55611d914c4f034a5f1688c5bae3dc41ea4297930634b51fd0755d8565d86ce","observation_id":"823245af-8343-4f3f-9163-65b24bdf3767","resolution":{"observed_at":"2026-08-07T12:30:10.243781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:15.419044Z","title":"Filter pruning using hierarchical group sparse regularization for deep convolutional neural networks","venue":null,"work_id":"8f0c49c5-f2e5-4cc4-a3db-f2f6b4c5e593","year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.329509Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:cb3a11ef59a73ac8905362d2f144c50aa9fd09176cc6a8ec9c7634e052463a86","observation_id":"5ce90e4c-571c-4785-820b-960ce7ef4a52","resolution":{"observed_at":"2026-08-07T12:30:15.502536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:10.415504Z","title":"Spectral normalization for generative adversarial networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.415504Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:245b365f2c4d7c65aa19c64a22ab41323ba35f4b79c92fdf63bd51dbfcc7fb28","observation_id":"2c92017a-51b0-415a-9ebd-481e973f9008","resolution":{"observed_at":"2026-08-07T12:30:10.415504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:15.196459Z","title":"Sosp: Efficiently capturing global correlations by second-order structured pruning","venue":null,"work_id":"030849e9-5600-4e57-9f81-91462ad74fc2","year":2022},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.509063Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:5045b584c5e6394903924f1f31b63f3bc1290f1406444b2e04fcd6b219fa00e3","observation_id":"b09925d0-381a-4ccc-b075-b11cbf8355bf","resolution":{"observed_at":"2026-08-07T12:30:15.320874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:14.913536Z","title":"Collaborative channel pruning for deep networks","venue":null,"work_id":"c787a03c-b3cd-4112-9661-cd2ab418c455","year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.577087Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:2bb901424127c9422212d6ee3d6e05bac04809d6133f22036c4125965d20233e","observation_id":"f700f187-793d-4c54-820f-ed92befaaf7e","resolution":{"observed_at":"2026-08-07T12:30:15.075082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6550","last_updated":"2015-03-27T11:52:28Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-19T22:40:51Z","title":"FitNets: Hints for Thin Deep Nets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6550","snapshot_observed_at":"2026-08-07T12:30:10.651644Z","title":"Fitnets: Hints for thin deep nets.arXiv preprint arXiv:1412.6550, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.651644Z"},"links":{"cited_paper":"/paper/1412.6550","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:5d3fefcff94385716af7bbd79d9ed96095cf9346e0169065442a4595a009c9f7","observation_id":"df3ca50e-f62b-46c6-b574-26bf41002eed","resolution":{"observed_at":"2026-08-07T12:30:10.651644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.06496","last_updated":"2021-02-12T12:55:42Z","snapshot_observed_at":"2026-07-06T10:40:47.631261Z","submitted_at":"2021-02-12T12:55:42Z","title":"Depthwise Separable Convolutions Allow for Fast and Memory-Efficient Spectral Normalization","version":1},"cited_work":{"arxiv_id":"2102.06496","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.06496","snapshot_observed_at":"2026-08-07T12:30:12.535019Z","title":"Depthwise Separable Convolutions Allow for Fast and Memory-Efficient Spectral Normalization","venue":"cs.LG","work_id":"f7951f37-ff19-4fe8-9212-caf6c44fc33d","year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.749971Z"},"links":{"cited_paper":"/paper/2102.06496","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:950145c8c17e03029d220f3b667dc37002df5d68ff5267db6ac21c71822c31d3","observation_id":"1cb00309-c50c-44c2-b89b-aa9e0bb36dc4","resolution":{"observed_at":"2026-08-07T12:30:12.603457Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:10.834505Z","title":"Wire: Wavelet implicit neural representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.834505Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:b206f473df1b183d91214c9d85831e5aa16d118ac089eda38615a60758c04040","observation_id":"29a03df0-35dd-4ba8-afda-e54c76cc33d4","resolution":{"observed_at":"2026-08-07T12:30:10.834505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:14.655567Z","title":"The singular values of convolutional layers","venue":null,"work_id":"a02997bc-e93e-4fbc-90e3-20b7f1fb19d5","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:10.924553Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:9047dbe05c947fc80edd94846a374df6d17c0a148cc4005a2e91bd35232d32e8","observation_id":"9b27811b-2589-4bc3-9c50-da7ab81a02b3","resolution":{"observed_at":"2026-08-07T12:30:14.791545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:11.011353Z","title":"Implicit neural representations with periodic activation functions.Advances in neural information processing systems, 33:7462–7473, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.011353Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:d251e42e6f398a132917475617d723b6424809e868b261837d92b551f92b6199","observation_id":"dfea235f-af04-45ac-bab3-68399366dcc3","resolution":{"observed_at":"2026-08-07T12:30:11.011353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:14.392611Z","title":"Robust large margin deep neural networks.IEEE Transactions on Signal Processing, 65(16):4265–4280, 2017","venue":null,"work_id":"9e3e60e3-f1d3-4ced-bdfe-89a04d0b42b4","year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.128789Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:d2e97a51a88f88520da2628647c13ca0d13bde1709edd8b7da5a0abc8fcaa5e0","observation_id":"07ecfab4-9f10-4b8c-a693-46d845415260","resolution":{"observed_at":"2026-08-07T12:30:14.502950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:11.233891Z","title":"Integral neural networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.233891Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:dd5bc1b9be950623960bda0e04a91be4d299f30370c3d3053c838ec4d6fb9655","observation_id":"de6c4a04-eef4-4a70-a377-14e36edd5d61","resolution":{"observed_at":"2026-08-07T12:30:11.233891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:11.329093Z","title":"A simple and effective pruning approach for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.329093Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:8c65666d06527907698831b6d435ff7522e2ad76aca056635d0272e293d9e851","observation_id":"25b8250a-658a-4321-81c2-8639e06aadfb","resolution":{"observed_at":"2026-08-07T12:30:11.329093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:14.235853Z","title":"Towards meta-pruning via optimal transport","venue":null,"work_id":"4a3c2744-be42-48ed-863e-8b255c1d5c90","year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.423972Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:3df19974f3be38b752a811513344da676b01efb73f0e1af85f955b13cf1996c1","observation_id":"9c0e4e31-695c-4a2a-b375-1243bae04866","resolution":{"observed_at":"2026-08-07T12:30:14.289511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:11.525199Z","title":"Training data-efficient image transformers & distillation through attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.525199Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:c951dc78a64be8ade1f81d4152fd3d692661caecfd70691cbbf8aa4dd4bedb05","observation_id":"cd7281f9-c8a9-4bf1-8203-2d8381bd874d","resolution":{"observed_at":"2026-08-07T12:30:11.525199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:14.038427Z","title":"Lipschitz-margin training: Scalable certification of perturbation invariance for deep neural networks.Advances in neural information processing systems, 31, 2018","venue":null,"work_id":"a87fd914-e6d5-46ef-b16d-0950bac22176","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.601716Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:2b7b78788694c73844a214322548cf3ffb43996fbb2878b2fae53eccba1154c6","observation_id":"ef627779-e12f-43a3-a798-80e9bbac1e99","resolution":{"observed_at":"2026-08-07T12:30:14.107705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.852200Z","title":"Forget the data and fine-tuning! just fold the network to compress","venue":null,"work_id":"7119b07b-10cf-4e1e-b0e6-a588d672aa86","year":2025},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.675562Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:db678e19f91219ec21018ed88c836f266bc1ac4e85e3f453d3db85924bca50d6","observation_id":"806788f4-8af9-4435-9ae4-2c1fc976bb1e","resolution":{"observed_at":"2026-08-07T12:30:13.951007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:11.753936Z","title":"Learning structured sparsity in deep neural networks.Advances in neural information processing systems, 29, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.753936Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:4444a82afdbeb45229a9a336384947b9d68fb873b9b51fa7252ae7eec6e1a93a","observation_id":"d4091609-2533-4788-9a25-fb0ca7063412","resolution":{"observed_at":"2026-08-07T12:30:11.753936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.607342Z","title":"Model pruning based on filter similarity for edge device deployment.Frontiers in Neurorobotics, 17:1132679, 2023","venue":null,"work_id":"38b0351b-1892-42ca-afd5-cb1aebdcc498","year":2023},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.835580Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:f3e8bcb9a0d07276ec56335c24f08be1bc707423db0bd0960a6b9bab3abaf6ee","observation_id":"4ea15573-6496-4653-9c74-28f6bedf26cc","resolution":{"observed_at":"2026-08-07T12:30:13.662753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.472754Z","title":"Neural metamorphosis","venue":null,"work_id":"7819ae2d-288d-4581-b66a-dd2248fb1fcb","year":2024},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.906554Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:76a75b8c1982d72695a1c4bcc3c1e2d09bba7af1253cf0ed6cd0f52f96e5151d","observation_id":"d9e962da-cdbe-41c4-b307-6ebef71aa6a3","resolution":{"observed_at":"2026-08-07T12:30:13.538403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.317956Z","title":"Rethinking the smaller-norm-less-informative assumption in channel pruning of convolution layers","venue":null,"work_id":"b53859e1-a522-4e6b-8b33-83af8120ebe0","year":2018},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:11.978856Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:65a66b2d3b718cf1f68f16bfc026fef76eccf1d01042c25613af70f7bb768095","observation_id":"ccb613b8-5cb5-40a6-b236-d6c3a3fa6b81","resolution":{"observed_at":"2026-08-07T12:30:13.400378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.10941","last_updated":"2017-05-31T04:56:25Z","snapshot_observed_at":"2026-08-05T12:22:57.956907Z","submitted_at":"2017-05-31T04:56:25Z","title":"Spectral Norm Regularization for Improving the Generalizability of Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.10941","snapshot_observed_at":"2026-08-07T12:30:12.050286Z","title":"Spectral norm regularization for improving the generalizability of deep learning.arXiv preprint arXiv:1705.10941, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:12.050286Z"},"links":{"cited_paper":"/paper/1705.10941","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:7d6d2f4de238351e39d8e45b0ca49239cfc926713684c63f3fd487d14ec5b45b","observation_id":"31d164b4-ec61-48b2-87a1-9bed53a19259","resolution":{"observed_at":"2026-08-07T12:30:12.050286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.171426Z","title":"Gate decorator: Global filter pruning method for accelerating deep convolutional neural networks.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":"bf9621d3-8a8b-470a-95dd-e0798c562ca6","year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:12.121087Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:2fdca6b5b0e9655f7ad2580d31b93310d5e7dc62bfbc7b255eda28c664b935d7","observation_id":"bbbf23a1-e817-406c-8b58-35470c7015ac","resolution":{"observed_at":"2026-08-07T12:30:13.252857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:13.002145Z","title":"On compressing deep models by low rank and sparse decomposition","venue":null,"work_id":"19ef7545-dcce-4b39-9ab8-fe5c3e683fea","year":2017},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:12.224939Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:81619d1cca87fc014e164d5dd4227da76de7b000326e55f918d8681461d422e0","observation_id":"19c37776-a671-4ed0-9834-b4c32ed4a507","resolution":{"observed_at":"2026-08-07T12:30:13.076371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:30:12.323559Z","title":"Be your own teacher: Improve the performance of convolutional neural networks via self distillation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:12.323559Z"},"links":{"citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:6a9ab1b96447fca0bec4e5225c47bf49012259cbacc5efc59b97bc7e00bc8089","observation_id":"310d3b94-e89e-482a-b1fe-8a4fb9a189f9","resolution":{"observed_at":"2026-08-07T12:30:12.323559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06160","last_updated":"2018-02-02T01:43:54Z","snapshot_observed_at":"2026-07-06T05:00:35.763958Z","submitted_at":"2016-06-20T15:02:31Z","title":"DoReFa-Net: Training Low Bitwidth Convolutional Neural Networks with Low Bitwidth Gradients","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06160","snapshot_observed_at":"2026-08-07T12:30:12.402648Z","title":"layers.0.0.conv1","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:30:12.402648Z"},"links":{"cited_paper":"/paper/1606.06160","citing_paper":"/paper/2505.24469"},"observation_digest":"sha256:0af548c5e1745a82da36a2f0ec2b0f6ab50c82bbcdefee3ae218aed91fe7604e","observation_id":"b59b0ab9-b085-4985-9e5d-5f5a6a4b91f7","resolution":{"observed_at":"2026-08-07T12:30:12.402648Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24469","last_updated":"2025-05-30T11:13:48Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T12:31:08.925480Z","submitted_at":"2025-05-30T11:13:48Z","title":"Smooth Model Compression without Fine-Tuning"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":2,"verified_fuzzy":29},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2505.24469."}