{"as_of":"2026-08-08T06:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:67a8a7ac9f8d56daaffcc24c015cfa3d6bd3d3f961e33e7c3dad6a85714b27d5","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:32:20.014194Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.18758/citation-record","integrity":"/paper/2505.18758/integrity","json":"/paper/2505.18758/citation-record.json","paper":"/paper/2505.18758"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:28.751863Z","title":"Croci, Bo Li, Pashmina Cameron, Martin Jaggi, Dan Alistarh, Torsten Hoefler, and James Hensman","venue":null,"work_id":"3dd8cdaf-764b-40b5-8a01-db90f83254da","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:16.190894Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:7297a98dfff86bf814fc14b3cdc36621bf0f40921d0fe811764252d06220f0ae","observation_id":"40af015c-b43e-4cbc-81e1-a8cdcc552ddf","resolution":{"observed_at":"2026-08-07T14:32:28.797709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:28.585677Z","title":"GPTVQ: The blessing of dimensionality for LLM quantization","venue":null,"work_id":"7a7471fb-ce03-4a31-b640-1796534d39aa","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:16.241300Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:926ea80d626d57e721852b47e743efa77efb713433095042076eff75bad689ae","observation_id":"c51b9444-a97c-4766-a862-6c45b7db9d9c","resolution":{"observed_at":"2026-08-07T14:32:28.654010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:28.464500Z","title":"ONNX: Open neural network exchange, 2019","venue":null,"work_id":"bc6a7edf-e780-4a06-b266-5f42e6fb3265","year":2019},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:16.358834Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:508b0a02686eb88e083c48df552f5574467e454d04ac8f05b4a70e76315bcecf","observation_id":"e4eba4ad-b0b8-47bc-a21b-5627f02ccf0b","resolution":{"observed_at":"2026-08-07T14:32:28.545358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.01741","last_updated":"2022-01-10T15:46:50Z","snapshot_observed_at":"2026-08-07T23:57:25.484522Z","submitted_at":"2022-01-05T18:04:42Z","title":"Understanding Entropy Coding With Asymmetric Numeral Systems (ANS): a Statistician's Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.01741","snapshot_observed_at":"2026-08-07T14:32:16.426671Z","title":"Understanding entropy coding with asymmetric numeral systems (ans): a statistician’s perspective.arXiv preprint arXiv:2201.01741, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:16.426671Z"},"links":{"cited_paper":"/paper/2201.01741","citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:ace5500157294555a705021f2d1fbab1d8fe941348559cf157c4cad815e299c4","observation_id":"b84cb3ec-0010-460b-a007-edfffe9f8604","resolution":{"observed_at":"2026-08-07T14:32:16.426671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:28.273647Z","title":"Bronstein, and Avi Mendelson","venue":null,"work_id":"60d9fef1-5e38-47e1-8bda-231c57ea101e","year":2021},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:16.511794Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:ad7064873f2ea7526b33c6427e0ebf5fb180d04db6df50932d8096bc33a85048","observation_id":"c74d72d4-3de6-4958-b936-3e752748c3cb","resolution":{"observed_at":"2026-08-07T14:32:28.368746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:28.102015Z","title":"NNCodec: An Open Source Software Implementation of the Neural Network Coding ISO/IEC Standard","venue":null,"work_id":"5f31ae05-e801-45db-a060-32364f61d38e","year":2023},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:16.583499Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:6611dc5348f6ac7332f83566a01223da61692335451e981c61421acd5e9a8b4e","observation_id":"dc197d84-ff2f-4ee5-8f6e-447a5cd3dde0","resolution":{"observed_at":"2026-08-07T14:32:28.181108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:27.917252Z","title":"EfficientQAT: Efficient Quantization-Aware Training for Large Language Models, October 2024","venue":null,"work_id":"b0197f5e-a1f1-4615-9fdd-7cfaafe314e1","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:16.640320Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:5de7d440c9a12e000b61c3d39343f97e16df632acf5c91b4d42d2a9fe9fd9a9c","observation_id":"fcc570e4-20a8-4a20-ac16-835174b597f0","resolution":{"observed_at":"2026-08-07T14:32:27.999615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:27.717173Z","title":"Bronstein, and Avi Mendelson","venue":null,"work_id":"bb17a3e8-791a-409f-9722-5044ae663909","year":2019},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:16.729492Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:a3459a774d33f5cb63dc451896e065af9661732019057e181a83d5b118f7ebed","observation_id":"98f4c2c9-2ba9-42fb-823e-77ad995f07db","resolution":{"observed_at":"2026-08-07T14:32:27.831968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:27.548050Z","title":"Universal Deep Neural Network Compres- sion.IEEE Journal of Selected Topics in Signal Processing, 14(4):715–726, May 2020","venue":null,"work_id":"d3671e03-a10a-45a4-9a9b-8550bfbcdbff","year":2020},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:16.835954Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:35defccf0e59831e4ba9cf41aa6c334af4936f3715ca1051faa2b224bd9cc53f","observation_id":"ba0676f6-8c18-4488-aa96-6dc25e01e812","resolution":{"observed_at":"2026-08-07T14:32:27.628117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:16.916800Z","title":"Imagenet: A large- scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:16.916800Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:4dcadb4d3e364bbf97f217a30e514fb4627e6bb2d5df75c032aa3cee25f5e993","observation_id":"2c2e90cb-97c4-455d-b258-6aac7cd8bb31","resolution":{"observed_at":"2026-08-07T14:32:16.916800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:27.349817Z","title":"GPT3.int8(): 8-bit Matrix Multiplication for Transformers at Scale.Neural Information Processing Systems (NeurIPS), January 2022","venue":null,"work_id":"8504b9c8-00f5-4434-bff7-c30365d8510a","year":2022},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:16.971706Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:a599099a2be2ffbea379e9c82395591231f2163f42ca65f4d816455576219562","observation_id":"2c31a623-0c1b-40ab-8873-f52a6e545d96","resolution":{"observed_at":"2026-08-07T14:32:27.442812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:27.136362Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs, May 2023","venue":null,"work_id":"50a2c699-7461-4915-bdb3-b59503f4afe2","year":2023},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.038296Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:79fbc2b56273e7541a3897ba72f48bdd808a1f7ab9461c9cc36168531c690cfa","observation_id":"b61ccbcd-d1ed-45a4-96b9-10487a13ebdc","resolution":{"observed_at":"2026-08-07T14:32:27.226382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:26.952805Z","title":"Svirschevski, Vage Egiazarian, Denis Kuznedelev, Elias Frantar, Saleh Ashkboos, Alexander Borzunov, Torsten Hoefler, and Dan Alistarh","venue":null,"work_id":"3c455df1-2b0c-4c77-8b0f-6fb6d6d9194d","year":2023},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.101095Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:e53e3b7843679ce22ea8006dfbb8606af0c057d4f9a632976d6a5ffc4b9d1b7c","observation_id":"08b72a21-f583-4eba-b37f-99687fdc40e1","resolution":{"observed_at":"2026-08-07T14:32:27.050348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:26.825799Z","title":"The case for 4-bit precision: K-bit Inference Scaling Laws","venue":null,"work_id":"9f086c13-a872-4335-a874-eaa3096b6126","year":2023},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.167832Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:87b654661a79d365e1701bfe00a3c2eae7b7ac77db39224cbd0fdd0b66b17574","observation_id":"7cb383c7-385d-49cc-8c08-2913a1704ae8","resolution":{"observed_at":"2026-08-07T14:32:26.869093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:26.682726Z","title":"STBLLM: Breaking the 1-Bit Barrier with Structured Binary LLMs, August 2024","venue":null,"work_id":"60345384-8135-4102-8cd1-c4e7d87c5aed","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.246176Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:e2e826c6e351a621d0d1f60e488d70b3d0f4fb019a842e8819f264a39eed9ab8","observation_id":"efdb50bb-466a-4a36-b625-99f1d7e75c22","resolution":{"observed_at":"2026-08-07T14:32:26.747986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:26.592497Z","title":"The use of asymmetric numeral systems as an accurate replacement for huffman coding","venue":null,"work_id":"62cf45ef-4871-4ad8-8cf4-c648d00d2dad","year":2015},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.325605Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:f9d76fb4c98e9cf21d129828c499753930e896dcbecf8744947b3b3fe666f984","observation_id":"50f7a082-196c-4b17-b9ab-92101700f1d1","resolution":{"observed_at":"2026-08-07T14:32:26.630506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:26.461224Z","title":"Extreme Compression of Large Language Models via Additive Quantization, September 2024","venue":null,"work_id":"cc530714-ba66-4367-ae58-bd77a741f3fc","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.399995Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:68e5428814f22641f7c3951a083a2244ef8230e73a82181b621711d752cbe7cf","observation_id":"966c4542-3a45-410b-93a2-27b59bc06d25","resolution":{"observed_at":"2026-08-07T14:32:26.543235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:26.325122Z","title":"Optimal Brain Compression: A Framework for Accurate Post- Training Quantization and Pruning","venue":null,"work_id":"2442a090-7eff-43f3-a25b-2ef8b5e12e9b","year":2022},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.461915Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:275b420ad06b0534c532ea89d8a6ee2a5ed0dcdfb4982ff862c2edaff42ed203","observation_id":"a7835023-4e6f-4a04-b6a4-30af7208a150","resolution":{"observed_at":"2026-08-07T14:32:26.389323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:26.243596Z","title":"SparseGPT: Massive Language Models Can Be Accurately Pruned in One-Shot, March 2023","venue":null,"work_id":"372b6b2b-aec8-4cf8-97c4-af8722a493a5","year":2023},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.553273Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:1c79363996f798d80b9db1b7e863ba4a1cbdb05888ffa8168da672de58d1fbef","observation_id":"97d2e906-e906-4fd3-a48c-fb5c6128f318","resolution":{"observed_at":"2026-08-07T14:32:26.279903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:26.162096Z","title":"OPTQ: Accurate quan- tization for generative pre-trained transformers","venue":null,"work_id":"844b7009-5cc2-4a76-9160-00dd65b1ec9b","year":2023},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.633391Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:3ca6bcc302cc50424834f50380f59658531f716a32bbde343b15538db72c948e","observation_id":"11561f6f-8600-4d3d-bc06-6a2290aac634","resolution":{"observed_at":"2026-08-07T14:32:26.200374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:26.046310Z","title":"Compression Scaling Laws:Unifying Sparsity and Quantization, February 2025","venue":null,"work_id":"5de3bed7-2c1b-45b1-8844-afc9aff74194","year":2025},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.690251Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:74ffb73952bf7a101db4d3deab33b756e20be7c3ebd2e0416f7ca151c468ed82","observation_id":"a0f1d2a1-98dd-4ac6-8a23-f0827d426d36","resolution":{"observed_at":"2026-08-07T14:32:26.118695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:25.927414Z","title":"MiniLLM: Knowledge Distillation of Large Language Models","venue":null,"work_id":"ed9997e6-89dc-4e69-9b00-c1111ff310e4","year":2023},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.769125Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:eff9a80bd715bb58aa8eea3bb8239898d98607458b73f84ed4fd6c1ccad95fe7","observation_id":"3805198f-2f45-4af3-a9e4-4bd38bd0eb37","resolution":{"observed_at":"2026-08-07T14:32:25.979526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:25.806561Z","title":null,"venue":null,"work_id":"1c0bb55e-b5d3-4382-9d60-af5b9ac964ee","year":2016},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.836993Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:9ffe8b03d0668c158bb12ae21b8286764ca4820d0fe13c3144b24395a5db7dac","observation_id":"e19cf533-d423-479f-9af8-f067ea7af6d8","resolution":{"observed_at":"2026-08-07T14:32:25.863479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:25.686657Z","title":"NeuZip: Memory-Efficient Training and Inference with Dynamic Compression of Neural Networks, October 2024","venue":null,"work_id":"3253c801-779b-4140-95c0-a9d8cd3f961e","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.905015Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:40bc0fc517a76d51d1d1eb61867dea78dda488f3337e9b9fb8fca60719bf6ce9","observation_id":"29015da6-6314-4e3e-862d-e23f06486f50","resolution":{"observed_at":"2026-08-07T14:32:25.743356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:25.541819Z","title":"Hassibi, D.G","venue":null,"work_id":"c00d8ac1-b192-4f1d-b581-a5a123a6ccd9","year":1993},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:17.992323Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:bacae689d85eac8857d078def83c8c2e6ceb86a3afdc959d1929b34a28097bcc","observation_id":"b56910ea-1476-4b58-98fd-403b3e979413","resolution":{"observed_at":"2026-08-07T14:32:25.630947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:25.423957Z","title":"Deep Residual Learning for Image Recognition","venue":null,"work_id":"eecd07a3-7d5c-419b-91ee-dab78c59a67d","year":2016},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.053367Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:891ebd86b5d0c502d5aa915897cef95083d5e240cadf71d442a67ff53b428658","observation_id":"c06c72ef-c27c-4b0d-9d36-b769f6272758","resolution":{"observed_at":"2026-08-07T14:32:25.469500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:25.248369Z","title":"Model Compression in Practice: Lessons Learned from Practitioners Creating On-device Machine Learning Experi- ences","venue":null,"work_id":"db0ce477-2506-49db-80e9-f2727ecc64b6","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.110251Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:e46ae9c3d490a952aa21fd4a725376342a23b366697268cc457ae42da50707ba","observation_id":"f52202bb-ac7e-4232-94c8-eca58327caa6","resolution":{"observed_at":"2026-08-07T14:32:25.359504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:25.127735Z","title":"Mahoney, Yakun Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"9c4b3205-ee62-4688-85b0-6b8da56245ab","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.187867Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:48fc2834f6fb4cd6a23d4a8f52d363641c47b5e91d62f5b8545deeeb9d6bac82","observation_id":"04780eec-bda4-4ae5-a8b2-4e05c0ba1871","resolution":{"observed_at":"2026-08-07T14:32:25.189720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:24.977090Z","title":"Le, and Hartwig Adam","venue":null,"work_id":"00b1999e-1125-480b-a2e5-9381d4271776","year":2019},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.289283Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:fc8587a945c9399ba21ee89cceac6b96c0f84386dc1ee0804c2f95048d9c07ed","observation_id":"07cebcb8-7ea8-4c33-a4ed-fc6ea06072be","resolution":{"observed_at":"2026-08-07T14:32:25.077667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:24.848405Z","title":"Accurate Post Training Quantization With Small Calibration Sets","venue":null,"work_id":"802f0a56-eaca-4c69-8ef4-adfec4d5458f","year":2021},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.361634Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:5e92d964da6f32f93d950feacb4f41f46fe82941b958946f035ad27371c4ae93","observation_id":"9a27fcbb-35a0-41ce-8a89-2b75d6c075cc","resolution":{"observed_at":"2026-08-07T14:32:24.916723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:24.669571Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":"14fcf74b-b47a-45b7-a87a-61964b7709a0","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.411007Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:2e9617328836c12d9652442da2c644e90d953bee720fe1aa1c1f2d7831a17cfa","observation_id":"cb6914b4-e72e-44da-912b-88c05c479446","resolution":{"observed_at":"2026-08-07T14:32:24.770296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:24.539133Z","title":"Aksu, Miska M","venue":null,"work_id":"edf263aa-537d-44ce-9764-eecc00dfd078","year":2022},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.463769Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:3cefa007c664605d533c25e4baf72d63d079953eb71b8d9224509c95918a483e","observation_id":"7b2c153c-0e14-4d83-8602-23851cdba37d","resolution":{"observed_at":"2026-08-07T14:32:24.589078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:24.393336Z","title":"Adaptive weight compression for memory-efficient neural networks","venue":null,"work_id":"08235e37-86ee-4954-9c94-51e0f632ece8","year":2017},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.535752Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:1fdcee05d5fb3046e0ce08f96ad4da00228379c374ded7038a92dfc825acc2b7","observation_id":"678cbc9e-cf74-4e3f-9650-dce56d55ccca","resolution":{"observed_at":"2026-08-07T14:32:24.467567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:18.611847Z","title":"Cifar-10 (canadian institute for advanced research)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.611847Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:5469facc8217609cfca7439a9ed3419dd2e5882a04eb099c5880d9af05d08a55","observation_id":"0c3747bb-9ab5-48b5-95a3-dcb1e6d96250","resolution":{"observed_at":"2026-08-07T14:32:18.611847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:24.242850Z","title":"Energy-Efficient Model Compression and Splitting for Collaborative Inference Over Time-Varying Channels","venue":null,"work_id":"d12918c4-6003-4492-b03f-ecf40b0e715d","year":2021},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.661478Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:5883b35f3df546f0ba3d3b5f19c67899e45675bb5bd5717c0cbec60a9f516b50","observation_id":"fedf0c03-7b2e-4efa-b589-abb654016c75","resolution":{"observed_at":"2026-08-07T14:32:24.309768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:18.725195Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.725195Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:636f3c233af72cbad8e59c122c2ad3545c06749587164973cd5a3031c123b9b2","observation_id":"f19237d7-95f6-4def-ad28-268ca16b2138","resolution":{"observed_at":"2026-08-07T14:32:18.725195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:24.110322Z","title":"Memory Efficient Optimizers with 4-bit States.Advances in Neural Information Processing Systems, 36:15136–15171, December 2023","venue":null,"work_id":"98a4093e-a5e3-4ec5-a0c6-28fab34737c7","year":2023},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.777724Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:3c6515f7f8b8882b9d7711f422920bd5630b74673567167f52f20d01e6ff8996","observation_id":"49b08133-2996-49c4-9b5a-a3a463600a6f","resolution":{"observed_at":"2026-08-07T14:32:24.193718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:24.007560Z","title":"PENNI: Pruned Kernel Sharing for Efficient CNN Inference","venue":null,"work_id":"ea2c2525-9a09-43ff-b1c1-e93434a55dba","year":2020},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.879989Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:934b9aff3253077b10188d392add4170d78cf65a4cd201c8709decd78382f256","observation_id":"ea0ff6d2-256e-4297-bb5e-61e19044e52c","resolution":{"observed_at":"2026-08-07T14:32:24.038562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:23.859419Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration, April 2024","venue":null,"work_id":"007b269c-251d-40ec-89a1-8f5663d85c4c","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:18.942144Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:2705cd96b7de96079b9815bca9206755a172faec8f641afd545a51b453d7330e","observation_id":"acbd46d8-c6fd-4c0b-9d62-f3bfd2794fb1","resolution":{"observed_at":"2026-08-07T14:32:23.928089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:23.676650Z","title":"Cambridge university press, 2003","venue":null,"work_id":"040aa143-3767-46be-bc3e-f7f5a1dda9b5","year":2003},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.009752Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:eab855406e8a05d7599379ccb5cd79a0b5d21a719a1d532731f768c092c39055","observation_id":"47fc9a82-5229-4550-931c-928db5094e91","resolution":{"observed_at":"2026-08-07T14:32:23.749967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:23.489455Z","title":"Range encoding: an algorithm for removing redundancy from a digitised message","venue":null,"work_id":"3462fefb-f315-44aa-a891-f34471696c99","year":1979},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.078862Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:9c1825b1ae6aec9e48b20e0514521fc5fcdc01b8c05778a868d0b8792a2f1684","observation_id":"2812bc00-7f8b-45f5-a989-3b49903e3ae6","resolution":{"observed_at":"2026-08-07T14:32:23.570244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:23.333402Z","title":"Up or Down? Adaptive Rounding for Post-Training Quantization","venue":null,"work_id":"301e3173-077a-48ad-a0a5-6ceef2e4de5b","year":2020},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.142752Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:7f437180fbba7d0d36047b85d0dd28e0d3ae1e6c4c361acb51fcf4da11741a56","observation_id":"b6c3659e-7fcb-4b0e-baf2-a7b7ec128f50","resolution":{"observed_at":"2026-08-07T14:32:23.422163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:23.186162Z","title":"A White Paper on Neural Network Quantization, June 2021","venue":null,"work_id":"99a68929-4bf5-411c-a470-5ad79e7dcc83","year":2021},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.217951Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:8ec06f6f8b5e98f17fb89517552d905b793229cbf2f1f1d61ccabcc78b5f09c9","observation_id":"82cadcdb-dc92-4d6c-a9ed-4b73d51897fe","resolution":{"observed_at":"2026-08-07T14:32:23.259329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:23.018058Z","title":"Kübler, Jiaji Huang, Matthäus Kleindessner, Jun Huan, V olkan Cevher, Yida Wang, and George Karypis","venue":null,"work_id":"6a0671a9-0fed-46dc-a6fc-1db35227e3e6","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.307019Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:b57a29488a973b59f756bfe54370375f2940af806e2b86e72abedfeaef85659f","observation_id":"83cc05eb-0e6b-4970-9389-f3788a22d706","resolution":{"observed_at":"2026-08-07T14:32:23.089866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:22.840929Z","title":"PhD thesis, Stanford University CA, 1976","venue":null,"work_id":"cc5a8c51-f509-4e53-b92b-eb659a49d593","year":1976},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.342907Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:512dc4ecc19a6d4deacb56150180185a582d2f2c997d2ff9b9ebbfe5d3eed0cc","observation_id":"0a6ff35c-4c2c-4566-8937-aa287d1d91a3","resolution":{"observed_at":"2026-08-07T14:32:22.904461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:22.642389Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library, December 2019","venue":null,"work_id":"1754747d-09b7-47ae-93b3-f649cb625fc8","year":2019},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.398920Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:cde66e8df4051a91de245e81f92ede3d81465c6fac8465518acdee6547a79e11","observation_id":"1bd47c1e-0df3-47ac-8a80-3fd74b0e4fb3","resolution":{"observed_at":"2026-08-07T14:32:22.735567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:22.435451Z","title":"Accurate LoRA-Finetuning Quantization of LLMs via Information Retention, May 2024","venue":null,"work_id":"b304c439-b560-48a1-b83e-d7dda0f88637","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.468784Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:e7fbfc21fd7b602721aacac96811b685c597949473b4640b7bb24816b630408f","observation_id":"8f6cb52b-a8e6-426b-84ce-e94e6f2d0d79","resolution":{"observed_at":"2026-08-07T14:32:22.532664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:22.175413Z","title":"Arithmetic coding.IBM Journal of research and development, 23(2):149–162, 1979","venue":null,"work_id":"566af6f8-df5c-48b5-a904-3d99541a53d8","year":1979},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.525797Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:55c32e0955d6588cafe329cfb6218422971fadb1a06b67f4bec40f3dfd3796cf","observation_id":"d191c42e-5b74-4010-8c30-85b192be3aa7","resolution":{"observed_at":"2026-08-07T14:32:22.305396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:21.965336Z","title":null,"venue":null,"work_id":"5672ffda-c505-45c7-9ee4-fd91e3172211","year":2023},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.581936Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:57d0733168c182c93434858d5bfc472ff08a306653a2db1a42d18cf21a5d1ba9","observation_id":"8e4c1547-574d-463d-8438-b1084a7d111c","resolution":{"observed_at":"2026-08-07T14:32:22.087711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:19.697752Z","title":null,"venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.697752Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:332fd1ceb241d3ce425a99b211dd9c4e14dea37b7b4724e5bedc5e57d6300d68","observation_id":"6a844d03-f3cc-46d2-b71b-58b23dce5c2c","resolution":{"observed_at":"2026-08-07T14:32:19.697752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:21.786362Z","title":"FlexGen: High-Throughput Generative Infer- ence of Large Language Models with a Single GPU","venue":null,"work_id":"c73ad81b-ae53-4e58-a3bd-1b6930c2a51e","year":2023},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.716104Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:d67485adf5a99fb6114f45119e19a381da2c25168bd1ac18d71167247f85867e","observation_id":"dfbe890b-d91c-4e24-ab30-706c230288ce","resolution":{"observed_at":"2026-08-07T14:32:21.889948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:21.612865Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","venue":null,"work_id":"3f7b19b5-64fd-4011-94a8-919c0c34fd7e","year":2015},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.719781Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:b259b9eff2440ee0ae0ec82e5ce0efe2a169c94bab154fa368289508016bac9b","observation_id":"a30e67ad-c023-49aa-b021-828605eae64c","resolution":{"observed_at":"2026-08-07T14:32:21.699086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:21.411366Z","title":"Zico Kolter","venue":null,"work_id":"14b68d09-7f4d-4751-81a9-f1e6e74f335a","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.756556Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:cf008dc3f6b6219030fcee58065dc50773e2f08bc3daee9beae3e40c0c270a28","observation_id":"72310331-4608-482e-aaa2-4249c9bdf1dc","resolution":{"observed_at":"2026-08-07T14:32:21.525600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:21.213293Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks, June 2024","venue":null,"work_id":"99e5e9b6-ad8d-4612-937b-5f2ea42a70f4","year":2024},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.797300Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:b8d7d8627f49198fc14372282029f50b81656b588fef7c3a96e711f7d8d86625","observation_id":"7748fb8f-49b8-4b7e-9827-2715c1895a00","resolution":{"observed_at":"2026-08-07T14:32:21.316087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:21.032963Z","title":"DeepCABAC: A Universal Compression Algorithm for Deep Neural Networks.IEEE Journal of Selected Topics in Signal Processing, 14(4):700–714, May 2020","venue":null,"work_id":"d225bda6-42db-4c70-897d-a8e8413cb682","year":2020},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.843328Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:3d04e482c65b99b8639520598ccd58498bf34b2cccdd0cf62bc338283866d69f","observation_id":"caf8093d-eec4-4c4a-9e22-05a1ea09391a","resolution":{"observed_at":"2026-08-07T14:32:21.114329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:20.783377Z","title":"Compact and computationally efficient representation of deep neural networks.IEEE Transactions on Neural Networks and Learning Systems, 31(3):772–785, 2020","venue":null,"work_id":"fc9f9f99-4d40-422f-aae4-827a68963019","year":2020},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.886008Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:335e5e37e1014e6af1c2fc930344ac6314083c0cde984b92c5ca178987fd2450","observation_id":"11aceea7-f138-4598-bd53-90a71d68a4c1","resolution":{"observed_at":"2026-08-07T14:32:20.902614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:20.478169Z","title":"Variational bayesian quantization","venue":null,"work_id":"3de562d5-2dd7-4a03-b59b-d5af7d661732","year":2020},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:19.927150Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:f851352279cdba18a265ea4c7277c7d856dc1d08adf7773aab880b17135fb3cc","observation_id":"085bb2b5-222b-4ca7-90dd-5f27afcb3923","resolution":{"observed_at":"2026-08-07T14:32:20.620742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:20.175097Z","title":"optimally compensate","venue":null,"work_id":"c25f8fab-af08-45dd-9e96-7e4d920f85cf","year":1985},"citing_paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:20.014194Z"},"links":{"citing_paper":"/paper/2505.18758"},"observation_digest":"sha256:d357cefd51aea6b2071bf73d4b08bbefe2cfe7393d01f9c0f5146a27ca00574b","observation_id":"cc116959-51fc-4bd1-8ffe-bdb6979cacb7","resolution":{"observed_at":"2026-08-07T14:32:20.341654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.18758","last_updated":"2025-05-24T15:52:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T03:52:49.784478Z","submitted_at":"2025-05-24T15:52:49Z","title":"Reducing Storage of Pretrained Neural Networks by Rate-Constrained Quantization and Entropy Coding"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":51},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2505.18758."}