{"as_of":"2026-08-18T06:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7c0e9ac4a50a0f6d6f9015ca13c27447d019966901e22ed55ddd6a1827664b60","coverage":[{"denominator":115,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:13:19.861392Z","state":"measured"},{"denominator":108,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":108,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T11:46:50.520083Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T15:45:48.761436Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":"2505.05530","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05530","snapshot_observed_at":"2026-07-01T15:45:48.761436Z","title":"arXiv preprint arXiv:2505.05530 , year=","venue":null,"work_id":"1e774860-eac0-4be9-981e-1b6fd9fa75fb","year":2025},"citing_paper":{"arxiv_id":"2604.03420","last_updated":"2026-05-08T06:46:47Z","snapshot_observed_at":"2026-07-31T05:51:44.917483Z","submitted_at":"2026-04-03T19:33:25Z","title":"Zero-Shot Quantization via Weight-Space Arithmetic","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T20:07:41.196837Z"},"links":{"cited_paper":"/paper/2505.05530","citing_paper":"/paper/2604.03420"},"observation_digest":"sha256:d7dcf46ae03e2ab53c10c36b10a3454d329f13a8c588170f14fe0e442ad5eb85","observation_id":"a2ed310a-1707-4cc8-b7c9-254c3c8be47d","resolution":{"observed_at":"2026-05-13T20:08:12.603473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":"2505.05530","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05530","snapshot_observed_at":"2026-07-01T15:45:48.761436Z","title":"arXiv preprint arXiv:2505.05530 , year=","venue":null,"work_id":"1e774860-eac0-4be9-981e-1b6fd9fa75fb","year":2025},"citing_paper":{"arxiv_id":"2604.09220","last_updated":"2026-04-10T11:26:09Z","snapshot_observed_at":"2026-08-12T21:33:05.141887Z","submitted_at":"2026-04-10T11:26:09Z","title":"TinyNeRV: Compact Neural Video Representations via Capacity Scaling, Distillation, and Low-Precision Inference","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-10T18:29:43.498730Z"},"links":{"cited_paper":"/paper/2505.05530","citing_paper":"/paper/2604.09220"},"observation_digest":"sha256:accf1380e79b3d4e87b5988ec405b579467761521e763e4da8096447ca25e05b","observation_id":"29cfaa74-df41-4ec8-a78d-fe5a7e64354a","resolution":{"observed_at":"2026-05-11T00:30:52.255853Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":"2505.05530","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05530","snapshot_observed_at":"2026-07-01T15:45:48.761436Z","title":"arXiv preprint arXiv:2505.05530 , year=","venue":null,"work_id":"1e774860-eac0-4be9-981e-1b6fd9fa75fb","year":2025},"citing_paper":{"arxiv_id":"2605.10933","last_updated":"2026-05-20T17:26:14Z","snapshot_observed_at":"2026-08-16T09:01:03.343803Z","submitted_at":"2026-05-11T17:58:28Z","title":"DECO: Sparse Mixture-of-Experts with Dense-Comparable Performance on End-Side Devices","version":1},"reference_index":179,"source":"arxiv_source","source_observed_at":"2026-05-12T03:36:12.915133Z"},"links":{"cited_paper":"/paper/2505.05530","citing_paper":"/paper/2605.10933"},"observation_digest":"sha256:f482473bc7737ca5e79c33a498ff24ec5eff51df6eab9187ce0c19febe673845","observation_id":"d8d30dce-ae4f-479e-a965-2c7e9174fa02","resolution":{"observed_at":"2026-05-12T03:36:20.006448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":"2505.05530","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05530","snapshot_observed_at":"2026-07-01T15:45:48.761436Z","title":"arXiv preprint arXiv:2505.05530 , year=","venue":null,"work_id":"1e774860-eac0-4be9-981e-1b6fd9fa75fb","year":2025},"citing_paper":{"arxiv_id":"2605.10933","last_updated":"2026-05-20T17:26:14Z","snapshot_observed_at":"2026-08-16T09:01:03.343803Z","submitted_at":"2026-05-11T17:58:28Z","title":"DECO: Sparse Mixture-of-Experts with Dense-Comparable Performance on End-Side Devices","version":2},"reference_index":179,"source":"arxiv_source","source_observed_at":"2026-05-13T07:29:14.545746Z"},"links":{"cited_paper":"/paper/2505.05530","citing_paper":"/paper/2605.10933"},"observation_digest":"sha256:a64481eb0f7a0e1155e9fa9db926da000de769123e5f20c7d0a2abf756692e74","observation_id":"01dbdfb9-1caf-4e20-9e3d-ba1aa9cd5d94","resolution":{"observed_at":"2026-05-13T07:32:30.232726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":"2505.05530","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05530","snapshot_observed_at":"2026-07-01T15:45:48.761436Z","title":"arXiv preprint arXiv:2505.05530 , year=","venue":null,"work_id":"1e774860-eac0-4be9-981e-1b6fd9fa75fb","year":2025},"citing_paper":{"arxiv_id":"2605.10933","last_updated":"2026-05-20T17:26:14Z","snapshot_observed_at":"2026-08-16T09:01:03.343803Z","submitted_at":"2026-05-11T17:58:28Z","title":"DECO: Sparse Mixture-of-Experts with Dense-Comparable Performance on End-Side Devices","version":3},"reference_index":179,"source":"arxiv_source","source_observed_at":"2026-05-21T07:57:49.746594Z"},"links":{"cited_paper":"/paper/2505.05530","citing_paper":"/paper/2605.10933"},"observation_digest":"sha256:fe14ce0d00103762504833d92eef4a676a763e24aa95cedd0c96364a042cf95b","observation_id":"088da7db-f95a-4ad4-9896-94c0b86e197a","resolution":{"observed_at":"2026-05-21T07:59:50.126006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":"2505.05530","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05530","snapshot_observed_at":"2026-07-01T15:45:48.761436Z","title":"arXiv preprint arXiv:2505.05530 , year=","venue":null,"work_id":"1e774860-eac0-4be9-981e-1b6fd9fa75fb","year":2025},"citing_paper":{"arxiv_id":"2605.17997","last_updated":"2026-05-18T07:51:49Z","snapshot_observed_at":"2026-08-16T20:09:44.271449Z","submitted_at":"2026-05-18T07:51:49Z","title":"MARR: Module-Adaptive Residual Reconstruction for Low-Bit Post-Training Quantization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T12:56:48.177386Z"},"links":{"cited_paper":"/paper/2505.05530","citing_paper":"/paper/2605.17997"},"observation_digest":"sha256:45e869ed5129de6cb0e0bc4e3534a8be7c4fd9826e1d508fa7d17e8713268039","observation_id":"d241124c-6c77-482f-a11a-e77cc63a4737","resolution":{"observed_at":"2026-05-20T12:58:17.777018Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":"2505.05530","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05530","snapshot_observed_at":"2026-07-01T15:45:48.761436Z","title":"arXiv preprint arXiv:2505.05530 , year=","venue":null,"work_id":"1e774860-eac0-4be9-981e-1b6fd9fa75fb","year":2025},"citing_paper":{"arxiv_id":"2606.28421","last_updated":"2026-07-08T14:55:43Z","snapshot_observed_at":"2026-07-12T11:46:49.191265Z","submitted_at":"2026-06-25T17:14:03Z","title":"JuZhou 1.0 Technical Report: The First Edge-Native Text-to-Image Foundation Model Trained Entirely on China-Developed AI Accelerators","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T01:02:20.024793Z"},"links":{"cited_paper":"/paper/2505.05530","citing_paper":"/paper/2606.28421"},"observation_digest":"sha256:3adf740d3e5a4e9ca2a417c5281c171023cc16c3ccc9b99a6f59111c6ac1c501","observation_id":"da34c941-e438-4ce0-8660-5a33c323c6c7","resolution":{"observed_at":"2026-07-01T15:45:48.762968Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05530","snapshot_observed_at":"2026-07-12T11:46:50.520083Z","title":"Low-bit model quantization for deep neural networks: A survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.28421","last_updated":"2026-07-08T14:55:43Z","snapshot_observed_at":"2026-07-12T11:46:49.191265Z","submitted_at":"2026-06-25T17:14:03Z","title":"JuZhou 1.0 Technical Report: The First Edge-Native Text-to-Image Foundation Model Trained Entirely on China-Developed AI Accelerators","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-12T11:46:50.520083Z"},"links":{"cited_paper":"/paper/2505.05530","citing_paper":"/paper/2606.28421"},"observation_digest":"sha256:de67a37575029a1e1fc7bf60e6f4c1a9b83a4f9ca15b85e74a5fc1f9553f774c","observation_id":"498a9f54-498e-45fa-9745-2b9a6764cc15","resolution":{"observed_at":"2026-07-12T11:46:50.520083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.05530/citation-record","integrity":"/paper/2505.05530/integrity","json":"/paper/2505.05530/citation-record.json","paper":"/paper/2505.05530"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.301573Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.301573Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:c091fd179bd5a086f9b3fe59dc02c4543b6d8ae90bf223800bae4af7364f92da","observation_id":"d4c433dc-e64d-4bc7-8dc8-955244e2d58d","resolution":{"observed_at":"2026-08-15T23:13:19.301573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.307627Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.307627Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:fef3fe4503a4c08325b7f3f90748828c5c49def444dc4be2e0a1d9c0aa66184e","observation_id":"7c9f85dd-55e2-4cbc-b044-6ecf5af51e1d","resolution":{"observed_at":"2026-08-15T23:13:19.307627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-15T23:13:19.313653Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.313653Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:00b6851ef7d87281d72bafec10d989b2dba0e5ea87edbafadedcd5c87a1c5eef","observation_id":"ad231187-c68c-4996-bcd4-223664066619","resolution":{"observed_at":"2026-08-15T23:13:19.313653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.320456Z","title":"Stanford alpaca: An instruction- following llama model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.320456Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:9109ed2938d85424fdcb7ce182e577a3ee2bcecf15ae876efa8e81684d04888e","observation_id":"de0fffe7-7431-4478-bcd4-a6bc94ac23b3","resolution":{"observed_at":"2026-08-15T23:13:19.320456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.325860Z","title":"The flan collection: Designing data and methods for effective instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.325860Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:febf9b44f0a3ffe07fb2dcdfb0094d147a067a247eb0749ec814719146fb633d","observation_id":"7c8247db-e210-48d4-bced-65a5883417c7","resolution":{"observed_at":"2026-08-15T23:13:19.325860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.331391Z","title":"Squad: 100,000+ questions for machine comprehension of text,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.331391Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:6b54172ba9d31dd82cfffae8755f40d8181428cc12bff6018295b9a5479b959e","observation_id":"0b3dec0d-62e1-48f5-aad9-f71b897218ac","resolution":{"observed_at":"2026-08-15T23:13:19.331391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.337284Z","title":"The penn treebank: annotating predicate argument structure,","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.337284Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:d1983093dfd618470ca51b234b0ab5c1352334b99e281d9c57476b9d72a05c56","observation_id":"ccd6baba-56b0-4b14-845a-8a3a7ccc11ee","resolution":{"observed_at":"2026-08-15T23:13:19.337284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.342577Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.342577Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:98214a3f23f85c903493181825781cf282efdd67ce97a86a5474abf6120eaabf","observation_id":"08cb68cb-d43c-495e-88ff-37b35be21364","resolution":{"observed_at":"2026-08-15T23:13:19.342577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.347448Z","title":"Super-naturalinstructions: Generalization via declarative instructions on 1600+ nlp tasks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.347448Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:fd770889c67e4c7079865c95c4943664038a1165c482f16eb9442fc29e7757ab","observation_id":"6fe00d19-7168-4563-bb3a-87f0cb87066d","resolution":{"observed_at":"2026-08-15T23:13:19.347448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.353409Z","title":"Piqa: Reasoning about physical commonsense in natural language,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.353409Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:37cfa0d5a36d0207743007603043431b94ab5ee2718201a8f7077949e60a0dd8","observation_id":"16d7adfe-f2f4-4780-ad5b-3618f7971f4d","resolution":{"observed_at":"2026-08-15T23:13:19.353409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.360380Z","title":"Hellaswag: Can a machine really finish your sentence?","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.360380Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:8d6fdf6b660c685fcd5ca08262e718a1adb753f6b349e3d389c2450fcd0aea5e","observation_id":"84168dd0-f48a-41ac-858c-aa153cd7b27f","resolution":{"observed_at":"2026-08-15T23:13:19.360380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.366110Z","title":"Wino- grande: An adversarial winograd schema challenge at scale,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.366110Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:cb708a14f8e48a1f7091b3c6cb63d276c98b1aa38fe2efef4ec6694ec3aa70f8","observation_id":"b0ac00a0-d44f-4331-830a-12e3afaaccbc","resolution":{"observed_at":"2026-08-15T23:13:19.366110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.371754Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.371754Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:e046a21aeb5a8eff02efe076caae93fb185a6f52b596579271443d372f69ad25","observation_id":"1c37cafe-eab3-4842-adaa-16e302cbae4f","resolution":{"observed_at":"2026-08-15T23:13:19.371754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-15T23:13:19.377457Z","title":"Opt: Open pre-trained transformer language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.377457Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:4e89eacf5bf2cb06eebc9e042fbc22f56f4a0691e9c89272e3048aaab94a9e44","observation_id":"22d826d9-34f1-4800-83f5-b4cc49affddc","resolution":{"observed_at":"2026-08-15T23:13:19.377457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-15T23:13:19.383064Z","title":"Bloom: A 176b-parameter open-access multilingual language model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.383064Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:a902bb1338c2b9eca902f8d176dd0f5106fee732aad922cb4a286752a05a751f","observation_id":"dec6f935-5ee6-4d0f-91a8-a93cbdb3e141","resolution":{"observed_at":"2026-08-15T23:13:19.383064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.388790Z","title":"Glm-130b: An open bilingual pre-trained model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.388790Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:f2d79f07009da56743ea12cf9f90788764e7a5e08239c2e85acd09dcf9729393","observation_id":"ca5d9ce6-7ad0-4b55-9359-7c3af10f133a","resolution":{"observed_at":"2026-08-15T23:13:19.388790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11990","last_updated":"2022-02-04T18:02:23Z","snapshot_observed_at":"2026-08-09T17:07:26.804289Z","submitted_at":"2022-01-28T08:59:57Z","title":"Using DeepSpeed and Megatron to Train Megatron-Turing NLG 530B, A Large-Scale Generative Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11990","snapshot_observed_at":"2026-08-15T23:13:19.393781Z","title":"Using deepspeed and megatron to train megatron-turing nlg 530b, a large-scale generative language model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.393781Z"},"links":{"cited_paper":"/paper/2201.11990","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:b89c4d917be30aecabbd99d56162f1240dc675a531fb6b7f9c7b27feb6198efd","observation_id":"6bc31284-9388-4808-95ec-b520ae9a210e","resolution":{"observed_at":"2026-08-15T23:13:19.393781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T23:13:19.399411Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.399411Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:4c7b70bda10b73b978f86dd585dbdbe0e21ff4c1b8a378ae3a1186db824aad7d","observation_id":"3cdf1d09-e01d-4e0b-a0b9-5677059a34f5","resolution":{"observed_at":"2026-08-15T23:13:19.399411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16867","snapshot_observed_at":"2026-08-15T23:13:19.405130Z","title":"The falcon series of open language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.405130Z"},"links":{"cited_paper":"/paper/2311.16867","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:3571df338b9bbffa69ff4eb8fb5991a2c51b4360400f2256cdc74733803ad4ee","observation_id":"df12727a-21cb-46ab-98a4-79ea8d457b2c","resolution":{"observed_at":"2026-08-15T23:13:19.405130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-15T23:13:19.411197Z","title":"Mixtral of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.411197Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:6032a5d730b87402529315f5497ab2f296188c6995747edf191ea0ee08cb1b1e","observation_id":"3672858d-5088-413b-885b-4370345dedfd","resolution":{"observed_at":"2026-08-15T23:13:19.411197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.416763Z","title":"Bert: Pre- training of deep bidirectional transformers for language under- standing,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.416763Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:f59556700f64e5b54271ae1c87e86e0ed3979f077118044b1f445f725577e361","observation_id":"e6babd0f-a2c7-47de-b7f5-7125fe98c1f3","resolution":{"observed_at":"2026-08-15T23:13:19.416763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-15T23:13:19.424439Z","title":"Roberta: A ro- bustly optimized bert pretraining approach,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.424439Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:defeeeb8c9efb499ed8a77f0515d691e4bc934c3fe96fc742c2d92a14caad632","observation_id":"374d54f2-233d-4f67-ab84-6d7a2fa89782","resolution":{"observed_at":"2026-08-15T23:13:19.424439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.433508Z","title":"Xlnet: Generalized autoregressive pretraining for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.433508Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:9aa6bb67f109e215979aeba5a9cfb50ecd7f7baa6cd863fdefb5d8179a1933c0","observation_id":"f7ea281b-ef24-4523-bc03-cee510a8d9d2","resolution":{"observed_at":"2026-08-15T23:13:19.433508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.440135Z","title":"Gpt-j-6b: A 6 billion parameter autoregressive language model,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.440135Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:7db562289c12d33b43ed5113de774db7e5dfbfbda8429edd8b5615992fd7047d","observation_id":"c7376160-75d2-4927-957c-6695b45996b5","resolution":{"observed_at":"2026-08-15T23:13:19.440135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06745","last_updated":"2022-04-14T04:00:27Z","snapshot_observed_at":"2026-08-13T14:54:27.001192Z","submitted_at":"2022-04-14T04:00:27Z","title":"GPT-NeoX-20B: An Open-Source Autoregressive Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06745","snapshot_observed_at":"2026-08-15T23:13:19.445717Z","title":"Gpt-neox-20b: An open-source autoregressive language model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.445717Z"},"links":{"cited_paper":"/paper/2204.06745","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:9bad995ddf103d34edcd2dc865de23f387759ac190fd96f9ac34478691835028","observation_id":"b83c480b-c9e5-416f-abf0-47e0637d48ff","resolution":{"observed_at":"2026-08-15T23:13:19.445717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-15T23:13:19.451214Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.451214Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:7c322fda122e007fe0b7c7f856e2f399109f9043acccbd5c59b7f6eaba56ffdf","observation_id":"c3ced501-4c15-4227-adbb-fb26f8be21f3","resolution":{"observed_at":"2026-08-15T23:13:19.451214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.457415Z","title":"Starcoder: may the source be with you!","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.457415Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:7e722e140f9a6450b590e4ce2b21ee819187721e335dce254cea32973ff829e6","observation_id":"80ac65f1-8fdf-4fb1-b5c6-2b6008d72bf7","resolution":{"observed_at":"2026-08-15T23:13:19.457415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-15T23:13:19.466372Z","title":"Gemma: Open models based on gemini research and technology,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.466372Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:ef5621aac0363c55e74179ca28dc0969fa2834c47d425587c5138f8d2e2266e8","observation_id":"a91eb1cf-6e9d-44f0-b042-b32e60b4baac","resolution":{"observed_at":"2026-08-15T23:13:19.466372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.473232Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.473232Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:7f5743989051071f4685eac09aebf41561ae6e3332550963576ae33050358125","observation_id":"1c272069-a21a-4d17-97ef-8304646565ff","resolution":{"observed_at":"2026-08-15T23:13:19.473232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.478220Z","title":"Zeroquant: Efficient and affordable post-training quantization for large-scale transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.478220Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:670677cc7f691cfb1dce0b65100b9a7c52efc426484b3d0da98ef222dbc7972d","observation_id":"d31ea53e-08d8-4148-bf08-06079fe7f90d","resolution":{"observed_at":"2026-08-15T23:13:19.478220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.483884Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.483884Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:dfe33633e4dbaf3228ac395410bebdd113b43996c50dc82518194afd14df2b70","observation_id":"7b8f45e1-2105-4996-9752-0fff3816dc08","resolution":{"observed_at":"2026-08-15T23:13:19.483884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.490788Z","title":"Squeezellm: Dense-and-sparse quanti- zation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.490788Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:3c78f9fbdf526c89ab05d695acc465f41bdc969a325ec3b1f50c50437314003e","observation_id":"7dbec1fb-aa5e-4346-88d9-ad669cbc4ed8","resolution":{"observed_at":"2026-08-15T23:13:19.490788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.496455Z","title":"Q-bert: Hessian based ultra low precision quantization of bert,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.496455Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:20d6458b8fa095240962d588ac5422336627c852a7ee2749e42b76bcd8fe0d1a","observation_id":"b4314687-587d-484e-adf0-2c223c6b8d54","resolution":{"observed_at":"2026-08-15T23:13:19.496455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.502538Z","title":"Qlora: Efficient finetuning of quantized llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.502538Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:086970fa744808f225d46bd803f2ece4f398b1abf0b8523bab8e8343b39f2610","observation_id":"d05075f5-2395-49c7-be44-9150fd1098e6","resolution":{"observed_at":"2026-08-15T23:13:19.502538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.508287Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.508287Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:8a9c8edc91802e76c8a87d39438dd9499195d73841fb5ce66154e2d1d14967b1","observation_id":"51cd4fc9-28f7-41f3-884f-8b4d8126dc16","resolution":{"observed_at":"2026-08-15T23:13:19.508287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.513481Z","title":"Spqr: A sparse-quantized representation for near-lossless llm weight compression,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.513481Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:65d753facf337a922257dd66a0ef52eb41f90fe8b457065f85a574d235969fd8","observation_id":"6787e335-578c-4eeb-a480-69c967f29cc5","resolution":{"observed_at":"2026-08-15T23:13:19.513481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.518391Z","title":"Awq: Activation-aware weight quantization for llm compression and acceleration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.518391Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:85bfe5e89005c3c1a554a0391d8ddbc0a0adb10bd7b874d6693330213708f38c","observation_id":"7d21d452-8d91-4c81-b5ce-5eca502624e4","resolution":{"observed_at":"2026-08-15T23:13:19.518391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.523916Z","title":"Training with quantization noise for extreme model compression,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.523916Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:914e6748a8ac18b59d4d23025b10df66321521b62c0d967253570c6b9e2a2ffe","observation_id":"1031e4fc-9521-4848-a71e-0e8d7d1ef6c4","resolution":{"observed_at":"2026-08-15T23:13:19.523916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.528929Z","title":"Obelics: An open web-scale filtered dataset of interleaved image-text documents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.528929Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:a3cb3461e2bbfd8f950b15360e3b3a7e8f69e50dae9cc7465047f67cb57f8449","observation_id":"3b955b59-d53a-4e20-88f8-87357c151536","resolution":{"observed_at":"2026-08-15T23:13:19.528929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.534387Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.534387Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:fc95a29f1f7ba5d7902d9775afc1babe96b08a06f6545c3522d9485e20bfbe8a","observation_id":"428ce152-9e8a-45f2-acca-d8a11948464f","resolution":{"observed_at":"2026-08-15T23:13:19.534387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.539647Z","title":"Wit: Wikipedia-based image text dataset for multimodal multilin- gual machine learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.539647Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:ef0bccc27d3503c3e99c079a890622afdb966d39de8185890c6f3b0275ac4688","observation_id":"93f2e3d4-016a-4efd-99db-23e35796e85a","resolution":{"observed_at":"2026-08-15T23:13:19.539647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.544978Z","title":"Gqa: A new dataset for real- world visual reasoning and compositional question answering,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.544978Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:0478cdc38f6d191303523dc63c4f624cc958509b470f1790226b606725b421b1","observation_id":"2fb15a19-b065-401b-980b-ad80e07494cc","resolution":{"observed_at":"2026-08-15T23:13:19.544978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.550543Z","title":"Towards vqa models that can read,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.550543Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:d7a1a84e3089c610152cef50ec3318ef968aa8e34bd0e842769945fad6fa6651","observation_id":"4b9cdd58-e13b-44f4-8fba-c1394432df23","resolution":{"observed_at":"2026-08-15T23:13:19.550543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.556053Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.556053Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:c11285e8a5b2b5d96767088d5c119c964c91b178fef79161c08077e1136c53bc","observation_id":"a33d66cb-8069-4f73-ad12-c5bd4fa41f11","resolution":{"observed_at":"2026-08-15T23:13:19.556053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.561966Z","title":"Vizwiz grand challenge: Answering visual questions from blind people,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.561966Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:288149d54df211b48e87ac3a89e00e6f76a1a1da5d4d588a046cccd70c8922db","observation_id":"64afc370-ae94-47b2-9e70-598a6fd7f437","resolution":{"observed_at":"2026-08-15T23:13:19.561966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.567377Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.567377Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:ba2e5df58ae274ebc9b641af08ff3266851e122435ac43a8a2940e0b8233aada","observation_id":"bab56926-1c31-4e04-8786-205c4bf1c8b2","resolution":{"observed_at":"2026-08-15T23:13:19.567377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:23.561550Z","title":"Openflamingo: An open-source framework for training large autoregressive vision-language models,","venue":null,"work_id":"9dcd228e-7a4c-443f-a4b4-6287377422a9","year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.573035Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:557aa95a61a61874f0b2e6e30badcf57eb39e4af61f42b86bd7f4c9223485a40","observation_id":"a77461eb-31cd-413c-8188-d06065b286e4","resolution":{"observed_at":"2026-08-15T23:13:23.567451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:23.543119Z","title":"Noisyquant: Noisy bias-enhanced post-training activation quanti- zation for vision transformers,","venue":null,"work_id":"df0bb818-110d-41a6-a7f3-49c5ae70b61e","year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.578203Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:7dc615c57effd9dec0f2d582a82671cd7b76128ea39e0037065ae4a236fc992e","observation_id":"00f8d0aa-8305-4f75-b696-2a5e484d3cb1","resolution":{"observed_at":"2026-08-15T23:13:23.548794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.583664Z","title":"Imagenet large scale visual recognition challenge,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.583664Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:1bfd9cd630931de0a7715e516ebe200491ef8902aab606523e06db603333fe67","observation_id":"58aec02d-4de8-4902-aa20-68417328c341","resolution":{"observed_at":"2026-08-15T23:13:19.583664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:23.514588Z","title":"Learning multiple layers of features from tiny images,","venue":null,"work_id":"92b8b232-6599-48af-bee7-b5465e7373ab","year":2009},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.589121Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:4a7b647111656ffa3e31cb22c9107c466394165f360e32954603e73fe5bc7327","observation_id":"2ef7bc6f-ba16-4f75-b036-44c9495225f9","resolution":{"observed_at":"2026-08-15T23:13:23.520121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-16T01:18:27.067382Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-15T23:13:19.594472Z","title":"Microsoft coco captions: Data collection and evaluation server,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.594472Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:3b7d9133fb6e8c8e3df94ab803c816d1d387c51b51f30cd986752b98aade7a08","observation_id":"3986a7fd-ed68-4074-8fe4-e42c7337376b","resolution":{"observed_at":"2026-08-15T23:13:19.594472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.03365","last_updated":"2016-06-04T09:51:30Z","snapshot_observed_at":"2026-08-08T13:26:17.517503Z","submitted_at":"2015-06-10T15:38:47Z","title":"LSUN: Construction of a Large-scale Image Dataset using Deep Learning with Humans in the Loop","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.03365","snapshot_observed_at":"2026-08-15T23:13:19.600703Z","title":"Lsun: Construction of a large-scale image dataset using deep learning with humans in the loop,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.600703Z"},"links":{"cited_paper":"/paper/1506.03365","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:2c75ba584ee21d3a50ee58434674ab7a4f52aab3c493fcce490479890fab8007","observation_id":"fbda1bb2-0b2b-4d3a-a907-0bf65c6cb46a","resolution":{"observed_at":"2026-08-15T23:13:19.600703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:23.495873Z","title":"Mak- ing the v in vqa matter: Elevating the role of image understanding in visual question answering,","venue":null,"work_id":"0a1d52ef-cc5e-448c-af38-610d2e4a57b7","year":2017},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.606142Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:1eeacf36b9f1045516999e9428b45b48e9c917fcb8143154134ed6ce612920ed","observation_id":"b46f1a0a-f61d-4d6b-8576-5654bbf11a35","resolution":{"observed_at":"2026-08-15T23:13:23.502605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:23.427203Z","title":"Improved denoising diffusion probabilistic models,","venue":null,"work_id":"b9d9ecaa-9327-4d9b-abe4-7d7fbe9f329b","year":2021},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.611276Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:705d02c41783d28bf571901438217ec2aec3d3e1257732650bc68e674a5339af","observation_id":"f8631432-f4db-43a2-af19-e3f25568717c","resolution":{"observed_at":"2026-08-15T23:13:23.483718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:23.275961Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":"25610d1a-4c9e-4d3d-815e-829fbe305a9b","year":2020},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.616513Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:6d77f42f8a8eec1a85bd22a0b572e6862fd265df61a5a0e18372798976d89269","observation_id":"910598c7-bf96-4d8d-a1bd-d43e646b7538","resolution":{"observed_at":"2026-08-15T23:13:23.338418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:23.258853Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":"1c9cf6c2-656d-49ff-90a8-9144727dec0b","year":2016},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.621356Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:286195e9706f1389b8199f07c419ce906e100dfe940844e653bd59fa395d06f5","observation_id":"42bb0e91-f8f9-46f6-b615-ad05928005c6","resolution":{"observed_at":"2026-08-15T23:13:23.264299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:23.242089Z","title":"Mobilenetv2: Inverted residuals and linear bottlenecks,","venue":null,"work_id":"f6fb989b-2a8a-4c12-b5d1-c9a4cfb823f8","year":2018},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.626410Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:f99067988e3e646d015881ebf76bb6bbcc5787ff69ab15c7bc582a290ebaf801","observation_id":"e11a9ad8-cc00-43ec-9634-ba36bfa1dd14","resolution":{"observed_at":"2026-08-15T23:13:23.248075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:23.149789Z","title":"A style-based generator archi- tecture for generative adversarial networks,","venue":null,"work_id":"2f99a2c2-62f2-4a2d-8e4d-d772a1ae1bfb","year":2019},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.631601Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:775a960e204fd636e92e0f1c000be9442886c11f67e420d2cb9445bec3e910e9","observation_id":"56d79bee-8932-4958-8873-814a60407cda","resolution":{"observed_at":"2026-08-15T23:13:23.202636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.957503Z","title":"Vila: On pre-training for visual language models,","venue":null,"work_id":"36cb7406-ab55-4c45-8386-0cafd38944e1","year":2024},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.637654Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:40e4155a3474d669dd8806208ebab992953b345a9bb4355d1be54cc9943d2141","observation_id":"66fc02ce-a191-477a-aaa3-5be1241f88cc","resolution":{"observed_at":"2026-08-15T23:13:23.061425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.938916Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":"88fe271c-a74a-49ff-a428-4e7e0da94779","year":2021},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.642937Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:9821b6fad556d13d3d71ccf843de3f3d451db82021fb7e203543f4b5ff2233d4","observation_id":"f7993d47-e9ce-491a-80c1-2e6881ecc1ff","resolution":{"observed_at":"2026-08-15T23:13:22.944959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.814342Z","title":"Qdrop: Randomly dropping quantization for extremely low-bit post-training quanti- zation,","venue":null,"work_id":"7b6a2398-0aba-4919-9d42-f62ec6b8ba58","year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.647856Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:6de41604309ee60c1d917eba42bff10836c22b678c8dd0850420eeabcbc36b5b","observation_id":"0e64118f-248d-4da1-ab8d-8ce10d91b2f3","resolution":{"observed_at":"2026-08-15T23:13:22.926953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.633322Z","title":"Post-training quantization on diffusion models,","venue":null,"work_id":"12e59270-f301-4d05-9a24-491ebffa2569","year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.653293Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:b879a7d9f5d8070d4fb9a9047152b81614c6b14ca3fd1dfefeaa73256be1f3a8","observation_id":"74fa6a8f-5602-411c-b988-e89c7ab4d4c9","resolution":{"observed_at":"2026-08-15T23:13:22.707014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.616144Z","title":"Q-DM: An efficient low-bit quantized diffusion model,","venue":null,"work_id":"dbbc2791-4e06-4bd7-aad0-bf093e09aa6e","year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.658909Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:6069f638691aec79a163601d549f895a05f8cb1529c430732eb71e4552a4495c","observation_id":"d0493f47-99e2-4eaa-bd99-dcc2f06d67b9","resolution":{"observed_at":"2026-08-15T23:13:22.622256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.598843Z","title":"Accurate post training quantization with small calibration sets,","venue":null,"work_id":"a6964a87-d8ef-4b66-9f32-dca678eb1633","year":2021},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.665717Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:8d8f8bfd9ad9a63447d267656d90e5214502a956c62913bfbb4805e9b04c2bde","observation_id":"7df7084f-f2a6-4513-a394-5cb90605ecc7","resolution":{"observed_at":"2026-08-15T23:13:22.604050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.582035Z","title":"Ntire 2017 challenge on single image super-resolution: Dataset and study,","venue":null,"work_id":"79743ec3-392e-4f28-9c93-eb84dcd8e2f6","year":2017},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.672421Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:359e6d8ff99ee6289b0f03f8361f12fe8219a85d7298aec20a2eaeffa3e4cba3","observation_id":"d94c755a-7381-40a5-bd80-22e19f16b029","resolution":{"observed_at":"2026-08-15T23:13:22.587317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.562129Z","title":"Component divide-and-conquer for real-world image super- resolution,","venue":null,"work_id":"6e815a45-0f46-4655-9d91-ea83d5c05cf3","year":2020},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.677928Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:56a6e39df1f136337ad6f5e1e1fc4e4668b6dbd4484d92820bd883f0bd71e244","observation_id":"b9c14db4-e7fe-4816-984b-13b71a5ab5dc","resolution":{"observed_at":"2026-08-15T23:13:22.569533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.508038Z","title":"Low-complexity single-image super-resolution based on nonnegative neighbor embedding,","venue":null,"work_id":"7c3ef60c-b9f2-48eb-8d66-f1a69092bf8e","year":2012},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.684017Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:b2d265ef9c70d00a8574b5217627c92ee99d40f54babd7bb8813a8479c24bc4a","observation_id":"ccf9d8d6-eef0-48d0-baa5-667f1af9ae2c","resolution":{"observed_at":"2026-08-15T23:13:22.550019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.382926Z","title":"On single image scale-up using sparse-representations,","venue":null,"work_id":"01bbdbe0-ac31-41f8-bf3a-86dd280a9a42","year":2010},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.689568Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:491a58b68f62db0e7c12736af0af754581c5ed5f5918fb660e8b7d620cbefa85","observation_id":"1619a4ba-1ee2-4f37-b610-dc2d798df6b4","resolution":{"observed_at":"2026-08-15T23:13:22.416809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.364133Z","title":"A database of human segmented natural images and its application to evaluating segmentation algorithms and measuring ecological statistics,","venue":null,"work_id":"9d59fa10-396a-4f8e-b938-2f068bae20fd","year":2001},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.695011Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:a95828a499bb1867d1747fba40c3342c7028f012635d08352f45ee2930e3dcc1","observation_id":"c4423193-ebfc-4b23-ae3d-97a079b34c09","resolution":{"observed_at":"2026-08-15T23:13:22.369441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.346178Z","title":"Single image super- resolution from transformed self-exemplars,","venue":null,"work_id":"1c452a14-fc03-4f4b-be6d-a5425a0e0cb1","year":2015},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.700262Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:658521ad8f167f69bec8eb08711ffbfafa40b1171ce316e8a40faa8e3791fb9e","observation_id":"18b30f33-3014-4a81-bb81-72d82a44be7c","resolution":{"observed_at":"2026-08-15T23:13:22.352026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.328110Z","title":"Accurate image super-resolution using very deep convolutional networks,","venue":null,"work_id":"a2132051-e4e7-4c3c-b72a-324b687b17f5","year":2016},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.706238Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:28b796e2e6af536caac8fc07c853c0a821ec0174d593099e2aef9dd2f5fa293e","observation_id":"e0e19478-2439-4718-b04d-a1ebdfc0fe8a","resolution":{"observed_at":"2026-08-15T23:13:22.333916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.238232Z","title":"Enhanced deep residual networks for single image super-resolution,","venue":null,"work_id":"8bc77dcb-26d7-4182-b6d5-de781d0c54d3","year":2017},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.713178Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:1305cf241a543bd3a9e0f4a292fa4b217dddf6ab15893ee324daa28f47b8e1d1","observation_id":"d7b25a41-7a76-40fc-a669-b1565a4b1681","resolution":{"observed_at":"2026-08-15T23:13:22.316244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.101483Z","title":"Residual dense network for image super-resolution,","venue":null,"work_id":"f3b553e3-5c78-46c5-9a97-596c714dafdc","year":2018},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.721060Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:914cc4e3b6ac6f686d69fa9143bdd9c7af0b991d6bbb40166fbbcd3dd7a3a0c6","observation_id":"a7cd9689-07a5-43ae-9dce-1e3a4d9becf5","resolution":{"observed_at":"2026-08-15T23:13:22.153553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.080874Z","title":"Photo- realistic single image super-resolution using a generative adver- sarial network,","venue":null,"work_id":"91059bf9-792a-48d2-9248-581d407e4645","year":2017},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.727526Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:1c96ae5052b3ffb693f77c191bb76382cc7c452b481c7c62ae964de3179998f7","observation_id":"402371c4-fecf-4a7c-8fea-3983c8b2dabf","resolution":{"observed_at":"2026-08-15T23:13:22.087919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:22.034885Z","title":"Daq: Channel-wise distribution-aware quantization for deep image super-resolution networks,","venue":null,"work_id":"af527f78-7abd-4fd7-8f7e-0f49e0c88c9a","year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.733221Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:a67f436e068e5c0eeab6f42c96f4bf286eabfcae8b9af9618fcacf99f2a0be45","observation_id":"fe6c70d7-ff75-42d6-80a9-ae675da94a33","resolution":{"observed_at":"2026-08-15T23:13:22.067706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.803296Z","title":"Searching for low-bit weights in quantized neural networks,","venue":null,"work_id":"3c05d8cc-b7a2-4aef-96d1-5de85c6c1cdd","year":2020},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.739106Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:b4e7614573a403ab0de3670972b5b1c7a50e71d26e9058f4e9a0fde696c7ae45","observation_id":"629789ed-85c1-4c6c-a977-a9d7c7879f90","resolution":{"observed_at":"2026-08-15T23:13:21.885684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.785090Z","title":"Learnable lookup table for neural network quantization,","venue":null,"work_id":"e6c70595-3609-450a-8cc2-abecc8a5b090","year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.744293Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:714c324f849a8df6b361478d67761368f90b5e6c48a521c15358631985a43781","observation_id":"0523555f-7e8d-4629-b374-b02e07ef61ad","resolution":{"observed_at":"2026-08-15T23:13:21.791408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.742781Z","title":"Encoder-decoder with atrous separable convolution for semantic image segmentation,","venue":null,"work_id":"773d1427-1b75-49c5-b503-f8280cc025e0","year":2018},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.749003Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:3f01a5ebecd6f16b0a83a6a25e662573ab66232d63c1a50ed8a862205f8efd32","observation_id":"e31be9f7-2585-42b4-b7dd-b7f254dd9eda","resolution":{"observed_at":"2026-08-15T23:13:21.773345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.575961Z","title":"Repvgg: Making vgg-style convnets great again,","venue":null,"work_id":"66b224e4-357c-468b-855d-4f9c785e7f55","year":2021},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.754090Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:6d78b4b02401071c5767f8b38ef5dd7b995ce43bcf0fa6cec9bd45bed3260b93","observation_id":"913aba1e-6f9a-4615-8df7-43a5cc94e500","resolution":{"observed_at":"2026-08-15T23:13:21.627957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.557329Z","title":"Up or down? adaptive rounding for post-training quantization,","venue":null,"work_id":"e26d68d8-43ba-47c1-b812-17ab71938228","year":2020},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.758749Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:d549cfc3dbb935f70793a60d0c628d9db986b4dba08b46059f467335e5416a71","observation_id":"8b37d7d7-1dc6-400f-bf23-5566dca156a8","resolution":{"observed_at":"2026-08-15T23:13:21.563277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.539787Z","title":"Designing network design spaces,","venue":null,"work_id":"a61d1fe5-bfd2-4c8e-88f4-646413e2d5ae","year":2020},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.763858Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:1c106aa3708770983e6299d9e2a64ef5d45b1a2aa37a125213b6bec7bcc41de4","observation_id":"bd612af2-c7b9-4bca-a937-8d14eab618a5","resolution":{"observed_at":"2026-08-15T23:13:21.545213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.520832Z","title":"Mnasnet: Platform-aware neural architecture search for mobile,","venue":null,"work_id":"46177832-fc8f-4765-a914-602e821dd0f4","year":2019},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.768886Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:051e836cfe73db08eb058c77022e072dea1dcfccabe62bb2746cc98d5989cdb3","observation_id":"7672931f-7f13-4a5b-be7b-0443310316ce","resolution":{"observed_at":"2026-08-15T23:13:21.526562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.359265Z","title":"Very deep convolutional net- works for large-scale image recognition,","venue":null,"work_id":"7db82212-d947-4f41-be36-29707cea6fe0","year":2015},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.773885Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:d392b78d9e1eaf5398e9e098e8d491132ef19b38df4c3b84dcb0f58e5fd10c4e","observation_id":"3af671cc-f240-4d24-964b-c40529025a1a","resolution":{"observed_at":"2026-08-15T23:13:21.471076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.232235Z","title":"Rethinking the inception architecture for computer vision,","venue":null,"work_id":"cde978f5-7080-4c97-a448-965c26cc4cb9","year":2016},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.778549Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:6a055fedb9a60927313d7dbcef9d8e2be781f8a4ce84359b356ef67f438a157e","observation_id":"1cfb2fda-c509-463c-bb82-ffc6deb89743","resolution":{"observed_at":"2026-08-15T23:13:21.304035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.212237Z","title":"Brecq: Pushing the limit of post-training quantization by block reconstruction,","venue":null,"work_id":"2431e006-f59e-43d8-ac94-a43ef2d76c7f","year":2021},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.783165Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:24c448310d4676d3eaf2b3300bfccebabf73605f6c7d377f3f6372df15d2d023","observation_id":"4b439f53-6ea3-42f0-a4c9-953faada2203","resolution":{"observed_at":"2026-08-15T23:13:21.217667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.193958Z","title":"Hawq: Hessian aware quantization of neural networks with mixed-precision,","venue":null,"work_id":"4d64994f-ba9c-4a1a-b7d0-9683bb9c6bea","year":2019},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.788993Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:97994a91e815db469c8c73b45913d6f6e71ce32769316595e30d5fd8a5264961","observation_id":"69755a2b-71e4-4b3d-925c-e796e3fd9c3d","resolution":{"observed_at":"2026-08-15T23:13:21.199956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.036391Z","title":"Overcoming oscillations in quantization-aware training,","venue":null,"work_id":"a7d9dd6d-9037-4759-bfe0-a5483fb7c4ae","year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.794294Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:09562db1fb65378a2bd9b9ffa522046f9a54bdcaf30c3e38a347438e895f0a05","observation_id":"5c0b2ae5-827d-4b3c-a3dd-8b1dd08c0655","resolution":{"observed_at":"2026-08-15T23:13:21.104647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:21.016208Z","title":"Focal loss for dense object detection,","venue":null,"work_id":"9d142649-193e-4dd8-b929-a56a19625f14","year":2017},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.800613Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:adaf33d07340b94b6def80504bebbd6a381c9810544a7e471467ed5ed95847d6","observation_id":"2f1c154f-a8ba-4759-96ad-0668e6a21009","resolution":{"observed_at":"2026-08-15T23:13:21.023172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-16T15:48:09.692405Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-08-15T23:13:19.805481Z","title":"A comprehensive study on post-training quantization for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.805481Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:5d8e78ffc0559e49fbaa4abad0f3b81252edc0e98a843da1ff3c422ef28e0be0","observation_id":"c69edea0-5bfa-4fec-bba0-34479dc12a9b","resolution":{"observed_at":"2026-08-15T23:13:19.805481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:20.997398Z","title":"A comprehen- sive survey on model quantization for deep neural networks in image classification,","venue":null,"work_id":"77fc8c3e-0b5a-42e8-a0db-c70a5d3c91c3","year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.810904Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:bfd6d32ab98b7a5258cea200f2f8d8c5979ca6fa9673af257a421661f6ef87a1","observation_id":"ffa7fade-73c5-4f78-87ea-17bb2a875211","resolution":{"observed_at":"2026-08-15T23:13:21.003205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:19.815967Z","title":"A survey of quantization methods for efficient neural network inference,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.815967Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:1f2a75a85d089c2a7fbae6d77bfdf9de7c183d6535b5b5ca48990e2d04de3e8b","observation_id":"038e160a-abbb-4a31-bb8d-9e6043671bf5","resolution":{"observed_at":"2026-08-15T23:13:19.815967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-16T14:14:37.272762Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-15T23:13:19.820832Z","title":"Evaluating quantized large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.820832Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:28941ad636d2079c969d1890d2f9c5bcf5b8e5903dfe7441d03c2eb7d078e31c","observation_id":"7a4e6d2a-9e2a-46d3-a366-7b37cf5ff968","resolution":{"observed_at":"2026-08-15T23:13:19.820832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18137","last_updated":"2024-11-04T11:16:38Z","snapshot_observed_at":"2026-08-16T13:48:38.580844Z","submitted_at":"2024-05-28T12:51:01Z","title":"Exploiting LLM Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18137","snapshot_observed_at":"2026-08-15T23:13:19.825641Z","title":"Exploiting llm quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.825641Z"},"links":{"cited_paper":"/paper/2405.18137","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:5f0b67582bad98e6ab6a7d6621c332fe668a37d2f82b2f046314b51816f3dd27","observation_id":"23c0c9f8-5cc3-43ae-a1ca-0f1bc939f365","resolution":{"observed_at":"2026-08-15T23:13:19.825641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:20.928136Z","title":"Exploring post-training quantization in llms from comprehensive study to low rank compensation,","venue":null,"work_id":"7723d296-7b4e-4b78-abee-d01a6237340f","year":2024},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.830284Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:7f7d693be25135a8f8d19d61582ce7c263194b21848dd5ed3a0e2c11b2e84ec2","observation_id":"7b8721ce-bbf3-4a53-b4e0-5fcbc4afa193","resolution":{"observed_at":"2026-08-15T23:13:20.969696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:20.772549Z","title":"Exploring quantization techniques for large-scale language models: Methods, challenges and future directions,","venue":null,"work_id":"a0b4bbfc-7dd4-4ca9-86a7-3c411491f963","year":2024},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.834912Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:e68a16ba0f81239d1db51e65570aee4cdde40b13fe63955618d9f83d334914ca","observation_id":"399b7d90-901d-4dbf-b466-da2133c0e6a7","resolution":{"observed_at":"2026-08-15T23:13:20.854574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:20.735945Z","title":"The case for 4-bit precision: k-bit inference scaling laws,","venue":null,"work_id":"202c2320-3488-4b81-823c-de4b9f9d9859","year":2023},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.839715Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:2cbbbfc832771ec0933be5791315dfdd969b07283092de20c61a828627f71af8","observation_id":"6c765d08-8b49-4e55-982c-f2b39e1461f2","resolution":{"observed_at":"2026-08-15T23:13:20.741994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:20.718160Z","title":"Only train once: A one-shot neural network training and pruning framework,","venue":null,"work_id":"61870484-a1cb-4510-aa8e-74b071a87088","year":2021},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.845366Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:40de7863e36d8b8351fdaf9538df56a757954ab133e72e4ffb5d4f1db38d30a5","observation_id":"d15ba077-7584-4b14-86c8-05739f4400ce","resolution":{"observed_at":"2026-08-15T23:13:20.723893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:20.658043Z","title":"Deephoyer: Learning sparser neural network with differentiable scale-invariant sparsity measures,","venue":null,"work_id":"43f7e603-93a6-4c12-bb11-9312da1d535c","year":2020},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.850130Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:bc89865853e1390f5607713a7588d77c5efbd2cfe39740b6532f5766c166ce04","observation_id":"c1b7694b-31bc-4787-8757-b41a6da224e3","resolution":{"observed_at":"2026-08-15T23:13:20.706752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.07827","last_updated":"2019-03-22T01:29:58Z","snapshot_observed_at":"2026-08-14T17:27:09.010883Z","submitted_at":"2019-01-23T11:29:39Z","title":"Towards Compact ConvNets via Structure-Sparsity Regularized Filter Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.07827","snapshot_observed_at":"2026-08-15T23:13:19.855265Z","title":"Towards compact convnets via structure-sparsity regularized filter pruning,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.855265Z"},"links":{"cited_paper":"/paper/1901.07827","citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:291b25c868b55cd2cd454dd3c67fbd4627370e04f0c9acddd3c2a9e47a7dfebb","observation_id":"e3a67481-d2d0-46b9-b5c0-a751206324f3","resolution":{"observed_at":"2026-08-15T23:13:19.855265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:13:20.606137Z","title":"Accelerate cnn via recursive bayesian pruning,","venue":null,"work_id":"a0d70d91-466e-4f33-aca3-e94156cb8c86","year":2019},"citing_paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-15T23:13:19.861392Z"},"links":{"citing_paper":"/paper/2505.05530"},"observation_digest":"sha256:4f4d0d456ad713ae6d5c3689c6edc7541b5f7879d74bbadade67fb840a95a0de","observation_id":"1a68048a-de30-41d3-b058-20a85153a1d9","resolution":{"observed_at":"2026-08-15T23:13:20.611473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.05530","last_updated":"2025-05-08T13:26:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T13:34:18.858488Z","submitted_at":"2025-05-08T13:26:19Z","title":"Low-bit Model Quantization for Deep Neural Networks: A Survey"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":0,"verified_fuzzy":46},"total_outbound_references":115},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 100 of 115 outbound references and 8 inbound Pith citation observations for arXiv:2505.05530."}