{"as_of":"2026-08-09T14:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5ca98f2448940ed358891b45cc0a4444b33e7ada31ff71a374068b9b1b6ca309","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":47,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:44:00.570594Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T11:09:46.244627Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"reference_index":262,"source":"pdf_text","source_observed_at":"2026-05-19T20:28:38.900026Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2307.06435"},"observation_digest":"sha256:160471fb722d67168ba55f10bb2349ab2ba22e1db21d635f6c84e54a144db2d5","observation_id":"1c207117-7a1b-4e98-831a-23616c41c4d2","resolution":{"observed_at":"2026-05-19T20:28:39.178137Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2401.05459","last_updated":"2024-05-08T06:16:23Z","snapshot_observed_at":"2026-08-02T13:57:57.119489Z","submitted_at":"2024-01-10T09:25:45Z","title":"Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security","version":2},"reference_index":250,"source":"pdf_text","source_observed_at":"2026-05-17T00:57:26.303195Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2401.05459"},"observation_digest":"sha256:c72145f69cc5757e989dfa0fd544ffd0ae646aa1f3d503d348f824cf96f7ca6c","observation_id":"6b0f978d-4f28-49b7-bb0a-4e9f5c9dfc7f","resolution":{"observed_at":"2026-05-17T00:57:26.711473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-02T17:17:56.296462Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-17T23:31:11.213552Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2402.13116"},"observation_digest":"sha256:dad4f1ecbc7495cb8c5ce49697016f8c956f51c23affda8c15eecc2a61a43ce7","observation_id":"7121c958-3f02-4e9d-83a0-eea923e4a4b1","resolution":{"observed_at":"2026-05-17T23:31:11.594298Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-08T13:44:00.570594Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07832","last_updated":"2025-02-11T00:21:40Z","snapshot_observed_at":"2026-08-09T09:01:49.466932Z","submitted_at":"2025-02-11T00:21:40Z","title":"SHARP: Accelerating Language Model Inference by SHaring Adjacent layers with Recovery Parameters","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-08T13:44:00.570594Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2502.07832"},"observation_digest":"sha256:142a8e942d02bc56c34572f0a945b6920ad7b51a68c4274a11f96c6c384a8734","observation_id":"9bbb9f5b-f553-4d78-9461-5702cce38c02","resolution":{"observed_at":"2026-08-08T13:44:00.570594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-07T23:03:44.638140Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09003","last_updated":"2025-06-06T02:29:18Z","snapshot_observed_at":"2026-08-09T10:27:15.269103Z","submitted_at":"2025-02-13T06:44:33Z","title":"RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T23:03:44.638140Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2502.09003"},"observation_digest":"sha256:5a3202e9634bbc693f07843b0ee9ade5ad0b520e2e81b8e72b95311cb2ba7f07","observation_id":"c06bde00-4f54-477a-8dbb-b25bd8c9a328","resolution":{"observed_at":"2026-08-07T23:03:44.638140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2504.06307","last_updated":"2026-04-11T22:45:17Z","snapshot_observed_at":"2026-07-06T21:06:17.499947Z","submitted_at":"2025-04-07T21:56:59Z","title":"Optimizing Large Language Models: Metrics, Energy Efficiency, and Case Study Insights","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T20:24:01.224251Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2504.06307"},"observation_digest":"sha256:45d0dd0f829b1e3bf493044cbdadf467e0f1b21b60162e62db8d87b8ca57e3a2","observation_id":"81f0e293-f8b7-4e9a-b481-24719f66a559","resolution":{"observed_at":"2026-05-22T20:25:05.451215Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2505.02242","last_updated":"2026-04-22T04:07:04Z","snapshot_observed_at":"2026-07-06T21:18:45.864722Z","submitted_at":"2025-05-04T20:50:44Z","title":"Sampling-Aware Quantization for Diffusion Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T15:59:13.334531Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2505.02242"},"observation_digest":"sha256:ce59bd5dabd7ce84146c81debed0d3af36dc2e93f569c136dd1d9f23ef2ae80f","observation_id":"583417e6-2d07-44e2-b63e-987611b1c3f9","resolution":{"observed_at":"2026-05-22T16:01:45.919541Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-07T15:36:05.513839Z","title":"Llm-qat: Data- free quantization aware training for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.513839Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:99b40c77bc168d19e0127c5adc82944771e28f0f860c5e9027dac8d2ab760795","observation_id":"1c5fd896-d33d-4a13-8799-4efc3d93369b","resolution":{"observed_at":"2026-08-07T15:36:05.513839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2505.16120","last_updated":"2026-05-04T12:54:07Z","snapshot_observed_at":"2026-08-02T10:48:03.601811Z","submitted_at":"2025-05-22T01:52:15Z","title":"LLM-Powered AI Agent Systems and Their Applications in Industry","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-22T14:05:54.535411Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2505.16120"},"observation_digest":"sha256:6c064ab4eb9231e855dcf09e9dd3238f38ffcce598825954954b3a61a7a4f42a","observation_id":"caf7d4d2-56b2-44f8-b527-c5be0de26c88","resolution":{"observed_at":"2026-05-22T14:06:37.842283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-07T15:09:29.098589Z","title":"Llm-qat: Data-free quan- tization aware training for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16210","last_updated":"2025-05-22T04:23:19Z","snapshot_observed_at":"2026-08-08T09:52:35.968307Z","submitted_at":"2025-05-22T04:23:19Z","title":"NQKV: A KV Cache Quantization Scheme Based on Normal Distribution Characteristics","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:29.098589Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2505.16210"},"observation_digest":"sha256:703d27af17d9843f1cce876dda9ea91ce2db1b5d912c2b57700338d8c024afdd","observation_id":"5e902144-9c07-4180-814a-abc23a3d27a2","resolution":{"observed_at":"2026-08-07T15:09:29.098589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-07T14:01:55.320202Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20132","last_updated":"2025-05-26T15:32:28Z","snapshot_observed_at":"2026-08-09T05:43:28.063073Z","submitted_at":"2025-05-26T15:32:28Z","title":"Tensorization is a powerful but underexplored tool for compression and interpretability of neural networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:55.320202Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2505.20132"},"observation_digest":"sha256:906c5012877101b6c227b60d5338daf135c526dce7e46de13afa5dec423f6872","observation_id":"67488c36-47eb-4299-9576-bf38307e1c8c","resolution":{"observed_at":"2026-08-07T14:01:55.320202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-07T05:04:03.029383Z","title":"Jianping Gou, Baosheng Yu, Stephen J Maybank, and Dacheng Tao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-07T04:55:51.014007Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:03.029383Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:3091736bdccc27b3ce42d859441d5593c4a7eefb7491adbce6a865625976712c","observation_id":"87080d35-f0c3-421d-aa94-a84a33b5ce14","resolution":{"observed_at":"2026-08-07T05:04:03.029383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-07T15:26:56.140382Z","title":"Llm-qat: Data-free quantization aware training for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11040","last_updated":"2025-05-21T04:45:11Z","snapshot_observed_at":"2026-08-07T22:34:12.973486Z","submitted_at":"2025-05-21T04:45:11Z","title":"Large Language models for Time Series Analysis: Techniques, Applications, and Challenges","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:26:56.140382Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2506.11040"},"observation_digest":"sha256:aaf81bb6a531c5b1e2261cec9198aaabe103d1c8409d2ab47d758db6c6d04a5e","observation_id":"0ba1c425-02c2-4533-b9fb-70d751a16708","resolution":{"observed_at":"2026-08-07T15:26:56.140382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-07T14:52:08.583287Z","title":"Stephen Merity, Caiming Xiong, James Bradbury, and Richard Socher","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12038","last_updated":"2025-05-23T03:28:24Z","snapshot_observed_at":"2026-08-07T14:45:04.578692Z","submitted_at":"2025-05-23T03:28:24Z","title":"LCD: Advancing Extreme Low-Bit Clustering for Large Language Models via Knowledge Distillation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:52:08.583287Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2506.12038"},"observation_digest":"sha256:6b1c39c42025a07e4b48c3cb7c51a3600f5976f45e0f43693e743c7bf40a5c4c","observation_id":"090a4bb0-5d7c-4879-a42f-42dba738a588","resolution":{"observed_at":"2026-08-07T14:52:08.583287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-06T23:36:12.171500Z","title":"Llm-qat: Data-free quantization aware training for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17639","last_updated":"2026-06-16T03:02:33Z","snapshot_observed_at":"2026-08-07T21:39:08.232650Z","submitted_at":"2025-06-21T08:45:32Z","title":"RLRC: Reinforcement Learning-based Recovery for Compressed Vision-Language-Action Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:36:12.171500Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2506.17639"},"observation_digest":"sha256:7f4976f08c8563b8a80ef9d19045f25c0c201451f9b739675dfc16c86892f037","observation_id":"ca8dafa3-68f8-4ed1-9907-6282d399f474","resolution":{"observed_at":"2026-08-06T23:36:12.171500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-06T21:36:39.922662Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23762","last_updated":"2025-06-30T12:09:29Z","snapshot_observed_at":"2026-08-06T21:29:49.550137Z","submitted_at":"2025-06-30T12:09:29Z","title":"Software Engineering for Large Language Models: Research Status, Challenges and the Road Ahead","version":1},"reference_index":224,"source":"pdf_text","source_observed_at":"2026-08-06T21:36:39.922662Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2506.23762"},"observation_digest":"sha256:10c9badf7099feed14a502c0e33bbf442b78aa48dcf78bf7d35b8926217434f6","observation_id":"8bbdf5b2-1fec-48e1-8abf-b6f612c7051e","resolution":{"observed_at":"2026-08-06T21:36:39.922662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-06T19:09:15.456220Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07145","last_updated":"2025-07-09T06:04:14Z","snapshot_observed_at":"2026-08-08T02:29:03.615649Z","submitted_at":"2025-07-09T06:04:14Z","title":"CCQ: Convolutional Code for Extreme Low-bit Quantization in LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T19:09:15.456220Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2507.07145"},"observation_digest":"sha256:58de0e4a5212b08b216e877f61114c5f682816197d3eded9eb040f46a075da3c","observation_id":"e4e182b3-3f62-43ad-a85b-9b4b60d23d5c","resolution":{"observed_at":"2026-08-06T19:09:15.456220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-06T17:56:21.258854Z","title":"Llm-qat: Data-free quantization aware training for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09665","last_updated":"2025-07-13T14:58:19Z","snapshot_observed_at":"2026-08-08T22:10:15.646478Z","submitted_at":"2025-07-13T14:58:19Z","title":"Is Quantization a Deal-breaker? Empirical Insights from Large Code Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:56:21.258854Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2507.09665"},"observation_digest":"sha256:5dcca90eb0fd81e2f773dfb564b3df0928df9ef81f129ab8b6a923b7599c34ac","observation_id":"c07aea92-73a5-43bf-82c5-40e55bf5a083","resolution":{"observed_at":"2026-08-06T17:56:21.258854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-06T17:45:20.824803Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10059","last_updated":"2025-07-14T08:44:59Z","snapshot_observed_at":"2026-08-09T09:16:27.763879Z","submitted_at":"2025-07-14T08:44:59Z","title":"GeLaCo: An Evolutionary Approach to Layer Compression","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T17:45:20.824803Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2507.10059"},"observation_digest":"sha256:e85b71de5f41d1a06f89d162750d24de2b659d5bfbfefbd619a78478bf5374b5","observation_id":"726f3140-9b51-40c8-a4b6-70696cff27e1","resolution":{"observed_at":"2026-08-06T17:45:20.824803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-06T15:08:32.123439Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16656","last_updated":"2025-07-22T14:52:25Z","snapshot_observed_at":"2026-08-08T15:46:21.312669Z","submitted_at":"2025-07-22T14:52:25Z","title":"P-CoT: A Pedagogically-motivated Participatory Chain-of-Thought Prompting for Phonological Reasoning in LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:32.123439Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2507.16656"},"observation_digest":"sha256:fdb6dd5fb9526a3a43cdda60d909a87bb688d7918ac288597e242cda225b6987","observation_id":"0ffd1ac8-21f6-4831-918e-aa7eb7a08017","resolution":{"observed_at":"2026-08-06T15:08:32.123439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-06T15:08:28.125268Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16933","last_updated":"2025-07-22T18:17:53Z","snapshot_observed_at":"2026-08-08T21:33:54.017773Z","submitted_at":"2025-07-22T18:17:53Z","title":"SiLQ: Simple Large Language Model Quantization-Aware Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T15:08:28.125268Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2507.16933"},"observation_digest":"sha256:150098e9ab9c19b8f4f5cb7fcf34fd62d3b5ef354aab5784627ff723c62123b5","observation_id":"b814e3ab-99ec-4300-aa5e-a2060109a7fe","resolution":{"observed_at":"2026-08-06T15:08:28.125268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2508.06974","last_updated":"2026-05-18T12:47:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-09T13:00:16Z","title":"Rethinking 1-bit Optimization Leveraging Pre-trained Large Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T23:44:01.953344Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2508.06974"},"observation_digest":"sha256:e77ec16140f37272ef06c2b764651dceaff6ed78d93242a7199d5104246d6531","observation_id":"6bac20f3-ce57-498f-bc25-413a448e58bd","resolution":{"observed_at":"2026-05-21T23:44:26.498527Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-05T15:52:44.997182Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19432","last_updated":"2025-08-26T21:01:45Z","snapshot_observed_at":"2026-08-09T00:35:46.151432Z","submitted_at":"2025-08-26T21:01:45Z","title":"Quantized but Deceptive? A Multi-Dimensional Truthfulness Evaluation of Quantized LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T15:52:44.997182Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2508.19432"},"observation_digest":"sha256:e9532933a9356335915a21fa800331e95e202e5ebdaf6aa8c4cd73c85a49fbc8","observation_id":"df962eed-6dcd-46ac-a387-c1fc943dcf18","resolution":{"observed_at":"2026-08-05T15:52:44.997182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-05T12:51:00.337520Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01229","last_updated":"2025-09-01T08:16:20Z","snapshot_observed_at":"2026-08-06T18:50:44.734272Z","submitted_at":"2025-09-01T08:16:20Z","title":"LiquidGEMM: Hardware-Efficient W4A8 GEMM Kernel for High-Performance LLM Serving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T12:51:00.337520Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2509.01229"},"observation_digest":"sha256:a6e97234acf0be2769eca1cb23f49f9eddad73d89dc08cce3393f8eea0b451f5","observation_id":"bbe18e3d-6411-4361-856c-30c03ce71e59","resolution":{"observed_at":"2026-08-05T12:51:00.337520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-04T14:45:26.761488Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.23729","last_updated":"2026-06-22T01:59:29Z","snapshot_observed_at":"2026-08-06T09:10:04.422236Z","submitted_at":"2025-09-28T08:20:00Z","title":"LUQ: Layerwise Ultra-Low Bit Quantization for Multimodal Large Language Models","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T14:45:26.761488Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2509.23729"},"observation_digest":"sha256:fe9566b98020089f5d7af962020562f95b57ddd73d92f96f3991eb1b5e1b8fec","observation_id":"e1221fe7-79bb-48e0-85a3-a87b018c6443","resolution":{"observed_at":"2026-08-04T14:45:26.761488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2602.04163","last_updated":"2026-05-15T03:25:05Z","snapshot_observed_at":"2026-08-02T22:48:54.849826Z","submitted_at":"2026-02-04T02:54:37Z","title":"BPDQ: Bit-Plane Decomposition Quantization on a Variable Grid for Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T14:10:32.706531Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2602.04163"},"observation_digest":"sha256:57920ae836aae2dabadb33b2e88bf1ad53688ee76d93b99fc3f9ab950312fe8d","observation_id":"5aa9d5ee-59f6-4577-a69f-6dc488c1ad3f","resolution":{"observed_at":"2026-05-21T14:14:12.407962Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-13T23:28:12.790404Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.16867","last_updated":"2026-06-03T09:37:20Z","snapshot_observed_at":"2026-08-06T21:47:33.826393Z","submitted_at":"2026-03-17T17:59:51Z","title":"Efficient Reasoning on the Edge","version":2},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-07-13T23:28:12.790404Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2603.16867"},"observation_digest":"sha256:4f8ab17e83fd2f748e3cc8cf335fe81688a299b9f54d66659fd339458f0b4c13","observation_id":"99a03ff7-decc-4925-a042-982722ce978a","resolution":{"observed_at":"2026-07-13T23:28:12.790404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-08-07T20:25:38.013655Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:fdca7f9cf0910f33878a22d48ad5aab0b0d5fb79135beb0ac91092e153c25a7a","observation_id":"790ad2c6-76d0-4f87-a730-69c21fefbf6f","resolution":{"observed_at":"2026-05-11T20:16:10.233740Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2604.24088","last_updated":"2026-04-27T06:27:31Z","snapshot_observed_at":"2026-07-29T22:55:04.073973Z","submitted_at":"2026-04-27T06:27:31Z","title":"TACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T01:36:41.804171Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2604.24088"},"observation_digest":"sha256:b148a842abc51ff305c633fe2e791dbc5403341d319a3b6cc2c350f5a00f6631","observation_id":"2b7bf740-18a7-4fc2-ada3-ce9aacb42f57","resolution":{"observed_at":"2026-05-11T23:06:20.891028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T18:04:32.981357Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:978c9377384b3b10160253dfcc7f369be8443396e44f49b54aaa7abd6dc061dd","observation_id":"6fd73307-f20b-441f-965b-172e3d7715b0","resolution":{"observed_at":"2026-05-11T05:35:56.887863Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2605.04062","last_updated":"2026-05-21T13:07:01Z","snapshot_observed_at":"2026-08-06T12:19:11.983556Z","submitted_at":"2026-04-10T15:49:44Z","title":"EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T10:07:35.063038Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2605.04062"},"observation_digest":"sha256:cc001120dcb5079c531c99c05d1e9b29b9e9279cb9b1f1d316f12471dfaa7cd2","observation_id":"266fad7a-5546-4724-bb32-a6709a8833ea","resolution":{"observed_at":"2026-05-22T10:11:23.356051Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2605.05819","last_updated":"2026-05-07T07:57:23Z","snapshot_observed_at":"2026-08-09T00:36:24.024091Z","submitted_at":"2026-05-07T07:57:23Z","title":"HCInfer: An Efficient Inference System via Error Compensation for Resource-Constrained Devices","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T14:44:13.936042Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2605.05819"},"observation_digest":"sha256:b0d6f57af764c4c09928677147bc198d5efdec40250e9b740824c6edd7acfc52","observation_id":"28ce22ae-d57c-40da-ad06-40416af41d00","resolution":{"observed_at":"2026-05-11T18:41:10.681776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2605.08842","last_updated":"2026-05-09T09:53:03Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T09:53:03Z","title":"XPERT: Expert Knowledge Transfer for Effective Training of Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-12T02:45:17.513513Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2605.08842"},"observation_digest":"sha256:8de774183d4e012e022a8e6f02d1d690df3d54446cc6518db3de8d9c219888b3","observation_id":"e3843bdb-a752-48ff-9ca0-fffe80ead469","resolution":{"observed_at":"2026-05-12T02:46:18.799055Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2605.10655","last_updated":"2026-05-11T14:40:20Z","snapshot_observed_at":"2026-07-06T23:22:37.355450Z","submitted_at":"2026-05-11T14:40:20Z","title":"BCJR-QAT: A Differentiable Relaxation of Trellis-Coded Weight Quantization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T04:16:47.855771Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2605.10655"},"observation_digest":"sha256:1b9257d7040ca88cefe59d11b94b18fb4b17ed2c24a03d1989ce0bdcc4c6c94d","observation_id":"9ad7c572-8576-4b14-8845-366755fe2af3","resolution":{"observed_at":"2026-05-12T06:26:25.727040Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2606.00539","last_updated":"2026-05-30T05:11:13Z","snapshot_observed_at":"2026-07-06T23:41:15.410587Z","submitted_at":"2026-05-30T05:11:13Z","title":"GNMR: Runtime Stability Control for Low-Precision Large Language Model Training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T18:53:47.187437Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2606.00539"},"observation_digest":"sha256:33918f42441551c3e6edb6ffe11b4e85f5e67f283cd559bec2146cff86950f51","observation_id":"38f4a9b2-7c09-4795-a7ef-acd6cbbae7f0","resolution":{"observed_at":"2026-06-28T19:42:36.014542Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2606.04238","last_updated":"2026-06-02T21:37:56Z","snapshot_observed_at":"2026-07-06T23:44:23.633099Z","submitted_at":"2026-06-02T21:37:56Z","title":"Recover-LoRA for Aggressive Quantization: Reclaiming Accuracy in 2-Bit Language Models via Low-Rank Adaptation with Knowledge Distillation on Synthetic Data","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-28T10:41:19.146166Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2606.04238"},"observation_digest":"sha256:b805fe8c093525018a7412da21f9012a31716078f271bd6f13cbd5a6adc4b74c","observation_id":"aaee0fdb-94f6-4ace-afe8-cbe02ab12f38","resolution":{"observed_at":"2026-07-02T02:46:28.224995Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2606.04945","last_updated":"2026-06-08T08:41:05Z","snapshot_observed_at":"2026-08-02T15:48:27.544154Z","submitted_at":"2026-06-03T14:34:35Z","title":"STaR-Quant: State-Time Consistent Post-Training Quantization for Diffusion Large Language Models","version":2},"reference_index":135,"source":"arxiv_source","source_observed_at":"2026-06-28T07:14:26.441339Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2606.04945"},"observation_digest":"sha256:48bb41ac30c8742791a2ea2829c08baf2da13a998a99ff3fbe2a759589aaea5e","observation_id":"d8416cfb-f7f3-4e63-94e1-1b104d227f3d","resolution":{"observed_at":"2026-07-02T07:06:43.737459Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2606.10531","last_updated":"2026-07-01T03:38:14Z","snapshot_observed_at":"2026-08-06T14:17:16.054117Z","submitted_at":"2026-06-09T08:02:56Z","title":"LC-QAT: Data-Efficient 2-Bit QAT for LLMs via Linear-Constrained Vector Quantization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T13:32:32.996055Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2606.10531"},"observation_digest":"sha256:5ec99f0c10bc87ecaa745eec10d58fa6df0d5819651503b27b386936efc22ab5","observation_id":"286b2fae-86ac-46f0-8c2b-dea804c6ea59","resolution":{"observed_at":"2026-07-03T04:57:38.374568Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2606.10531","last_updated":"2026-07-01T03:38:14Z","snapshot_observed_at":"2026-08-06T14:17:16.054117Z","submitted_at":"2026-06-09T08:02:56Z","title":"LC-QAT: Data-Efficient 2-Bit QAT for LLMs via Linear-Constrained Vector Quantization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-02T22:47:05.759610Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2606.10531"},"observation_digest":"sha256:f37ca8f35035d72e2b569e9a8ac3a7604309f73f652831eb02e92d9793ae0b0e","observation_id":"a5a612fb-9ba0-40d2-b5d0-995de1e16987","resolution":{"observed_at":"2026-07-02T22:47:25.227142Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2606.22249","last_updated":"2026-06-20T22:22:26Z","snapshot_observed_at":"2026-08-06T20:47:52.441640Z","submitted_at":"2026-06-20T22:22:26Z","title":"On the Expressive Power of Weight Quantization in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T11:53:45.787243Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2606.22249"},"observation_digest":"sha256:b339e4739e0dc7f9bf721d050b398a9fa5b22cce26e417cb436b4a65896cd5bc","observation_id":"7c9714d8-5af6-46b3-8cb6-4e0d3cca6ce8","resolution":{"observed_at":"2026-07-04T08:19:44.249942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.17888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-04T11:09:46.244627Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"aa772a15-dd3c-421b-a1a0-0fcfd75b9862","year":2023},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-02T23:19:25.465662Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":1},"reference_index":149,"source":"pdf_text","source_observed_at":"2026-06-26T08:09:57.542558Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:04c9a9b8461c6387981464e18d2db690ff243bb03f48d2c46fcbafa268a52d0f","observation_id":"3ae913f0-da22-43de-a08e-792808a197f3","resolution":{"observed_at":"2026-07-04T11:09:46.246173Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-02T10:27:18.290805Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models.arXiv Preprint arXiv:2305.17888, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-02T23:19:25.465662Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":2},"reference_index":138,"source":"pdf_text","source_observed_at":"2026-08-02T10:27:18.290805Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:c01a7f22fdc08439873624503f50dac6ab77932448b146f0697a1f6d74153ef0","observation_id":"bac2f086-923e-4241-b59c-aae7c865516d","resolution":{"observed_at":"2026-08-02T10:27:18.290805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-07-14T08:45:52.855783Z","title":"arXiv preprint arXiv:2305.17888 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10855","last_updated":"2026-07-12T17:39:09Z","snapshot_observed_at":"2026-08-06T03:10:18.618115Z","submitted_at":"2026-07-12T17:39:09Z","title":"Reliability Scaling Laws for Quantized Large Language Models","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-07-14T08:45:52.855783Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2607.10855"},"observation_digest":"sha256:38a2d27008d2284ca76416b0c35f4fd4450b1c9a40e0efe26b77afbc1ac9447d","observation_id":"839d221e-91aa-4df9-b8a0-6d5be99aabdd","resolution":{"observed_at":"2026-07-14T08:45:52.855783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-02T03:55:40.665371Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13735","last_updated":"2026-07-17T08:40:24Z","snapshot_observed_at":"2026-08-06T21:00:57.912415Z","submitted_at":"2026-07-15T11:47:24Z","title":"Constraint-Driven Model Optimization: An Industry Framework for Selecting Compression and Acceleration Techniques in Modern Machine Learning Systems","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T03:55:40.665371Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2607.13735"},"observation_digest":"sha256:81a454c865f0b4edaa0b07f47866e3b2cf496f87f601fc89979cf678dad438de","observation_id":"19cb1add-ad6b-41f6-ae63-a819d29e2108","resolution":{"observed_at":"2026-08-02T03:55:40.665371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-02T03:32:51.848447Z","title":"LLM-QAT: Data-free quan- tization aware training for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14181","last_updated":"2026-07-15T14:05:33Z","snapshot_observed_at":"2026-08-08T17:47:34.090198Z","submitted_at":"2026-07-15T14:05:33Z","title":"Quantize with Confidence? An Empirical Study of Quantization for Code Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T03:32:51.848447Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2607.14181"},"observation_digest":"sha256:20b360b22d778ee6278b570ba6719077a156ecc51b39a991ecfe1777c5748d71","observation_id":"b130432c-3936-4f38-9d1e-dd118626a477","resolution":{"observed_at":"2026-08-02T03:32:51.848447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-02T09:50:32.862421Z","title":"arXiv:2305.17888","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16248","last_updated":"2026-06-27T01:22:47Z","snapshot_observed_at":"2026-08-05T04:21:35.447834Z","submitted_at":"2026-06-27T01:22:47Z","title":"High-accuracy Low-Bit KV-Cache Quantization via Local Distribution Restoration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T09:50:32.862421Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2607.16248"},"observation_digest":"sha256:fbe317544aa23291ed85a2a343cdee08b82d920f5b959ea07cfa28d73eebb0d7","observation_id":"9853d2b9-d422-4a99-a51a-3afc791542a9","resolution":{"observed_at":"2026-08-02T09:50:32.862421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-08T00:50:44.544992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04048","last_updated":"2026-08-04T08:32:05Z","snapshot_observed_at":"2026-08-08T23:10:55.143986Z","submitted_at":"2026-08-04T08:32:05Z","title":"Recurrent Residual Quantization: A Progressive Multi-Precision Representation for LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T00:50:44.544992Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2608.04048"},"observation_digest":"sha256:115e6521928e86498d6b029a50e7cb84ffb6fb1983253f0ebc6be30dd18e8fa4","observation_id":"4aa58001-ee2b-486f-ab5f-c93f5be466fe","resolution":{"observed_at":"2026-08-08T00:50:44.544992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.17888/citation-record","integrity":"/paper/2305.17888/integrity","json":"/paper/2305.17888/citation-record.json","paper":"/paper/2305.17888"},"outbound":[],"paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 47 inbound Pith citation observations for arXiv:2305.17888."}