{"as_of":"2026-08-09T22:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba424194905c09a06b237d034d0fb9edcad495ebe0caebb34fc60d3831a02972","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:57:41.320727Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T00:56:24.897034Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":"2303.08302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-07-02T00:56:24.897034Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":"5b2fdc63-bcc4-4372-a1fc-5a1cecbeff10","year":2023},"citing_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-07-31T18:33:34.529799Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T19:56:45.348973Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2305.05176"},"observation_digest":"sha256:0e6d7f12d99850cf0d9a7cfc21a5bf9e47a41d287012743df61b25b2697ace89","observation_id":"f26d289c-09a8-4f5c-a6f8-ce0ad0956639","resolution":{"observed_at":"2026-05-11T19:56:45.442680Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":"2303.08302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-07-02T00:56:24.897034Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":"5b2fdc63-bcc4-4372-a1fc-5a1cecbeff10","year":2023},"citing_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"reference_index":206,"source":"pdf_text","source_observed_at":"2026-05-15T02:39:33.007894Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2404.14294"},"observation_digest":"sha256:99dc44119c94d77ee1da3056307859cf84723a8373ef08b2c8fd12912e3d7698","observation_id":"f06b8139-c80f-4fba-aeb4-50b171d3cb12","resolution":{"observed_at":"2026-05-15T02:39:33.241090Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-08-07T05:57:41.320727Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11105","last_updated":"2025-08-07T14:57:45Z","snapshot_observed_at":"2026-08-07T05:50:57.667003Z","submitted_at":"2025-06-07T01:37:42Z","title":"Enabling On-Device Medical AI Assistants via Input-Driven Saliency Adaptation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:41.320727Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2506.11105"},"observation_digest":"sha256:16db0910a2988a6597d2c3d1b92ef7789e09791d5ba00c73cac1b718a206e3fb","observation_id":"5ed274c0-c79e-4d6a-8a69-55a310c6f575","resolution":{"observed_at":"2026-08-07T05:57:41.320727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-08-06T18:20:00.467026Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08771","last_updated":"2025-07-30T04:14:15Z","snapshot_observed_at":"2026-08-07T06:32:52.508610Z","submitted_at":"2025-07-11T17:28:56Z","title":"BlockFFN: Towards End-Side Acceleration-Friendly Mixture-of-Experts with Chunk-Level Activation Sparsity","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T18:20:00.467026Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2507.08771"},"observation_digest":"sha256:3123a30d44a28dcf068f658830ff0fac4d91a0c14a83b4066fe147c927b1ffb4","observation_id":"25797477-e26a-421e-9ef0-e44c03e8bedc","resolution":{"observed_at":"2026-08-06T18:20:00.467026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-08-06T14:11:13.303967Z","title":"arXiv preprintarXiv:2303.08302 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19699","last_updated":"2025-07-25T22:35:10Z","snapshot_observed_at":"2026-08-07T22:53:22.048383Z","submitted_at":"2025-07-25T22:35:10Z","title":"Towards Inclusive NLP: Assessing Compressed Multilingual Transformers across Diverse Language Benchmarks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:11:13.303967Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2507.19699"},"observation_digest":"sha256:1559a6b615ae9ef00ae49eae59c65e63098ba79a13ecd14889e332acb1b210b3","observation_id":"d49f8fb0-a2f7-488c-890d-ab937df70595","resolution":{"observed_at":"2026-08-06T14:11:13.303967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-08-05T16:10:53.398370Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.18911","last_updated":"2025-08-27T04:14:45Z","snapshot_observed_at":"2026-08-07T03:54:11.925644Z","submitted_at":"2025-08-26T10:34:13Z","title":"Enhancing Model Privacy in Federated Learning with Random Masking and Quantization","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T16:10:53.398370Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2508.18911"},"observation_digest":"sha256:7ad7a3383fae754ffed86663b7c2e47fe90ce66f6aefffd32b436594b31e779e","observation_id":"ef2bf2c0-6452-4e33-bb6e-4c5c73e30e2f","resolution":{"observed_at":"2026-08-05T16:10:53.398370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":"2303.08302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-07-02T00:56:24.897034Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":"5b2fdc63-bcc4-4372-a1fc-5a1cecbeff10","year":2023},"citing_paper":{"arxiv_id":"2511.06516","last_updated":"2026-06-28T18:20:13Z","snapshot_observed_at":"2026-08-03T23:21:36.698338Z","submitted_at":"2025-11-09T19:58:24Z","title":"You Had One Job: Per-Task Quantization Using LLMs' Hidden Representations","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-21T18:46:04.926179Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2511.06516"},"observation_digest":"sha256:5cccbf7b5835a20851a4f9c1661d218f2c141320bb3ea31b14376afbc4e12d7a","observation_id":"8566c60f-50ec-4410-94e6-6776a6cd901a","resolution":{"observed_at":"2026-05-21T18:50:30.273755Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-08-03T23:21:42.110167Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06516","last_updated":"2026-06-28T18:20:13Z","snapshot_observed_at":"2026-08-03T23:21:36.698338Z","submitted_at":"2025-11-09T19:58:24Z","title":"You Had One Job: Per-Task Quantization Using LLMs' Hidden Representations","version":4},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-03T23:21:42.110167Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2511.06516"},"observation_digest":"sha256:4df6707dfdb1d6a7b93b32448059a8f6940af97a9b2f62ae9846d9ac4b951907","observation_id":"9777d95e-76ab-4c39-b98f-ae42929a6f48","resolution":{"observed_at":"2026-08-03T23:21:42.110167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":"2303.08302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-07-02T00:56:24.897034Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":"5b2fdc63-bcc4-4372-a1fc-5a1cecbeff10","year":2023},"citing_paper":{"arxiv_id":"2604.21026","last_updated":"2026-04-24T07:54:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-22T19:18:30Z","title":"MCAP: Deployment-Time Layer Profiling for Memory-Constrained LLM Inference","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T00:54:33.897112Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2604.21026"},"observation_digest":"sha256:deaa924e6aa4517464815dbee6fd08bce9ce6a93db897411de0739ae248334ea","observation_id":"310bac23-4950-49a3-a4ed-0b616205c63b","resolution":{"observed_at":"2026-05-10T00:54:48.415115Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":"2303.08302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-07-02T00:56:24.897034Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":"5b2fdc63-bcc4-4372-a1fc-5a1cecbeff10","year":2023},"citing_paper":{"arxiv_id":"2605.10933","last_updated":"2026-05-20T17:26:14Z","snapshot_observed_at":"2026-08-03T07:36:40.918472Z","submitted_at":"2026-05-11T17:58:28Z","title":"DECO: Sparse Mixture-of-Experts with Dense-Comparable Performance on End-Side Devices","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-12T03:36:12.915133Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2605.10933"},"observation_digest":"sha256:e6b20d3e33acf6931a1b99df2e128d16b5509f1811f979038e5dd5189a49b254","observation_id":"f05640c3-6400-4fc2-b46b-aacd0f9b81f3","resolution":{"observed_at":"2026-05-12T03:36:19.950190Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":"2303.08302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-07-02T00:56:24.897034Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":"5b2fdc63-bcc4-4372-a1fc-5a1cecbeff10","year":2023},"citing_paper":{"arxiv_id":"2605.10933","last_updated":"2026-05-20T17:26:14Z","snapshot_observed_at":"2026-08-03T07:36:40.918472Z","submitted_at":"2026-05-11T17:58:28Z","title":"DECO: Sparse Mixture-of-Experts with Dense-Comparable Performance on End-Side Devices","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-13T07:29:14.545746Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2605.10933"},"observation_digest":"sha256:4a2d2d963f04c5f087ae45f8eb214f0d7858bc06796a1ebc82f6d4cfaed386ab","observation_id":"03866696-993d-496c-93ff-04e990ad6929","resolution":{"observed_at":"2026-05-13T07:32:30.196922Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":"2303.08302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-07-02T00:56:24.897034Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":"5b2fdc63-bcc4-4372-a1fc-5a1cecbeff10","year":2023},"citing_paper":{"arxiv_id":"2605.10933","last_updated":"2026-05-20T17:26:14Z","snapshot_observed_at":"2026-08-03T07:36:40.918472Z","submitted_at":"2026-05-11T17:58:28Z","title":"DECO: Sparse Mixture-of-Experts with Dense-Comparable Performance on End-Side Devices","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-21T07:57:49.746594Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2605.10933"},"observation_digest":"sha256:b63c92e157bdb0cd7f8179aeaada63f6e8d68b7f477b6c49b617c2d861c388c2","observation_id":"4246816d-2079-4874-b669-88e413c3a234","resolution":{"observed_at":"2026-05-21T07:59:50.166136Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":"2303.08302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-07-02T00:56:24.897034Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":"5b2fdc63-bcc4-4372-a1fc-5a1cecbeff10","year":2023},"citing_paper":{"arxiv_id":"2605.19929","last_updated":"2026-05-19T14:49:57Z","snapshot_observed_at":"2026-08-02T05:44:37.705586Z","submitted_at":"2026-05-19T14:49:57Z","title":"Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-20T05:20:45.264341Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2605.19929"},"observation_digest":"sha256:9f42893ab19a598b717d735ee38e78b6db027fe4e3ac2ce10f77646f7fa3b42f","observation_id":"bc7bccb3-9cea-42ea-8cce-3c2bf492175e","resolution":{"observed_at":"2026-05-20T05:23:03.633191Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":"2303.08302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-07-02T00:56:24.897034Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":"5b2fdc63-bcc4-4372-a1fc-5a1cecbeff10","year":2023},"citing_paper":{"arxiv_id":"2606.00494","last_updated":"2026-06-02T02:20:42Z","snapshot_observed_at":"2026-08-06T11:18:56.095781Z","submitted_at":"2026-05-30T02:54:40Z","title":"ProjQ: Project-and-Quantize for Adapter-Aware LLM Compression","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-28T19:10:58.845006Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2606.00494"},"observation_digest":"sha256:72d93a322f6da4d8d88c3920c280b87b47b6d5f73d6752d0b829407c6ba65a0e","observation_id":"9e9c1558-3a9b-4696-8b17-2112027836db","resolution":{"observed_at":"2026-06-28T19:12:34.512202Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":"2303.08302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-07-02T00:56:24.897034Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":"5b2fdc63-bcc4-4372-a1fc-5a1cecbeff10","year":2023},"citing_paper":{"arxiv_id":"2606.01412","last_updated":"2026-05-31T19:17:39Z","snapshot_observed_at":"2026-08-05T23:04:35.966323Z","submitted_at":"2026-05-31T19:17:39Z","title":"GPTQ-intrinsic LoRA: A Near-optimal Algorithm for Low-precision Quantization with Low-rank Adaptation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-28T17:28:14.160341Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2606.01412"},"observation_digest":"sha256:7f771b84cc435d8f68913b62beaf8a712648e1bad1810a4ace8a0c4f0924e8c7","observation_id":"07652548-2994-4d7f-9f53-23a64a978848","resolution":{"observed_at":"2026-07-01T21:06:14.396687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":"2303.08302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-07-02T00:56:24.897034Z","title":"A comprehensive study on post-training quantization for large language models","venue":null,"work_id":"5b2fdc63-bcc4-4372-a1fc-5a1cecbeff10","year":2023},"citing_paper":{"arxiv_id":"2606.01556","last_updated":"2026-06-01T02:02:12Z","snapshot_observed_at":"2026-07-06T23:42:07.508474Z","submitted_at":"2026-06-01T02:02:12Z","title":"TwinQuant: Learnable Subspace Decomposition for 4-Bit LLM Quantization","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-06-28T13:07:53.001390Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2606.01556"},"observation_digest":"sha256:f0959e9b4377615ff8c42e4fb9e1294fb93a0e16cc73d14ef4d86cf73f634237","observation_id":"c504d84a-0b2d-4614-a750-898e16cfb00e","resolution":{"observed_at":"2026-07-02T00:56:24.899516Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-08-02T03:55:41.125011Z","title":"Zeroquant-v2: Exploring post-training quantization in llms from comprehensive study to low rank compensation.arXiv preprint arXiv:2303.08302,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13735","last_updated":"2026-07-17T08:40:24Z","snapshot_observed_at":"2026-08-06T21:00:57.912415Z","submitted_at":"2026-07-15T11:47:24Z","title":"Constraint-Driven Model Optimization: An Industry Framework for Selecting Compression and Acceleration Techniques in Modern Machine Learning Systems","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T03:55:41.125011Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2607.13735"},"observation_digest":"sha256:c1600a5f74ad99822a6843882879a15558022fb2a70cfc4b96e710cb54468821","observation_id":"66defc3c-1c96-409c-be9e-3130e323c914","resolution":{"observed_at":"2026-08-02T03:55:41.125011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-08-01T03:16:46.948303Z","title":"Zeroquant-v2: Exploring post-training quantization in llms from comprehensive study to low rank compensation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27694","last_updated":"2026-07-30T05:26:20Z","snapshot_observed_at":"2026-08-08T17:55:34.075087Z","submitted_at":"2026-07-30T05:26:20Z","title":"GyRot: Leveraging Hidden Synergy between Rotation and Fine-grained Group Quantization for Low-bit LLM Inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T03:16:46.948303Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2607.27694"},"observation_digest":"sha256:343d5317a26ab2e285fbfb3c0d1aa86907f212b2ae78c82aebd9e8bedbdb0b99","observation_id":"5b0249f8-bee6-47b8-9021-6f42da1652e7","resolution":{"observed_at":"2026-08-01T03:16:46.948303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2303.08302/citation-record","integrity":"/paper/2303.08302/integrity","json":"/paper/2303.08302/citation-record.json","paper":"/paper/2303.08302"},"outbound":[],"paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T07:05:46.232759Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 18 inbound Pith citation observations for arXiv:2303.08302."}