{"as_of":"2026-08-16T06:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:303ca79a88e8f67554de70d36b393e1cee77b2e9c7367b18393fa9ff63121ffa","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:37:51.969859Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06763/citation-record","integrity":"/paper/2608.06763/integrity","json":"/paper/2608.06763/citation-record.json","paper":"/paper/2608.06763"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:52.539244Z","title":null,"venue":null,"work_id":"89453367-5576-4472-9446-fa2f3c68e982","year":1982},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.866445Z"},"links":{"citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:4029808e74ea1eb7665302741d726ab0616aa5da0c811f8b0f8430ccbe02c2a0","observation_id":"35ddb784-c191-4b63-b602-bd0ac0517b42","resolution":{"observed_at":"2026-08-15T14:37:52.543206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:52.526198Z","title":null,"venue":null,"work_id":"015e545c-7fee-4609-8be3-6f54ab95869f","year":1960},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.870534Z"},"links":{"citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:824c18b6983e3bbfb6c75ce774b5346f8e74c1b0fd7ec061e566263ec9cdd3a4","observation_id":"8952b72f-b4e2-4d03-87eb-8275e0c51054","resolution":{"observed_at":"2026-08-15T14:37:52.530366Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-11T21:19:33.078277Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-15T14:37:51.874367Z","title":"Frantar, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.874367Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:838104718aab2529abbc534673ccbeaeeedaae108fc73f408c42077876fe19ce","observation_id":"fbf75246-eb19-4634-b929-6e3dea3213a5","resolution":{"observed_at":"2026-08-15T14:37:51.874367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-08-15T14:37:51.878299Z","title":"Lin et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.878299Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:12931c9e4ba230ec86503a1584977bd2d16395749b722accc149af2aaef26be0","observation_id":"02858430-7466-4380-8513-dad4b4f0eaf9","resolution":{"observed_at":"2026-08-15T14:37:51.878299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10438","last_updated":"2024-03-29T19:21:58Z","snapshot_observed_at":"2026-08-15T13:13:36.205705Z","submitted_at":"2022-11-18T18:59:33Z","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10438","snapshot_observed_at":"2026-08-15T14:37:51.882079Z","title":"Xiao et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.882079Z"},"links":{"cited_paper":"/paper/2211.10438","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:e6f147f7c8b5bf15504d993edd843c1d623d6c9724d7ed4b6517c1084542d2ff","observation_id":"8b3fc2d1-bb4e-4938-b953-6bbaa027385c","resolution":{"observed_at":"2026-08-15T14:37:51.882079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13137","last_updated":"2024-03-18T05:33:22Z","snapshot_observed_at":"2026-08-15T10:44:06.141247Z","submitted_at":"2023-08-25T02:28:35Z","title":"OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13137","snapshot_observed_at":"2026-08-15T14:37:51.885673Z","title":"Shao et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.885673Z"},"links":{"cited_paper":"/paper/2308.13137","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:8367cd484e5e81a47c85bc10ae133d5f4bdbaec1dabe6540e34b95f063e709eb","observation_id":"6d5977e7-6bb8-4793-9324-883c3b0a37db","resolution":{"observed_at":"2026-08-15T14:37:51.885673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-08-13T23:56:42.354755Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-15T14:37:51.889813Z","title":"Dettmers, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.889813Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:fd393643eea4e4a78084fe06b0f1a1f01d4005dd4a1cf09ff37fee563ddb1e31","observation_id":"ab3dcfb9-137c-4320-8d73-aaeff59185d1","resolution":{"observed_at":"2026-08-15T14:37:51.889813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06965","last_updated":"2023-06-14T17:38:09Z","snapshot_observed_at":"2026-08-13T11:19:08.921519Z","submitted_at":"2023-06-12T08:52:14Z","title":"NF4 Isn't Information Theoretically Optimal (and that's Good)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06965","snapshot_observed_at":"2026-08-15T14:37:51.893158Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.893158Z"},"links":{"cited_paper":"/paper/2306.06965","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:3ce2bafb031ea090610c88754041e7376a474df67a2a8f7dcd06725d1a805725","observation_id":"7798a314-f5f4-4792-b3e9-94eb94066060","resolution":{"observed_at":"2026-08-15T14:37:51.893158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06653","last_updated":"2025-05-10T14:00:15Z","snapshot_observed_at":"2026-08-15T22:34:39.004525Z","submitted_at":"2025-05-10T14:00:15Z","title":"Improving Block-Wise LLM Quantization by 4-bit Block-Wise Optimal Float (BOF4): Analysis and Variations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06653","snapshot_observed_at":"2026-08-15T14:37:51.896735Z","title":"Blumenberg, T","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.896735Z"},"links":{"cited_paper":"/paper/2505.06653","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:4aa3c66e8849e022ebdb20b471ea085c346c9d378037878c6d7d07b9c0339035","observation_id":"1416a9ed-452b-45ac-9d02-d784546e38cb","resolution":{"observed_at":"2026-08-15T14:37:51.896735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:51.899676Z","title":"Cook et al","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.899676Z"},"links":{"citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:bc63d8803833b52d1f96cd3c682f050891ab7aafe02d3058f80a8c87bc5d4917","observation_id":"d3c3b17e-05a4-4c1b-8dba-5d365b6c18f9","resolution":{"observed_at":"2026-08-15T14:37:51.899676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:51.902525Z","title":"Elangovan, C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.902525Z"},"links":{"citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:638e9f8d2122a6cbe4490567ecf9ed123215c5cded73221e921a884b2690089d","observation_id":"cdb6bb5d-f966-4433-9ba1-0d323b787b6f","resolution":{"observed_at":"2026-08-15T14:37:51.902525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08692","last_updated":"2026-06-05T03:25:16Z","snapshot_observed_at":"2026-08-02T22:04:13.106139Z","submitted_at":"2026-05-09T04:59:21Z","title":"AAAC: Activation-Aware Adaptive Codebooks for 4-bit LLM Weight Quantization","version":2},"cited_work":{"arxiv_id":"2605.08692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08692","snapshot_observed_at":"2026-08-15T14:37:52.147751Z","title":"AAAC: Activation-Aware Adaptive Codebooks for 4-bit LLM Weight Quantization","venue":"cs.LG","work_id":"4ecbe90c-30c4-4573-909e-9062b6859f16","year":2026},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.905348Z"},"links":{"cited_paper":"/paper/2605.08692","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:9a7229c060d372c489f405b0484591e8649367faef55ac5efcdd329c32eae2d8","observation_id":"590b14fd-1e57-47f3-837e-22577d86488c","resolution":{"observed_at":"2026-08-15T14:37:52.153508Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.05433","last_updated":"2022-09-29T20:47:07Z","snapshot_observed_at":"2026-08-14T05:39:52.416140Z","submitted_at":"2022-09-12T17:39:55Z","title":"FP8 Formats for Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.05433","snapshot_observed_at":"2026-08-15T14:37:51.908150Z","title":"Micikevicius et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.908150Z"},"links":{"cited_paper":"/paper/2209.05433","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:49d84c8b5d757e378808d6e711cef3f9bc3f70405cf61440d1987747e2e80193","observation_id":"3c247724-cdf6-4299-851d-c9a240268d3d","resolution":{"observed_at":"2026-08-15T14:37:51.908150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-13T11:18:21.844753Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-15T14:37:51.911058Z","title":"Kim et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.911058Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:dc64bf89a377300cbacb05a1e5093e1ee45d6011cdaa194154673f5307f5825e","observation_id":"a7416f9b-af4f-4111-8886-f14a698dd9e2","resolution":{"observed_at":"2026-08-15T14:37:51.911058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03078","last_updated":"2023-06-05T17:53:28Z","snapshot_observed_at":"2026-08-13T11:24:04.469181Z","submitted_at":"2023-06-05T17:53:28Z","title":"SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03078","snapshot_observed_at":"2026-08-15T14:37:51.914357Z","title":"Dettmers et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.914357Z"},"links":{"cited_paper":"/paper/2306.03078","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:7bce74c7097a49038e62ed227a015b119208da826f31909e78d0faaeaa883a55","observation_id":"94a4d206-ecce-4dd5-9da6-7fc639909889","resolution":{"observed_at":"2026-08-15T14:37:51.914357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06118","last_updated":"2024-09-11T07:48:26Z","snapshot_observed_at":"2026-08-15T19:21:14.349554Z","submitted_at":"2024-01-11T18:54:44Z","title":"Extreme Compression of Large Language Models via Additive Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06118","snapshot_observed_at":"2026-08-15T14:37:51.917762Z","title":"Egiazarian et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.917762Z"},"links":{"cited_paper":"/paper/2401.06118","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:d52120fc43b31a3e05a2cb15f348dd1fc599398391ce8169f0a119371db78887","observation_id":"d1d3c721-2f17-4c0b-a6ac-4401bff74d62","resolution":{"observed_at":"2026-08-15T14:37:51.917762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-08-13T04:24:47.509375Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-15T14:37:51.921431Z","title":"Tseng et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.921431Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:d94f01b1ae8284569a996cb336adfad1b205907daa8813d284d2184d9a2dbb03","observation_id":"cfb16197-e846-4ae6-9451-ab02bc3c76a6","resolution":{"observed_at":"2026-08-15T14:37:51.921431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09557","last_updated":"2024-04-01T06:09:41Z","snapshot_observed_at":"2026-08-14T06:12:29.966982Z","submitted_at":"2022-06-20T03:48:17Z","title":"LUT-GEMM: Quantized Matrix Multiplication based on LUTs for Efficient Inference in Large-Scale Generative Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.09557","snapshot_observed_at":"2026-08-15T14:37:51.925114Z","title":"Park et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.925114Z"},"links":{"cited_paper":"/paper/2206.09557","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:e1d9d735e1f99e6b4a46629fa9d9778d9895e6ef4249ee1e8d1a3a782b8ead03","observation_id":"1b8385ab-6c08-48de-bb60-068aa42be394","resolution":{"observed_at":"2026-08-15T14:37:51.925114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10960","last_updated":"2025-01-17T03:09:24Z","snapshot_observed_at":"2026-08-15T10:21:56.636122Z","submitted_at":"2024-07-15T17:55:42Z","title":"Fast Matrix Multiplications for Lookup Table-Quantized LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10960","snapshot_observed_at":"2026-08-15T14:37:51.929038Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.929038Z"},"links":{"cited_paper":"/paper/2407.10960","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:b02729ca42b7e89f5cb501db49dbbc806ff375a727f14e1dfcf1e671267c7f84","observation_id":"89c1a04a-2a02-425b-887d-10716361de31","resolution":{"observed_at":"2026-08-15T14:37:51.929038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-14T18:46:34.971072Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-08-15T14:37:51.932311Z","title":"Frantar, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.932311Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:a524dedb4f51cb2523693a8b1a9996dd92d7edb19a6368ff239321b1d67d26fa","observation_id":"018de6fc-3bc7-4061-a741-0e320dd5ff01","resolution":{"observed_at":"2026-08-15T14:37:51.932311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07339","snapshot_observed_at":"2026-08-15T14:37:51.936116Z","title":"Dettmers, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.936116Z"},"links":{"cited_paper":"/paper/2208.07339","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:cfd4dd26507556f5b89e6a72d9cd00ce540b655aca29a0a4a5c68ac3c37bef57","observation_id":"d434098f-a569-4f9d-9f0b-aef64c8d30c3","resolution":{"observed_at":"2026-08-15T14:37:51.936116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01861","last_updated":"2022-06-04T00:28:21Z","snapshot_observed_at":"2026-08-14T22:20:42.170453Z","submitted_at":"2022-06-04T00:28:21Z","title":"ZeroQuant: Efficient and Affordable Post-Training Quantization for Large-Scale Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01861","snapshot_observed_at":"2026-08-15T14:37:51.939462Z","title":"Yao et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.939462Z"},"links":{"cited_paper":"/paper/2206.01861","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:7236d4e054e3b5acc7e342f3144cdad7ed892d76d47c959ad4ae7e86bd60c597","observation_id":"6276d88e-1bee-4694-b241-3aaf305918bf","resolution":{"observed_at":"2026-08-15T14:37:51.939462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04532","last_updated":"2025-05-01T02:14:05Z","snapshot_observed_at":"2026-08-13T00:12:52.272658Z","submitted_at":"2024-05-07T17:59:30Z","title":"QServe: W4A8KV4 Quantization and System Co-design for Efficient LLM Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04532","snapshot_observed_at":"2026-08-15T14:37:51.942650Z","title":"Lin et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.942650Z"},"links":{"cited_paper":"/paper/2405.04532","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:9b28561ea835cef727a941e090db123a379057ac9c93d789e926806e1174bfd6","observation_id":"c0adacbf-fd65-45f8-a7b3-5a8d6e1922d4","resolution":{"observed_at":"2026-08-15T14:37:51.942650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-15T14:37:51.945821Z","title":"Kwon et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.945821Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:189ba3409f7a5264ef976ea4390928b4dceb72a156658dcca4402b69ff6e16b7","observation_id":"3647b336-4397-49b9-b324-839da58f1fa1","resolution":{"observed_at":"2026-08-15T14:37:51.945821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:52.515313Z","title":"CUDA Binary Utilities","venue":null,"work_id":"a9eac866-ab28-466f-99d0-ab5b860aa824","year":2026},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.948863Z"},"links":{"citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:5dd270e637c1f2b44b69678c4c3f213911ef1d31efcd86ec3489aa881e6acc22","observation_id":"140d3f71-4c16-4e20-9abd-ac194f11a5a2","resolution":{"observed_at":"2026-08-15T14:37:52.518911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:52.504087Z","title":null,"venue":null,"work_id":"e9264bec-33f1-46b0-b0bf-f65f1438f6b6","year":null},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.952237Z"},"links":{"citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:afe8d2006d750b2ead698856cc19e8f8c083fa412fcee4b0f5c4c2a8dcd937f5","observation_id":"2ec69a78-a05c-4d32-94ac-0b6cba3fcf93","resolution":{"observed_at":"2026-08-15T14:37:52.508093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:52.492515Z","title":null,"venue":null,"work_id":"c11ab253-2d33-4232-8822-d92078782e17","year":null},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.956378Z"},"links":{"citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:f3f583936d73b7a242ff2467c4f011d0dd3712ecea19adbd7bcd0602f38586b2","observation_id":"30ec63d6-fbe9-4de1-8147-89ed7525649c","resolution":{"observed_at":"2026-08-15T14:37:52.496077Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:52.481084Z","title":null,"venue":null,"work_id":"0f891f9b-78ac-48e4-81b3-72df217c27cf","year":null},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.959751Z"},"links":{"citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:622f92d3ddbcf4a140ad398c1fd4db722dbab7bcf29703fc6f0a10b8aea3cca1","observation_id":"161300db-3004-4dd2-9996-a68f93f55c7f","resolution":{"observed_at":"2026-08-15T14:37:52.485020Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:52.470562Z","title":null,"venue":null,"work_id":"942546dd-afe7-4044-a766-ff1c1f79894b","year":null},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.963159Z"},"links":{"citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:b814476fe1c7a7ca1eb4e58bcb2490b2e00cb7d3e917c566dd4754e48a672ad3","observation_id":"96264e0d-bf53-4bf2-8007-c01b467df09f","resolution":{"observed_at":"2026-08-15T14:37:52.474176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:52.459300Z","title":null,"venue":null,"work_id":"15596a26-186d-451f-b07c-c7da0eee9110","year":null},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.966477Z"},"links":{"citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:ad54eca4b38eef29bb80b740a1a97a49c95096aba24ad9f6d534fe01ad7d5192","observation_id":"3f31e6b3-42c2-4fc1-a64c-c815e6c727c5","resolution":{"observed_at":"2026-08-15T14:37:52.462925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:52.448625Z","title":null,"venue":null,"work_id":"db36cb12-16f0-4483-a00f-c836a14bdded","year":null},"citing_paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:51.969859Z"},"links":{"citing_paper":"/paper/2608.06763"},"observation_digest":"sha256:c3a8c27eaab9a9cadb62d279b5d464cf7f09a5ed8908f3d3e013d2e76ee12692","observation_id":"23fa6840-28b7-467d-8366-51fd919063d3","resolution":{"observed_at":"2026-08-15T14:37:52.452149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.06763","last_updated":"2026-08-07T03:36:07Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T14:27:58.688235Z","submitted_at":"2026-08-07T03:36:07Z","title":"CubicQuant: Parametric Non-Uniform Codebooks for High-Throughput LLM Inference with 1-8-Bit Weights"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2608.06763."}