{"as_of":"2026-08-07T20:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4bcd3b44f7c33750087ad1ee6a146ca1f6604533b1d857527e52fb317ffb4c66","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":52,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:52:09.141264Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:6499e830121e730c8422292a91765fb9cec40951fcbf134d67e02b293e4fb900","observation_id":"28701e4b-a19a-4ee3-8cbf-e3743c6ad444","resolution":{"observed_at":"2026-05-17T20:11:43.597896Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"reference_index":216,"source":"pdf_text","source_observed_at":"2026-05-15T02:39:33.007894Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2404.14294"},"observation_digest":"sha256:8efa57916b8a6d50aa355fb1fafd5e61df433a831c1187876f2a6926967d48e4","observation_id":"a9f02f46-12f3-4abb-b454-9281721a0e04","resolution":{"observed_at":"2026-05-15T02:39:33.271712Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2407.08608","last_updated":"2024-07-12T22:15:02Z","snapshot_observed_at":"2026-07-06T18:44:53.587276Z","submitted_at":"2024-07-11T15:44:48Z","title":"FlashAttention-3: Fast and Accurate Attention with Asynchrony and Low-precision","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-20T19:45:36.337956Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2407.08608"},"observation_digest":"sha256:985e8b7da85cdca832afe404e9328256f0c5b14551f3d7028977d8aee5f14ff7","observation_id":"6952bc00-5e45-44c9-bd43-e9a65c78c65e","resolution":{"observed_at":"2026-05-20T19:45:36.456215Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T13:30:40.665688Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21670","last_updated":"2025-05-27T18:48:40Z","snapshot_observed_at":"2026-08-07T13:22:57.661020Z","submitted_at":"2025-05-27T18:48:40Z","title":"Rethinking the Outlier Distribution in Large Language Models: An In-depth Study","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:40.665688Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2505.21670"},"observation_digest":"sha256:682333e35d85646dc83f58c4df2f9f8e0e184473fb19a9a127150205abf6f73f","observation_id":"8f1435f5-aada-4861-9453-291e952d78cf","resolution":{"observed_at":"2026-08-07T13:30:40.665688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T10:43:47.223987Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-07T10:26:40.111860Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.223987Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:5d13ba905aeb4828e37657543b0222abc7961c86be6deacf11c861b380d4a1a9","observation_id":"abf25eb5-8f0d-4593-965a-6a9964b135d3","resolution":{"observed_at":"2026-08-07T10:43:47.223987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T10:42:41.017031Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05432","last_updated":"2025-06-26T06:17:49Z","snapshot_observed_at":"2026-08-07T10:30:44.169195Z","submitted_at":"2025-06-05T08:58:58Z","title":"PCDVQ: Enhancing Vector Quantization for Large Language Models via Polar Coordinate Decoupling","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:42:41.017031Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2506.05432"},"observation_digest":"sha256:79fd547060c51315587a85c0e9aa7421e4c8fa6d4357d96a28bccb238118bed6","observation_id":"f9803ddb-fe65-4a43-a073-ffdc263e8117","resolution":{"observed_at":"2026-08-07T10:42:41.017031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T14:52:09.141264Z","title":"Mart van Baalen, Andrey Kuzmin, Markus Nagel, Pe- ter Couperus, Cedric Bastoul, Eric Mahurin, Tijmen Blankevoort, and Paul Whatmough","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12038","last_updated":"2025-05-23T03:28:24Z","snapshot_observed_at":"2026-08-07T14:45:04.578692Z","submitted_at":"2025-05-23T03:28:24Z","title":"LCD: Advancing Extreme Low-Bit Clustering for Large Language Models via Knowledge Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:52:09.141264Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2506.12038"},"observation_digest":"sha256:13ab2c20c9a7644b589c3de391071104bb7ac866a7da68ee9f0fd257df45c497","observation_id":"653af550-633e-4c12-99bf-49198969a537","resolution":{"observed_at":"2026-08-07T14:52:09.141264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2506.12040","last_updated":"2026-04-09T06:22:06Z","snapshot_observed_at":"2026-08-02T23:24:15.663595Z","submitted_at":"2025-05-24T03:57:19Z","title":"BTC-LLM: Efficient Sub-1-Bit LLM Quantization via Learnable Transformation and Binary Codebook","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T14:03:35.214840Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2506.12040"},"observation_digest":"sha256:89753a51a6e6ed97ce25665b21d58b320af40a331835ac5de41c13128a940834","observation_id":"fa5f84dc-5fa2-48b3-b38d-220288c5e4af","resolution":{"observed_at":"2026-05-19T14:07:20.504672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T14:06:24.880486Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15689","last_updated":"2025-08-29T12:03:45Z","snapshot_observed_at":"2026-08-07T13:58:32.434150Z","submitted_at":"2025-05-26T14:22:21Z","title":"BASE-Q: Bias and Asymmetric Scaling Enhanced Rotational Quantization for Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:24.880486Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2506.15689"},"observation_digest":"sha256:46b29b78bd8573fa44b419cd0073fb507236e989f5b55ad1525259859e711f70","observation_id":"76718352-586f-4a20-830d-36091d474f31","resolution":{"observed_at":"2026-08-07T14:06:24.880486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-06T19:09:16.104514Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07145","last_updated":"2025-07-09T06:04:14Z","snapshot_observed_at":"2026-08-06T18:57:41.729030Z","submitted_at":"2025-07-09T06:04:14Z","title":"CCQ: Convolutional Code for Extreme Low-bit Quantization in LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T19:09:16.104514Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2507.07145"},"observation_digest":"sha256:232d05718c8adce189a143abe7cbca72a731332ef838f957ab282c41ade7fecd","observation_id":"844df51a-8dcc-4883-97e2-cff04b4e25a6","resolution":{"observed_at":"2026-08-06T19:09:16.104514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2508.04853","last_updated":"2026-04-09T18:24:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-06T20:00:40Z","title":"Provable Post-Training Quantization: Theoretical Analysis of OPTQ and Qronos","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T23:52:06.036879Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2508.04853"},"observation_digest":"sha256:e2c9af3635e53140975d1cb89c07bd46f85e522cb63309f76d680f5e139efb68","observation_id":"b468cf42-94a4-4060-b90c-7ff0b58c9d84","resolution":{"observed_at":"2026-05-18T23:52:53.059020Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-03T18:28:19.977137Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice code- books.arXiv preprint arXiv:2402.04396, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.05277","last_updated":"2026-06-02T23:07:19Z","snapshot_observed_at":"2026-08-07T00:48:11.221345Z","submitted_at":"2025-12-04T21:57:10Z","title":"From Segments to Scenes: Temporal Understanding for Agentic Autonomous Driving via Vision-Language Models","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T18:28:19.977137Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2512.05277"},"observation_digest":"sha256:c13a06d5d02bf489b0a21f7a1a13f6d6bc7193bec1ff39923d8108a8fe723747","observation_id":"bc2d4450-97ef-4fca-ad2c-fd26dad50cbd","resolution":{"observed_at":"2026-08-03T18:28:19.977137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2601.17187","last_updated":"2026-05-13T16:41:48Z","snapshot_observed_at":"2026-08-06T05:31:02.944877Z","submitted_at":"2026-01-23T21:32:44Z","title":"High-Rate Quantized Matrix Multiplication I","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T11:18:41.456313Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2601.17187"},"observation_digest":"sha256:c9458111d4a262d12f85656882cc4ea1582d05c5b53f1ac5e6709e67c24078c6","observation_id":"334fd9c3-d10f-459a-86ea-b26c2e77af96","resolution":{"observed_at":"2026-05-16T11:20:53.235633Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-03T06:01:15.959552Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.00942","last_updated":"2026-05-28T22:25:40Z","snapshot_observed_at":"2026-08-06T17:02:26.888999Z","submitted_at":"2026-02-01T00:00:11Z","title":"SALAAD: Sparse And Low-Rank Adaptation via ADMM for Large Language Model Inference","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T06:01:15.959552Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2602.00942"},"observation_digest":"sha256:40192725046b1f890cf7bf1bfd5cd315c32d402eb679d5fd4df803d07c8a338b","observation_id":"c4b4a7bf-04bf-43f8-9125-e543a17f50a8","resolution":{"observed_at":"2026-08-03T06:01:15.959552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-03T04:10:43.337679Z","title":"Quip\\#: Even better llm quantization with hadamard incoherence and lattice codebooks, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.05790","last_updated":"2026-06-15T20:50:08Z","snapshot_observed_at":"2026-08-03T04:10:38.797902Z","submitted_at":"2026-02-05T15:46:53Z","title":"Price of metric universality in vector quantization is at most 0.11 bit","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-03T04:10:43.337679Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2602.05790"},"observation_digest":"sha256:5b38c921e5338a3a34932f14fa44067898f3dac9a3e36435f3fce8e911c4ba44","observation_id":"29b21c0b-812c-4736-98e7-520c6166b220","resolution":{"observed_at":"2026-08-03T04:10:43.337679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-07-14T23:10:46.775151Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.11021","last_updated":"2026-07-07T12:10:29Z","snapshot_observed_at":"2026-08-06T14:26:15.552405Z","submitted_at":"2026-03-11T17:48:45Z","title":"Leech Lattice Vector Quantization for Efficient LLM Compression","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T23:10:46.775151Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2603.11021"},"observation_digest":"sha256:091f193dfee507a9f86b9f60ec9e1bf2db8cd35d8956a895b09f99720c166195","observation_id":"5850f303-8b23-4b49-8c14-9523306ebce5","resolution":{"observed_at":"2026-07-14T23:10:46.775151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.07955","last_updated":"2026-04-09T08:20:59Z","snapshot_observed_at":"2026-07-31T08:51:28.505317Z","submitted_at":"2026-04-09T08:20:59Z","title":"Rethinking Residual Errors in Compensation-based LLM Quantization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T18:10:54.439287Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.07955"},"observation_digest":"sha256:f8374317370aa0e931abaf60bc5e7ae34dd3232cb69a16c7e3f5bdf5a5c3d669","observation_id":"979a4726-743f-460c-995d-f138547b3c09","resolution":{"observed_at":"2026-05-11T05:21:01.232262Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.17789","last_updated":"2026-04-21T07:37:48Z","snapshot_observed_at":"2026-08-06T01:13:13.579210Z","submitted_at":"2026-04-20T04:27:28Z","title":"DuQuant++: Fine-grained Rotation Enhances Microscaling FP4 Quantization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T05:59:23.738476Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.17789"},"observation_digest":"sha256:d9e2f1d4adcbfbc005294646ce3dd1a6b4d1d36b0831b9a128ac1a6c5c95ba39","observation_id":"a82fc49e-4cc3-4433-a214-14351a05f5a7","resolution":{"observed_at":"2026-05-10T06:01:13.345365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.18556","last_updated":"2026-05-15T09:34:30Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T17:45:47Z","title":"GSQ: Highly-Accurate Low-Precision Scalar Quantization for LLMs via Gumbel-Softmax Sampling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T05:29:51.182114Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.18556"},"observation_digest":"sha256:f1684f5488140ae506cb8a48a200bc91fa44834004945e8974e12382b7c4a2b2","observation_id":"1c84b740-b831-4017-9c08-7a1429a8d62b","resolution":{"observed_at":"2026-05-10T05:41:02.529038Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.18556","last_updated":"2026-05-15T09:34:30Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T17:45:47Z","title":"GSQ: Highly-Accurate Low-Precision Scalar Quantization for LLMs via Gumbel-Softmax Sampling","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T18:01:08.514022Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.18556"},"observation_digest":"sha256:d8d0b1300d2097d74715264b2828b009e1222d9238d253614c521bcf5fc29205","observation_id":"ded0d6f2-9429-4b4d-9d74-40da99bc914d","resolution":{"observed_at":"2026-05-19T18:02:42.158526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.19884","last_updated":"2026-04-21T18:03:38Z","snapshot_observed_at":"2026-08-02T02:23:56.450641Z","submitted_at":"2026-04-21T18:03:38Z","title":"From Signal Degradation to Computation Collapse: Uncovering the Two Failure Modes of LLM Quantization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-10T02:32:50.182859Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.19884"},"observation_digest":"sha256:5d6b1bcf3c5ff19de6081332d6c998f9486a37ac333fe65995609b8bc774c1b1","observation_id":"7faa9924-73d0-49a2-ab8e-b55ec9c3b411","resolution":{"observed_at":"2026-05-10T02:38:17.179684Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.20682","last_updated":"2026-04-22T15:31:46Z","snapshot_observed_at":"2026-07-06T23:07:14.243878Z","submitted_at":"2026-04-22T15:31:46Z","title":"Variance Is Not Importance: Structural Analysis of Transformer Compressibility Across Model Scales","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T01:44:42.989053Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.20682"},"observation_digest":"sha256:43cc062936eb54369ec14687880054f493bbcf437739427c5bd8b5dac61fb696","observation_id":"d90fc254-7403-4cc7-9e95-459904760672","resolution":{"observed_at":"2026-05-11T13:26:04.520977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2604.24273","last_updated":"2026-04-27T10:03:37Z","snapshot_observed_at":"2026-07-06T23:10:20.676482Z","submitted_at":"2026-04-27T10:03:37Z","title":"BitRL: Reinforcement Learning with 1-bit Quantized Language Models for Resource-Constrained Edge Deployment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T04:23:26.079298Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2604.24273"},"observation_digest":"sha256:d080839461cec28d8ef778b08ecffb736ada08de2fcd6e4ad2877ffb3aa89a08","observation_id":"65084898-a928-49f3-8b7d-d021bd7234ed","resolution":{"observed_at":"2026-05-11T21:46:43.051795Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.05699","last_updated":"2026-05-07T05:44:39Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T05:44:39Z","title":"When Quantization Is Free: An int4 KV Cache That Outruns fp16 on Apple Silicon","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T03:16:00.868964Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.05699"},"observation_digest":"sha256:2d7c1d147261965e1ecf8335fbde460580be64b50df4d9d8b32dc9651f5bb097","observation_id":"1277e456-2dab-422e-8fe1-41b5f467ee08","resolution":{"observed_at":"2026-05-11T22:11:14.373234Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.12464","last_updated":"2026-05-12T17:50:08Z","snapshot_observed_at":"2026-08-02T04:50:55.914032Z","submitted_at":"2026-05-12T17:50:08Z","title":"Search Your Block Floating Point Scales!","version":1},"reference_index":157,"source":"arxiv_source","source_observed_at":"2026-05-13T05:52:26.558984Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.12464"},"observation_digest":"sha256:b816dda05f50e2a8aee70d2426df1e4353da0d60165aa51032bb5f05631b4841","observation_id":"e74c1b17-4971-445f-9e69-2044a2204c1e","resolution":{"observed_at":"2026-05-13T06:02:24.139246Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.13768","last_updated":"2026-06-08T15:33:38Z","snapshot_observed_at":"2026-08-01T18:18:03.683548Z","submitted_at":"2026-05-13T16:47:25Z","title":"High-Rate Quantized Matrix Multiplication II","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-14T19:29:22.250363Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.13768"},"observation_digest":"sha256:ceec24574ade1480a76b3dcb3afa9d8e106558072db15d888cf3989aa5c9ca71","observation_id":"fa5e0692-584d-4ebb-a1c8-c1a8e06a9df5","resolution":{"observed_at":"2026-05-14T19:32:52.654039Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.13768","last_updated":"2026-06-08T15:33:38Z","snapshot_observed_at":"2026-08-01T18:18:03.683548Z","submitted_at":"2026-05-13T16:47:25Z","title":"High-Rate Quantized Matrix Multiplication II","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T21:25:26.862900Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.13768"},"observation_digest":"sha256:f5e9fb86fe6e77ec4e0af0d1d71bceb52aece975e92fa227f143f06d404f5167","observation_id":"8e2d83e8-3f0b-4d30-a204-174f4a9231be","resolution":{"observed_at":"2026-06-30T21:35:04.991846Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.14844","last_updated":"2026-05-14T13:52:31Z","snapshot_observed_at":"2026-08-06T09:00:02.069223Z","submitted_at":"2026-05-14T13:52:31Z","title":"XFP: Quality-Targeted Adaptive Codebook Quantization with Sparse Outlier Separation for LLM Inference","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-30T21:28:36.358474Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.14844"},"observation_digest":"sha256:c768abb07e116f0c78fa62af26eff40b2e8fb7fc8a05b82e536241d2f4e2f13c","observation_id":"69e0ff21-96d9-40f6-a763-1e2993afd757","resolution":{"observed_at":"2026-06-30T21:35:04.699300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.18475","last_updated":"2026-05-18T14:30:58Z","snapshot_observed_at":"2026-08-04T01:21:32.686727Z","submitted_at":"2026-05-18T14:30:58Z","title":"GAMMA: Global Bit Allocation for Mixed-Precision Models under Arbitrary Budgets","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-20T12:25:39.417436Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.18475"},"observation_digest":"sha256:390b5c232d4df51b6c66b7cdb3346aac6f18aaa23ea1ef6a61cab921863e5771","observation_id":"7afb0a30-8a77-4ba0-ba68-76932eac5c88","resolution":{"observed_at":"2026-05-20T12:28:16.800354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.18800","last_updated":"2026-05-11T10:51:40Z","snapshot_observed_at":"2026-07-06T23:29:38.069295Z","submitted_at":"2026-05-11T10:51:40Z","title":"Theory-optimal Quantization Based on Flatness","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T22:38:06.888665Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.18800"},"observation_digest":"sha256:771916089e56e20da3b6cc2548e2e3129be4dbb2577518b690759e71ec16c1f5","observation_id":"5c711e35-6b5a-40c7-aeaa-e3055fc33baa","resolution":{"observed_at":"2026-05-20T22:39:10.010380Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.20706","last_updated":"2026-05-20T05:05:10Z","snapshot_observed_at":"2026-08-02T06:31:23.188753Z","submitted_at":"2026-05-20T05:05:10Z","title":"Llamas on the Web: Memory-Efficient, Performance-Portable, and Multi-Precision LLM Inference with WebGPU","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-21T02:52:40.923230Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.20706"},"observation_digest":"sha256:ba8a8b3cb8a6b9296eda2525bf44231c9a2845701070c2857ff32c1dd882e1fb","observation_id":"66a62db8-dd20-40f8-84a5-1e764908bff2","resolution":{"observed_at":"2026-05-21T02:53:55.288364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.23078","last_updated":"2026-05-21T22:23:38Z","snapshot_observed_at":"2026-08-02T10:30:48.658412Z","submitted_at":"2026-05-21T22:23:38Z","title":"GEMQ: Global Expert-Level Mixed-Precision Quantization for MoE LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-25T05:33:06.719954Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.23078"},"observation_digest":"sha256:1aecce71b755aac9ac79de450c9514801edafbff7285d8ae65088c7f540b19f7","observation_id":"9a056b76-2bae-4243-beaf-d2045c7cc745","resolution":{"observed_at":"2026-05-25T05:36:39.854470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.24019","last_updated":"2026-05-20T06:11:25Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-20T06:11:25Z","title":"MGVQ: Synergizing Multi-dimensional Sensitivity-Aware and Gradient-Hessian Fusion for Vector Quantization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T17:36:45.807397Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.24019"},"observation_digest":"sha256:ff55fd8ee0db27b3bff75948d1d75925763e4059807e48e34577c9b8499baca0","observation_id":"a922941e-80d6-4ce0-b902-4094c5e34ef0","resolution":{"observed_at":"2026-07-01T15:05:48.338378Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.24144","last_updated":"2026-05-22T19:06:22Z","snapshot_observed_at":"2026-07-06T23:34:13.859813Z","submitted_at":"2026-05-22T19:06:22Z","title":"EVA: Accelerating LLM Decoding via an Efficient Vector Quantization Architecture","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-30T14:35:02.484377Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.24144"},"observation_digest":"sha256:50fcd992aa2d93dfe34b6a2b0a06690b89f1a386b7171df963b486ecc25fc5bd","observation_id":"a829676f-80bb-44d5-9680-467e235be0fc","resolution":{"observed_at":"2026-06-30T14:44:45.610682Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2605.25203","last_updated":"2026-05-24T18:05:37Z","snapshot_observed_at":"2026-08-04T10:11:25.132076Z","submitted_at":"2026-05-24T18:05:37Z","title":"Influence-Inspired Spectral Rotations for Extreme Low-Bit LLM Quantization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T12:13:18.805668Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2605.25203"},"observation_digest":"sha256:f62a56192d74e76f6aa36f25208edc0a9fcbdbdda596f5926c6a9f9eb1e8489a","observation_id":"c625abbc-a448-4950-a656-559e37105655","resolution":{"observed_at":"2026-06-30T12:14:39.052951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.00206","last_updated":"2026-05-29T18:00:00Z","snapshot_observed_at":"2026-08-01T20:12:00.914542Z","submitted_at":"2026-05-29T18:00:00Z","title":"Quantized Reasoning Models Think They Need to Think Longer, but They Do Not","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-28T23:05:00.401365Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.00206"},"observation_digest":"sha256:07cbd508c6ecaa8b5dd2b54454c7816223251b7290c1587b63b86c8679b406a9","observation_id":"66a62b39-59be-4d24-821d-bb8eb1562754","resolution":{"observed_at":"2026-07-01T19:16:00.108641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.00535","last_updated":"2026-05-30T05:05:24Z","snapshot_observed_at":"2026-07-06T23:41:15.410587Z","submitted_at":"2026-05-30T05:05:24Z","title":"DREAM-S: Speculative Decoding with Searchable Drafting and Target-Aware Refinement for Multimodal Generation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-28T18:55:51.474956Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.00535"},"observation_digest":"sha256:8dbb2db2214dcbbad6b9c3b9b6963909f85450f9c54a40944cf5536b77f6a1ad","observation_id":"c13b1c42-78a6-46b0-958b-7e8ed3a4b80c","resolution":{"observed_at":"2026-06-28T19:02:34.620068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.00573","last_updated":"2026-05-30T06:53:23Z","snapshot_observed_at":"2026-07-06T23:41:15.410587Z","submitted_at":"2026-05-30T06:53:23Z","title":"LASER: Loss-Aware Singular-value Decomposition and Rank Allocation for Efficient Low-Precision Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T19:09:29.347284Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.00573"},"observation_digest":"sha256:3db4b740b3faa3a10509f8ea7c742ea3cb13b736f410ea78b98763b21d692569","observation_id":"c9ce07cf-3804-46ab-85a5-3a24dc1b8fa8","resolution":{"observed_at":"2026-06-28T19:12:34.668492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.02823","last_updated":"2026-06-01T19:40:32Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:40:32Z","title":"Qift: Shift-Friendly No-Zero W2 Post-Training Quantization for Rotated W2A4/KV4 LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T15:49:41.836888Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.02823"},"observation_digest":"sha256:8a176de516c7c4019947b0d3f94ad72316d080c04960548a6532b262993b6ec5","observation_id":"bde79f78-77dc-4e2e-b4b9-1ee44d2b52f9","resolution":{"observed_at":"2026-07-01T22:06:15.982040Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.04050","last_updated":"2026-06-29T14:48:51Z","snapshot_observed_at":"2026-08-02T11:21:40.769275Z","submitted_at":"2026-06-02T08:52:04Z","title":"LiftQuant: Continuous Bit-Width LLM via Dimensional Lifting and Projection","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-28T11:14:03.535306Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.04050"},"observation_digest":"sha256:8cefebc3b179ef0e46e52b6b0e41273dcccf37f7b01c86278c38f87e33a99570","observation_id":"d3d7e18c-cfd3-49cb-8c9a-7aed78fa2441","resolution":{"observed_at":"2026-07-02T02:06:26.980422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.04050","last_updated":"2026-06-29T14:48:51Z","snapshot_observed_at":"2026-08-02T11:21:40.769275Z","submitted_at":"2026-06-02T08:52:04Z","title":"LiftQuant: Continuous Bit-Width LLM via Dimensional Lifting and Projection","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-30T11:17:53.736872Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.04050"},"observation_digest":"sha256:aa9272703ae41218e2765e08b27d675b671e3ea413c5328861b48868c143500f","observation_id":"d37ff3ed-95ea-4597-a431-61d0017580b9","resolution":{"observed_at":"2026-06-30T11:24:38.273775Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.05429","last_updated":"2026-06-03T20:51:52Z","snapshot_observed_at":"2026-08-06T01:16:12.101022Z","submitted_at":"2026-06-03T20:51:52Z","title":"Minimizing the Hidden Cost of Scales: Graph-Guided Ultra-Low-Bit Quantization for Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T06:09:42.838355Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.05429"},"observation_digest":"sha256:892d33d3de8190abbe84b56b37a6386eef505653c2200c607d4e14acdfdd8fee","observation_id":"24c04631-cb20-4438-892f-108233728ee6","resolution":{"observed_at":"2026-07-02T08:16:48.288085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.06547","last_updated":"2026-07-19T09:43:18Z","snapshot_observed_at":"2026-08-02T12:23:11.141699Z","submitted_at":"2026-06-04T08:00:51Z","title":"FAIR-Calib: Frontier-Aware Instability-Reweighted Calibration for Post-Training Quantization of Diffusion Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T02:35:00.563647Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.06547"},"observation_digest":"sha256:354728ad8c11f24abb4c7c99d62d5113fc9e569decfac61a9f142a608562f42f","observation_id":"93ff78ee-bb36-434a-b4af-36eaf89af560","resolution":{"observed_at":"2026-07-02T12:06:55.577768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-02T12:23:13.879878Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.06547","last_updated":"2026-07-19T09:43:18Z","snapshot_observed_at":"2026-08-02T12:23:11.141699Z","submitted_at":"2026-06-04T08:00:51Z","title":"FAIR-Calib: Frontier-Aware Instability-Reweighted Calibration for Post-Training Quantization of Diffusion Large Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T12:23:13.879878Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.06547"},"observation_digest":"sha256:47b6e546269fb35747892ca96af247b2ad45e664949565d056d4c63e642177f2","observation_id":"c0132601-3a29-4c84-96e1-d0977ae20abc","resolution":{"observed_at":"2026-08-02T12:23:13.879878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.23406","last_updated":"2026-06-22T14:30:47Z","snapshot_observed_at":"2026-08-07T08:16:17.853171Z","submitted_at":"2026-06-22T14:30:47Z","title":"HyperQuant: A Rate-Distortion-Optimal Quantization Pipeline for Large Language and Diffusion Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T08:46:01.500880Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.23406"},"observation_digest":"sha256:362fa6457ef9c932dc11eba9137c938d0d2287ee2880c193b1de738bfd77c4d7","observation_id":"70b88107-7b85-4d66-a397-62ab0c9862d1","resolution":{"observed_at":"2026-07-04T10:29:45.532847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2606.23419","last_updated":"2026-06-22T14:42:34Z","snapshot_observed_at":"2026-07-06T23:58:11.694332Z","submitted_at":"2026-06-22T14:42:34Z","title":"GRINQH: Graded Input-based Quantization Hierarchy for Efficient LLM Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T08:38:32.577228Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2606.23419"},"observation_digest":"sha256:b6f3414fe2dc98a27480a5c763c4ffafb85726118888fcc5dfb71d11487ef10d","observation_id":"2f57c8e7-0ff3-4570-96ce-312bc4869769","resolution":{"observed_at":"2026-07-04T10:39:45.441374Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-07-14T08:45:52.855783Z","title":"arXiv preprint arXiv:2402.04396 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10855","last_updated":"2026-07-12T17:39:09Z","snapshot_observed_at":"2026-08-06T03:10:18.618115Z","submitted_at":"2026-07-12T17:39:09Z","title":"Reliability Scaling Laws for Quantized Large Language Models","version":1},"reference_index":160,"source":"arxiv_source","source_observed_at":"2026-07-14T08:45:52.855783Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2607.10855"},"observation_digest":"sha256:33c9093e730b06ee26046da5e29aec4fa8085351035c3545de419b3a1ed62107","observation_id":"75cbd6cf-71ce-45fd-bc84-c577b9e28297","resolution":{"observed_at":"2026-07-14T08:45:52.855783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-02T01:35:43.851034Z","title":"Tseng, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14630","last_updated":"2026-07-16T06:47:52Z","snapshot_observed_at":"2026-08-06T23:27:59.381028Z","submitted_at":"2026-07-16T06:47:52Z","title":"Cross-Layer Error Compensation and Finite-Sample Feature-Statistics Matching for Extreme Low-Bit Quantization of Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T01:35:43.851034Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2607.14630"},"observation_digest":"sha256:56d855ae35625149ec1e4f5cd082cfab89d1871c7f47de5160073ba1b8e874e2","observation_id":"6f7f2d25-95d6-4df6-a7d3-18d90b9d3ac6","resolution":{"observed_at":"2026-08-02T01:35:43.851034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-02T14:29:28.509827Z","title":"arXiv preprint arXiv:2402.04396 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20434","last_updated":"2026-05-11T10:50:26Z","snapshot_observed_at":"2026-08-06T17:07:51.320317Z","submitted_at":"2026-05-11T10:50:26Z","title":"Break Through the Compression Bottleneck: From Theory to Practice","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T14:29:28.509827Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2607.20434"},"observation_digest":"sha256:5bc2150ef5bcb39dde39229dcf321a8f94929ed44ecf1c2bb6a693d28eca289c","observation_id":"0d47cdbc-5d5d-4238-836f-77290468ea3e","resolution":{"observed_at":"2026-08-02T14:29:28.509827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-07-31T22:36:29.341483Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24148","last_updated":"2026-07-27T08:29:05Z","snapshot_observed_at":"2026-08-07T04:57:17.871783Z","submitted_at":"2026-07-27T08:29:05Z","title":"A Motion-Aware Vector Quantization Framework with Centroid Reuse for Efficient VLA Inference","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-31T22:36:29.341483Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2607.24148"},"observation_digest":"sha256:b75d31c8aa2807b6514575bc0b112c71b239ffd9d4d389461dd4b29f1990cf1d","observation_id":"829af20d-2a27-471e-a618-badf62ddb760","resolution":{"observed_at":"2026-07-31T22:36:29.341483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-01T03:16:46.931878Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27694","last_updated":"2026-07-30T05:26:20Z","snapshot_observed_at":"2026-08-06T21:37:30.089385Z","submitted_at":"2026-07-30T05:26:20Z","title":"GyRot: Leveraging Hidden Synergy between Rotation and Fine-grained Group Quantization for Low-bit LLM Inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T03:16:46.931878Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2607.27694"},"observation_digest":"sha256:19299980aa7b23d5805bf1dc5fd1d4a15722e7930010c9b04fb15064b1cd7b83","observation_id":"34d4b659-a33f-4912-8ed3-172af34aa219","resolution":{"observed_at":"2026-08-01T03:16:46.931878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T21:59:39.992784Z","title":"arXiv preprint arXiv:2402.04396 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03276","last_updated":"2026-08-04T07:51:37Z","snapshot_observed_at":"2026-08-07T19:11:49.803755Z","submitted_at":"2026-08-04T07:51:37Z","title":"TaskPress: Query-Agnostic KV Cache Compression via Task-Guided Pruning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T21:59:39.992784Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2608.03276"},"observation_digest":"sha256:eb856e7ec71a849aa51ed057fe04d734c68bacb1dcdcb5eef0681da651d77318","observation_id":"c2ee7334-ce78-4440-80e0-3553412fa3c8","resolution":{"observed_at":"2026-08-05T21:59:39.992784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.04396/citation-record","integrity":"/paper/2402.04396/integrity","json":"/paper/2402.04396/citation-record.json","paper":"/paper/2402.04396"},"outbound":[],"paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 52 inbound Pith citation observations for arXiv:2402.04396."}