{"as_of":"2026-08-04T22:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e81311ef9f92d36ecb78c6286f56e10c79574308b954aa779e800ea527529408","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":36,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T23:41:52.877669Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T16:18:37.340082Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2312.05821","last_updated":"2025-08-28T03:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-10T08:41:24Z","title":"ASVD: Activation-aware Singular Value Decomposition for Compressing Large Language Models","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T13:49:33.747672Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2312.05821"},"observation_digest":"sha256:326b1978e49c708f67fadc5649c22d59428402c8e06d0548eee4461288fd20ed","observation_id":"fe5067cf-dab7-4166-aa91-a11026099e93","resolution":{"observed_at":"2026-05-20T13:49:33.850130Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-13T10:36:17.764761Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2401.10774"},"observation_digest":"sha256:6af3ffaa821a72b36c544e3dfd17be81efed38cfc4a5beebddb858673b2676dc","observation_id":"652a7ae9-34ed-4e07-bc1c-d8e964f9b301","resolution":{"observed_at":"2026-05-13T10:36:18.341205Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2402.02750","last_updated":"2024-07-25T09:16:05Z","snapshot_observed_at":"2026-07-06T17:25:18.238343Z","submitted_at":"2024-02-05T06:06:47Z","title":"KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T08:53:12.253243Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2402.02750"},"observation_digest":"sha256:6994d183d1f69f5f1c8602b5d54e6146a3f12dbcbb9c2228616f747b59f575d6","observation_id":"37c8d920-1703-41cf-9a2c-069a3b3898ab","resolution":{"observed_at":"2026-05-12T08:53:12.337562Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2403.12031","last_updated":"2024-03-28T17:56:28Z","snapshot_observed_at":"2026-07-06T17:46:29.153377Z","submitted_at":"2024-03-18T17:59:04Z","title":"RouterBench: A Benchmark for Multi-LLM Routing System","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-16T10:47:31.006944Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2403.12031"},"observation_digest":"sha256:b7065805013961f0a42739563b95fce2e15a854428d3f15030c310858503b749","observation_id":"8c46ab81-0c82-4bf6-82d4-4f4f738c1f12","resolution":{"observed_at":"2026-05-16T10:47:31.094875Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"reference_index":197,"source":"pdf_text","source_observed_at":"2026-05-15T02:39:33.007894Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2404.14294"},"observation_digest":"sha256:5d2332c0cfc73808175acdbccd7e609cab3f9339826b230cd0ff567f03af20b3","observation_id":"dc0a389b-ad0f-4564-b0d7-fec01552fe30","resolution":{"observed_at":"2026-05-15T02:39:33.214075Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T15:52:34.606853Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2405.16406"},"observation_digest":"sha256:de95e5bbff9db4b13366f85adaa3343aef310a4c912650d7f21d40be6fd6bb85","observation_id":"c2b6fba9-5454-4565-b948-54fe9cad1fec","resolution":{"observed_at":"2026-05-15T15:52:34.700791Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2503.08223","last_updated":"2026-04-09T15:28:27Z","snapshot_observed_at":"2026-07-06T20:50:33.513259Z","submitted_at":"2025-03-11T09:41:29Z","title":"Will LLMs Scaling Hit the Wall? Breaking Barriers via Distributed Resources on Massive Edge Devices","version":3},"reference_index":174,"source":"pdf_text","source_observed_at":"2026-05-23T01:03:26.037233Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2503.08223"},"observation_digest":"sha256:9a2d45b3cf9bc2dc45f4f8da79c96ad11fb1d1011699ecb8b9cf554067bc3b73","observation_id":"a609dd30-4a14-47d9-b2e7-a04c77294da5","resolution":{"observed_at":"2026-05-23T01:05:16.310998Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2504.19874","last_updated":"2025-04-28T15:05:35Z","snapshot_observed_at":"2026-08-01T14:10:27.172555Z","submitted_at":"2025-04-28T15:05:35Z","title":"TurboQuant: Online Vector Quantization with Near-optimal Distortion Rate","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T08:09:22.226608Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2504.19874"},"observation_digest":"sha256:84b3bb0e0980dccb76be353097dbe4eda6990536c794d21add0971d11063770d","observation_id":"e28853ba-9226-4caf-bf9b-35df3a4991a8","resolution":{"observed_at":"2026-05-20T08:09:22.277661Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2505.02380","last_updated":"2026-01-26T11:44:39Z","snapshot_observed_at":"2026-07-06T21:18:55.327700Z","submitted_at":"2025-05-05T05:42:14Z","title":"EntroLLM: Entropy Encoded Weight Compression for Efficient Large Language Model Inference on Edge Devices","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T16:34:37.083239Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2505.02380"},"observation_digest":"sha256:118e86bb20c5a0412e90364e87033c36dcc3aad671be60ec0b1cb1b46656798c","observation_id":"929dcb5e-aab5-4020-aca7-84de10b3c0bc","resolution":{"observed_at":"2026-05-22T16:34:59.261977Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2506.13727","last_updated":"2026-05-07T16:37:45Z","snapshot_observed_at":"2026-07-06T21:43:03.415527Z","submitted_at":"2025-06-16T17:38:36Z","title":"Attribution-Guided Pruning for Insight and Control: Circuit Discovery and Targeted Correction in Small-scale LLMs","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T08:52:45.818050Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2506.13727"},"observation_digest":"sha256:7daf3ad56258c0d7283efb1f8404549525fadd212fc071eb3b527c146231afc4","observation_id":"0c4f7916-3238-492b-bb86-7a95c6562580","resolution":{"observed_at":"2026-05-19T08:53:04.144810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-03T23:41:52.877669Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.04805","last_updated":"2026-07-06T16:04:54Z","snapshot_observed_at":"2026-08-04T04:11:07.086318Z","submitted_at":"2025-11-06T20:53:02Z","title":"PuzzleMoE: Efficient Compression of Large Mixture-of-Experts Models via Sparse Expert Merging and Bit-packed inference","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-03T23:41:52.877669Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2511.04805"},"observation_digest":"sha256:853cc2bc2aa4adf490f351ec10d77e7d3b8965a1ca4f1bba8dc7f62e4b347b59","observation_id":"5345532e-07ac-4710-acc3-c0145d49c1b6","resolution":{"observed_at":"2026-08-03T23:41:52.877669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-03T06:38:22.663076Z","title":"Squeezellm:Dense-and-sparsequantization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.22546","last_updated":"2026-07-31T03:36:38Z","snapshot_observed_at":"2026-08-04T22:10:34.959220Z","submitted_at":"2026-01-30T04:36:09Z","title":"Towards the Holographic Characteristic of LLMs for Efficient Short-text Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T06:38:22.663076Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2601.22546"},"observation_digest":"sha256:1081eb7d12ae5db6f82221cddb2adc72058bff057c68cfde04f933c3fd660ac0","observation_id":"0985625e-76f9-437f-ad97-54c08b11d733","resolution":{"observed_at":"2026-08-03T06:38:22.663076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2602.05902","last_updated":"2026-05-08T19:18:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-05T17:18:02Z","title":"CoreQ: Learning-Free Mismatch Correction and Successive Rounding for Quantization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T06:51:18.629467Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2602.05902"},"observation_digest":"sha256:f0bb3e76f5f6888a126608cfb1849cd0d3145ca9358f870b764242ffca3ff691","observation_id":"bd74cafc-1369-4735-b1e1-8dc004cf81fc","resolution":{"observed_at":"2026-05-16T06:52:28.393534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2604.20079","last_updated":"2026-04-22T00:53:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-22T00:53:43Z","title":"On the Quantization Robustness of Diffusion Language Models in Coding Benchmarks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T00:21:30.101748Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2604.20079"},"observation_digest":"sha256:955fe2eb3b96b4158b48f9b6e26b85fb9f1573c7ed009fef8373efbc3edeffb9","observation_id":"4f1281b2-6e40-4ab6-8b75-236e1bbd952f","resolution":{"observed_at":"2026-05-10T00:24:47.003271Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2604.24008","last_updated":"2026-04-27T03:43:29Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:43:29Z","title":"Coverage-Based Calibration for Post-Training Quantization via Weighted Set Cover over Outlier Channels","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T04:35:02.120009Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2604.24008"},"observation_digest":"sha256:2adee7c6cad8ddbac9fcbd8f894b33700aa67b1344fc9cf4203ad4f254e7f016","observation_id":"4de3b8e2-c80f-463d-a5d6-a86773e97d0d","resolution":{"observed_at":"2026-05-11T21:41:16.200257Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2604.24273","last_updated":"2026-04-27T10:03:37Z","snapshot_observed_at":"2026-07-06T23:10:20.676482Z","submitted_at":"2026-04-27T10:03:37Z","title":"BitRL: Reinforcement Learning with 1-bit Quantized Language Models for Resource-Constrained Edge Deployment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T04:23:26.079298Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2604.24273"},"observation_digest":"sha256:e01a6887a1f925d904ef9775d948774ef5a11314bf583034acdc858facc7eae8","observation_id":"e07df099-eae8-4bee-9a7e-d68669a9ec3a","resolution":{"observed_at":"2026-05-11T21:46:42.443324Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2605.02196","last_updated":"2026-05-08T12:13:19Z","snapshot_observed_at":"2026-08-02T18:15:52.484665Z","submitted_at":"2026-05-04T03:54:14Z","title":"DurableUn: Quantization-Induced Recovery Attacks in Machine Unlearning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T18:49:53.432959Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2605.02196"},"observation_digest":"sha256:d68384fd92f1832c9a42dcaab96ba95f7cf875cdf055f82d8ce7512f66e963c0","observation_id":"8f50f0c4-d94e-433f-ab19-6021234e0e44","resolution":{"observed_at":"2026-05-09T06:10:42.160072Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2605.02196","last_updated":"2026-05-08T12:13:19Z","snapshot_observed_at":"2026-08-02T18:15:52.484665Z","submitted_at":"2026-05-04T03:54:14Z","title":"DurableUn: Quantization-Induced Recovery Attacks in Machine Unlearning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T01:49:51.021741Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2605.02196"},"observation_digest":"sha256:2baaa92b40b3779921e5116c0871b627b00f09427bc4b9dad06c87dbe0170f9a","observation_id":"39e3d22d-1c77-4575-9115-5a4f1c462bc9","resolution":{"observed_at":"2026-05-11T01:50:51.165324Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2605.02262","last_updated":"2026-05-04T06:17:13Z","snapshot_observed_at":"2026-07-06T23:15:23.301944Z","submitted_at":"2026-05-04T06:17:13Z","title":"WindowQuant: Mixed-Precision KV Cache Quantization based on Window-Level Similarity for VLMs Inference Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-09T16:06:26.450483Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2605.02262"},"observation_digest":"sha256:1609b80e30f651942fa66db6e6749f8ede9942e45e4f7ae1446ec004e6933c33","observation_id":"99e832e7-3ec7-4588-b1ac-415de378cc29","resolution":{"observed_at":"2026-05-11T16:36:08.029916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2605.04058","last_updated":"2026-04-10T08:00:28Z","snapshot_observed_at":"2026-07-06T23:16:54.673178Z","submitted_at":"2026-04-10T08:00:28Z","title":"MP-ISMoE: Mixed-Precision Interactive Side Mixture-of-Experts for Efficient Transfer Learning","version":1},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-05-10T17:19:59.247074Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2605.04058"},"observation_digest":"sha256:3eeb7f66ce34e8d4e10ba152f6461920d5803e7989127d2c03a21bf1f28d3ff7","observation_id":"0d0da963-e2f9-4554-b344-1f115737f3f5","resolution":{"observed_at":"2026-05-11T07:01:10.321373Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2605.04738","last_updated":"2026-05-09T08:06:42Z","snapshot_observed_at":"2026-07-06T23:17:28.583202Z","submitted_at":"2026-05-06T10:35:25Z","title":"OSAQ: Outlier Self-Absorption for Accurate Low-bit LLM Quantization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T18:23:14.935801Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2605.04738"},"observation_digest":"sha256:360fbc47ecd93c735c5c9a4836247db79d32e3cf1f22aeb23d457d60ea3f6f1c","observation_id":"ee2ac829-f9e2-4fd6-ad98-c96f3e2bc34f","resolution":{"observed_at":"2026-05-09T06:30:44.142303Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2605.04738","last_updated":"2026-05-09T08:06:42Z","snapshot_observed_at":"2026-07-06T23:17:28.583202Z","submitted_at":"2026-05-06T10:35:25Z","title":"OSAQ: Outlier Self-Absorption for Accurate Low-bit LLM Quantization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T02:59:00.997742Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2605.04738"},"observation_digest":"sha256:7edcd6468df0f1906bd819e39b932cbcaea6d8f59645bf841a8af40e589bb37c","observation_id":"2740b635-abd5-496a-a944-9bdd0dd5b5ea","resolution":{"observed_at":"2026-05-12T03:01:18.210120Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2605.14844","last_updated":"2026-05-14T13:52:31Z","snapshot_observed_at":"2026-07-06T23:26:13.644646Z","submitted_at":"2026-05-14T13:52:31Z","title":"XFP: Quality-Targeted Adaptive Codebook Quantization with Sparse Outlier Separation for LLM Inference","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-30T21:28:36.358474Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2605.14844"},"observation_digest":"sha256:0cbb513af200b81b5b91dd8989ed47c3733d32598f674b857f3187f7509492db","observation_id":"d16da3e7-de78-4192-8548-66862fc2ff1b","resolution":{"observed_at":"2026-06-30T21:35:04.690279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2605.19929","last_updated":"2026-05-19T14:49:57Z","snapshot_observed_at":"2026-08-02T05:44:37.705586Z","submitted_at":"2026-05-19T14:49:57Z","title":"Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T05:20:45.264341Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2605.19929"},"observation_digest":"sha256:d7265320c1f90546e43c6a654e1dca8658d89feeb592d19a2a0c38494fb260ec","observation_id":"7ec28d36-0207-4a96-98b0-9217129dccff","resolution":{"observed_at":"2026-05-20T05:23:03.625863Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2605.23078","last_updated":"2026-05-21T22:23:38Z","snapshot_observed_at":"2026-08-02T10:30:48.658412Z","submitted_at":"2026-05-21T22:23:38Z","title":"GEMQ: Global Expert-Level Mixed-Precision Quantization for MoE LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-25T05:33:06.719954Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2605.23078"},"observation_digest":"sha256:e6608dde710d9f56a6979e7fa7ee1b95c4fa54419a479ca48fe73283af1c8eef","observation_id":"9bd3ab0c-6349-4222-a3c0-7f1dfd3eba6d","resolution":{"observed_at":"2026-05-25T05:36:39.872360Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2605.24011","last_updated":"2026-06-04T20:07:22Z","snapshot_observed_at":"2026-08-01T12:29:34.981172Z","submitted_at":"2026-05-19T19:57:26Z","title":"ActQuant: Sub-4-bit Action-Guided Quantization for Vision-Language-Action Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T17:54:56.386488Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2605.24011"},"observation_digest":"sha256:a7b786040b5019e92f864663b8dbd1e0f8599aca768319ac00fb5983a10a7431","observation_id":"bf0cc52c-1c31-4da3-9a8e-9cba87bf348f","resolution":{"observed_at":"2026-06-30T18:04:58.491515Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2606.00535","last_updated":"2026-05-30T05:05:24Z","snapshot_observed_at":"2026-07-06T23:41:15.410587Z","submitted_at":"2026-05-30T05:05:24Z","title":"DREAM-S: Speculative Decoding with Searchable Drafting and Target-Aware Refinement for Multimodal Generation","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-06-28T18:55:51.474956Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2606.00535"},"observation_digest":"sha256:357d489d765308a6d281067cef9777e84ec239b0eaada98f7ba99f390dcb7937","observation_id":"9f262736-e8cc-4a2d-ada2-88c261a3f7b2","resolution":{"observed_at":"2026-06-28T19:02:34.617720Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2606.01412","last_updated":"2026-05-31T19:17:39Z","snapshot_observed_at":"2026-08-03T03:34:13.453285Z","submitted_at":"2026-05-31T19:17:39Z","title":"GPTQ-intrinsic LoRA: A Near-optimal Algorithm for Low-precision Quantization with Low-rank Adaptation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T17:28:14.160341Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2606.01412"},"observation_digest":"sha256:485c496ac2e135d39fe8be0a1935818266c383fdc1cdddd467b41ecfbedbd05d","observation_id":"d4b4ba6f-6db8-4589-807f-f054a40c3feb","resolution":{"observed_at":"2026-07-01T21:06:14.475000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2606.05429","last_updated":"2026-06-03T20:51:52Z","snapshot_observed_at":"2026-08-01T01:29:54.377180Z","submitted_at":"2026-06-03T20:51:52Z","title":"Minimizing the Hidden Cost of Scales: Graph-Guided Ultra-Low-Bit Quantization for Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T06:09:42.838355Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2606.05429"},"observation_digest":"sha256:fe179a0a4c958556dd63b400052ccc524a2f2606b0c92450a60217d56e8209b7","observation_id":"cb5672a2-5a67-43de-ac03-95457cefd64a","resolution":{"observed_at":"2026-07-02T08:16:48.293704Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2606.28438","last_updated":"2026-06-26T07:35:43Z","snapshot_observed_at":"2026-08-03T00:04:55.169727Z","submitted_at":"2026-06-26T07:35:43Z","title":"When AI Reviews Its Own Code: Recursive Self-Training Collapse in Code LLMs","version":1},"reference_index":141,"source":"arxiv_source","source_observed_at":"2026-06-30T01:29:42.919461Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2606.28438"},"observation_digest":"sha256:86a622066807d12e292270a9be4e484981e7d66473e97714f707392b996176ad","observation_id":"cc0d0cdb-359f-4fbf-a642-c00e4281e965","resolution":{"observed_at":"2026-07-01T15:25:48.408417Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2607.01065","last_updated":"2026-07-01T15:25:21Z","snapshot_observed_at":"2026-07-07T00:06:39.908636Z","submitted_at":"2026-07-01T15:25:21Z","title":"GSRQ: Gain-Shape Residual Quantization for Sub-1-bit KV Cache","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-02T15:55:40.177742Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2607.01065"},"observation_digest":"sha256:b25962ec403a1b284dd752df223977047347039ff84be7f1839213d03bac1bcd","observation_id":"1bac6c64-6ee8-4ee4-a0bd-310a5e10279c","resolution":{"observed_at":"2026-07-02T15:57:06.403971Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2607.01876","last_updated":"2026-07-02T08:30:00Z","snapshot_observed_at":"2026-07-07T00:07:23.664493Z","submitted_at":"2026-07-02T08:30:00Z","title":"SAB-LVLM: Significance-Aware Binarization for Large Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-03T16:14:03.717787Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2607.01876"},"observation_digest":"sha256:3c5e7f3546c693fe301f1de7cb2c05b8e2c3ec79e0f5e92ca7e7d3331498a5cf","observation_id":"807090fd-1b0e-484d-b714-c291eb299548","resolution":{"observed_at":"2026-07-03T16:18:37.341488Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":"2306.07629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-03T16:18:37.340082Z","title":"W., and Keutzer, K","venue":null,"work_id":"aebf1644-0d5e-418f-a910-1b207d30e16d","year":2023},"citing_paper":{"arxiv_id":"2607.02461","last_updated":"2026-07-02T17:27:34Z","snapshot_observed_at":"2026-08-02T16:58:40.309745Z","submitted_at":"2026-07-02T17:27:34Z","title":"OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-03T14:56:10.553212Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2607.02461"},"observation_digest":"sha256:f6183b1b6c445cc15b6a2015c3385cafba273a5c2a0926db5f8e7cbcd4fad9d2","observation_id":"0e56bdc7-8bc2-4799-9fed-944eb3b39dbb","resolution":{"observed_at":"2026-07-03T14:58:32.417750Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-07-13T01:10:03.032181Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08993","last_updated":"2026-07-09T23:52:57Z","snapshot_observed_at":"2026-08-03T16:02:09.671176Z","submitted_at":"2026-07-09T23:52:57Z","title":"StreamDQ: Near-Memory Weight DeQuantization in Custom HBM for Scalable AI Inference Acceleration","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T01:10:03.032181Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2607.08993"},"observation_digest":"sha256:2e5f072fcae2eda23097ecb7c8b276ab265ff4747300820f6218f65e2c392545","observation_id":"91ab3514-5ab9-417b-bd6b-a58cc4aea220","resolution":{"observed_at":"2026-07-13T01:10:03.032181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-01T17:12:27.941291Z","title":"arXiv preprint arXiv:2306.07629 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-03T10:45:48.871032Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.941291Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:904b31e3c90952d03487296c5638b23ceb3ded5b1fafd457babf89c7655d0d08","observation_id":"25b40a43-1701-4822-b146-c3fd2fdc511c","resolution":{"observed_at":"2026-08-01T17:12:27.941291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-01T12:04:14.348367Z","title":"SqueezeLLM: Dense -and-sparse quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19676","last_updated":"2026-07-22T02:25:46Z","snapshot_observed_at":"2026-08-01T12:04:11.398800Z","submitted_at":"2026-07-22T02:25:46Z","title":"Edge Intelligence in Civil Aviation: Paradigms, Techniques, and Applications","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T12:04:14.348367Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2607.19676"},"observation_digest":"sha256:6b310569deabf4219fcf799dff2c2c2e79382de08c9467d36c34f223e8b76d91","observation_id":"a32228b5-c235-4152-960b-a3ebecdb9bf7","resolution":{"observed_at":"2026-08-01T12:04:14.348367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.07629/citation-record","integrity":"/paper/2306.07629/integrity","json":"/paper/2306.07629/citation-record.json","paper":"/paper/2306.07629"},"outbound":[],"paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T15:22:23.791521Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 36 inbound Pith citation observations for arXiv:2306.07629."}