{"as_of":"2026-08-17T01:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:23cbc38e12d9e29126d37f8b2b5fc637a67d777db1df7cf1f7d4ca959441aec7","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:09:58.030422Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.13989/citation-record","integrity":"/paper/2504.13989/integrity","json":"/paper/2504.13989/citation-record.json","paper":"/paper/2504.13989"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-08-16T14:24:10.346445Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-08-16T12:09:57.862024Z","title":"Croci, Marcelo Gennari do Nascimento, Torsten Hoefler, and James Hensman","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.862024Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:1d86b6917dd747220303ade267424c97175d565dc999c9dc33d5f57d1ca28b0b","observation_id":"86c87acc-c3e4-40e3-abe3-74eb8f650ecb","resolution":{"observed_at":"2026-08-16T12:09:57.862024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-16T14:04:57.666315Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-16T12:09:57.868237Z","title":"Croci, Bo Li, Pashmina Cameron, Martin Jaggi, Dan Alistarh, Torsten Hoefler, and James Hensman","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.868237Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:424db8a05772157bb982f45a3522eb81db5181225b7a7e2653631018b905424f","observation_id":"a34c4ed4-32ad-436f-8bf4-35fce4c08590","resolution":{"observed_at":"2026-08-16T12:09:57.868237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.659650Z","title":"QuIP: 2-Bit Quantization of Large Language Models With Guarantees","venue":null,"work_id":"71cb352f-ea2f-435f-8641-8904cb29c0aa","year":null},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.873928Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:1d4042576a01ea31cac2339949aeff34a69c2b4f744bc65f9acc8ff69fd6dbd2","observation_id":"dd88d39d-ccf9-4868-ba89-3da7d4b87012","resolution":{"observed_at":"2026-08-16T12:09:58.664330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05265","last_updated":"2025-01-27T13:39:25Z","snapshot_observed_at":"2026-08-16T13:11:48.628054Z","submitted_at":"2024-10-07T17:59:35Z","title":"PrefixQuant: Eliminating Outliers by Prefixed Tokens for Large Language Models Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05265","snapshot_observed_at":"2026-08-16T12:09:57.878624Z","title":"PrefixQuant: Static Quantization Beats Dynamic through Prefixed Outliers in LLMs, October 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.878624Z"},"links":{"cited_paper":"/paper/2410.05265","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:c89fec18866987cf6bca4a4d8758a08de6782705832ebf51123ffb914f2c54aa","observation_id":"d5bc7b90-b37f-4f49-8425-8a3a359e467f","resolution":{"observed_at":"2026-08-16T12:09:57.878624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.06085","last_updated":"2018-07-17T07:33:19Z","snapshot_observed_at":"2026-08-14T19:14:52.069991Z","submitted_at":"2018-05-16T01:19:43Z","title":"PACT: Parameterized Clipping Activation for Quantized Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.06085","snapshot_observed_at":"2026-08-16T12:09:57.884243Z","title":"PACT: Parameterized Clipping Activation for Quantized Neural Networks, July 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.884243Z"},"links":{"cited_paper":"/paper/1805.06085","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:f29e9b253be65cf0875f161014ef3bd8fbf00536c0637d3c752f4a6bd51d0cb1","observation_id":"2c443f7a-9ca4-4069-9718-ac8d7d5509c5","resolution":{"observed_at":"2026-08-16T12:09:57.884243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:57.890010Z","title":"Extreme Value Theory","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.890010Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:4bde4e76ba21bd07841ce229dbe4941485dee1fa2c0731a476b4b1ffd1b9cdd2","observation_id":"887ca33d-69b4-40f4-83b6-f41838afe2ea","resolution":{"observed_at":"2026-08-16T12:09:57.890010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.645268Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","venue":null,"work_id":"114089b5-3cb6-4abe-9c2d-01ccdc0ecfc9","year":null},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.894605Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:7ab13cd7c0410b4bf014da3312fcbb6b529e11c2fb4a5107a46a33904236b1b2","observation_id":"98a9f086-ffe8-41c6-9154-f049e085912d","resolution":{"observed_at":"2026-08-16T12:09:58.649968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09987","last_updated":"2022-10-17T13:29:01Z","snapshot_observed_at":"2026-08-16T18:30:14.557273Z","submitted_at":"2021-04-20T14:14:03Z","title":"Differentiable Model Compression via Pseudo Quantization Noise","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09987","snapshot_observed_at":"2026-08-16T12:09:57.899034Z","title":"Differentiable Model Compression via Pseudo Quantization Noise, October 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.899034Z"},"links":{"cited_paper":"/paper/2104.09987","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:dbe58949bc5b6b78a9f02292b1e4ec19b1fa790cdfe3e0312157f8d4ade4314a","observation_id":"f3fad53e-445b-4241-89fc-8796cdd25ec0","resolution":{"observed_at":"2026-08-16T12:09:57.899034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08153","last_updated":"2020-05-07T03:30:49Z","snapshot_observed_at":"2026-08-14T17:13:05.593256Z","submitted_at":"2019-02-21T17:31:32Z","title":"Learned Step Size Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.08153","snapshot_observed_at":"2026-08-16T12:09:57.904252Z","title":"Esser, Jeffrey L","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.904252Z"},"links":{"cited_paper":"/paper/1902.08153","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:4c038d2e963729eacc9e4152b4c46f75f46988dcaa6540eaf4d40757298c0a3a","observation_id":"945fb518-1ac8-4c20-b855-4bbbe0540d1c","resolution":{"observed_at":"2026-08-16T12:09:57.904252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17513","last_updated":"2025-08-28T15:33:02Z","snapshot_observed_at":"2026-08-16T12:47:49.928304Z","submitted_at":"2025-03-21T19:56:59Z","title":"Improving Quantization with Post-Training Model Expansion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17513","snapshot_observed_at":"2026-08-16T12:09:57.908970Z","title":"Improving Quantization with Post-Training Model Expansion, March 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.908970Z"},"links":{"cited_paper":"/paper/2503.17513","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:e6c2de1a90e94d1db518b1ca71d4f95364ad5a5badd64930a1bf5d377c22d8b5","observation_id":"0e535ed3-b364-49a3-90a1-a43a51c32b7f","resolution":{"observed_at":"2026-08-16T12:09:57.908970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-16T07:57:19.216626Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-16T12:09:57.914155Z","title":"GPTQ: Accurate Post- Training Quantization for Generative Pre-trained Transformers, March 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.914155Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:dd8efb13a1836a1ef810176ce115c58d2db932e4dec7dd0aa454ccaf0cc56ed7","observation_id":"a6d75e20-6ca4-41cf-a7a5-13c92c0cafb1","resolution":{"observed_at":"2026-08-16T12:09:57.914155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-08-16T18:36:28.163779Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-16T12:09:57.919431Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.919431Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:ce230edd1007083191c5294df24e03ee8fe7b6d2ea3965932166370f3de1a70f","observation_id":"678dfe5d-7c1b-4b41-800e-ae8776face67","resolution":{"observed_at":"2026-08-16T12:09:57.919431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.629855Z","title":"A Survey on Methods and Theories of Quantized Neural Networks, December","venue":null,"work_id":"bdbe31f9-b1b4-4071-8965-d4bd74e2e84f","year":null},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.924546Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:2706626121a9acd47e2e22447b0e6e5dd81944210e7b721c323eceae09721445","observation_id":"01b231fd-8970-46e4-984c-bca8458b718a","resolution":{"observed_at":"2026-08-16T12:09:58.635023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.613852Z","title":null,"venue":null,"work_id":"614a0ea3-7420-4cfb-a1d9-fc54fc26f7a8","year":null},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.933256Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:dfec89af08cf59ea7cacc0af7d9ce2f7f7499cba8038ee9b569442af11230f6d","observation_id":"354b0ca1-5d4c-4b94-bbed-63c07d7d48cf","resolution":{"observed_at":"2026-08-16T12:09:58.618961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08044","last_updated":"2024-09-26T23:47:03Z","snapshot_observed_at":"2026-08-16T13:35:17.182917Z","submitted_at":"2024-07-10T20:52:18Z","title":"RoLoRA: Fine-tuning Rotated Outlier-free LLMs for Effective Weight-Activation Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08044","snapshot_observed_at":"2026-08-16T12:09:57.942902Z","title":"RoLoRA: Fine-tuning Rotated Outlier-free LLMs for Effective Weight-Activation Quantization, July 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.942902Z"},"links":{"cited_paper":"/paper/2407.08044","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:da81c96461365d2955c378a137c36de7d32048890a1f25b6e9a4ff19a292e99c","observation_id":"2e25ae29-f3d9-4364-88c1-787f9da4977a","resolution":{"observed_at":"2026-08-16T12:09:57.942902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:57.947393Z","title":"LightRot: A Light-weighted Rotation Scheme and Architecture for Accurate Low-bit Large Language Model Inference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.947393Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:8c503df0ed3efecbf58a9e977e67651c7fcd02c0b804aa04df859ca1ae1ada2c","observation_id":"bc3fbb15-45c0-4248-90d1-0df33063d4f4","resolution":{"observed_at":"2026-08-16T12:09:57.947393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.582801Z","title":"DuQuant: Distributing Outliers via Dual Transformation Makes Stronger Quantized LLMs","venue":null,"work_id":"fe9dcfee-dbe0-4443-bfd7-c89937d9a1b1","year":null},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.952636Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:16855c7d819ce15576b91f0e7ca875b337f915bfe50015041e51feb0365af4ae","observation_id":"1365ca31-6124-487e-bd08-2a32bc8d6c9e","resolution":{"observed_at":"2026-08-16T12:09:58.588625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08444","last_updated":"2019-04-17T18:23:24Z","snapshot_observed_at":"2026-08-14T16:44:50.044754Z","submitted_at":"2019-04-17T18:23:24Z","title":"Defensive Quantization: When Efficiency Meets Robustness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08444","snapshot_observed_at":"2026-08-16T12:09:57.957446Z","title":"Defensive Quantization: When Efficiency Meets Robustness, April 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.957446Z"},"links":{"cited_paper":"/paper/1904.08444","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:703ed282ec810f4d4d812f1b2f407cea4014849acce96bedfeedfc38a7823f95","observation_id":"dafef2af-4617-4a17-8aba-b00585a845e3","resolution":{"observed_at":"2026-08-16T12:09:57.957446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-08-16T17:18:05.876361Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-16T12:09:57.963040Z","title":"SpinQuant: LLM quantization with learned rotations, May 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.963040Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:826542da5121f2901a40b6ca8b7b3a39221ec21452aec5428827a7e0097e8138","observation_id":"2dcd214c-1bb8-4a84-843c-e8d8c2a2ad43","resolution":{"observed_at":"2026-08-16T12:09:57.963040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-14T15:17:37.878305Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-16T12:09:57.967681Z","title":"The Era of 1-bit LLMs: All Large Lan- guage Models are in 1.58 Bits, February 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.967681Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:5eb6249ffa443c2a42e0b392c117b446cefaa8949739188e634aeb0e56330b0a","observation_id":"71a85a44-1d70-456a-96cc-fd5efc3e2973","resolution":{"observed_at":"2026-08-16T12:09:57.967681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.567133Z","title":"Applying maximum entropy principle on quantized neural networks correlates with high accuracy","venue":null,"work_id":"b2dcd918-7a57-448f-b2aa-213dad3149c9","year":null},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.972265Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:eb10bf4fbdc3e41a8db4790e654f4c64b786200ff6072c0e18cad35d946dc17c","observation_id":"3d39f4ec-95d0-4bfb-8a67-4f57637d555f","resolution":{"observed_at":"2026-08-16T12:09:58.572064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21553","last_updated":"2025-04-30T11:52:18Z","snapshot_observed_at":"2026-08-16T04:57:57.583738Z","submitted_at":"2025-04-30T11:52:18Z","title":"Precision Where It Matters: A Novel Spike Aware Mixed-Precision Quantization Strategy for LLaMA-based Language Models","version":1},"cited_work":{"arxiv_id":"2504.21553","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.21553","snapshot_observed_at":"2026-08-16T12:09:58.199009Z","title":"Precision Where It Matters: A Novel Spike Aware Mixed-Precision Quantization Strategy for LLaMA-based Language Models","venue":"cs.CL","work_id":"3ed00c46-34b6-494d-a29c-6ceb7c9ee9ea","year":2025},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.976654Z"},"links":{"cited_paper":"/paper/2504.21553","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:e2ff657d90f65e5938d377792e4ff435876c1ea85bc62c1d31e04f3e3ccc39a8","observation_id":"98677ebc-dbe7-41d4-a815-9166739c8b99","resolution":{"observed_at":"2026-08-16T12:09:58.204110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03605","last_updated":"2024-08-26T20:48:19Z","snapshot_observed_at":"2026-08-16T14:03:33.713881Z","submitted_at":"2024-04-04T17:25:30Z","title":"Mitigating the Impact of Outlier Channels for Language Model Quantization with Activation Regularization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03605","snapshot_observed_at":"2026-08-16T12:09:57.981017Z","title":"Mitigating the Impact of Outlier Channels for Language Model Quantization with Activation Regularization, April 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.981017Z"},"links":{"cited_paper":"/paper/2404.03605","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:bbce06b3faeea907b110480fade33628d5e3e16871e827cc9745329f95c7d43e","observation_id":"410c4b62-7c16-4e36-b806-d58295a603f6","resolution":{"observed_at":"2026-08-16T12:09:57.981017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.552014Z","title":"Pre- fixing Attention Sinks can Mitigate Activation Outliers for Large Language Model Quantization","venue":null,"work_id":"bda6d369-fb02-4699-aa18-4225f801e1bd","year":2024},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.985604Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:720383ca4d3b7bec0d285503a019547989254c5db3463eb48105e6454f163468","observation_id":"013c7246-32a0-4777-89ba-7d53d7b3f38f","resolution":{"observed_at":"2026-08-16T12:09:58.557534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.536199Z","title":"High-Dimensional Probability: An Introduction with Applica- tions in Data Science","venue":null,"work_id":"899bd649-4d93-46f5-9c24-16dac0869ad9","year":2018},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.989944Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:ed4aaeadbe5b8e9bfa0d02c5a08b01cb5843d4581f32479f83d98d2cae30fbb7","observation_id":"12454ad5-b722-49ec-ad98-6faabe51ba8c","resolution":{"observed_at":"2026-08-16T12:09:58.541603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-08-15T04:43:14.762539Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-08-16T12:09:57.998757Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models, October 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.998757Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:ed41a83a74249e3e8086975540a9e02a71f4d9336d3b2e2dcd8320f19a3a397f","observation_id":"4168ccd0-b698-44a5-93f2-d2169f6b5090","resolution":{"observed_at":"2026-08-16T12:09:57.998757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09145","last_updated":"2023-10-23T08:48:31Z","snapshot_observed_at":"2026-08-16T15:39:30.998681Z","submitted_at":"2023-04-18T17:34:23Z","title":"Outlier Suppression+: Accurate quantization of large language models by equivalent and optimal shifting and scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09145","snapshot_observed_at":"2026-08-16T12:09:58.003309Z","title":"Outlier Suppression+: Accurate quantization of large language models by equivalent and optimal shifting and scaling, October 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:58.003309Z"},"links":{"cited_paper":"/paper/2304.09145","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:fd72d32ee8725d12677b861f70179169cc28bc64d0c628870870062027e14ee3","observation_id":"d9467dd6-8133-4c6c-b586-6606bd970425","resolution":{"observed_at":"2026-08-16T12:09:58.003309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:57.994492Z","title":"URL https://www.cambridge.org/core/books/ highdimensional-probability/797C466DA29743D2C8213493BD2D2102","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.994492Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:3678e562c084b4fdc4b192f6aa0911ba5d5a8636267a5658b0e375f327363158","observation_id":"6eb51ddc-0838-4d99-b671-2a7da9c3b1c9","resolution":{"observed_at":"2026-08-16T12:09:57.994492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.521193Z","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models","venue":null,"work_id":"a755876c-5688-4bf0-8b36-e7bd0c202758","year":2023},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:58.012171Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:c6ddd04269fc43d9bf1a9a3ee6008e864c3e31b79450f3da1154670d9627d985","observation_id":"4eb85cc4-06d3-474c-8a9a-a8be5437cad0","resolution":{"observed_at":"2026-08-16T12:09:58.526112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.505788Z","title":"Post- Training Quantization for Re-parameterization via Coarse & Fine Weight Splitting, December","venue":null,"work_id":"ce46a7cc-18ab-41f0-837a-55510e144721","year":null},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:58.016644Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:a2834276cc856e76ad8835ad0c1f0400bd811f08fc813d84db8fd2f14ba4a8ad","observation_id":"4b703a1e-00d9-4762-9115-97e6ae4f2b15","resolution":{"observed_at":"2026-08-16T12:09:58.511025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00648","last_updated":"2025-07-15T15:36:44Z","snapshot_observed_at":"2026-08-16T21:26:53.398407Z","submitted_at":"2024-12-01T02:55:08Z","title":"DFRot: Achieving Outlier-Free and Massive Activation-Free for Rotated LLMs with Refined Rotation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00648","snapshot_observed_at":"2026-08-16T12:09:58.007686Z","title":"DFRot: Achieving Outlier-Free and Massive Activation- Free for Rotated LLMs with Refined Rotation, December 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:58.007686Z"},"links":{"cited_paper":"/paper/2412.00648","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:13216f800920ff38534ec4fa857501c24c59f34f88104e40170e3c073ec9a071","observation_id":"1aa0b935-c05e-4665-934a-2705a729ef38","resolution":{"observed_at":"2026-08-16T12:09:58.007686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.01064","last_updated":"2017-02-23T06:52:28Z","snapshot_observed_at":"2026-08-14T21:27:15.285323Z","submitted_at":"2016-12-04T05:00:22Z","title":"Trained Ternary Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.01064","snapshot_observed_at":"2026-08-16T12:09:58.030422Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:58.030422Z"},"links":{"cited_paper":"/paper/1612.01064","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:0c301e9a4459299143327eb50e97a7e78a5819ed17a94eaf49b9d48d1c214b75","observation_id":"2978e13b-6bd7-42fa-bae6-43cb41915d0f","resolution":{"observed_at":"2026-08-16T12:09:58.030422Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v35i12.17269","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.061026Z","title":"FracBits: Mixed Precision Quantization via Fractional Bit-Widths","venue":null,"work_id":"6f57997b-2dc9-4811-8670-b402e56b0acd","year":2021},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:58.025642Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:cb56cc4a6c0a747fc8363c1b18a9c1d30cf8821623b5b8812abd07c540b4793f","observation_id":"66e8fb5d-0f03-434e-a56d-3f6e1f61586a","resolution":{"observed_at":"2026-08-16T12:09:58.067601Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:09:58.599246Z","title":"Google-Books-ID: oR_HDgAAQBAJ","venue":null,"work_id":"49e52598-6ca1-4674-ac73-ff1af48b2b14","year":null},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.937566Z"},"links":{"citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:d3ef7f7b5bab98a5e71819ed76ee49166499b1b1fb3fff154e7046a54be174f9","observation_id":"65212913-0a54-45ac-9ac8-f4e3d0156aee","resolution":{"observed_at":"2026-08-16T12:09:58.603826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.04752","last_updated":"2018-12-16T08:26:57Z","snapshot_observed_at":"2026-08-14T18:41:48.710363Z","submitted_at":"2018-08-13T14:11:43Z","title":"A Survey on Methods and Theories of Quantized Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.04752","snapshot_observed_at":"2026-08-16T12:09:57.928927Z","title":"arXiv:1808.04752 [cs, stat]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:57.928927Z"},"links":{"cited_paper":"/paper/1808.04752","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:d4527a71ed36613cb2cd58defb312f4ea1e4fa9fc1b0bcfee4600931cce74e72","observation_id":"e5c4ba70-91ae-486f-824d-8ee8454d6a2f","resolution":{"observed_at":"2026-08-16T12:09:57.928927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10588","last_updated":"2023-12-17T02:31:20Z","snapshot_observed_at":"2026-08-16T14:34:05.476074Z","submitted_at":"2023-12-17T02:31:20Z","title":"Post-Training Quantization for Re-parameterization via Coarse & Fine Weight Splitting","version":1},"cited_work":{"arxiv_id":"2312.10588","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.10588","snapshot_observed_at":"2026-08-16T12:09:58.118269Z","title":"Post-Training Quantization for Re-parameterization via Coarse & Fine Weight Splitting","venue":"cs.CV","work_id":"5c065c34-baa1-4829-a3fd-0473772740ae","year":2023},"citing_paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T12:09:58.020933Z"},"links":{"cited_paper":"/paper/2312.10588","citing_paper":"/paper/2504.13989"},"observation_digest":"sha256:8761a7168c6846b7170beed67a806b187c5fe40b24bf764893f266af9237ca53","observation_id":"e625a395-fe0c-46c1-9054-e4daead71b42","resolution":{"observed_at":"2026-08-16T12:09:58.124044Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.13989","last_updated":"2025-05-13T09:36:03Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T17:19:48.615751Z","submitted_at":"2025-04-18T13:46:58Z","title":"Gradual Binary Search and Dimension Expansion : A general method for activation quantization in LLMs"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":22,"verified_exact":2,"verified_fuzzy":10},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2504.13989."}