{"as_of":"2026-08-08T23:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9976f4599f5ecb298d2e18a135bbd3c9d7bb2c27ae085fa7b12b926ab67537ca","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:43:50.212638Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T23:10:46.775151Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T22:11:14.387607Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04985","snapshot_observed_at":"2026-07-14T23:10:46.775151Z","title":"Fptquant: Function-preserving transforms for llm quantization.arXiv preprint arXiv:2506.04985,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.11021","last_updated":"2026-07-07T12:10:29Z","snapshot_observed_at":"2026-08-06T14:26:15.552405Z","submitted_at":"2026-03-11T17:48:45Z","title":"Leech Lattice Vector Quantization for Efficient LLM Compression","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T23:10:46.775151Z"},"links":{"cited_paper":"/paper/2506.04985","citing_paper":"/paper/2603.11021"},"observation_digest":"sha256:c159e9827ca0d1fe9d96af77d56e149ee40d7670222cb66fcde9efd4a9d9498f","observation_id":"fbe7599b-8d5c-4a5e-b8b4-f20481b37886","resolution":{"observed_at":"2026-07-14T23:10:46.775151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04985","snapshot_observed_at":"2026-07-13T23:28:12.790404Z","title":"Fptquant: Function-preserving transforms for llm quantization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16867","last_updated":"2026-06-03T09:37:20Z","snapshot_observed_at":"2026-08-06T21:47:33.826393Z","submitted_at":"2026-03-17T17:59:51Z","title":"Efficient Reasoning on the Edge","version":2},"reference_index":147,"source":"pdf_text","source_observed_at":"2026-07-13T23:28:12.790404Z"},"links":{"cited_paper":"/paper/2506.04985","citing_paper":"/paper/2603.16867"},"observation_digest":"sha256:6d7924f417d0f7a611142598a3949ed616e8aecfa566863434defdc122910ffc","observation_id":"7bd8316e-ec7e-42e8-9b9d-7b05baa4b7ba","resolution":{"observed_at":"2026-07-13T23:28:12.790404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"cited_work":{"arxiv_id":"2506.04985","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04985","snapshot_observed_at":"2026-07-09T01:19:36.313617Z","title":"FPTQuant: Function-preserving transforms for LLM quantization","venue":null,"work_id":"0371fcd4-718a-4ccf-9d47-19ee695dc571","year":2025},"citing_paper":{"arxiv_id":"2605.05699","last_updated":"2026-05-07T05:44:39Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T05:44:39Z","title":"When Quantization Is Free: An int4 KV Cache That Outruns fp16 on Apple Silicon","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T03:16:00.868964Z"},"links":{"cited_paper":"/paper/2506.04985","citing_paper":"/paper/2605.05699"},"observation_digest":"sha256:609e52b6bf3ea2539973fc6ddd6906ee1628961d354a391744e6dc818acf300b","observation_id":"781beda3-9b01-4397-bf23-090a6a93836f","resolution":{"observed_at":"2026-07-09T01:19:36.313617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04985","snapshot_observed_at":"2026-07-12T09:35:12.908124Z","title":"arXiv preprint arXiv:2506.04985 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02584","last_updated":"2026-07-11T01:46:15Z","snapshot_observed_at":"2026-08-08T14:50:05.364337Z","submitted_at":"2026-07-01T02:44:10Z","title":"RotateAttention: RoPE-Aware Rotation and Range Rectification for INT4 Quantized Attention in Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T09:35:12.908124Z"},"links":{"cited_paper":"/paper/2506.04985","citing_paper":"/paper/2607.02584"},"observation_digest":"sha256:6bcb7e0df2664bd170434d483cce4b8281b8132e1f02c3063e247c2538ef3a8c","observation_id":"70b001ba-0d1e-4e7a-8c1e-dd1c65847f4e","resolution":{"observed_at":"2026-07-12T09:35:12.908124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04985","snapshot_observed_at":"2026-07-14T16:53:34.398685Z","title":"arXiv preprint arXiv:2506.04985 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02584","last_updated":"2026-07-11T01:46:15Z","snapshot_observed_at":"2026-08-08T14:50:05.364337Z","submitted_at":"2026-07-01T02:44:10Z","title":"RotateAttention: RoPE-Aware Rotation and Range Rectification for INT4 Quantized Attention in Video Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T16:53:34.398685Z"},"links":{"cited_paper":"/paper/2506.04985","citing_paper":"/paper/2607.02584"},"observation_digest":"sha256:e146c86b65fee7e2b3b8b1e0b9010e5f1e95a907866b874be0682561e807311a","observation_id":"f81c0d0d-901b-418c-bf2b-bff90bf5bbf0","resolution":{"observed_at":"2026-07-14T16:53:34.398685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04985/citation-record","integrity":"/paper/2506.04985/integrity","json":"/paper/2506.04985/citation-record.json","paper":"/paper/2506.04985"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:57.506377Z","title":"Understanding and overcoming the challenges of efficient transformer quantization","venue":null,"work_id":"7315ed97-f4ae-4f3e-800a-5ea492d6b524","year":2021},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:43.392506Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:05a9466002bf3aba393ffab68e95130305b475d733e426c24c7fc19c19fa8890","observation_id":"9ba8cc1a-738b-4380-916b-0bd6202341e8","resolution":{"observed_at":"2026-08-07T10:43:57.626006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:57.261653Z","title":"Bert busters: Outlier dimensions that disrupt transformers","venue":null,"work_id":"10531554-ebe1-44b1-a996-39127759f2f8","year":2021},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:43.456213Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:40f098b1add6e10c2c5099ebb1d245d74fb72b064193be0be408d1d1681d8278","observation_id":"d8256077-1503-4508-a07d-c06095ff042e","resolution":{"observed_at":"2026-08-07T10:43:57.355244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:43.539598Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:43.539598Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:2b8b709af135417452eb7a4d04a0b584e6c25f119c33c5302c141260f7b80a3e","observation_id":"58f5443b-3af2-4d9a-a195-b157c627bcf6","resolution":{"observed_at":"2026-08-07T10:43:43.539598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12929","last_updated":"2023-11-09T14:05:51Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T14:39:04Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12929","snapshot_observed_at":"2026-08-07T10:43:43.611046Z","title":"Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:43.611046Z"},"links":{"cited_paper":"/paper/2306.12929","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:14d5355f8f72e196a4acbd3d572f9cc44b174d95088c1bb8a955df3e95520240","observation_id":"c7a78b1e-bcb8-4804-99bd-ffe86490b644","resolution":{"observed_at":"2026-08-07T10:43:43.611046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17762","last_updated":"2024-08-14T16:00:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T18:55:17Z","title":"Massive Activations in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17762","snapshot_observed_at":"2026-08-07T10:43:43.694378Z","title":"Massive activations in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:43.694378Z"},"links":{"cited_paper":"/paper/2402.17762","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:6b23ad928800351ad0fbd77863267beafeea4429fd8e02e18c3efd0af52dea06","observation_id":"dbc63c28-99f4-47d7-b4b6-d19a1ba1c380","resolution":{"observed_at":"2026-08-07T10:43:43.694378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10438","last_updated":"2024-03-29T19:21:58Z","snapshot_observed_at":"2026-08-07T09:04:32.994880Z","submitted_at":"2022-11-18T18:59:33Z","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10438","snapshot_observed_at":"2026-08-07T10:43:43.819233Z","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:43.819233Z"},"links":{"cited_paper":"/paper/2211.10438","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:17ed3993f7f914b6e3ebca3b6806173880f9d92b82df1e1fef6a3337ed833b99","observation_id":"b8559f51-d5d2-40ec-adc0-7fce677ae39b","resolution":{"observed_at":"2026-08-07T10:43:43.819233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-05T10:45:45.389337Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-07T10:43:43.915764Z","title":"Croci, Bo Li, Martin Jaggi, Dan Alistarh, Torsten Hoefler, and James Hensman","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:43.915764Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:39394e31079e48af51f30c89d041c14bea6fbd7abe0fbd23d4ad39afd676b062","observation_id":"4d5c4acd-5ea6-4cb4-94c9-3db336267736","resolution":{"observed_at":"2026-08-07T10:43:43.915764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-07T10:43:43.996956Z","title":"SpinQuant: LLM quan- tization with learned rotations, May 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:43.996956Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:62daa1501c2c56c3fb8636864a3cdf894237b5d7950266ba7a6096a317a48b54","observation_id":"dd047719-78d1-4eb2-be08-62d303645640","resolution":{"observed_at":"2026-08-07T10:43:43.996956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08342","last_updated":"2018-06-21T17:32:46Z","snapshot_observed_at":"2026-07-06T06:46:08.396066Z","submitted_at":"2018-06-21T17:32:46Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.08342","snapshot_observed_at":"2026-08-07T10:43:44.073059Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:44.073059Z"},"links":{"cited_paper":"/paper/1806.08342","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:26981a4cc0a56c635d09d329a99fa16156c049660a6a98cc88d4ebd799450f75","observation_id":"509b68ee-495b-49c2-b78c-d8b23520fd09","resolution":{"observed_at":"2026-08-07T10:43:44.073059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08295","last_updated":"2021-06-15T17:12:42Z","snapshot_observed_at":"2026-08-02T11:19:40.664702Z","submitted_at":"2021-06-15T17:12:42Z","title":"A White Paper on Neural Network Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08295","snapshot_observed_at":"2026-08-07T10:43:44.171780Z","title":"A white paper on neural network quantization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:44.171780Z"},"links":{"cited_paper":"/paper/2106.08295","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:b42b73e6afb6af44d6c2ee7d2adf8769fb27e2832d286fd60a17ed6c848a65cf","observation_id":"cd97d06f-d500-4c0b-bfb6-2e87bb99de26","resolution":{"observed_at":"2026-08-07T10:43:44.171780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.05723","last_updated":"2019-05-29T08:45:02Z","snapshot_observed_at":"2026-08-06T12:27:39.329564Z","submitted_at":"2018-10-02T15:10:44Z","title":"Post-training 4-bit quantization of convolution networks for rapid-deployment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.05723","snapshot_observed_at":"2026-08-07T10:43:44.249922Z","title":"Post-training 4-bit quantization of convolution networks for rapid-deployment","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:44.249922Z"},"links":{"cited_paper":"/paper/1810.05723","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:4399c25d14e7132adbdc209a286f68d3f9f510c81e577b85121b36e1004db10e","observation_id":"3c83e253-9f44-4951-9bd2-dd5921bec1df","resolution":{"observed_at":"2026-08-07T10:43:44.249922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:56.972699Z","title":"Zeroq: A novel zero shot quantization framework","venue":null,"work_id":"ae68b7aa-9495-4515-9a40-6a9ac0aa8214","year":2020},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:44.317595Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:aa1408a1893e71333e8138f77de768364ab09b1dd7368708d2ce0c74e267c94f","observation_id":"50e04b74-1f22-4005-b250-0dacbfd07d84","resolution":{"observed_at":"2026-08-07T10:43:57.104781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:56.717359Z","title":"Low-bit quantization of neural networks for efficient inference","venue":null,"work_id":"0d781c97-a67b-41fb-a118-98affbe0bdb3","year":2019},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:44.407583Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:9b510c2fd9cbd79d3c206e9c72af9dafb6c22a5b812d1262c8aaffa91d4855aa","observation_id":"885d442f-996e-402c-bedb-82def12ce75b","resolution":{"observed_at":"2026-08-07T10:43:56.881070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10518","last_updated":"2020-12-14T15:55:05Z","snapshot_observed_at":"2026-08-07T23:40:03.163791Z","submitted_at":"2020-06-14T16:07:55Z","title":"Improving Post Training Neural Quantization: Layer-wise Calibration and Integer Programming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10518","snapshot_observed_at":"2026-08-07T10:43:44.490409Z","title":"Improving post training neural quantization: Layer-wise calibration and integer programming","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:44.490409Z"},"links":{"cited_paper":"/paper/2006.10518","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:3a137fd797b0f3cbc816bf3a1fa6a99db0774329d142396663ad6a30704698d1","observation_id":"438057e3-01be-4626-a686-f32d716e6d88","resolution":{"observed_at":"2026-08-07T10:43:44.490409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:56.509332Z","title":"Same, same but different: Recovering neural network quantization error through weight factorization","venue":null,"work_id":"63f462c0-f8df-4a71-9451-7318a4d48386","year":2019},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:44.585531Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:b815d8dd044b08d5cf9ac8926b9f527fbc8a6b76ab826bf29f9127aebb0e237a","observation_id":"1f216aed-f293-45eb-a214-bb2a4a85655a","resolution":{"observed_at":"2026-08-07T10:43:56.608405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:56.277568Z","title":"Improving neural net- work quantization without retraining using outlier channel splitting","venue":null,"work_id":"66652ddd-2e65-420a-b0da-0728c8e0c738","year":2019},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:44.660979Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:1b59b3488b81b107e78ae91449cff409b70c01b28aab8193fe0ec27382dabbce","observation_id":"6b191482-579b-4f32-8e53-101cfa8e6b23","resolution":{"observed_at":"2026-08-07T10:43:56.392159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:55.990483Z","title":"Data-free quantization through weight equalization and bias correction","venue":null,"work_id":"626a4817-2ca2-42b7-a790-16154de9d572","year":2019},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:44.761658Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:055663122262422e06fb443676c5b785a25087612ea840515422ba7268b2c2f3","observation_id":"2aed43fc-d301-4c5a-917d-c633adb95ae8","resolution":{"observed_at":"2026-08-07T10:43:56.110221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10568","last_updated":"2020-06-30T09:51:23Z","snapshot_observed_at":"2026-08-08T12:31:54.022002Z","submitted_at":"2020-04-22T13:44:28Z","title":"Up or Down? Adaptive Rounding for Post-Training Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.10568","snapshot_observed_at":"2026-08-07T10:43:44.852414Z","title":"Up or Down? Adaptive Rounding for Post-Training Quantization, April 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:44.852414Z"},"links":{"cited_paper":"/paper/2004.10568","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:3c86adf2bda1e381e865d89d5d7cc3dbaa11aa5d2b7b9d9f5b72dae6522556d3","observation_id":"b210edd9-11bb-41f6-af73-0a1ab55e1632","resolution":{"observed_at":"2026-08-07T10:43:44.852414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05426","last_updated":"2021-07-25T09:34:39Z","snapshot_observed_at":"2026-08-04T09:21:27.169501Z","submitted_at":"2021-02-10T13:46:16Z","title":"BRECQ: Pushing the Limit of Post-Training Quantization by Block Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05426","snapshot_observed_at":"2026-08-07T10:43:44.932932Z","title":"Brecq: Pushing the limit of post-training quantization by block reconstruction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:44.932932Z"},"links":{"cited_paper":"/paper/2102.05426","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:26a40750273ac13733a5ec0139523995a1e5694e8a2b3ac3d3eb1c7c3d8e39e7","observation_id":"e388f3a5-d0be-46bb-93b9-73a199e95015","resolution":{"observed_at":"2026-08-07T10:43:44.932932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:55.811476Z","title":"Deep learning with limited numerical precision","venue":null,"work_id":"9caf3187-977c-4507-848a-bf6aa9e75c71","year":2015},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.012514Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:e7e256a236545eaa2ea90449d615067e6964efd63325d573bbeeb8a2a3239976","observation_id":"c024df58-8b6e-4c68-be7e-3940bd5d7b7c","resolution":{"observed_at":"2026-08-07T10:43:55.882906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:55.649485Z","title":"Quantization and training of neural networks for efficient integer-arithmetic-only inference","venue":null,"work_id":"916c85bb-c778-4f47-94fd-aed038df636d","year":2018},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.059061Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:09b7da8dcb60f9346321cf615d70f4e37023e5caac4952dbebc655ab0ea7338d","observation_id":"5cc967d0-211a-47cf-9b83-fad6bcc52476","resolution":{"observed_at":"2026-08-07T10:43:55.735484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:55.398100Z","title":"Esser, Jeffrey L","venue":null,"work_id":"c044bb5a-f936-421b-b838-22ce7f8c3766","year":2020},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.133526Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:4c92a9b0621248178f35cd7742f45c681e2ecc14c65bbef00c0305ef36fdae9e","observation_id":"969ea878-426c-48d8-bc60-02170c14f88e","resolution":{"observed_at":"2026-08-07T10:43:55.535555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:55.152228Z","title":"Lsq+: Improving low-bit quantization through learnable offsets and better initialization","venue":null,"work_id":"5b4540d2-3026-4966-8d89-7ff4326ef9ce","year":2020},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.211084Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:954ba964ebaf603efeb2706295dfff12cd357e4d32726e9be4c02d25f032d0b4","observation_id":"485f1515-d3bf-4677-986b-9f33a9ddafdc","resolution":{"observed_at":"2026-08-07T10:43:55.246016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:54.948910Z","title":"Overcoming oscillations in quantization-aware training","venue":null,"work_id":"9044faab-523b-4b68-925d-072efbf6c671","year":2022},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.287584Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:31701c38c2157c57e410a503a26f9c7c7b0b5fe1b90f0e44ae884c5cda796489","observation_id":"d507e2b7-65cc-4069-b782-597c119b6fd5","resolution":{"observed_at":"2026-08-07T10:43:55.037723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:45.412441Z","title":"LLM-QAT: Data-Free Quan- tization Aware Training for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.412441Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:fb5fa5a682273cc4de82b1fa2436f6ad8b1f300d403395ab21e36d1f3bd8365b","observation_id":"7da8cef2-4587-4574-81db-7b5309ac1165","resolution":{"observed_at":"2026-08-07T10:43:45.412441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10631","last_updated":"2024-02-16T12:27:15Z","snapshot_observed_at":"2026-07-06T17:31:08.762955Z","submitted_at":"2024-02-16T12:27:15Z","title":"BitDistiller: Unleashing the Potential of Sub-4-Bit LLMs via Self-Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10631","snapshot_observed_at":"2026-08-07T10:43:45.503765Z","title":"Bitdistiller: Unleashing the potential of sub-4-bit llms via self-distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.503765Z"},"links":{"cited_paper":"/paper/2402.10631","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:bbbfe61030bc929850cd69f723c6a6671645066468b40910d58fe741099ed3cb","observation_id":"3cb6aee2-6a07-482b-b315-3ac18a450963","resolution":{"observed_at":"2026-08-07T10:43:45.503765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11062","last_updated":"2025-05-19T06:20:01Z","snapshot_observed_at":"2026-08-08T01:47:51.652242Z","submitted_at":"2024-07-10T17:53:30Z","title":"EfficientQAT: Efficient Quantization-Aware Training for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11062","snapshot_observed_at":"2026-08-07T10:43:45.644520Z","title":"Efficientqat: Efficient quantization-aware training for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.644520Z"},"links":{"cited_paper":"/paper/2407.11062","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:4d8d81cc27b9b3ab539e0ba3a995c87fd3616d9376dbf0c1bfedb8f4944ac06b","observation_id":"f030abb1-84cb-4181-94c3-7817bbfdee0e","resolution":{"observed_at":"2026-08-07T10:43:45.644520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:45.723371Z","title":"Qlora: Efficient finetuning of quantized llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.723371Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:d61a4170399705bf734618bde250d3b32b077c92060c2aae4902515c8e4af189","observation_id":"657cfb93-0532-4c48-87ab-aec4df2bec6d","resolution":{"observed_at":"2026-08-07T10:43:45.723371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14717","last_updated":"2023-10-09T07:39:04Z","snapshot_observed_at":"2026-08-03T21:40:53.000035Z","submitted_at":"2023-09-26T07:22:23Z","title":"QA-LoRA: Quantization-Aware Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14717","snapshot_observed_at":"2026-08-07T10:43:45.821751Z","title":"Qa-lora: Quantization-aware low-rank adaptation of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.821751Z"},"links":{"cited_paper":"/paper/2309.14717","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:93d473f0be63a8944696cb0ad18c6448cab8e2ce38b7b4aeefd8ea0f708baad1","observation_id":"289ff14b-bc35-4733-ae33-54f1fb574b65","resolution":{"observed_at":"2026-08-07T10:43:45.821751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06385","last_updated":"2024-09-03T16:36:06Z","snapshot_observed_at":"2026-08-03T17:41:51.570643Z","submitted_at":"2024-06-10T15:44:22Z","title":"Low-Rank Quantization-Aware Training for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06385","snapshot_observed_at":"2026-08-07T10:43:45.907542Z","title":"Low-Rank Quantization- Aware Training for LLMs, September 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.907542Z"},"links":{"cited_paper":"/paper/2406.06385","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:899424817873b02570c69cc2bf216fc65bec682d9846b0c5aae8522e8aa55acf","observation_id":"1768de1f-a55d-48c9-be05-903aee41c92e","resolution":{"observed_at":"2026-08-07T10:43:45.907542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:45.985375Z","title":"Paretoq: Scaling laws in extremely low-bit llm quantization, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:45.985375Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:687088ae3a8c847136666ff9e2fb6852af56e34370ceb20b3a7eb49ae68f58ca","observation_id":"e4a6e479-b504-4dfe-b7b0-2a07dfdb3d53","resolution":{"observed_at":"2026-08-07T10:43:45.985375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-07T10:43:46.065076Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.065076Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:5c46078abc98e50faa9389752f67ffd99b6d6a0d3d5ea1dcdd5cd91e6b2811c9","observation_id":"15fd83d1-ec0c-4244-85a5-e58b9eb4ac3b","resolution":{"observed_at":"2026-08-07T10:43:46.065076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03078","last_updated":"2023-06-05T17:53:28Z","snapshot_observed_at":"2026-08-08T23:08:43.190961Z","submitted_at":"2023-06-05T17:53:28Z","title":"SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03078","snapshot_observed_at":"2026-08-07T10:43:46.139211Z","title":"Spqr: A sparse-quantized representation for near-lossless llm weight compression","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.139211Z"},"links":{"cited_paper":"/paper/2306.03078","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:04febf7c7dc15cef91cb0d58e7d0f20826fcd3c7124346d0ed2ffdbf3969e6f4","observation_id":"9ecc4d88-0f0c-4804-8227-bdda6b9b0470","resolution":{"observed_at":"2026-08-07T10:43:46.139211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-08-07T10:43:46.226301Z","title":"Awq: Activation-aware weight quantization for llm compression and acceleration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.226301Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:84d8684210c8877cecd7d1e260957d94e1ca22bb0d59177506488d2b0dde81c1","observation_id":"8fad7b8c-9a67-4e89-8b00-bbee994ae2b9","resolution":{"observed_at":"2026-08-07T10:43:46.226301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:46.309944Z","title":"Owq: Outlier- aware weight quantization for efficient fine-tuning and inference of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.309944Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:94537bbe0cd418da595769c47040f824abbce4f9804c674f7f70080810a0cf41","observation_id":"c502772d-b90a-412c-8437-8958ce0fba68","resolution":{"observed_at":"2026-08-07T10:43:46.309944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-05T21:17:46.828705Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-07T10:43:46.395454Z","title":"Squeezellm: Dense-and-sparse quantization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.395454Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:e2ae484a1fd1d248324954a7a6b362e079159a2743c0c62be3df68c0e13708a5","observation_id":"8667e534-2518-4bf2-954d-47bdcf62d9c7","resolution":{"observed_at":"2026-08-07T10:43:46.395454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14917","last_updated":"2025-05-25T08:58:37Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T16:21:48Z","title":"SliM-LLM: Salience-Driven Mixed-Precision Quantization for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14917","snapshot_observed_at":"2026-08-07T10:43:46.491664Z","title":"Slim-llm: Salience-driven mixed-precision quantization for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.491664Z"},"links":{"cited_paper":"/paper/2405.14917","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:dc251c6e1feab89360fba76bf1b1d38e328869eb98012d7a8ded3ec5257acc6a","observation_id":"f696d429-04b3-4cc4-a2a8-feec06fcb35b","resolution":{"observed_at":"2026-08-07T10:43:46.491664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06118","last_updated":"2024-09-11T07:48:26Z","snapshot_observed_at":"2026-08-06T11:31:16.355778Z","submitted_at":"2024-01-11T18:54:44Z","title":"Extreme Compression of Large Language Models via Additive Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06118","snapshot_observed_at":"2026-08-07T10:43:46.566561Z","title":"Extreme compression of large language models via additive quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.566561Z"},"links":{"cited_paper":"/paper/2401.06118","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:16d54ecb3f0e1f31db1dc964650911e5f35bd3cc5403884c4cbc62768bc1deda","observation_id":"9f794de9-c001-4ba4-8925-f3957faa6e3a","resolution":{"observed_at":"2026-08-07T10:43:46.566561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:54.756926Z","title":"A frustratingly easy post-training quantization scheme for llms","venue":null,"work_id":"1fbcac5a-c0cf-4b73-9902-e40defb560c8","year":2023},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.675630Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:e1b544ad2bcc8e64e45de8c41357e2f593778b9b19025931933f7aa3101d1857","observation_id":"ec96620d-493a-4815-8591-81342b0588be","resolution":{"observed_at":"2026-08-07T10:43:54.828721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:54.572485Z","title":"Flexround: Learnable rounding based on element-wise division for post-training quantization","venue":null,"work_id":"043286d8-0230-461f-89f4-6e86e8424abb","year":2023},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.752521Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:27a04410a3f612b7187c3f0f184a0e980aece208cc45c9569cb289af6c8c1abd","observation_id":"da98e275-fbe4-41a6-ad7a-77f7f3f47aa0","resolution":{"observed_at":"2026-08-07T10:43:54.667231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:54.315291Z","title":"Long- range zero-shot generative deep network quantization","venue":null,"work_id":"5ae7b9f1-de39-489c-bff2-f7cccc8308b9","year":2023},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.841044Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:41a25414c6d32ed69c8a68f88bf8495c5dafabc82fe2e23e541719fa1fb677c9","observation_id":"bf7d682b-5699-4ec9-bb14-7d3682149f37","resolution":{"observed_at":"2026-08-07T10:43:54.454601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:54.103711Z","title":"Quip: 2-bit quantiza- tion of large language models with guarantees","venue":null,"work_id":"a047b4c4-d9db-4ea8-b855-dacfc359c4be","year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.918388Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:2ee3f97ddbae5de268645d10b00a157002912e7247c77ca356216a176a6db6df","observation_id":"0a53fc79-93eb-4c1d-989b-0d38e74703a7","resolution":{"observed_at":"2026-08-07T10:43:54.223241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09145","last_updated":"2023-10-23T08:48:31Z","snapshot_observed_at":"2026-07-06T15:17:05.623407Z","submitted_at":"2023-04-18T17:34:23Z","title":"Outlier Suppression+: Accurate quantization of large language models by equivalent and optimal shifting and scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09145","snapshot_observed_at":"2026-08-07T10:43:46.980855Z","title":"Outlier Suppression+: Accurate quantization of large language models by equivalent and optimal shifting and scaling, October 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:46.980855Z"},"links":{"cited_paper":"/paper/2304.09145","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:526b8a3caadc5a29f898f5c0829f9be67c5e983756bc7a02e330f2b933105d1d","observation_id":"a2cac9bb-05ea-4ff6-a91f-d0c1ecd524df","resolution":{"observed_at":"2026-08-07T10:43:46.980855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13137","last_updated":"2024-03-18T05:33:22Z","snapshot_observed_at":"2026-07-06T16:10:15.694898Z","submitted_at":"2023-08-25T02:28:35Z","title":"OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13137","snapshot_observed_at":"2026-08-07T10:43:47.032509Z","title":"OmniQuant: Omnidirectionally Calibrated Quantiza- tion for Large Language Models, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.032509Z"},"links":{"cited_paper":"/paper/2308.13137","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:392de31118660c33da3b015bfe9705126df52495cc8730037d6b20920592b84a","observation_id":"69b59f67-87e3-4053-98ab-73f54a6393f9","resolution":{"observed_at":"2026-08-07T10:43:47.032509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:53.923749Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks, February","venue":null,"work_id":"74dc97db-5ebb-44da-bb0a-0f005775e4ce","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.124919Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:8aa407589a01a94ba6093969da80801c84dfbd34a50ab75b9902405c979e4bb0","observation_id":"e26850cc-f1fa-42f3-8bd4-b7d17fd82973","resolution":{"observed_at":"2026-08-07T10:43:53.975213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01721","last_updated":"2024-11-01T17:12:53Z","snapshot_observed_at":"2026-08-07T04:58:45.510275Z","submitted_at":"2024-06-03T18:27:44Z","title":"DuQuant: Distributing Outliers via Dual Transformation Makes Stronger Quantized LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01721","snapshot_observed_at":"2026-08-07T10:43:47.305676Z","title":"DuQuant: Distributing Outliers via Dual Transformation Makes Stronger Quantized LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.305676Z"},"links":{"cited_paper":"/paper/2406.01721","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:0b44b9fd1d84fff80c579c993768ab0ea5aed58f2139868cec25b6af5eff5097","observation_id":"870a263e-334d-4d85-bcaa-7fa4cc1a2161","resolution":{"observed_at":"2026-08-07T10:43:47.305676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-07T16:35:49.463807Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-07T10:43:47.377076Z","title":"FlatQuant: Flatness Matters for LLM Quantization, October 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.377076Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:d265cd1c8a912ccf92ef78aacd040de2092e1dd29c68e60bc6f8532b97484425","observation_id":"252b32eb-f7f4-4bcd-809a-0b2ae9fc5dcc","resolution":{"observed_at":"2026-08-07T10:43:47.377076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15024","last_updated":"2024-02-09T17:59:40Z","snapshot_observed_at":"2026-07-06T17:21:01.918787Z","submitted_at":"2024-01-26T17:35:45Z","title":"SliceGPT: Compress Large Language Models by Deleting Rows and Columns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15024","snapshot_observed_at":"2026-08-07T10:43:47.464816Z","title":"Croci, Marcelo Gennari do Nascimento, Torsten Hoefler, and James Hensman","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.464816Z"},"links":{"cited_paper":"/paper/2401.15024","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:14fb71635486e82f5b1f9cc09bab3fc32bf7dba2417e1f5e6bf7e8b80adc2e7f","observation_id":"64dc9d2b-c2fd-430f-a0f7-a6a009f3ce69","resolution":{"observed_at":"2026-08-07T10:43:47.464816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:47.553216Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.553216Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:109305af8431126850dfbb8d6b959e8189497af6042e2223964cea93d6d4bc45","observation_id":"7287845d-6e7e-4085-9c68-9ffa36c6253a","resolution":{"observed_at":"2026-08-07T10:43:47.553216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T10:43:47.634359Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.634359Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:3c5ffc3f7a755d9600f9fe9a4e216c0720378acbfba2d68ef8827b8b7e17a397","observation_id":"43470d1e-cbcb-47c7-af8c-9615542eca02","resolution":{"observed_at":"2026-08-07T10:43:47.634359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T10:43:47.714871Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.714871Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:83c5b7e5163ffaf178f3b8c102fe832eb26942aa21cc23f8c928cf63cde52f9d","observation_id":"f00ec514-0be5-4c54-a336-416364dbeb24","resolution":{"observed_at":"2026-08-07T10:43:47.714871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:47.806276Z","title":"Pointer sentinel mixture models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.806276Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:616b7ae9b46d0ba2bb9dd5c180b751e099349ef64ad7bf24409d667bf816e04e","observation_id":"16655abc-63aa-47d1-bdef-c8b6b42e0071","resolution":{"observed_at":"2026-08-07T10:43:47.806276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:53.727154Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","venue":null,"work_id":"314e4741-4591-40d6-89b3-f7f2768df6e4","year":2020},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.981754Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:9f3877ba4a4f94eed3a3449aeca69ab3c5bc6058564c34dc394eb2433dc214a1","observation_id":"19c78207-9ae1-4dc9-996b-c6d7aeeb92ed","resolution":{"observed_at":"2026-08-07T10:43:53.813234Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:53.536022Z","title":"WinoGrande: an adversarial winograd schema challenge at scale","venue":null,"work_id":"37193eff-4729-4916-a587-06e37c6427f4","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:48.097905Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:325210a5fee2093607bd725840f648412bfcf484d94ebbb13affe1bd22c46a3d","observation_id":"a34ff82a-8ca1-475f-b07b-e0983c96af3a","resolution":{"observed_at":"2026-08-07T10:43:53.636507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-07-31T00:09:56.948833Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-07T10:43:48.336766Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?, May 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:48.336766Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:7b3dc22322f3ea6c9fc979f54dd5a08207ccfb7f7b4a88abdab4326f459196ea","observation_id":"1d04d0d8-2b3b-488a-99d5-7ca5f7ae42f5","resolution":{"observed_at":"2026-08-07T10:43:48.336766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T10:43:48.475734Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge, March 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:48.475734Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:2c4a5bd8de4c572a65638473e47d1920ff38c16fa76837b0e7640a2dff356cc6","observation_id":"e7ad51cb-3060-462f-87fc-3d24e2b28753","resolution":{"observed_at":"2026-08-07T10:43:48.475734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:53.337493Z","title":"The lambada dataset: Word prediction requiring a broad discourse context","venue":null,"work_id":"ab671074-fed1-41e7-8c01-4605032a1c66","year":2016},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:48.616558Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:3c557cdd62869ca87d664381990f20461f8048cd3afab4c1fcd04bf6492d6a59","observation_id":"f46dc064-b0cf-4035-a0c0-11d2169c7aa3","resolution":{"observed_at":"2026-08-07T10:43:53.430817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:53.140901Z","title":"Working with Quantized Types — NVIDIA TensorRT Doc- umentation","venue":null,"work_id":"0dd011d0-0c93-44a8-966e-7361b227a01d","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:48.792727Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:9128ae1395346339fe4f3bfceb8c013f85f0c50121988832c714ecddd67d22eb","observation_id":"f3c35bc1-b422-4358-baea-1ae5efa5ca4d","resolution":{"observed_at":"2026-08-07T10:43:53.245750Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:52.980876Z","title":"Quantization — PyTorch AO documentation","venue":null,"work_id":"89a78581-cf23-47d0-b875-71727892c1ee","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:48.899498Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:f3ce0b188cdac81890145df3b3e1e8bd2f839f84e0548ec66c9d500be40dc7af","observation_id":"e737f547-f15a-4453-a5aa-4dad17c7128f","resolution":{"observed_at":"2026-08-07T10:43:53.033620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:52.843547Z","title":"AI Engine Direct SDK documentation","venue":null,"work_id":"c26259cf-d37b-4df0-a1d3-960fc1adf4d2","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:49.036004Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:5fafa69bdf4d24d8836e620fcea1d1e40ac6cc5a5deda1ab6c4abd4b2a9c08f3","observation_id":"30abc064-9048-4414-a3c4-459a113e0e72","resolution":{"observed_at":"2026-08-07T10:43:52.915494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:52.657065Z","title":"TensorRT operators documentation: DynamicQuantize not supported on DLA","venue":null,"work_id":"528093f7-4f63-4e89-a8c5-67b4803c879b","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:49.215303Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:c5803d3567d0637173706acdb441a5596fd0031e1eefee70a66f87dbfb1bab45","observation_id":"9d768a9a-4f8f-4431-ba16-962eb3325d66","resolution":{"observed_at":"2026-08-07T10:43:52.766879Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:52.462788Z","title":"fast-hadamard-transform","venue":null,"work_id":"ed3d8864-1224-4545-9f76-4d9c0c0a51e4","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:49.347868Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:322550d3bda65c7c3f1995b769e9cb4aaa971a00b2043a8704d1dd58ab0caa83","observation_id":"e72a981b-b49f-4efb-80c4-7bc224be7ec9","resolution":{"observed_at":"2026-08-07T10:43:52.513457Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:52.347112Z","title":"double-packed","venue":null,"work_id":"b5ba2458-0d81-4067-813d-2a86344a0bdd","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:49.457392Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:13b7eb52aec48ead3793f2c76e3ab1e4833984d61a7e18569aafee9cc0920ed0","observation_id":"a265f935-0e7d-45f6-9090-3ef70eb62590","resolution":{"observed_at":"2026-08-07T10:43:52.383814Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:52.108311Z","title":"Evaluate quantization error per quantizer placement (e.g","venue":null,"work_id":"2b05a5d2-a655-41d8-97d2-b965919f33b7","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:49.606480Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:438992d075dd210883e98ff47b509bc121083efbaf540d4ae269719aef2a18e0","observation_id":"389e9d3d-8215-4636-88c7-3c78d8a8139a","resolution":{"observed_at":"2026-08-07T10:43:52.260528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:51.887153Z","title":"Based on step 1, choose which FPTs to add: (a) Attention and FFN input","venue":null,"work_id":"d3828022-f5e3-4d5c-9367-fbde4c923c9a","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:49.704829Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:4ee9c747a5f76b70c44ab272357aaa928da7570b9dd9c9e6d1c9a2e69a9771a2","observation_id":"0d901eaf-5cd8-4c22-9a12-499f44daeb7a","resolution":{"observed_at":"2026-08-07T10:43:51.990152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:51.642496Z","title":"Initialize transforms, e.g","venue":null,"work_id":"075d4050-fdea-46f6-9012-4baf3b8e0f24","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:49.859176Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:25ca9c249b72cb50d78643ea59355c8f85c86cb6d94775939ecc66b676f869d4","observation_id":"b57a2e1a-8f17-4c26-90bc-d603c2affe6a","resolution":{"observed_at":"2026-08-07T10:43:51.744777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:51.453968Z","title":"Locally optimizing transforms improves performance and reduces training time, whilst incurring very little cost (Appendix F.2.1)","venue":null,"work_id":"0d0de716-2997-4698-a731-0986df4318bc","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:49.988735Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:a15e6909b11d6bf9c4b4e7e8cd47566ce4e1d591094c9d22f526d81229fe0c0e","observation_id":"fa9295aa-18e8-4de6-a6a1-cb6f538260c3","resolution":{"observed_at":"2026-08-07T10:43:51.540897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:51.243733Z","title":"Set the initial quantization grid, e.g","venue":null,"work_id":"0019e37b-13cb-4280-95f9-41a86871e9c0","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:50.099603Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:2a5a549090f556d4a9638050b2ffe123c38b1218fe484d96460f0bd596bd60f1","observation_id":"33ec7427-9afd-4f78-a2fc-1c9b3d06c178","resolution":{"observed_at":"2026-08-07T10:43:51.372855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:51.031869Z","title":"Train the FPTs and quantization grid end-to-end, with the unquantized outputs as target","venue":null,"work_id":"fdbeace6-43e7-4892-bca2-f404007c9fa5","year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:50.212638Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:40da037e4eb6e0d0c8a377fedbae759be78ac27a0661483965e768511751dc34","observation_id":"b4549857-6b67-4f37-9003-499b98980c9d","resolution":{"observed_at":"2026-08-07T10:43:51.087441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:43:48.191111Z","title":"doi: 10.1145/3474381","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:48.191111Z"},"links":{"citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:9cdfe62492c9f3d6a0ee2364c273010a09cbcb646fd40f372515655ee2bd9bc2","observation_id":"9a0cd5c9-7041-469c-94cf-c7e320333fb7","resolution":{"observed_at":"2026-08-07T10:43:48.191111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-07-06T17:26:31.326736Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-07T10:43:47.223987Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.223987Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:54e72a8512a4f144730f2a853110290a920b4ce0ea87a6bfcdd33864cfdf041b","observation_id":"abf25eb5-8f0d-4593-965a-6a9964b135d3","resolution":{"observed_at":"2026-08-07T10:43:47.223987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T14:49:23.884160Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":5,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 5 inbound Pith citation observations for arXiv:2506.04985."}