{"as_of":"2026-08-17T14:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3ad1021a5b7f0edcc23a97b55f5cacffab1e1dae93823a3f8fab038b479a32a","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T16:13:20.004756Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T12:54:26.511410Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T14:47:14.541739Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-08-12T05:20:23.849109Z","title":"Ostquant: Refining large language model quantization with orthogonal and scaling transformations for better distribution fitting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.00648","last_updated":"2025-07-15T15:36:44Z","snapshot_observed_at":"2026-08-16T21:26:53.398407Z","submitted_at":"2024-12-01T02:55:08Z","title":"DFRot: Achieving Outlier-Free and Massive Activation-Free for Rotated LLMs with Refined Rotation","version":4},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T05:20:23.849109Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2412.00648"},"observation_digest":"sha256:1c9f0f9eca607e630fd96884271438741023ec134ee245cd84a0eac445287ca7","observation_id":"5fe2956b-78de-4d3e-ba8c-ce8102e30ea0","resolution":{"observed_at":"2026-08-12T05:20:23.849109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-08-09T19:12:56.082348Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.00425","last_updated":"2025-08-10T04:13:03Z","snapshot_observed_at":"2026-08-17T14:07:15.133393Z","submitted_at":"2025-02-01T13:08:02Z","title":"MQuant: Unleashing the Inference Potential of Multimodal Large Language Models via Full Static Quantization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T19:12:56.082348Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2502.00425"},"observation_digest":"sha256:d706d4e410524e3d645ea4b32af0cac7ca5009595b27ae6e74ffe4589f024f24","observation_id":"a559fc8b-f7ee-40ab-b741-7b5fc3d2db5f","resolution":{"observed_at":"2026-08-09T19:12:56.082348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-08-07T14:50:06.797957Z","title":"Jacob, B., Kligys, S., Chen, B., Zhu, M., Tang, M., Howard, A., Adam, H., and Kalenichenko, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17595","last_updated":"2026-05-29T03:13:03Z","snapshot_observed_at":"2026-08-13T06:07:29.695675Z","submitted_at":"2025-05-23T07:59:46Z","title":"NeUQI: Near-Optimal Uniform Quantization Parameter Initialization for Low-Bit LLMs","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:50:06.797957Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2505.17595"},"observation_digest":"sha256:b5d9c4d9c4b81eb41f6f9655b121e7dd11eed90ee1b2e942faa1ed75c3c8801c","observation_id":"76dddf82-afb5-4854-bccc-a09f17123e90","resolution":{"observed_at":"2026-08-07T14:50:06.797957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-08-07T14:42:20.965959Z","title":"Ostquant: Refining large language model quantization with orthogonal and scaling transformations for better distribution fitting.arXiv preprint arXiv:2501.13987, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18231","last_updated":"2026-07-15T15:32:56Z","snapshot_observed_at":"2026-08-13T22:02:22.754796Z","submitted_at":"2025-05-23T12:40:07Z","title":"NSNQuant: A Double Normalization Approach for Calibration-Free Low-Bit Vector Quantization of KV Cache","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:42:20.965959Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2505.18231"},"observation_digest":"sha256:01c0c9fd7f0b649e486abcaec27574d554dcd01324981e0fd0cf88adbaa8415d","observation_id":"67e9cea5-60b0-4f83-a1c7-19a6a6315861","resolution":{"observed_at":"2026-08-07T14:42:20.965959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2506.01352","last_updated":"2026-05-08T20:31:58Z","snapshot_observed_at":"2026-08-17T09:20:57.626106Z","submitted_at":"2025-06-02T06:13:41Z","title":"TAH-QUANT: Effective Activation Quantization in Pipeline Parallelism over Slow Network","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-19T11:24:36.046052Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2506.01352"},"observation_digest":"sha256:6c8800abf39e862374506bc1b99017b0829df18fd93fa622e56eddc76b0554b5","observation_id":"d79a8ae5-d216-42f4-a1ae-10e1599b4b39","resolution":{"observed_at":"2026-05-19T11:27:15.970801Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-08-07T10:42:40.948535Z","title":"Ostquant: Refining large language model quantization with orthogonal and scaling transformations for better distribution fitting.arXiv preprint arXiv:2501.13987, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05432","last_updated":"2025-06-26T06:17:49Z","snapshot_observed_at":"2026-08-12T17:05:27.686275Z","submitted_at":"2025-06-05T08:58:58Z","title":"PCDVQ: Enhancing Vector Quantization for Large Language Models via Polar Coordinate Decoupling","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:42:40.948535Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2506.05432"},"observation_digest":"sha256:2448802beffe0b5a714c277d7221b6e13030c3a8ab44b7ad8e2cb08366a35213","observation_id":"4f427d71-a399-4caf-ab73-9d9024678da8","resolution":{"observed_at":"2026-08-07T10:42:40.948535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2506.12040","last_updated":"2026-04-09T06:22:06Z","snapshot_observed_at":"2026-08-16T21:08:22.449761Z","submitted_at":"2025-05-24T03:57:19Z","title":"BTC-LLM: Efficient Sub-1-Bit LLM Quantization via Learnable Transformation and Binary Codebook","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T14:03:35.214840Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2506.12040"},"observation_digest":"sha256:4144547710335d1b6fb3242b38ad6ec9fd7564d226f07c11977a305c858e753e","observation_id":"9c216eaf-d8bd-49af-87fe-7753206914e9","resolution":{"observed_at":"2026-05-19T14:07:20.549231Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-08-07T14:06:24.512952Z","title":"Ostquant: Refining large language model quantization with orthogonal and scaling transformations for better distribution fitting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15689","last_updated":"2025-08-29T12:03:45Z","snapshot_observed_at":"2026-08-12T21:46:22.581796Z","submitted_at":"2025-05-26T14:22:21Z","title":"BASE-Q: Bias and Asymmetric Scaling Enhanced Rotational Quantization for Large Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:24.512952Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2506.15689"},"observation_digest":"sha256:ef0ed4875c6bcd388b6e89280e448adf262cd7b5139e8f84001d5485f798c859","observation_id":"6d56403d-f536-4b30-b255-95fc7fe68239","resolution":{"observed_at":"2026-08-07T14:06:24.512952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2602.20309","last_updated":"2026-04-06T23:32:59Z","snapshot_observed_at":"2026-08-11T03:24:57.486480Z","submitted_at":"2026-02-23T19:55:54Z","title":"QuantVLA: Scale-Calibrated Post-Training Quantization for Vision-Language-Action Models","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T20:20:10.435886Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2602.20309"},"observation_digest":"sha256:7df669dca33f072f0a97298c3d128c597f84f34a9027eb6f0cba980ca5cd96ac","observation_id":"332b1750-a916-408a-9724-90631d4a2c20","resolution":{"observed_at":"2026-05-15T20:20:17.353194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2604.26378","last_updated":"2026-04-29T07:41:31Z","snapshot_observed_at":"2026-08-13T02:03:31.266492Z","submitted_at":"2026-04-29T07:41:31Z","title":"CoQuant: Joint Weight-Activation Subspace Projection for Mixed-Precision LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T13:39:31.422613Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2604.26378"},"observation_digest":"sha256:e70aaa7f83749f0ca2c1b3566d940f2923be4af9159a470fedad9828839506c3","observation_id":"7a238a67-7853-49d2-9596-37552a95dd6b","resolution":{"observed_at":"2026-05-12T08:51:24.365884Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2605.16343","last_updated":"2026-05-08T01:45:28Z","snapshot_observed_at":"2026-08-15T13:35:24.518791Z","submitted_at":"2026-05-08T01:45:28Z","title":"LoopQ: Quantization for Recursive Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T22:41:55.787556Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2605.16343"},"observation_digest":"sha256:6422baac12ff60bad2436e0d4baa3e08e9f658e2fcf5ed81d5002444c4bd802f","observation_id":"9d909944-23ac-45db-bc4c-45acc74a9ede","resolution":{"observed_at":"2026-05-20T22:43:50.823348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2605.18475","last_updated":"2026-05-18T14:30:58Z","snapshot_observed_at":"2026-08-15T15:48:21.544447Z","submitted_at":"2026-05-18T14:30:58Z","title":"GAMMA: Global Bit Allocation for Mixed-Precision Models under Arbitrary Budgets","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-20T12:25:39.417436Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2605.18475"},"observation_digest":"sha256:fc2ed47b1eb7226e566a125c75f95673c0d7a66a016df8f5dca61c32b7fd20bb","observation_id":"1f2f61f0-e9d5-4cf8-9ad8-f9a6ec79edf2","resolution":{"observed_at":"2026-05-20T12:28:16.794228Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2605.18800","last_updated":"2026-05-11T10:51:40Z","snapshot_observed_at":"2026-08-16T20:24:16.055895Z","submitted_at":"2026-05-11T10:51:40Z","title":"Theory-optimal Quantization Based on Flatness","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T22:38:06.888665Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2605.18800"},"observation_digest":"sha256:6606e20f3caead9b85aea5a983106c8f1b79128b92c5dd4f0f5fa44e21602915","observation_id":"f79f4af6-d087-43fc-9b2f-f646131dfb32","resolution":{"observed_at":"2026-05-20T22:39:09.902771Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2605.19929","last_updated":"2026-05-19T14:49:57Z","snapshot_observed_at":"2026-08-14T18:57:19.754744Z","submitted_at":"2026-05-19T14:49:57Z","title":"Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T05:20:45.264341Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2605.19929"},"observation_digest":"sha256:afe6dc7aa441272cc52a8a15ecc051f5c3ddf79883c33462ea45530502dadd15","observation_id":"b600cc3a-2a90-4409-8fc9-e66fa77b68e6","resolution":{"observed_at":"2026-05-20T05:23:03.619341Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2605.24019","last_updated":"2026-05-20T06:11:25Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-20T06:11:25Z","title":"MGVQ: Synergizing Multi-dimensional Sensitivity-Aware and Gradient-Hessian Fusion for Vector Quantization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T17:36:45.807397Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2605.24019"},"observation_digest":"sha256:0383dc89492b7e6cd4bf9b4237637a8e587b4cca5ad9e91a127ed8c2047486ae","observation_id":"af2a470a-7516-4cd6-93cf-417adf65cc40","resolution":{"observed_at":"2026-07-01T15:05:48.333381Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2605.28803","last_updated":"2026-08-11T05:08:08Z","snapshot_observed_at":"2026-08-15T13:25:11.599585Z","submitted_at":"2026-05-27T17:55:01Z","title":"HoloQ-VLA: Uniform W4A4 Quantization of Vision-Language-Action Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T12:44:50.624778Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2605.28803"},"observation_digest":"sha256:511151a3c5047c2808ed5114d5c5565258a9ffe0d2c5cadbcc7e88b3e8990230","observation_id":"6a58618d-e155-46f8-80b3-7768f06d4160","resolution":{"observed_at":"2026-06-29T12:53:26.946776Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2605.31035","last_updated":"2026-05-29T09:05:42Z","snapshot_observed_at":"2026-08-13T00:59:08.247988Z","submitted_at":"2026-05-29T09:05:42Z","title":"MixFP4: Enhancing NVFP4 with Adaptive FP4/INT4 Block Representations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T20:17:16.036226Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2605.31035"},"observation_digest":"sha256:bd9f93245ac480d8f92371295c69826d7560c705d7c58e7702502537edcfa3f3","observation_id":"83fea8c0-1853-41f1-94ad-521d2a547e1a","resolution":{"observed_at":"2026-06-28T20:22:37.216780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2607.02461","last_updated":"2026-07-02T17:27:34Z","snapshot_observed_at":"2026-08-16T23:35:17.957783Z","submitted_at":"2026-07-02T17:27:34Z","title":"OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-03T14:56:10.553212Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2607.02461"},"observation_digest":"sha256:122779d3ba000491a3be8c171a6a116bbca59551b676ca9aa10169c93fae9320","observation_id":"7542aa95-3ac1-4b1c-8cea-3e8ba3d8b8e6","resolution":{"observed_at":"2026-07-03T14:58:32.376068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":"2501.13987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-07-10T14:47:14.541739Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","venue":"cs.LG","work_id":"f0e274ef-46fc-49e1-b8e7-aef0e06c5d7b","year":2025},"citing_paper":{"arxiv_id":"2607.07964","last_updated":"2026-08-08T21:43:41Z","snapshot_observed_at":"2026-08-14T14:58:15.706165Z","submitted_at":"2026-07-08T22:34:52Z","title":"KronQ: LLM Quantization via Kronecker-Factored Hessian","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-10T14:38:16.781357Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2607.07964"},"observation_digest":"sha256:84b4125bb65794a439ec5c250f9291a7ddb2aeeb2f248fffa4d68e82bf0e948f","observation_id":"eb0e06c6-54a2-4af6-843d-8aee223ec01b","resolution":{"observed_at":"2026-07-10T14:47:14.543000Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-08-02T14:29:36.125062Z","title":"arXiv preprint arXiv:2501.13987 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20434","last_updated":"2026-05-11T10:50:26Z","snapshot_observed_at":"2026-08-13T14:16:27.401838Z","submitted_at":"2026-05-11T10:50:26Z","title":"Break Through the Compression Bottleneck: From Theory to Practice","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-02T14:29:36.125062Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2607.20434"},"observation_digest":"sha256:3cfe646d899026f3abed20232e8ee29ea8e8775b11ecef7b7f23a6dd0dfb15c4","observation_id":"ba66d4ad-6293-4e9e-ad0b-b288e8cebc40","resolution":{"observed_at":"2026-08-02T14:29:36.125062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-08-01T03:16:46.815346Z","title":"Ostquant: Refining large language model quantization with orthogonal and scaling transformations for better distribution fitting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27694","last_updated":"2026-07-30T05:26:20Z","snapshot_observed_at":"2026-08-16T00:23:09.347215Z","submitted_at":"2026-07-30T05:26:20Z","title":"GyRot: Leveraging Hidden Synergy between Rotation and Fine-grained Group Quantization for Low-bit LLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T03:16:46.815346Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2607.27694"},"observation_digest":"sha256:c3d908dc3f29ec16d920b8c05ec2398f3963e8ec12d4f3d6d5905234309ff7e6","observation_id":"a0da8510-6be4-4114-a83f-c86f6c1a7264","resolution":{"observed_at":"2026-08-01T03:16:46.815346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13987","snapshot_observed_at":"2026-08-14T12:54:26.511410Z","title":"OSTQuant : Refining large language model quantization with orthogonal and scaling transformations for better distribution fitting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13365","last_updated":"2026-08-13T15:31:01Z","snapshot_observed_at":"2026-08-17T12:19:53.055981Z","submitted_at":"2026-08-13T15:31:01Z","title":"When Local Variance Optimality Is Not Enough: RoPE-Aligned Q/K Rotations for Dynamic 4-Bit Quantisation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T12:54:26.511410Z"},"links":{"cited_paper":"/paper/2501.13987","citing_paper":"/paper/2608.13365"},"observation_digest":"sha256:499503eb6c756588c9d02d976d2ef7b2a683903af08a9f76dcb9cd4706dfa1b7","observation_id":"ab679e37-2974-4fad-ac33-4266e21ecace","resolution":{"observed_at":"2026-08-14T12:54:26.511410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.13987/citation-record","integrity":"/paper/2501.13987/integrity","json":"/paper/2501.13987/citation-record.json","paper":"/paper/2501.13987"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T16:13:19.891667Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.891667Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:0aefbd441cd41f9711b0d3745afed6c7fe0c55522bc63e3baf1105d9e803b35a","observation_id":"f9e28a0a-43f5-4102-b60c-d2bf42b495e4","resolution":{"observed_at":"2026-08-10T16:13:19.891667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-16T14:04:57.666315Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-10T16:13:19.895149Z","title":"Quarot: Outlier-free 4-bit inference in rotated llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.895149Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:5b9c20012adcd1ae86b318343560eac5970a19644b9c44b7f73370008e3fd2c8","observation_id":"d96730dd-3b9b-4b4e-8f45-535fc4726c1a","resolution":{"observed_at":"2026-08-10T16:13:19.895149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00760","last_updated":"2019-02-18T02:32:53Z","snapshot_observed_at":"2026-08-14T18:21:06.309051Z","submitted_at":"2018-10-01T15:31:36Z","title":"Riemannian Adaptive Optimization Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.00760","snapshot_observed_at":"2026-08-10T16:13:19.898135Z","title":"Riemannian adaptive optimization methods","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.898135Z"},"links":{"cited_paper":"/paper/1810.00760","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:bb9939c726c9487a25c896917300d9a5bb0955584772e7f992b65c73db92de32","observation_id":"5a7f3044-ddba-40da-a6d2-5f8d7a476db1","resolution":{"observed_at":"2026-08-10T16:13:19.898135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:19.901788Z","title":"Piqa: Reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.901788Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:ea7279461e648815780ad9566cbd97aea4b676c3fb0c07087889ad99f8fc4c2e","observation_id":"1a1eb707-f59b-4400-890e-dc51fa180a0a","resolution":{"observed_at":"2026-08-10T16:13:19.901788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.00358","last_updated":"2019-02-04T20:59:32Z","snapshot_observed_at":"2026-08-14T19:08:31.830367Z","submitted_at":"2018-06-01T14:06:45Z","title":"A Systematic Classification of Knowledge, Reasoning, and Context within the ARC Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.00358","snapshot_observed_at":"2026-08-10T16:13:19.905063Z","title":"A systematic classification of knowledge, reasoning, and context within the arc dataset","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.905063Z"},"links":{"cited_paper":"/paper/1806.00358","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:cb381a117d1b9a5ad1b7c1c91e517ac3d734304cffa4095ac087a41272296e2e","observation_id":"87526d87-580b-44a3-ac45-b82f1efe4d3b","resolution":{"observed_at":"2026-08-10T16:13:19.905063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13304","last_updated":"2024-01-15T21:54:28Z","snapshot_observed_at":"2026-08-16T15:13:32.645984Z","submitted_at":"2023-07-25T07:44:06Z","title":"QuIP: 2-Bit Quantization of Large Language Models With Guarantees","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13304","snapshot_observed_at":"2026-08-10T16:13:19.908404Z","title":"Quip: 2-bit quantization of large language models with guarantees","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.908404Z"},"links":{"cited_paper":"/paper/2307.13304","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:19c296c03c8890c61a9781f4967d546112e6f587109e69c9bb420d8bc568f30b","observation_id":"50759f5d-a546-42c4-888f-72e3fee4cbcc","resolution":{"observed_at":"2026-08-10T16:13:19.908404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:20.447925Z","title":"Driving with llms: Fusing object-level vector modality for explainable autonomous driving","venue":null,"work_id":"105c89c0-32a9-4240-9418-0801ef91ffa2","year":2024},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.911984Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:7d419e67f1a75e899382eb7fc073a6c6f1ea2d36bbb2017251068b7263bee375","observation_id":"b983fb3d-502e-4f32-a4e8-cbd9a9de49d8","resolution":{"observed_at":"2026-08-10T16:13:20.451293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:20.437530Z","title":"Distributional quantization of large language models","venue":null,"work_id":"9629fb13-1286-46d3-97b7-7b77be721340","year":2023},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.914847Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:a504d9ecf856aaf52cf4366808e299b31a20bafdc87d59f965f612ded39fe9d9","observation_id":"8aa98808-749c-480d-a83e-082e4fe38242","resolution":{"observed_at":"2026-08-10T16:13:20.440804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-08-17T13:55:12.255135Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-10T16:13:19.917627Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.917627Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:9617151911cd07a1f9331abe8b738a17245080a1d548e31e7919184112147788","observation_id":"2e74fef4-d385-43d9-8b0c-1f008c0f3e55","resolution":{"observed_at":"2026-08-10T16:13:19.917627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:19.920908Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.920908Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:55c0465c5349704593d7c6ed4b819bd5e9239149d9d841a11d702b04b847d3d0","observation_id":"4a5ba079-b1c3-4606-816b-65b18b35b9a4","resolution":{"observed_at":"2026-08-10T16:13:19.920908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-16T07:57:19.216626Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-10T16:13:19.923928Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.923928Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:6ff707b38fe3c17359b8b38ec948f8ede5ab640ecc96838a22fc134e9397e792","observation_id":"a0be1eaa-e935-424c-b151-c8778f59b39d","resolution":{"observed_at":"2026-08-10T16:13:19.923928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:19.927047Z","title":"A framework for few-shot language model evaluation, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.927047Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:7a2b3afface19ad2296e1f87f18c23187003bc379ff9f9246463e992d90fb8b4","observation_id":"d158af50-efbe-404e-a5b5-dd08d3199988","resolution":{"observed_at":"2026-08-10T16:13:19.927047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-16T13:48:46.780307Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-08-10T16:13:19.929890Z","title":"I-llm: Efficient integer-only inference for fully-quantized low-bit large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.929890Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:7005cea261e2703f4ce93d6d27d149855aebde68e1edfc0032db77ff13fb4d3d","observation_id":"aaaa6f37-4691-448f-b13b-563a8c370dec","resolution":{"observed_at":"2026-08-10T16:13:19.929890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:20.421402Z","title":"The topology of Stiefel manifolds, volume 24","venue":null,"work_id":"1aca800c-e555-463b-80eb-5f6332b3467b","year":1976},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.933027Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:e7da0270b8c98b399db90ec4e4ee4722776966560d3793155b37a366ff2fa347","observation_id":"173008cf-539b-4b48-bf75-2b117e72f090","resolution":{"observed_at":"2026-08-10T16:13:20.424841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-10T16:13:19.936085Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.936085Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:5b625420caeb071e5003916a645a4242f748594234584464d864d8c67a24609d","observation_id":"ecc961d3-0e04-44d8-9d9b-79cb1e4398bc","resolution":{"observed_at":"2026-08-10T16:13:19.936085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:19.939014Z","title":"Geoopt: Riemannian optimization in pytorch, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.939014Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:9baa25aec41fd93015eaa02f563377856096d2f78a8184907e0b5eac79671312","observation_id":"57493104-f9ce-4cd2-a527-6bba40b14ace","resolution":{"observed_at":"2026-08-10T16:13:19.939014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02272","last_updated":"2024-01-24T02:53:27Z","snapshot_observed_at":"2026-08-16T15:26:49.661873Z","submitted_at":"2023-06-04T06:33:13Z","title":"OWQ: Outlier-Aware Weight Quantization for Efficient Fine-Tuning and Inference of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02272","snapshot_observed_at":"2026-08-10T16:13:19.941751Z","title":"Owq: Lessons learned from activation outliers for weight quantization in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.941751Z"},"links":{"cited_paper":"/paper/2306.02272","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:d8ce6d188ccdd7c7390837b93acd3af31f357f0fa6cd121fab41df09bf4b6edd","observation_id":"8099866e-fca7-4610-b48f-6d02622d2c7e","resolution":{"observed_at":"2026-08-10T16:13:19.941751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.01113","last_updated":"2020-02-04T04:01:51Z","snapshot_observed_at":"2026-08-16T03:09:16.574897Z","submitted_at":"2020-02-04T04:01:51Z","title":"Efficient Riemannian Optimization on the Stiefel Manifold via the Cayley Transform","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.01113","snapshot_observed_at":"2026-08-10T16:13:19.944930Z","title":"Efficient riemannian optimization on the stiefel manifold via the cayley transform","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.944930Z"},"links":{"cited_paper":"/paper/2002.01113","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:d61b12dcf2e9f1a032026ed4b67d8465cd5009d3b18088633d5dc29047be64b8","observation_id":"0f5b7e03-ee08-4fc2-afb7-9614d5a8acaa","resolution":{"observed_at":"2026-08-10T16:13:19.944930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-08-10T16:13:19.948946Z","title":"Awq: Activation-aware weight quantization for llm compression and acceleration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.948946Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:89ae9fc081cca840b7c69f13d1ab6440db3bc60b90fde4dac30a4b6751771df6","observation_id":"930d2d93-5223-4a70-aad2-3647360bb88c","resolution":{"observed_at":"2026-08-10T16:13:19.948946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-08-16T17:18:05.876361Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-10T16:13:19.951975Z","title":"Spinquant--llm quantization with learned rotations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.951975Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:fc74f52a78f2b5278cb9ab9afa8c829953f7cdab1c05474ffa0e388385ec737c","observation_id":"9a126cef-7a74-45cb-aa0b-3c97758022b9","resolution":{"observed_at":"2026-08-10T16:13:19.951975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12544","last_updated":"2024-03-19T08:40:21Z","snapshot_observed_at":"2026-08-16T14:08:29.102072Z","submitted_at":"2024-03-19T08:40:21Z","title":"AffineQuant: Affine Transformation Quantization for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12544","snapshot_observed_at":"2026-08-10T16:13:19.955208Z","title":"Affinequant: Affine transformation quantization for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.955208Z"},"links":{"cited_paper":"/paper/2403.12544","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:587203ca00077cdb7f1d2acd5f0785e3909cc761ae9b0ba0a00ce670d211163f","observation_id":"166a56b1-ef19-463e-839d-1cb62672ca48","resolution":{"observed_at":"2026-08-10T16:13:19.955208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-08-17T01:46:43.513643Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-10T16:13:19.958622Z","title":"Pointer sentinel mixture models","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.958622Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:027ffd42849311b34382a6e2ee71dbfd8709a14608de70853aa3866a1b4f0524","observation_id":"6a645625-2a43-4db3-818a-4bdb75671c5b","resolution":{"observed_at":"2026-08-10T16:13:19.958622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-14T07:00:02.529732Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-10T16:13:19.961767Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.961767Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:d9913f62e5ea404743571807f8b2166eb73aac87c444fc3ce30f173186cd9c88","observation_id":"01b1de57-5097-44b0-b57e-c2821d653482","resolution":{"observed_at":"2026-08-10T16:13:19.961767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:19.964432Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.964432Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:25737c02c69eb23e81449092717db6daa3cfa79b697adb13e247212cd763d3d2","observation_id":"7c0038c3-37cd-4fd9-bc2c-522ec5ac7ffc","resolution":{"observed_at":"2026-08-10T16:13:19.964432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:20.399672Z","title":"Winogrande: An adversarial winograd schema challenge at scale","venue":null,"work_id":"cbeb0c10-4e0b-4a13-84e0-feb035698f2b","year":2021},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.966892Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:4962bcb76e39259e9a581cdc7b71fc6616b9e7a2bb4beec6b5bfe4fdfe5d9783","observation_id":"1fd6c393-d5d7-46df-b17d-270372abe28d","resolution":{"observed_at":"2026-08-10T16:13:20.404531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09728","last_updated":"2019-09-09T17:29:55Z","snapshot_observed_at":"2026-08-12T21:45:41.485479Z","submitted_at":"2019-04-22T05:36:37Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09728","snapshot_observed_at":"2026-08-10T16:13:19.969429Z","title":"Socialiqa: Commonsense reasoning about social interactions","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.969429Z"},"links":{"cited_paper":"/paper/1904.09728","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:29099e3a86fcf36bebcd350a7ada4bf20cfda08a6711c4c8ea00f886fad42cfe","observation_id":"67d41117-7f90-49cc-8211-4eeed2a23e34","resolution":{"observed_at":"2026-08-10T16:13:19.969429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13137","last_updated":"2024-03-18T05:33:22Z","snapshot_observed_at":"2026-08-16T15:05:54.961547Z","submitted_at":"2023-08-25T02:28:35Z","title":"OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13137","snapshot_observed_at":"2026-08-10T16:13:19.972488Z","title":"Omniquant: Omnidirectionally calibrated quantization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.972488Z"},"links":{"cited_paper":"/paper/2308.13137","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:352bf64a4f45a909a86e11bcef0eb628601c9dc2b398191ad2824c146670f51f","observation_id":"df928ba2-f7dc-455a-b9b7-4c19c81a4607","resolution":{"observed_at":"2026-08-10T16:13:19.972488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T16:13:19.975474Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.975474Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:e20db001480f9e392008336675f1aea9f475e769796a6f8b458ff3dba7e1487b","observation_id":"90b7234d-c566-4752-880b-594c5e760a1d","resolution":{"observed_at":"2026-08-10T16:13:19.975474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T16:13:19.978710Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.978710Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:5282374915c5bac5b4401fd54b18dc6cfa093ab3a0afe2f8560a9976250b2557","observation_id":"71a20098-ff60-41a4-bd5f-56be22d2b7a0","resolution":{"observed_at":"2026-08-10T16:13:19.978710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-08-16T14:20:50.908439Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-10T16:13:19.981883Z","title":"Quip\\#: Even better llm quantization with hadamard incoherence and lattice codebooks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.981883Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:a529eb6b548b4cfe2052936489efd7e120da9a43f05ed9774d4726336eccc289","observation_id":"6537f63c-1669-4b9b-a292-4bb7a9402611","resolution":{"observed_at":"2026-08-10T16:13:19.981883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10438","last_updated":"2024-03-29T19:21:58Z","snapshot_observed_at":"2026-08-16T16:15:00.962632Z","submitted_at":"2022-11-18T18:59:33Z","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10438","snapshot_observed_at":"2026-08-10T16:13:19.985136Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.985136Z"},"links":{"cited_paper":"/paper/2211.10438","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:6b2a642b3ec155515820f6118de14833022c52e20bb2fab902c0f7c615cebce2","observation_id":"a8e874f3-822b-48d7-af15-c9534422461c","resolution":{"observed_at":"2026-08-10T16:13:19.985136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01861","last_updated":"2022-06-04T00:28:21Z","snapshot_observed_at":"2026-08-16T16:55:23.882455Z","submitted_at":"2022-06-04T00:28:21Z","title":"ZeroQuant: Efficient and Affordable Post-Training Quantization for Large-Scale Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01861","snapshot_observed_at":"2026-08-10T16:13:19.988135Z","title":"Zeroquant: Efficient and affordable post-training quantization for large-scale transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.988135Z"},"links":{"cited_paper":"/paper/2206.01861","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:6a7c42ed072e0793c2baae3920aac52ee30c1adce157505e4af0c1cb65b17ecd","observation_id":"d1c187c5-2f9a-4c8e-b164-77642734c8de","resolution":{"observed_at":"2026-08-10T16:13:19.988135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-10T16:13:19.991146Z","title":"Hellaswag: Can a machine really finish your sentence? arXiv preprint arXiv:1905.07830, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.991146Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:d450a79f22f3f3b5906fa9596ec330d7e450b278edb738156dc615e364d1c27f","observation_id":"1e4030b3-c143-4615-9710-868a7e384154","resolution":{"observed_at":"2026-08-10T16:13:19.991146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:19.994255Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.994255Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:c47e9f7322c9fc94d9b99b82cddedd04a860270eb3be0d106bcd2dec9676fc7b","observation_id":"ff7a0792-c45d-43dd-beb7-3ba3753d3629","resolution":{"observed_at":"2026-08-10T16:13:19.994255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:19.998256Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.998256Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:a173ca99223fdecd35280df92fe5e9e9c0989392c13d1b62aa697dd8d65e5013","observation_id":"68bf4dff-eb60-4194-876c-414bde825a80","resolution":{"observed_at":"2026-08-10T16:13:19.998256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:20.001515Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:20.001515Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:c64a609822067a270005bee9c2d96b42d6afa212f74d5a90ad912c0c5ac214b5","observation_id":"853873af-147e-4eea-bcc5-073c0c79443f","resolution":{"observed_at":"2026-08-10T16:13:20.001515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:13:20.004756Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:20.004756Z"},"links":{"citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:8032d7e00fbe311f39c0e6ea9d9b6bbefa6567321ee6ecb91f69fcf9cae5a761","observation_id":"72d7de02-d8d0-49d8-94a9-0dbc2585bd05","resolution":{"observed_at":"2026-08-10T16:13:20.004756Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T13:19:56.824745Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 22 inbound Pith citation observations for arXiv:2501.13987."}