{"as_of":"2026-08-21T00:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d58473d5f70c2ad91062f3df3e83b91cd2d74ac89b15a66bbb0c56e133924d7f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":47,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:32:56.673897Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T14:47:14.595381Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-11T00:38:47.280143Z","title":"Flatquant: Flatness matters for llm quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19442","last_updated":"2025-07-30T05:24:46Z","snapshot_observed_at":"2026-08-20T14:01:46.841630Z","submitted_at":"2024-12-27T04:17:57Z","title":"A Survey on Large Language Model Acceleration based on KV Cache Management","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T00:38:47.280143Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2412.19442"},"observation_digest":"sha256:3c9a8193953bd1c4d42f85cc5613a1c98223d3e41ccae40705d868fa3fd8abb9","observation_id":"cf63bef9-ed5c-4a67-ae3b-e16590eff196","resolution":{"observed_at":"2026-08-11T00:38:47.280143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-11T00:21:52.282753Z","title":"Flatquant: Flatness matters for llm quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19509","last_updated":"2025-03-21T06:01:23Z","snapshot_observed_at":"2026-08-18T00:33:19.218843Z","submitted_at":"2024-12-27T07:55:36Z","title":"MBQ: Modality-Balanced Quantization for Large Vision-Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T00:21:52.282753Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2412.19509"},"observation_digest":"sha256:a90a69a8a9ac1b42314cfc472995759466df26966b91f6e55213bdc50914557a","observation_id":"84f6cc41-98bc-4567-8db8-f5aa81e0f34e","resolution":{"observed_at":"2026-08-11T00:21:52.282753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-07T13:18:31.651215Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22179","last_updated":"2025-05-29T04:07:33Z","snapshot_observed_at":"2026-08-13T22:38:08.304751Z","submitted_at":"2025-05-28T09:55:08Z","title":"Speculative Decoding Meets Quantization: Compatibility Evaluation and Hierarchical Framework Design","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:18:31.651215Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2505.22179"},"observation_digest":"sha256:cc185ab3e1f01ab198e8ebe88ff332765bcc3d80a28e48d46bc3107686769fc2","observation_id":"eb5a1c4f-ed55-40c2-817e-440bfcb4107f","resolution":{"observed_at":"2026-08-07T13:18:31.651215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-15T22:32:56.673897Z","title":"FlatQuant: Flatness Matters for LLM Quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-20T11:22:02.250012Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.673897Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:cd77a40a9ab37f2f7f2ebdc54d06946188a1e252115c5d447d6c68815fe2cffb","observation_id":"f05e635b-5436-40eb-9de6-dfb5d3d91b5f","resolution":{"observed_at":"2026-08-15T22:32:56.673897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-07T10:43:47.377076Z","title":"FlatQuant: Flatness Matters for LLM Quantization, October 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04985","last_updated":"2026-07-08T07:56:27Z","snapshot_observed_at":"2026-08-19T02:08:39.348290Z","submitted_at":"2025-06-05T12:56:12Z","title":"FPTQuant: Function-Preserving Transforms for LLM Quantization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:43:47.377076Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2506.04985"},"observation_digest":"sha256:d1e1bec27dc07735239e89aa9703f766fd9b01138baffbbe32caafc401e9885b","observation_id":"252b32eb-f7f4-4bcd-809a-0b2ae9fc5dcc","resolution":{"observed_at":"2026-08-07T10:43:47.377076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-07T10:47:33.692846Z","title":"FlatQuant: Flatness Matters for LLM Quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05413","last_updated":"2025-07-29T15:28:07Z","snapshot_observed_at":"2026-08-17T03:31:37.948985Z","submitted_at":"2025-06-04T19:07:45Z","title":"SmoothRot: Combining Channel-Wise Scaling and Rotation for Quantization-Friendly LLMs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:33.692846Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2506.05413"},"observation_digest":"sha256:252c7521f7810232dfffa8b7c808d0ac6b08d4e01da68bc45ce11841fd04188b","observation_id":"9b4a16a2-bb2b-4aef-91ef-144e620cb39f","resolution":{"observed_at":"2026-08-07T10:47:33.692846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2506.12040","last_updated":"2026-04-09T06:22:06Z","snapshot_observed_at":"2026-08-16T21:08:22.449761Z","submitted_at":"2025-05-24T03:57:19Z","title":"BTC-LLM: Efficient Sub-1-Bit LLM Quantization via Learnable Transformation and Binary Codebook","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-19T14:03:35.214840Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2506.12040"},"observation_digest":"sha256:e715b602c31757e764b3035ed0b40a85029ab64f6da8aea1f2403311ec1e8cae","observation_id":"a2cf9096-26ba-445d-8fd4-16888dbb8644","resolution":{"observed_at":"2026-05-19T14:07:20.495009Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-07T14:06:25.044991Z","title":"Flatquant: Flatness matters for llm quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15689","last_updated":"2025-08-29T12:03:45Z","snapshot_observed_at":"2026-08-18T02:46:12.498670Z","submitted_at":"2025-05-26T14:22:21Z","title":"BASE-Q: Bias and Asymmetric Scaling Enhanced Rotational Quantization for Large Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:25.044991Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2506.15689"},"observation_digest":"sha256:9bec8f567a617a1fdb3228bc132fca1f005f836c20b5aadb455ec0b0d987a6e3","observation_id":"f7019349-af58-4c26-82d7-f4579f20ef7b","resolution":{"observed_at":"2026-08-07T14:06:25.044991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-06T14:48:30.655337Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18212","last_updated":"2025-07-24T09:07:20Z","snapshot_observed_at":"2026-08-16T16:50:11.191630Z","submitted_at":"2025-07-24T09:07:20Z","title":"Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T14:48:30.655337Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2507.18212"},"observation_digest":"sha256:cfbb4fd669844f018e03d2c082819eb6a4e3b2bd0ab76d50936ff7d33cd71cbc","observation_id":"01d5bc78-5d95-421a-980a-e0fa4f1b8566","resolution":{"observed_at":"2026-08-06T14:48:30.655337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-06T11:15:34.021581Z","title":"Flatquant: Flatness matters for llm quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23035","last_updated":"2026-06-02T03:48:06Z","snapshot_observed_at":"2026-08-15T09:38:35.594651Z","submitted_at":"2025-07-30T19:01:25Z","title":"OASIS: Outlier-Aware LUT-Based GEMM with Dual-Side Quantization for LLM Inference Acceleration","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T11:15:34.021581Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2507.23035"},"observation_digest":"sha256:3e79916f2f63760c51fcfbe0a7d333c1d85c77befd0febeb85d2b75347cfaae1","observation_id":"ccd3cce7-639b-436b-b6df-46d6abd5dcd6","resolution":{"observed_at":"2026-08-06T11:15:34.021581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-04T19:47:08.903863Z","title":"Zechun Liu, Changsheng Zhao, Igor Fedorov, Bilge Soran, Dhruv Choudhary, Raghuraman Krishnamoorthi, Vikas Chandra, Yuandong Tian, and Tijmen Blankevoort","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09090","last_updated":"2025-09-11T01:52:25Z","snapshot_observed_at":"2026-08-20T12:51:33.981228Z","submitted_at":"2025-09-11T01:52:25Z","title":"SQAP-VLA: A Synergistic Quantization-Aware Pruning Framework for High-Performance Vision-Language-Action Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T19:47:08.903863Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2509.09090"},"observation_digest":"sha256:69143b6b82fbc0d3e7b280bb336921c30bc978a21d344a21f74e15e57feab049","observation_id":"1319fedc-277e-4ec4-ba9b-b618e122e71e","resolution":{"observed_at":"2026-08-04T19:47:08.903863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-03T11:10:52.712469Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.07475","last_updated":"2026-07-04T06:36:53Z","snapshot_observed_at":"2026-08-15T13:14:22.329443Z","submitted_at":"2026-01-12T12:27:22Z","title":"ARCQuant: Boosting NVFP4 Quantization with Augmented Residual Channels for LLMs","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-03T11:10:52.712469Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2601.07475"},"observation_digest":"sha256:027a44a1bff7fb7986397f39be834243d824c1894a124da608298326ff6b5986","observation_id":"ae612764-88b0-4a26-b26a-7d60345fe6c7","resolution":{"observed_at":"2026-08-03T11:10:52.712469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-15T15:45:56.364409Z","title":"FlatQuant: Flatness matters for llm quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.22347","last_updated":"2026-05-27T21:46:34Z","snapshot_observed_at":"2026-08-19T19:15:56.390524Z","submitted_at":"2026-01-29T21:46:26Z","title":"Pushing the Limits of Block Rotations in Post-Training Quantization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T15:45:56.364409Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2601.22347"},"observation_digest":"sha256:23452c02272295dd8333d0fc659d3246333ebe1a23213bff3fdfddcc0f1956bc","observation_id":"8a36bdb3-0c4d-42c5-9689-ceae74b09a9a","resolution":{"observed_at":"2026-08-15T15:45:56.364409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-03T04:37:25.306491Z","title":"Flatquant: Flatness matters for llm quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.04595","last_updated":"2026-07-22T11:57:18Z","snapshot_observed_at":"2026-08-13T15:58:08.779619Z","submitted_at":"2026-02-04T14:22:08Z","title":"Harmonia: Algorithm-Hardware Co-Design for Memory- and Compute-Efficient BFP-based LLM Inference","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T04:37:25.306491Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2602.04595"},"observation_digest":"sha256:b254f5f75dd02c09ff9496cabfa643a48f22cd9d97818bcb44e927322c2ebb8c","observation_id":"02f00097-e4a3-4008-a6d5-c9aede9f43db","resolution":{"observed_at":"2026-08-03T04:37:25.306491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2602.20309","last_updated":"2026-04-06T23:32:59Z","snapshot_observed_at":"2026-08-11T03:24:57.486480Z","submitted_at":"2026-02-23T19:55:54Z","title":"QuantVLA: Scale-Calibrated Post-Training Quantization for Vision-Language-Action Models","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T20:20:10.435886Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2602.20309"},"observation_digest":"sha256:0c11b9b58c13f8e4c07caf1001c084253409d82919e41c3f0c060b9c64507f71","observation_id":"981620d0-e0a4-43c7-8720-32014b5ae3c4","resolution":{"observed_at":"2026-05-15T20:20:17.322115Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2604.04013","last_updated":"2026-04-05T08:04:39Z","snapshot_observed_at":"2026-08-11T09:45:12.224702Z","submitted_at":"2026-04-05T08:04:39Z","title":"RUQuant: Towards Refining Uniform Quantization for Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T17:36:53.861234Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2604.04013"},"observation_digest":"sha256:4c301ec5d944d763628ae48e2eec61c6fb29cabc8b93473dc3d20927cf885a68","observation_id":"c7763bef-6454-406c-a39d-9a306fc8d6fa","resolution":{"observed_at":"2026-05-13T17:38:02.560937Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2604.09742","last_updated":"2026-04-10T00:17:47Z","snapshot_observed_at":"2026-08-17T20:33:48.684635Z","submitted_at":"2026-04-10T00:17:47Z","title":"Efficient Matrix Implementation for Rotary Position Embedding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T18:20:15.071698Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2604.09742"},"observation_digest":"sha256:f12bc5d1b90040c53cdacecdb5486b10137434d76c4b2d6d331d099faa8b2077","observation_id":"dcfc9ff8-9d64-4e82-9ef8-749821b52979","resolution":{"observed_at":"2026-05-11T00:45:49.908197Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2604.12782","last_updated":"2026-04-14T14:17:59Z","snapshot_observed_at":"2026-08-11T18:44:28.415280Z","submitted_at":"2026-04-14T14:17:59Z","title":"OSC: Hardware Efficient W4A4 Quantization via Outlier Separation in Channel Dimension","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T16:15:59.622461Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2604.12782"},"observation_digest":"sha256:671920a537cf41a3f269280db748041f2f8f2bc7b12dd7765e3e74d21050581b","observation_id":"b0465a61-5f4c-4f65-acf2-80a765675ba0","resolution":{"observed_at":"2026-05-11T09:05:59.532704Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2604.18556","last_updated":"2026-05-15T09:34:30Z","snapshot_observed_at":"2026-08-13T18:41:24.702288Z","submitted_at":"2026-04-20T17:45:47Z","title":"GSQ: Highly-Accurate Low-Precision Scalar Quantization for LLMs via Gumbel-Softmax Sampling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T05:29:51.182114Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2604.18556"},"observation_digest":"sha256:462e3aec52882e807f9158a4e7ba44240d5b27176a3ffaa19dcb24103c4b0d05","observation_id":"4816c971-df3b-45a9-b0d8-5af2f7d239fd","resolution":{"observed_at":"2026-05-10T05:41:02.523683Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2604.18556","last_updated":"2026-05-15T09:34:30Z","snapshot_observed_at":"2026-08-13T18:41:24.702288Z","submitted_at":"2026-04-20T17:45:47Z","title":"GSQ: Highly-Accurate Low-Precision Scalar Quantization for LLMs via Gumbel-Softmax Sampling","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T18:01:08.514022Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2604.18556"},"observation_digest":"sha256:d4f76b8e8c1a0b5f69fd14199dc8881a50f89e8e56ca27225792e721554241ea","observation_id":"44500a70-ac63-4fce-ac0c-e5997af0ff5f","resolution":{"observed_at":"2026-05-19T18:02:42.221346Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2604.22577","last_updated":"2026-04-24T14:10:29Z","snapshot_observed_at":"2026-08-12T14:44:23.276596Z","submitted_at":"2026-04-24T14:10:29Z","title":"QuantClaw: Precision Where It Matters for OpenClaw","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T11:51:07.657988Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2604.22577"},"observation_digest":"sha256:cb52c32872f25aad7603f2b96ca83832a37a89b2b8d19dc5ebed0d316109436e","observation_id":"4b767354-3d73-497b-8c75-e9eaf5ebfc76","resolution":{"observed_at":"2026-05-11T19:31:07.492180Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2604.24088","last_updated":"2026-04-27T06:27:31Z","snapshot_observed_at":"2026-08-12T12:37:06.254147Z","submitted_at":"2026-04-27T06:27:31Z","title":"TACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-08T01:36:41.804171Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2604.24088"},"observation_digest":"sha256:4d022f76d1d7756c2db2c99e276a7cba354c766aaa11f5e468e302504c555f95","observation_id":"5c406260-4f0a-4e6d-a86b-715e6a18e9a0","resolution":{"observed_at":"2026-05-11T23:06:20.857342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2605.18475","last_updated":"2026-05-18T14:30:58Z","snapshot_observed_at":"2026-08-15T15:48:21.544447Z","submitted_at":"2026-05-18T14:30:58Z","title":"GAMMA: Global Bit Allocation for Mixed-Precision Models under Arbitrary Budgets","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-20T12:25:39.417436Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2605.18475"},"observation_digest":"sha256:b815b141e9c6fca61838472e53176aa8421aec98e0dffd868de4703ec3296039","observation_id":"509dd602-ecf0-4c42-9bb7-1ebd9f016c37","resolution":{"observed_at":"2026-05-20T12:28:16.830861Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2605.18800","last_updated":"2026-05-11T10:51:40Z","snapshot_observed_at":"2026-08-16T20:24:16.055895Z","submitted_at":"2026-05-11T10:51:40Z","title":"Theory-optimal Quantization Based on Flatness","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T22:38:06.888665Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2605.18800"},"observation_digest":"sha256:303b7947892d1e5b0ee98c77a25569654a15dbfd5c06dcc33ab37df06a8b8322","observation_id":"07f6ca75-8adb-461f-8115-1407c96cc5e2","resolution":{"observed_at":"2026-05-20T22:39:09.966350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2605.19218","last_updated":"2026-05-19T00:45:00Z","snapshot_observed_at":"2026-08-20T00:56:00.090969Z","submitted_at":"2026-05-19T00:45:00Z","title":"Rotation-Aligned Key Channel Pruning for Efficient Vision-Language Model Inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-20T07:43:18.828740Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2605.19218"},"observation_digest":"sha256:5484be6e023ca3e3fe852ef52d1cf52c62ba3e1c36eec5f63b6f123d063cd1ed","observation_id":"464745cb-6247-4472-931f-b022e77edc75","resolution":{"observed_at":"2026-05-20T07:43:23.767504Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2605.19929","last_updated":"2026-05-19T14:49:57Z","snapshot_observed_at":"2026-08-14T18:57:19.754744Z","submitted_at":"2026-05-19T14:49:57Z","title":"Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-20T05:20:45.264341Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2605.19929"},"observation_digest":"sha256:2490058168c8334205d0ec52e7a8b7d46426c048869f72f200593c764bfbebb6","observation_id":"922a2180-cd71-4ba7-a745-bfda9b91541c","resolution":{"observed_at":"2026-05-20T05:23:03.645477Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2605.26175","last_updated":"2026-05-25T05:34:46Z","snapshot_observed_at":"2026-08-12T17:34:26.022031Z","submitted_at":"2026-05-25T05:34:46Z","title":"InfoQuant: Shaping Activation Distributions for Low-Bit LLM Quantization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T23:04:50.336003Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2605.26175"},"observation_digest":"sha256:09a0b1d29ae404dc95bfb29be922b9399526ca0f7e4b80d411afc1b280199452","observation_id":"a6059e17-cf3c-45de-bee1-2470236a5b27","resolution":{"observed_at":"2026-06-29T23:14:02.081936Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2605.28803","last_updated":"2026-08-11T05:08:08Z","snapshot_observed_at":"2026-08-15T13:25:11.599585Z","submitted_at":"2026-05-27T17:55:01Z","title":"HoloQ-VLA: Uniform W4A4 Quantization of Vision-Language-Action Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T12:44:50.624778Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2605.28803"},"observation_digest":"sha256:c4cd181e89ef3f6cca55584b8750718fd4a287346e026ec915b6e7fee8a43a1d","observation_id":"0c447f2e-5f9b-43a5-bf3e-b11dbf452433","resolution":{"observed_at":"2026-06-29T12:53:26.925078Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2605.31035","last_updated":"2026-05-29T09:05:42Z","snapshot_observed_at":"2026-08-13T00:59:08.247988Z","submitted_at":"2026-05-29T09:05:42Z","title":"MixFP4: Enhancing NVFP4 with Adaptive FP4/INT4 Block Representations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T20:17:16.036226Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2605.31035"},"observation_digest":"sha256:880ed8fbecdb473071ed7a39ac3461759e583d610a0ea2dd96f173614ba1d2c3","observation_id":"01ce34e9-3f9d-40e5-83a8-6824d8a7311e","resolution":{"observed_at":"2026-06-28T20:22:37.194777Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2606.00206","last_updated":"2026-05-29T18:00:00Z","snapshot_observed_at":"2026-08-15T13:37:05.608666Z","submitted_at":"2026-05-29T18:00:00Z","title":"Quantized Reasoning Models Think They Need to Think Longer, but They Do Not","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-28T23:05:00.401365Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2606.00206"},"observation_digest":"sha256:26c2e451636246dc512790c6e4cf38dacff1112e3a28cfd9b987502ff32c59ad","observation_id":"281bc437-b119-420b-a0c2-c260d1492997","resolution":{"observed_at":"2026-07-01T19:16:00.093879Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2606.02823","last_updated":"2026-06-01T19:40:32Z","snapshot_observed_at":"2026-08-17T23:20:16.004735Z","submitted_at":"2026-06-01T19:40:32Z","title":"Qift: Shift-Friendly No-Zero W2 Post-Training Quantization for Rotated W2A4/KV4 LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T15:49:41.836888Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2606.02823"},"observation_digest":"sha256:2181a64c5a059811a535fe9a215e815a07104bbacfcf7974d16fce1a221c6fe0","observation_id":"de93df8b-96bc-4ebe-a4fa-0c1cdd2cd91f","resolution":{"observed_at":"2026-07-01T22:06:15.971711Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2606.04050","last_updated":"2026-06-29T14:48:51Z","snapshot_observed_at":"2026-08-15T00:21:47.708199Z","submitted_at":"2026-06-02T08:52:04Z","title":"LiftQuant: Continuous Bit-Width LLM via Dimensional Lifting and Projection","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-28T11:14:03.535306Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2606.04050"},"observation_digest":"sha256:8539fab9cc36e418be001c4c5c253260876bb6f115373c0f329dd45b3370d3bc","observation_id":"90567447-2a14-48f3-b8c1-fc02e45bd621","resolution":{"observed_at":"2026-07-02T02:06:26.975824Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2606.04050","last_updated":"2026-06-29T14:48:51Z","snapshot_observed_at":"2026-08-15T00:21:47.708199Z","submitted_at":"2026-06-02T08:52:04Z","title":"LiftQuant: Continuous Bit-Width LLM via Dimensional Lifting and Projection","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-30T11:17:53.736872Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2606.04050"},"observation_digest":"sha256:9abf67330a86db104cecb5f9e7ba667268e1a359ecf7e09b86b6f877f2b9dc19","observation_id":"d69724b8-b8fc-4f5c-afa9-14c835495fe9","resolution":{"observed_at":"2026-06-30T11:24:38.285781Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2606.06547","last_updated":"2026-07-19T09:43:18Z","snapshot_observed_at":"2026-08-15T03:54:17.349866Z","submitted_at":"2026-06-04T08:00:51Z","title":"FAIR-Calib: Frontier-Aware Instability-Reweighted Calibration for Post-Training Quantization of Diffusion Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T02:35:00.563647Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2606.06547"},"observation_digest":"sha256:86e9b25b0e84c37b4bdc34fab0e7fc9fe7519bc829a1b8140965ffb27bae76bf","observation_id":"b4439ba7-7369-45ef-99d1-1f41ec2b1ca1","resolution":{"observed_at":"2026-07-02T12:06:55.560481Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-02T12:23:13.709784Z","title":"Flatquant: Flatness matters for llm quantization.arXiv preprint arXiv:2410.09426,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.06547","last_updated":"2026-07-19T09:43:18Z","snapshot_observed_at":"2026-08-15T03:54:17.349866Z","submitted_at":"2026-06-04T08:00:51Z","title":"FAIR-Calib: Frontier-Aware Instability-Reweighted Calibration for Post-Training Quantization of Diffusion Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T12:23:13.709784Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2606.06547"},"observation_digest":"sha256:7a62ed9ec4d59c422ea2809f2c82db539ed6ab362f10d127a51cd042b361e4da","observation_id":"452af151-a6dd-4d1e-9d41-a8134163b404","resolution":{"observed_at":"2026-08-02T12:23:13.709784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2606.12487","last_updated":"2026-06-10T09:25:45Z","snapshot_observed_at":"2026-08-13T07:02:18.498766Z","submitted_at":"2026-06-10T09:25:45Z","title":"DynamicPTQ: Mitigating Activation Quantization Collapse via Residual-Stream Dynamics","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T10:36:33.893923Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2606.12487"},"observation_digest":"sha256:184aab95db9c994123f00fd5856e06eb3274a5dbf7cb19514bf121a92514ead8","observation_id":"47f841d1-bf95-4a61-abce-ceaa57481538","resolution":{"observed_at":"2026-07-03T08:57:47.858609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2606.20437","last_updated":"2026-06-18T16:18:10Z","snapshot_observed_at":"2026-08-12T21:15:47.497351Z","submitted_at":"2026-06-18T16:18:10Z","title":"HEPTv2: End-to-End Efficient Point Transformer for Charged Particle Reconstruction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T14:57:13.185248Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2606.20437"},"observation_digest":"sha256:8c77002d1a31e7c6d4d2ece1886f1bb58ba6c4836b35207afea26c58e505d531","observation_id":"87bfadae-b6c8-4e4a-bf82-93b4ea473d42","resolution":{"observed_at":"2026-07-04T05:59:38.324310Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2607.02461","last_updated":"2026-07-02T17:27:34Z","snapshot_observed_at":"2026-08-16T23:35:17.957783Z","submitted_at":"2026-07-02T17:27:34Z","title":"OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-03T14:56:10.553212Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2607.02461"},"observation_digest":"sha256:131e70f1e3134e1dabe448f13b4174878a9769844903400dbc34b46ec3f7150f","observation_id":"feed6185-49ba-4e16-8cf6-4a52347fc662","resolution":{"observed_at":"2026-07-03T14:58:32.420372Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":"2410.09426","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-07-10T14:47:14.595381Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, and 1 others","venue":"cs.CL","work_id":"5e815818-31d3-46d2-9c35-b2c9e33fc9c2","year":2024},"citing_paper":{"arxiv_id":"2607.07964","last_updated":"2026-08-08T21:43:41Z","snapshot_observed_at":"2026-08-14T14:58:15.706165Z","submitted_at":"2026-07-08T22:34:52Z","title":"KronQ: LLM Quantization via Kronecker-Factored Hessian","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-10T14:38:16.781357Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2607.07964"},"observation_digest":"sha256:4c84e5711ebea0d6cdc69dacfdf399039fc01d3b26f631287bae4d98dc4b0d3e","observation_id":"c2a1a963-30f2-49ff-a49d-f7efc7cd2cd0","resolution":{"observed_at":"2026-07-10T14:47:14.596545Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-02T03:32:53.097749Z","title":"FlatQuant: Flatness matters for LLM quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14181","last_updated":"2026-07-15T14:05:33Z","snapshot_observed_at":"2026-08-18T06:45:06.018281Z","submitted_at":"2026-07-15T14:05:33Z","title":"Quantize with Confidence? An Empirical Study of Quantization for Code Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T03:32:53.097749Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2607.14181"},"observation_digest":"sha256:32275120997c5ce0e062f514c30c23dd44d85d4497d13fd7000579910a7d4739","observation_id":"23215029-05bd-423c-91ff-e93776deef77","resolution":{"observed_at":"2026-08-02T03:32:53.097749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-01T07:32:25.311733Z","title":"arXiv preprint arXiv:2410.09426 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21446","last_updated":"2026-07-23T15:52:20Z","snapshot_observed_at":"2026-08-19T02:20:30.903088Z","submitted_at":"2026-07-23T15:52:20Z","title":"KroQuant: Kronecker-Structured Block Transforms for Efficient Post-Training Quantization of Diffusion Transformers","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T07:32:25.311733Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2607.21446"},"observation_digest":"sha256:fe6dafbee0302b0975ffa48c925ca9ef92727a49075153973d538aa9cc5f5563","observation_id":"90c9e76c-96a8-4dc8-862b-52a9df8e1451","resolution":{"observed_at":"2026-08-01T07:32:25.311733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-01T03:16:46.910245Z","title":"Flatquant: Flatness matters for llm quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27694","last_updated":"2026-07-30T05:26:20Z","snapshot_observed_at":"2026-08-20T16:27:15.880918Z","submitted_at":"2026-07-30T05:26:20Z","title":"GyRot: Leveraging Hidden Synergy between Rotation and Fine-grained Group Quantization for Low-bit LLM Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T03:16:46.910245Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2607.27694"},"observation_digest":"sha256:8ac8e085024f590dfeb4e730fe6c1d5781a419aa70eb6bac67161d7a4df2d0a3","observation_id":"d4ce794d-c345-4e23-878c-d5ed1a6d45c0","resolution":{"observed_at":"2026-08-01T03:16:46.910245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-01T03:01:44.151542Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27704","last_updated":"2026-07-30T05:39:58Z","snapshot_observed_at":"2026-08-14T14:39:11.713519Z","submitted_at":"2026-07-30T05:39:58Z","title":"LightRot: A Light-Weighted Rotation Scheme and Architecture for Accurate Low-Bit Large Language Model Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T03:01:44.151542Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2607.27704"},"observation_digest":"sha256:b70e02e118b811722cab6f327ab5b34007c7a56997e13a4c39c611c9984ca5a2","observation_id":"21d8ec9b-5d47-497b-8d34-32a4eedc50d2","resolution":{"observed_at":"2026-08-01T03:01:44.151542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-14T04:40:10.285584Z","title":"arXiv preprint arXiv:2410.09426 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08447","last_updated":"2026-08-09T03:30:14Z","snapshot_observed_at":"2026-08-17T06:02:48.187688Z","submitted_at":"2026-08-09T03:30:14Z","title":"Hidden Language Consistency Phenomena in Reasoning LLMs","version":1},"reference_index":248,"source":"arxiv_source","source_observed_at":"2026-08-14T04:40:10.285584Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2608.08447"},"observation_digest":"sha256:b6766433050cf0214d4e828caa6a648c54f88e6e7959aced69a7ec4d8ebcfd9e","observation_id":"b1728799-5ba9-4fb7-937e-88df2418a78c","resolution":{"observed_at":"2026-08-14T04:40:10.285584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-14T04:38:43.928718Z","title":"arXiv preprint arXiv:2410.09426 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08506","last_updated":"2026-08-09T06:03:48Z","snapshot_observed_at":"2026-08-20T01:43:54.976595Z","submitted_at":"2026-08-09T06:03:48Z","title":"Understanding Calibration and Truncation Error Propagation in Training-Free Low-Rank Compression for LLMs","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-08-14T04:38:43.928718Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2608.08506"},"observation_digest":"sha256:e5aa6912cf59a37580250a543905ed1074ffb0f52eb5a09e6a3c6efbe1f1a799","observation_id":"dc904aee-37cb-4221-ab88-8c1eb790edd5","resolution":{"observed_at":"2026-08-14T04:38:43.928718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-11T20:11:13.960472Z","title":"Flatquant: Flatness matters for llm quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09291","last_updated":"2026-08-10T08:43:19Z","snapshot_observed_at":"2026-08-19T04:05:06.167131Z","submitted_at":"2026-08-10T08:43:19Z","title":"UnionSparse: An Index-Efficient Sparsity Framework for Low-Bit Sparse LLM Inference on Edge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:11:13.960472Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2608.09291"},"observation_digest":"sha256:4d00778c5eed20b3e49897cc840cafb81a51a4e150312f5f7d1c5e3701579989","observation_id":"d368b82d-868b-453d-8ba0-de167cbda201","resolution":{"observed_at":"2026-08-11T20:11:13.960472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-14T12:54:26.604734Z","title":"FlatQuant : Flatness matters for LLM quantization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13365","last_updated":"2026-08-13T15:31:01Z","snapshot_observed_at":"2026-08-17T17:08:33.314163Z","submitted_at":"2026-08-13T15:31:01Z","title":"When Local Variance Optimality Is Not Enough: RoPE-Aligned Q/K Rotations for Dynamic 4-Bit Quantisation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-14T12:54:26.604734Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2608.13365"},"observation_digest":"sha256:3f34a3405cceca4ba078b18133a1a92231cea2b2b0ffbeab44189ec5e6000dfe","observation_id":"4b7a28b2-59b1-4ad8-a9c2-401784380ae3","resolution":{"observed_at":"2026-08-14T12:54:26.604734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.09426/citation-record","integrity":"/paper/2410.09426/integrity","json":"/paper/2410.09426/citation-record.json","paper":"/paper/2410.09426"},"outbound":[],"paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 47 inbound Pith citation observations for arXiv:2410.09426."}