{"as_of":"2026-08-04T17:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fe24ab1d5209790a12680fe3843204d7e6ced9285b2b505be79fb5af431b8cef","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T03:32:14.749400Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T10:01:02.459027Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08755","snapshot_observed_at":"2026-08-02T10:01:02.459027Z","title":"2605.08755 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16237","last_updated":"2026-06-25T21:44:54Z","snapshot_observed_at":"2026-08-02T10:00:56.992428Z","submitted_at":"2026-06-25T21:44:54Z","title":"Quantizing Recursive Reasoning Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-02T10:01:02.459027Z"},"links":{"cited_paper":"/paper/2605.08755","citing_paper":"/paper/2607.16237"},"observation_digest":"sha256:c47a0e4159c076d2232c70064f2569b62522e313e69077e5a1e5bb5e3ee661f3","observation_id":"1d366ff8-ee2c-4cea-8a85-c4912cda3a04","resolution":{"observed_at":"2026-08-02T10:01:02.459027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.08755/citation-record","integrity":"/paper/2605.08755/integrity","json":"/paper/2605.08755/citation-record.json","paper":"/paper/2605.08755"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08832","last_updated":"2024-12-12T00:12:43Z","snapshot_observed_at":"2026-07-06T20:05:36.919481Z","submitted_at":"2024-12-12T00:12:43Z","title":"HadaCore: Tensor Core Accelerated Hadamard Transform Kernel","version":1},"cited_work":{"arxiv_id":"2412.08832","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.08832","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agarwal, R","venue":null,"work_id":"9acbc6c1-ce0b-4389-91df-417aca58b652","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2412.08832","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:b246af830c993e2d6e1997c09639520d4c60367a5f61849189fdeee30f6ff43f","observation_id":"416d8a42-57ff-4b24-8f4a-7a5082aade3b","resolution":{"observed_at":"2026-05-12T07:16:29.957067Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quarot: Outlier-free 4-bit inference in rotated llms.Advances in Neural Information Processing Systems, 37:100213– 100240","venue":null,"work_id":"c7ead886-6b98-4085-a839-493bb5e67d46","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:c0ba56d16841f47c8385edf43d79cb26d9f04b578e23e6d7bc06fec07d0f1b32","observation_id":"2a161468-51e0-480e-a3ef-1113aa065aa1","resolution":{"observed_at":"2026-05-12T19:21:47.001272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Db-llm: Accurate dual-binarization for efficient llms","venue":null,"work_id":"4f64fe31-b366-4364-9eef-1df04c9b3f11","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:1eed3451ee4aa48e7e5a8d0f596dbe8c081536e7a9a791ad060f5295984fadeb","observation_id":"5556e63e-c94a-4710-a8dd-5e053dec39bc","resolution":{"observed_at":"2026-05-12T19:21:47.005336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11062","last_updated":"2025-05-19T06:20:01Z","snapshot_observed_at":"2026-08-02T11:02:26.107201Z","submitted_at":"2024-07-10T17:53:30Z","title":"EfficientQAT: Efficient Quantization-Aware Training for Large Language Models","version":3},"cited_work":{"arxiv_id":"2407.11062","doi":"10.48550/arxiv.2407.11062","metadata_source":"pith","pith_arxiv_id":"2407.11062","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Efficientqat: Efficient quantization-aware training for large language models","venue":"cs.LG","work_id":"7d09dbf5-c36c-46e8-96bc-42b2cda1f7f7","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2407.11062","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:62958c7e8c0d7c647400662f8e78ff41490e0dd34f367f5b27f73abc7df9ce77","observation_id":"b7072eaf-39c8-4678-b4bb-030efa9365a9","resolution":{"observed_at":"2026-05-12T07:16:30.062985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:22:10.122064+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:22:10.122064+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T05:00:42.364163Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":"1559faa7-290d-49e9-aebf-bc97f7434e07","year":2019},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:cb2cc99d7f1354ce4822b475c87fc69c0ea7d53a26ed690422e211d9366e23ee","observation_id":"c93c1c47-7603-47d4-afe9-84c9cd4bd152","resolution":{"observed_at":"2026-05-12T19:21:47.008826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:68e5139f873d2eb64f083932f12629412704645093c5b74fafb65429dd856813","observation_id":"81e10119-ed18-4bf5-a61e-a227a2595932","resolution":{"observed_at":"2026-05-12T07:16:30.042155Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fast Hadamard Transform in CUDA, with a PyTorch Interface","venue":null,"work_id":"bd31cde1-b42c-4c2a-998b-f866ec8f24b5","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:31f029bc9bb29ec3dc604be1fff918eeee87ca4ce331b441fb4eb49cedc19036","observation_id":"be64087b-5180-4d0e-8244-3ee25e5f89c6","resolution":{"observed_at":"2026-05-12T19:21:46.990238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T11:03:40.152421Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":"e88f7222-3e8e-41a6-b3e3-36964716b0bb","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:b31a9cc3dbd57235d12dfc4f125b6eaceefa5cbf3b0e0332fed419e74333c5bf","observation_id":"767708a3-1afd-4d44-b915-4d91bb4eb3f4","resolution":{"observed_at":"2026-05-12T19:21:46.997989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bitdistiller: Unleashing the potential of sub-4-bit llms via self-distillation","venue":null,"work_id":"e1694cf4-af4d-4730-b1fd-13653aa40c1b","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:118e17b4eff096c2b8b425768abec7974c05ba0bd32c671e588c530fe3afa711","observation_id":"dd69a17c-eaa2-4bae-a95e-7d4e881637ff","resolution":{"observed_at":"2026-05-12T19:21:46.994293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17415","last_updated":"2024-10-28T08:59:01Z","snapshot_observed_at":"2026-07-31T13:43:50.860969Z","submitted_at":"2024-06-25T09:37:15Z","title":"Layer-Wise Quantization: A Pragmatic and Effective Method for Quantizing LLMs Beyond Integer Bit-Levels","version":3},"cited_work":{"arxiv_id":"2406.17415","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.17415","snapshot_observed_at":"2026-07-02T15:57:06.548416Z","title":"Layer-wise quantization: A pragmatic and effective method for quantizing llms beyond integer bit- levels","venue":null,"work_id":"3cb628b7-9c3d-4943-a3a2-331447512fee","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2406.17415","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:4f3a74f5be2e8e1626d6031f2b0b2dfa0f8ca8e7322b6a181aa9a18baa5f09da","observation_id":"7d625e96-cec0-4548-8c99-7989d0e513d3","resolution":{"observed_at":"2026-05-12T07:16:29.946471Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimal brain compression: A framework for accurate post- training quantization and pruning.Advances in Neural Information Processing Systems, 35:4475– 4488","venue":null,"work_id":"ed0b324c-cde9-43e2-bdb9-84087b221ed0","year":2022},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:58ca257611642730d44bef0ee5cf1ccca6b0540714a651811fb8ea396889b781","observation_id":"850f2a4c-7c95-4acb-93ac-3378aedfa772","resolution":{"observed_at":"2026-05-12T19:21:46.863128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OPTQ: Accurate quantization for generative pre-trained transformers","venue":null,"work_id":"d4cf294a-ce1d-4c35-a57c-079817064213","year":2023},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:a1b3449fdef9bffbd43ea1a69a1404a16c1cac7d6d2eb694940a28fece904f36","observation_id":"8349e49b-3da0-4837-92f7-d5d3648439d9","resolution":{"observed_at":"2026-05-12T19:21:46.872238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T21:44:12.851583Z","title":"The language model evaluation harness, 07 2024","venue":null,"work_id":"9148854a-4b09-4c5d-b1a4-5ee9cccc772c","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:1bc819c4cbe4e3b3fead4a744bf51343bfb79d71206fb4172066d728b738e44c","observation_id":"cdb52f0b-ced6-4d97-afbc-c82d4b07ea23","resolution":{"observed_at":"2026-05-12T19:21:46.958714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T22:57:42.777153Z","title":"Fast r-cnn","venue":null,"work_id":"b734ebda-f4bc-4627-a1c6-29f231a6e7e4","year":2015},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:c642cc8739571b9d3423470eb1c509d572651ff9453156c4b0bfdb18dc48a2a8","observation_id":"5acf8d37-9ef8-42f7-b471-30b617186120","resolution":{"observed_at":"2026-05-12T19:21:46.903974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:418e8a4ceffbe149c7adad9a12227499968b9bbee8c5006d0061bfe7a037e2f0","observation_id":"a484f3d1-7fa8-46cc-9bc7-a1f3dddd6869","resolution":{"observed_at":"2026-05-12T07:16:30.033811Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:fe0ed20a35d2738a8178d542d84359663f52c531ab5cdd7ae2939d14e602d1ca","observation_id":"d2e2f417-fee2-42bd-b462-35420fda727a","resolution":{"observed_at":"2026-05-12T07:16:30.023168Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lighteval: A lightweight framework for llm evaluation","venue":null,"work_id":"4d5f4cf5-b2b2-4f62-8278-97b857cc50e1","year":2023},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:e936fd9e906bf90cbac7126b9feccd522efc75d5bf0c874390fefd14adeb9bb1","observation_id":"9a8b7780-1629-4236-b8ce-3daba0fa435e","resolution":{"observed_at":"2026-05-12T19:21:46.936800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Second order derivatives for network pruning: Optimal brain surgeon.Advances in neural information processing systems, 5","venue":null,"work_id":"c2167ac2-6812-44c5-a2bd-1b929f518af0","year":1992},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:9aa0a84ddbf84e39555c006af60d12093551c28ae603504c91dcafb0512d507e","observation_id":"3ca35901-a173-4d54-bf68-3b1a0b39d895","resolution":{"observed_at":"2026-05-12T19:21:46.812501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Billm: pushing the limit of post-training quantization for llms","venue":null,"work_id":"fa34a1ab-c376-4b9e-b96e-a125d59a51d6","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:b55b07432255af28d28e4585e6f026dec706df9b528b64bc7c754fa3d86a157c","observation_id":"a2e6b270-069d-487d-8769-23115ee29ab5","resolution":{"observed_at":"2026-05-12T19:21:46.822276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T10:03:37.335804Z","title":"Robust estimation of a location parameter","venue":null,"work_id":"540fec30-417c-4a0f-8daf-65e0d32d4585","year":1992},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:66ff02e0b55411dd1d6867851aa7ec25f330635399dcdfa03c7e88a483216f13","observation_id":"f63fef00-b76e-4b7b-96fa-cd81c81930b1","resolution":{"observed_at":"2026-05-12T19:21:46.840229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open r1: A fully open reproduction of deepseek-r1, January 2025","venue":null,"work_id":"8df7186d-e789-4512-a208-6beaa02e1c9c","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:96df814055ac08a23278268c78cab7c110c0f96bfe80211a4244aba5797b8689","observation_id":"8260486d-5f8f-44b5-b05b-40ed53c57f00","resolution":{"observed_at":"2026-05-12T19:21:46.867958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code","venue":null,"work_id":"efaa1922-d6c8-45e6-8baf-430529e31b5d","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:00048b0e5c019cb51c489aafde756e15c61f3541b5da7ff80f13d3ea8987dcb7","observation_id":"635fc5d0-97da-4419-af2a-ec7f0b8e8bf0","resolution":{"observed_at":"2026-05-12T19:21:46.848162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aime problem set 2024","venue":null,"work_id":"77153363-a166-48bd-b082-7abf93851c4d","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:a879b562932cb0444c36cbfcce07822c4aec5133e5882b0847ef0bc5d1afa014","observation_id":"c093f77f-07fb-4e9c-ac15-2c88107159ec","resolution":{"observed_at":"2026-05-12T19:21:46.925262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":"f2ee3f39-945a-4e4f-87d8-2495e70a01b9","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:1883b9701e9763f6331def25fdd6d968697def9d9df3dabf2ebfe8b7bfab8b57","observation_id":"56d0a82e-fe2c-482e-9ffb-9453f590b0ce","resolution":{"observed_at":"2026-05-12T19:21:46.855245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The impact of quantization on large reasoning model reinforcement learning","venue":null,"work_id":"68da1bc6-fd27-40d3-b75b-063b55d11563","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:96ace6150d26581299886fedee0e8c380e01b07dcd4e4c2873f5840978066cf4","observation_id":"084903f5-e809-4814-82e6-af41c9bcec6e","resolution":{"observed_at":"2026-05-12T19:21:46.804128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:24:01.262844Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":"ba38df18-25de-4771-8903-3ff55d99b09f","year":2023},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:19201da5ef9df4e92bd418fd31db6617db0477bbb331bf311f8bfa7cc02ad6f8","observation_id":"37770ace-c8f0-41df-b0be-7d507803538e","resolution":{"observed_at":"2026-05-12T19:21:46.896035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimal brain damage.Advances in neural information processing systems, 2","venue":null,"work_id":"ffd6626c-d379-4061-945f-113920ff8a37","year":1989},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:34fd6630e81773cd2664e931949674fd312a7180b6f5cd9ab87a9cd0e4ad4184","observation_id":"8deccc73-cd4a-4ce6-b779-70d498532257","resolution":{"observed_at":"2026-05-12T19:21:46.928941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rilq: Rank-insensitive lora-based quantization error compensation for boosting 2-bit large language model accuracy","venue":null,"work_id":"d985daed-c257-4418-a8c7-1a6d05c2c623","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:db1259cea9aa8664faf2c919b1b011c30ad259326397fe07f3bdecb864e0cf3a","observation_id":"7a5d26fd-038f-4210-bed2-19ee9794d1f8","resolution":{"observed_at":"2026-05-12T19:21:46.921373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03035","last_updated":"2025-02-24T14:34:37Z","snapshot_observed_at":"2026-07-06T20:17:06.835639Z","submitted_at":"2025-01-06T14:23:02Z","title":"Quantization Meets Reasoning: Exploring LLM Low-Bit Quantization Degradation for Mathematical Reasoning","version":4},"cited_work":{"arxiv_id":"2501.03035","doi":"10.48550/arxiv.2501.03035","metadata_source":"pith","pith_arxiv_id":"2501.03035","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Quantization meets reasoning: Exploring llm low-bit quantization degradation for mathematical reasoning","venue":"cs.CL","work_id":"4588f59b-42bc-44af-8c3e-5031be977d8f","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2501.03035","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:c97bb2c042db53d41c18553abf1d7126d7dab2d13e722c707d03c68f2a638d92","observation_id":"0e22c51e-8cab-4013-a3fd-59a651e419fb","resolution":{"observed_at":"2026-05-12T07:16:30.052044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:22:03.410928+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:22:03.410928+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ParoQuant: Pairwise Rotation Quantization for Efficient Reasoning LLM Inference","venue":null,"work_id":"9cf6c795-c4fe-4615-811a-c745ff788c83","year":2026},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:9c0a22e961aeb855d5d613d05bcf1d89c060eaa1d5158475449e8f0f530abd9a","observation_id":"577cb0ff-7ac7-47af-aae6-d85182a55bcd","resolution":{"observed_at":"2026-05-12T19:21:46.982130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Duquant: Distributing outliers via dual transformation makes stronger quantized llms.Advances in Neural Information Processing Systems, 37:87766–87800","venue":null,"work_id":"411e512e-dc69-48c1-859c-22f5d79dc416","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:eda5b6a791cc68162db9e7b9deb56d053b313c8607ecb06f089344e036b5e5db","observation_id":"205064f0-efca-4ded-a2e7-11c077851e85","resolution":{"observed_at":"2026-05-12T19:21:46.881121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Awq: Activation-aware weight quantization for on-device llm compression and acceleration.Proceedings of machine learning and systems, 6:87–100","venue":null,"work_id":"58453255-8d61-40a3-84cd-9208e939f942","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:6ecff3aa507a66fd302f8a10747e2ce35d9eecbf99f8f443f37eece454368603","observation_id":"1642ad78-6658-465e-912c-2a2adb6571b6","resolution":{"observed_at":"2026-05-12T19:21:46.969878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qserve: W4a8kv4 quantization and system co-design for efficient llm serving","venue":null,"work_id":"ff3f237f-818d-4c7f-a202-b95a9aa72562","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:07614c62f19200c82515c8dcca74484af2c022fe39e1bef24c1a61009f7ab33f","observation_id":"d0a073f3-6d58-4f65-b97a-ff42589ba22f","resolution":{"observed_at":"2026-05-12T19:21:46.808506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04823","last_updated":"2025-08-18T16:06:09Z","snapshot_observed_at":"2026-08-01T18:18:48.262400Z","submitted_at":"2025-04-07T08:22:45Z","title":"Quantization Hurts Reasoning? An Empirical Study on Quantized Reasoning Models","version":2},"cited_work":{"arxiv_id":"2504.04823","doi":"10.48550/arxiv.2504.04823","metadata_source":"pith","pith_arxiv_id":"2504.04823","snapshot_observed_at":"2026-07-10T14:47:14.605259Z","title":"Quantization hurts reasoning? an empirical study on quantized reasoning models.arXiv preprint arXiv:2504.04823","venue":"cs.CL","work_id":"a26b5b9f-bd80-409d-9593-c781040e06f9","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2504.04823","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:b9d6f4a33c9f8d6cb88ebfc8c7739b923d959bc7dca1d4d2d85fc35cd9353375","observation_id":"1e569c06-81f9-446d-9952-1cb8784451a1","resolution":{"observed_at":"2026-05-12T07:16:29.962602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vptq: Extreme low-bit vector post-training quantization for large language models","venue":null,"work_id":"d24c7f10-048c-4b1a-9a01-be1b9c60b71c","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:d22752bd5c05c586da905ce885feac0ed6aa6b2a14ffc7c65d7abe680e0106b5","observation_id":"15b2df96-56ab-4af2-a6c9-f20c32dcd6a6","resolution":{"observed_at":"2026-05-12T19:21:46.900182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spinquant: LLM quantization with learned rotations","venue":null,"work_id":"fe47c522-38b2-4b1b-b7ba-57454fd5ab47","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:7d0083e900c81b25dd2391651f6d057a50c3fdb56a4ff8eb9e7eee6ef466b300","observation_id":"db1ed53a-cc76-467e-8519-67d13ed52c6a","resolution":{"observed_at":"2026-05-12T19:21:46.836236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:36:29.521451Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"139a920c-85a1-42e5-937e-f14d907436d5","year":2019},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:3baad12a565e08f0dbc58fbf094ae9ed0f08c8f8fce1e4fc9169bbcdde56cb22","observation_id":"7eb6fa0e-b309-48c2-8dfc-d9f2e0b94b38","resolution":{"observed_at":"2026-05-12T19:21:46.966442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What makes low-bit quantization-aware training work for reasoning llms? a systematic study","venue":null,"work_id":"0703c661-032f-4967-84dd-9a970bf4a101","year":2026},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:61b66667e01bca051a9ea2899d2ae3636c2a17671516c91c9a806cd87f1e139c","observation_id":"f37acbb0-2e06-459b-807f-6116eb63c0aa","resolution":{"observed_at":"2026-05-12T19:21:46.884782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aime problem set 2025","venue":null,"work_id":"9af63dab-deda-4e3f-9a9a-e1b4e2451a2c","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:8a88d7b9da5505d1254e35f131d54f23025c83fd4e7633ea3ee1bfdf0e19017e","observation_id":"35fcec6c-6459-41c2-a0a6-c4053fd0ac20","resolution":{"observed_at":"2026-05-12T19:21:46.908009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Does quantization affect models’ performance on long-context tasks? InProceedings of the 2025 Conference on Empirical Methods in Natural Language Processing, pages 9433–9481","venue":null,"work_id":"ad77a413-c570-4d22-9cc5-13d70de7a35c","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:e12db6a59c104150bbf1c111e9ca0f86fa4eb99fc7a4ed9b6a24341d8aa7a472","observation_id":"3813e6ec-791b-427b-ad27-d04b7906c5fe","resolution":{"observed_at":"2026-05-12T19:21:46.986011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T04:45:59.128873Z","title":"Pointer sentinel mixture models","venue":null,"work_id":"e24e2207-094f-4683-b902-901f466712ba","year":2016},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:c2309b9e302074be1c67ddbb9713b168a26d1fdca8df249ff8b2c383c5a6067f","observation_id":"29195419-5c4a-4515-a8b2-97bf141193fb","resolution":{"observed_at":"2026-05-12T19:21:46.941334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T10:43:39.521871Z","title":"s1: Simple test-time scaling","venue":null,"work_id":"a3e7b62a-fe52-4fbc-9830-9d6adb0d60c3","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:8df481c20159e4b5cdbbea0ba782274fc1ebda8a8bc7656083ec210a0954d723","observation_id":"6b80ced4-80a5-44cd-a46a-01421f172752","resolution":{"observed_at":"2026-05-12T19:21:46.949755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards quantization- aware training for ultra-low-bit reasoning LLMs","venue":null,"work_id":"834b2e59-ba1d-4c5c-9b13-68aeced2d341","year":2026},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:0dbf076dd6a0e475638a90bb713cb7b73eeb93a1d0769e82c19b38d74731d196","observation_id":"3ff0e282-fefd-4a5d-ba3d-7914a30d7a65","resolution":{"observed_at":"2026-05-12T19:21:46.978025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T06:46:03.174797Z","title":null,"venue":null,"work_id":"68a06489-b640-4359-a59e-b94242d77087","year":2020},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:b9b2ecc7c01bdf6eb83e2ed84d75d9789a31e3a1481173e0bfe80fac5afa7f4e","observation_id":"e897025d-99be-420d-ae4e-05ada09a669b","resolution":{"observed_at":"2026-05-12T19:21:46.954066Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T10:43:39.491142Z","title":null,"venue":null,"work_id":"20816d24-89c4-490b-99ef-c4c53d0419e5","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:a65d67852d191920d00e48618e6e8f9fadf04206763d0b474ce5517ce2cea92d","observation_id":"f5d5a291-04e0-4996-a89e-ae4312f30c3f","resolution":{"observed_at":"2026-05-12T19:21:46.875432Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omniquant: Omnidirectionally calibrated quan- tization for large language models","venue":null,"work_id":"23b45535-04c4-4453-aa68-415f0dfb01d8","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:734f1d967c4b37647a3b58b94505564afdfac7949d154726f18c27a93d3b627b","observation_id":"ee82e121-8ac0-4655-b31c-40b31547f0c4","resolution":{"observed_at":"2026-05-12T19:21:46.851693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:e4641d1882ff9f0b11f54bb2f2d91e705749214243c5663006a1d4acf08e9f27","observation_id":"ce4611e9-953f-4e15-975e-d13533add57f","resolution":{"observed_at":"2026-05-12T07:16:30.073475Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling LLM test-time com- pute optimally can be more effective than scaling parameters for reasoning","venue":null,"work_id":"d970a9f5-af0c-4275-8df5-3ccee3f3f59f","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:81b06c2d13e5f57245e87c130ae8e45a3921863ae0d7a28bed1f3b3785179be4","observation_id":"2f946c59-8016-4323-ad3d-e42a0af64728","resolution":{"observed_at":"2026-05-12T19:21:46.945625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:54:45.493523Z","title":"Qtip: Quantization with trellises and incoherence processing.Advances in Neural Information Processing Systems, 37:59597– 59620","venue":null,"work_id":"62b17ea2-6ad2-4021-81c6-c9a6842782fa","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:f6488411ec4173175f10883e7b844ddb4eb0495502783858c2977a7c14ffeb48","observation_id":"0cf8ccc9-3e98-4843-8dae-5e4c6291a1c2","resolution":{"observed_at":"2026-05-12T19:21:46.932613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.11453","doi":"10.48550/arxiv.2310.11453","metadata_source":"pith","pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","venue":"cs.CL","work_id":"28ad8f61-4291-4894-b120-1d42fc9937a3","year":2023},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:9cdcfdcfd8c5cf8384f222bf0d9a29113dd05c3a396a482276a159005fb52aa4","observation_id":"6bad0043-39d8-490c-99f5-d6acd3a216fe","resolution":{"observed_at":"2026-05-12T07:16:29.974116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T16:57:25.345368Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark.Advances in Neural Information Processing Systems, 37:95266–95290","venue":null,"work_id":"8ce2e771-bc8c-4b3b-a834-6303b981b746","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:5e5dc1df545d6ffb2cad4a1a7eebfe5a1b436a5d8245c294d4041713a929d37d","observation_id":"dc62e25f-af31-48e3-a25c-3ed30305fe55","resolution":{"observed_at":"2026-05-12T19:21:46.974413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f16651db-a485-4079-9ba1-964487441b00","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:c23da5450d857aa79f93fb5a9af61b618b7fa68a37c498ae4c5944f616619366","observation_id":"4b3574d1-5869-436b-b0b5-0344561afe73","resolution":{"observed_at":"2026-05-12T19:21:46.962163Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the impact of calibration data in post-training quantization and pruning","venue":null,"work_id":"427970d1-e7b1-401f-9ba5-d14642695d88","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:c67dba50e01ee4e64801e2c1e3c2680b401b806f8f312980794618ef3e6f1e09","observation_id":"7bfd6899-44d6-43f4-9741-b58991ca6146","resolution":{"observed_at":"2026-05-12T19:21:46.912090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Think before you prune: Selective self- generated calibration for pruning large reasoning models","venue":null,"work_id":"30e57560-0bdf-4db4-9cac-29e6d016eb31","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:acadc6d11d7e38a4a3f1468e950e8944bc80c23240559ea9f20f5d323301e299","observation_id":"20b68d8b-6395-4755-aca2-df1e9291591a","resolution":{"observed_at":"2026-05-12T19:21:46.817089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SmoothQuant: Accurate and efficient post-training quantization for large language models","venue":null,"work_id":"b2ff453e-f612-4ad8-9d88-d2b5afa823ee","year":2023},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:d673dc6d638a4fb30c1a00738ebcd623ece0f4ae7aecd6f236b97c7be08174cb","observation_id":"559d3cfb-c238-4c1a-89e4-9255d7dca79d","resolution":{"observed_at":"2026-05-12T19:21:46.916892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:ff804a91c20625eff6f93e4506b9f90b9affc57c1b348f56063522b02dba65bd","observation_id":"bc72d758-d03e-473d-8a66-19bf03986a8a","resolution":{"observed_at":"2026-05-12T07:16:30.001888Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-07-11T03:07:50.815080Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:840b2ef0d8157795b3dfef98b1ab159564d861d3281902da934f0bcb57dd52df","observation_id":"433f7aea-0753-4e9c-a9c0-88d8c15daf8a","resolution":{"observed_at":"2026-05-12T07:16:30.017359Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T01:04:25.243929Z","title":"Hellaswag: Can a machine really finish your sentence? InProceedings of the 57th annual meeting of the association for computational linguistics, pages 4791–4800","venue":null,"work_id":"40e9d896-75dd-4672-b1eb-9a8bf6290ccb","year":2019},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:291f596fb2b00f55ddc07eaab3354e31abf3294deb5d45acae90fdbbf8751f0c","observation_id":"0b87694a-f503-4f2e-b60c-43eada8f1be8","resolution":{"observed_at":"2026-05-12T19:21:46.831698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.02581","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quantlrm: Quantization of large reasoning models via fine-tuning signals","venue":null,"work_id":"5df576fe-7030-4d90-a7d1-25a8b7c2481a","year":2026},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:63694b4749eb2f74794867fcce1e438d7b347a266afebb009c9afbb14e00ba27","observation_id":"03272172-6638-4431-9b47-0dec6c77d9cc","resolution":{"observed_at":"2026-05-12T07:16:29.986985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Atom: Low-bit quantization for efficient and accurate llm serving","venue":null,"work_id":"fac81869-02cb-4c86-a72c-307787eac088","year":2024},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:ac9084165699739421d3f9095a1887afdce16e470a84767a424baa20624889ee","observation_id":"4ff5550f-a2bd-4a9f-b64d-d07015dc1179","resolution":{"observed_at":"2026-05-12T19:21:46.890935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An empirical study of qwen3 quantiza- tion.Visual Intelligence, 4(1):11","venue":null,"work_id":"d292c8f5-640b-4d91-8021-5776736f6140","year":2026},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:9548fb91392028464a3b0c5fc4c693c4666508c03dd1b1bc7491b97ae7d54ed7","observation_id":"06471a8b-5d82-463f-ad44-b873e0d688a1","resolution":{"observed_at":"2026-05-12T19:21:46.844742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.06598","last_updated":"2021-04-15T02:21:45Z","snapshot_observed_at":"2026-07-06T10:59:26.299730Z","submitted_at":"2021-04-14T02:53:32Z","title":"AR-LSAT: Investigating Analytical Reasoning of Text","version":2},"cited_work":{"arxiv_id":"2104.06598","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.06598","snapshot_observed_at":"2026-07-03T16:58:43.238141Z","title":"Ar-lsat: Investigating analytical reasoning of text","venue":null,"work_id":"ccf0a072-b381-4dad-9f5e-08484dfa3782","year":2021},"citing_paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-12T03:32:14.749400Z"},"links":{"cited_paper":"/paper/2104.06598","citing_paper":"/paper/2605.08755"},"observation_digest":"sha256:5596538c066e1f7ac17c7bfa00c670b225b84abde0a3ff047d7958437b1e8997","observation_id":"bde502e0-d0fd-43f2-b3b8-df72fd2e8827","resolution":{"observed_at":"2026-05-12T07:16:29.996229Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.08755","last_updated":"2026-05-09T07:35:38Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:35:38Z","title":"LAQuant: A Simple Overhead-free Large Reasoning Model Quantization by Layer-wise Lookahead Loss"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":12,"verified_fuzzy":45},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 1 inbound Pith citation observation for arXiv:2605.08755."}