{"as_of":"2026-08-17T21:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:767fc1b45ce842fa528b5d7e6915b732544203ef958f4c9a0e07317f89d7e7c8","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:08:07.355372Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T03:40:30.476346Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T03:40:53.352505Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"cited_work":{"arxiv_id":"2505.03031","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03031","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Radio: rate-distortion optimization for large language model compression","venue":null,"work_id":"be20b643-ffa9-45a6-aa1a-038374284853","year":2025},"citing_paper":{"arxiv_id":"2605.07863","last_updated":"2026-05-08T15:23:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T15:23:53Z","title":"ADKO: Agentic Decentralized Knowledge Optimization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-11T03:40:30.476346Z"},"links":{"cited_paper":"/paper/2505.03031","citing_paper":"/paper/2605.07863"},"observation_digest":"sha256:afec4ba1c73a2eff7dfd5340fd83f73007b9c1cc73f0b636a70ab29793e6be59","observation_id":"13501990-99d5-4adb-aa77-07b431b2d483","resolution":{"observed_at":"2026-05-11T03:40:53.354476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.03031/citation-record","integrity":"/paper/2505.03031/integrity","json":"/paper/2505.03031/citation-record.json","paper":"/paper/2505.03031"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.846306Z","title":null,"venue":null,"work_id":"fd3765d9-b88f-4636-b2b8-1e6096675aff","year":2023},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.204932Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:87916298b249928ff8c3854746f9b5b05145ee94cdf2065c5592faee5c99a4ff","observation_id":"2a4d0f5c-042c-4778-9e11-5e50de01eafe","resolution":{"observed_at":"2026-08-16T00:08:07.850443Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.835634Z","title":null,"venue":null,"work_id":"053e7323-ee1c-423f-8628-4fda7bafafcb","year":2011},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.208950Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:f248c79ecd7ff2107d79a0a56c6fccc69b6cdcc407731ff79a337c4ade270662","observation_id":"867c3107-fe27-4760-8405-d2ae285efae8","resolution":{"observed_at":"2026-08-16T00:08:07.838908Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.701140Z","title":null,"venue":null,"work_id":"1d42272d-5173-47a3-be6e-a9ae204dec53","year":2022},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.250265Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:3d4973fb2b06cf7624c5452ec5fd262f9e0376ed727e9154595f87c7b187f827","observation_id":"8bc5ace9-0211-47b6-8259-168e96b94769","resolution":{"observed_at":"2026-08-16T00:08:07.704983Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.587655Z","title":null,"venue":null,"work_id":"70da1d00-2828-4198-887b-10e69927688c","year":2022},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.285779Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:6deeca35a5be518929a7ae88954b301ef67c57238d7d3868b0f883cd77f34686","observation_id":"f132c08d-c020-4a67-a391-2cd4e1f0ae67","resolution":{"observed_at":"2026-08-16T00:08:07.592620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.798513Z","title":null,"venue":null,"work_id":"8ede7678-087d-4ede-bd6a-3702af0cf4d0","year":2019},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.219797Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:b13e6ed652b9a367e99357c3def86a7feec09451589bb58e06edf54392757964","observation_id":"2ba9d43e-044b-4116-91ef-ce22b45ad7a0","resolution":{"observed_at":"2026-08-16T00:08:07.802606Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.775351Z","title":"Loss-aware quantization methods (Hou & Kwok, 2018; Nahshan et al., 2020; Qu et al.,","venue":null,"work_id":"bf8507fa-d0d2-430b-8d2b-ab92c3555b37","year":2018},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.228007Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:a27c07e2962be3eb7b419ceab48a0b6b1e14395106d37fe242805bf142e6b995","observation_id":"25097e98-f9a7-4a8e-8ab7-7af35b3e035c","resolution":{"observed_at":"2026-08-16T00:08:07.779781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.749432Z","title":"Choi et al., 2021)","venue":null,"work_id":"71d7a994-b3fa-4ba5-9e05-ecb5fe8e55dc","year":2021},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.235669Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:ecbce3750af31a0bfd21348e464ca5d07a4fb1f1b2558f41e711e4ade258f0de","observation_id":"6cec5c42-d4f0-456a-a1fa-0400afa7beb8","resolution":{"observed_at":"2026-08-16T00:08:07.753635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.712818Z","title":null,"venue":null,"work_id":"689e4652-23ac-494e-92da-0be9332387de","year":2024},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.247012Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:8d47054725a6be351451e9e5a0e932f7621fe4888b8f3f4bb0b8ddda5838cf66","observation_id":"98c650d6-2ce0-4007-86f2-37de99fe0afb","resolution":{"observed_at":"2026-08-16T00:08:07.716502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.688791Z","title":",ΘN) (model), {X} (calibration set), 2 R (target bit rate), Bmax←8 (max bit depth) 3 Output: B1,","venue":null,"work_id":"eac98cf2-7231-4bde-9b4c-9806af8297a8","year":1991},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.253481Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:9c6fd6ccb096f14ef1de4f1b27160b06a7f88da6240a4b72fcb765b43b17e7a5","observation_id":"9c64d67b-ae23-4520-b80b-62b825ea8766","resolution":{"observed_at":"2026-08-16T00:08:07.693027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.649820Z","title":null,"venue":null,"work_id":"e4080b13-469e-4949-9118-f8767cab8bad","year":2021},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.266602Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:0297bc0c0a769026f878a90e025288ad6c89f794b5413d5e1c8bd6b6f8f04bb5","observation_id":"a821614b-93e0-4ac3-8ef5-d972cff51848","resolution":{"observed_at":"2026-08-16T00:08:07.653161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.625463Z","title":null,"venue":null,"work_id":"089848b6-8f20-4dd3-ac86-0356ebe6f535","year":null},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.274922Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:d2fd284a8447b425990b287e3d590d2be8c1a9780cb2ca753ba8ceea36461808","observation_id":"334d9281-4fbf-4643-9c22-0a6883abce8f","resolution":{"observed_at":"2026-08-16T00:08:07.629160Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.601236Z","title":"A small fraction of weights is quantized to zero and pruned away due to low variance, with smaller groups increasing the degree of pruning (a)","venue":null,"work_id":"befb7839-cbf5-46ab-89f6-e05693b14317","year":null},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.282391Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:6b0b9ff6631bc00938b60776034499ef6f4b7804a10b923385c6c503f17b236a","observation_id":"d965accc-908c-4363-bdc2-65dbad5e789a","resolution":{"observed_at":"2026-08-16T00:08:07.605465Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.575820Z","title":null,"venue":null,"work_id":"e1308ceb-7909-45da-b09d-fb57cedc8d77","year":2024},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.288751Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:a114cea4a2f42a8d530f3ebcf8cec28992eca66279fb3ae1f598a93d35e1505a","observation_id":"49cee01f-4c04-410e-8986-a7cf44d3a350","resolution":{"observed_at":"2026-08-16T00:08:07.579547Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.564601Z","title":null,"venue":null,"work_id":"27969cd1-7e25-4882-bcea-210113c8f5b6","year":1992},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.292510Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:1b095bfae2b543ad70fbc4d1f7a58c18af71bdbf24ea9d37f9ab0a0a5b3f85fe","observation_id":"26349be0-721e-4eca-8941-138dac8b5223","resolution":{"observed_at":"2026-08-16T00:08:07.567983Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.551097Z","title":"We quantize the Meta Llama 2 family of LLMs to ~3 bits per weight on average and measure the running time of the proposed method","venue":null,"work_id":"8ec1f970-ab59-413d-9458-18053e56b120","year":2024},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.297083Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:85f69270e1d4163c4de0cf105c3aa034367abc193180bf14f5bf1c14eadf3800","observation_id":"93552923-e1f2-45b2-be3e-0444c8968433","resolution":{"observed_at":"2026-08-16T00:08:07.555280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.526444Z","title":null,"venue":null,"work_id":"1ced94f7-566b-4ccf-a8b8-3015de3ba2f0","year":2022},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.304687Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:25ea7b12149faeafac7acd538f14221929ca2fe3a86228beadbd55d5d2538fc3","observation_id":"695451d0-c033-4b27-a167-b3fb26e9a0df","resolution":{"observed_at":"2026-08-16T00:08:07.531313Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15319","last_updated":"2025-06-03T09:22:07Z","snapshot_observed_at":"2026-08-16T14:15:54.276952Z","submitted_at":"2024-02-23T13:39:16Z","title":"GPTVQ: The Blessing of Dimensionality for LLM Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15319","snapshot_observed_at":"2026-08-16T00:08:07.309044Z","title":"GPTVQ: The blessing of dimensionality for LLM quantization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.309044Z"},"links":{"cited_paper":"/paper/2402.15319","citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:2810abcc35998fe60dc9def5b6927a49dbc5afb1d34946fb25f06302535e72c9","observation_id":"af601756-700a-4fd3-aa05-b2d470c0ebfb","resolution":{"observed_at":"2026-08-16T00:08:07.309044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-16T00:08:07.314408Z","title":"A 3-bit weight matrix of dimension 𝑁×𝑀 multiplies a vector of length 𝑀 to produce a vector of length 𝑁 (denoted 𝑀→𝑁)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.314408Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:ae0bb7dc833ee4c10851dfc88845b8b855ae088481805a2bf7e79c13bbb04d1e","observation_id":"a5b65937-b1e7-4029-9404-0a1b08a91cc9","resolution":{"observed_at":"2026-08-16T00:08:07.314408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-16T00:08:07.318559Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.318559Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:4f5638e0020705b0d335fefea277ba146c009514d3172a3bf298fddedfa84374","observation_id":"37b84664-3383-4607-8252-54eb37413e76","resolution":{"observed_at":"2026-08-16T00:08:07.318559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03078","last_updated":"2023-06-05T17:53:28Z","snapshot_observed_at":"2026-08-17T19:57:48.664476Z","submitted_at":"2023-06-05T17:53:28Z","title":"SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03078","snapshot_observed_at":"2026-08-16T00:08:07.322704Z","title":"SpQR: A Sparse-Quantized Representation for near-lossless LLM weight compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.322704Z"},"links":{"cited_paper":"/paper/2306.03078","citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:00d2d6955c7bfe47b26206718608a0d48ecff23f23983fae18d3b0984eb89f6f","observation_id":"e6d11470-7753-4d96-bb95-7ef9669aa837","resolution":{"observed_at":"2026-08-16T00:08:07.322704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14917","last_updated":"2025-05-25T08:58:37Z","snapshot_observed_at":"2026-08-16T17:18:53.719666Z","submitted_at":"2024-05-23T16:21:48Z","title":"SliM-LLM: Salience-Driven Mixed-Precision Quantization for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14917","snapshot_observed_at":"2026-08-16T00:08:07.326349Z","title":"SliM-LLM: Salience-driven mixed-precision quantization for large language models, https://arxiv.org/abs/2405.14917v1,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.326349Z"},"links":{"cited_paper":"/paper/2405.14917","citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:add85c1ec6777bc01a7dcf506d45cd0b1a5460d0977ec62477ecd6958d31df75","observation_id":"44056cb3-520c-4416-b47b-fa98bda3fdcf","resolution":{"observed_at":"2026-08-16T00:08:07.326349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-16T00:08:07.330969Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.330969Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:2c44f0920f3319a48aa579c32dcc9b3c3feb793ede10c11f64b479f35f369e77","observation_id":"5ccfe4e2-f618-4e68-93e8-6db7200d97ab","resolution":{"observed_at":"2026-08-16T00:08:07.330969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11641","last_updated":"2019-11-26T15:31:46Z","snapshot_observed_at":"2026-08-08T00:48:01.603669Z","submitted_at":"2019-11-26T15:31:46Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11641","snapshot_observed_at":"2026-08-16T00:08:07.334881Z","title":"PIQA: Reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.334881Z"},"links":{"cited_paper":"/paper/1911.11641","citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:444561a288654ee7032e176177c4a586e14e9886432714455858735da1e1df6f","observation_id":"b30f0260-7467-4eba-ad01-3e8fbbabf6e7","resolution":{"observed_at":"2026-08-16T00:08:07.334881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16363","last_updated":"2024-05-01T20:42:28Z","snapshot_observed_at":"2026-08-16T14:15:25.301514Z","submitted_at":"2024-02-26T07:33:05Z","title":"LLM Inference Unveiled: Survey and Roofline Model Insights","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16363","snapshot_observed_at":"2026-08-16T00:08:07.339198Z","title":"LLM inference unveiled: Survey and roofline model insights","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.339198Z"},"links":{"cited_paper":"/paper/2402.16363","citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:aa61d67d6251ec4795995902a7cf2c5c1acb8a64b991cd3cf5071055e00e0506","observation_id":"544d44c2-a468-4194-a83e-01d11be79cd1","resolution":{"observed_at":"2026-08-16T00:08:07.339198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-16T00:08:07.343553Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence? http://arxiv.org/abs/1905.07830,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.343553Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:670de0a64f11559907eaade305b89d72baee6d0d6fcf599b93873e4e22431b51","observation_id":"c0ea1df5-a8da-404b-9f43-46975a26cc7c","resolution":{"observed_at":"2026-08-16T00:08:07.343553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-16T00:08:07.347413Z","title":"OPT: Open Pre-trained Transformer Language Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.347413Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:cca94ff232ec4de59503e3b19bf02b5f631d678ff048509183056f0ee1bee2f2","observation_id":"5f239068-4143-44f8-a6f2-da4c746fa302","resolution":{"observed_at":"2026-08-16T00:08:07.347413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.612939Z","title":null,"venue":null,"work_id":"d86fde72-f8ce-406b-b96e-7914f15f6389","year":2024},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":256,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.278707Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:2560132510489e2efad90eb6e77379fd5f5ab92f269e2a97bf4ce6e5de01f9c1","observation_id":"5164f785-521b-41d2-9500-c391a014c275","resolution":{"observed_at":"2026-08-16T00:08:07.617176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.539332Z","title":"We will discuss the quantization of activations and more advanced methods for model quantization in the sequel","venue":null,"work_id":"cd932fc1-508c-4b90-8a0d-d893c82befcf","year":2024},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":1024,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.300711Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:d2cc75a27c9b725183d249d6b677f27f99526355bba95907d32648037116eeb1","observation_id":"617a7b52-d82c-4133-abdc-24122e32b2b5","resolution":{"observed_at":"2026-08-16T00:08:07.542495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.497458Z","title":"For simplicity, let us rewrite model (4) as 𝑓( ⋅ ,𝚯1,𝚯2,...,𝚯𝑁)=𝑓( ⋅ ,𝚯), where 𝚯 is a vector of all model weights across different layers of the model","venue":null,"work_id":"9b6485cf-37b8-428d-8891-41dd56e5101e","year":1992},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":1992,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.355372Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:11156750c3a730cb7ddbbe250bcc4d4f293dd46560d1c3b4b2fc02115befe7f5","observation_id":"a99a4bc3-f319-43db-906a-824e27f80860","resolution":{"observed_at":"2026-08-16T00:08:07.504043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.513232Z","title":"One can think of 𝐺12,𝐺22,...,𝐺𝑁2 as the diagonal elements of a non-diagonal Hessian matrix used in e.g","venue":null,"work_id":"59249622-1390-4873-8c26-85b984e17f1c","year":1991},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.351338Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:db7d9eda73a64296cc96e435bf2be42783e921847e5507f98c7a8805e0b50eb2","observation_id":"ea508295-4861-4714-9557-7086e939d41a","resolution":{"observed_at":"2026-08-16T00:08:07.517869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.674861Z","title":"companded","venue":null,"work_id":"d224ab97-2804-430b-8a0c-74b88ab37c32","year":2019},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.257291Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:f6b288eae129c554d9663182863d9f25057d0b2488cae4e2c01c53110c615f4a","observation_id":"9a5d4d76-2dea-40e6-8cf9-ef1194cf3535","resolution":{"observed_at":"2026-08-16T00:08:07.679897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.811071Z","title":"Choi et al., 2017; Wang et al., 2019), determining the optimal bit depth (Wang et al., 2019; D","venue":null,"work_id":"674e854d-1650-4dc7-a561-5946de8be471","year":2017},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.216065Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:09320e3e11795137b35b66fe283cc89ee641ab15c3e641c83fe295443728a5dc","observation_id":"842faee6-7a8d-43d6-8383-579ad7d4c1ea","resolution":{"observed_at":"2026-08-16T00:08:07.815115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.787135Z","title":null,"venue":null,"work_id":"e99dc755-1980-4f62-b403-9889680d2594","year":2019},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.224084Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:4afafc6d047c481d26cde70abb30882bc6e761c807a9d3b4061e4c6b2b6c39e3","observation_id":"3c59bbb7-265b-47a3-b6b6-f209d48d1eaa","resolution":{"observed_at":"2026-08-16T00:08:07.790664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.822897Z","title":"Zhang et al., 2018; Zhou et al.,","venue":null,"work_id":"d95a831b-55b0-4aa3-b07c-ad9e0a709cc8","year":2019},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.212877Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:b5532cbefcfa6bdd3ed6df6f8de6b82727ae08e0ca1b67b4683d5a2878076239","observation_id":"a0085984-0077-4a13-8872-e987b8d38f90","resolution":{"observed_at":"2026-08-16T00:08:07.827344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.763161Z","title":"Data-free quantization (Nagel et al., 2019; Xu et al., 2020; K","venue":null,"work_id":"cdae5e27-f6b2-4808-a04f-d0ce7c59faa0","year":2019},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.231705Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:b0842a2c7dcc98f1603204fcb48a313ad340730c0ef02099e420d269f8ecc057","observation_id":"d42624dc-591e-4574-b9f9-88a5de5b8bf3","resolution":{"observed_at":"2026-08-16T00:08:07.766995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.637642Z","title":"Next Token Prediction","venue":null,"work_id":"76d20ce6-f83c-40c2-91e5-7cc6eee9822f","year":2022},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.271212Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:7efe2aa0e9a45d43eb97f4c0200ca5462d89d3e44b80f57ff1ca0f332734b108","observation_id":"3555d3b8-8980-4c63-a8cb-1d4bae81713e","resolution":{"observed_at":"2026-08-16T00:08:07.641838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.737360Z","title":"More recent extensions (Dettmers et al., 2023; Lee et al.,","venue":null,"work_id":"1b6b5458-9f72-4050-b4ef-d5d51d405e36","year":2023},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.239171Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:54c4f4f16f54c453b1909071f5297c64aaf3532832f81895f292fe36a9536cd0","observation_id":"1558e9a2-9966-444b-80ef-4ba9411a8dbc","resolution":{"observed_at":"2026-08-16T00:08:07.741210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.660556Z","title":"For calibration data, we source 128 examples from the training split of the C4 dataset (Raffel et al., 2020)","venue":null,"work_id":"66da59b4-106f-4a69-9183-869230fe3644","year":2020},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.261953Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:052e97d87bccdbd44a9a488ba41d3c13af8c99bdf1ad13a474d81d6f193b0f50","observation_id":"7ad5133a-88c6-43c9-a51f-5b28ce9deb4b","resolution":{"observed_at":"2026-08-16T00:08:07.666408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.724861Z","title":null,"venue":null,"work_id":"6ac31836-06c1-486d-8327-be50d39450af","year":2024},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.243502Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:a65a4efeba281a51a07fd9be80a681cdfcddca1dd4464b7593a4678d4efd5e48","observation_id":"84147a17-9c66-4c4c-9678-31e3941ee6e5","resolution":{"observed_at":"2026-08-16T00:08:07.729336Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:08:07.859886Z","title":null,"venue":null,"work_id":"492fd465-a440-44f1-94b6-61b5b91ffdfe","year":2025},"citing_paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T00:08:07.200473Z"},"links":{"citing_paper":"/paper/2505.03031"},"observation_digest":"sha256:461ff0f68530e8c08b3c9c7c0e1f93977cb90f6b3b81d1d3a10835102454239a","observation_id":"289d4672-14a0-4178-a0b0-21cae6777588","resolution":{"observed_at":"2026-08-16T00:08:07.864716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.03031","last_updated":"2025-05-05T21:17:14Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T20:52:13.710587Z","submitted_at":"2025-05-05T21:17:14Z","title":"Radio: Rate-Distortion Optimization for Large Language Model Compression"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 1 inbound Pith citation observation for arXiv:2505.03031."}