{"as_of":"2026-08-19T03:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:04d8ee1e5f0529442f83c7648c50412e3760c371b21c5384cb54db4f85adcb7d","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:06:29.141726Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.13472/citation-record","integrity":"/paper/2506.13472/integrity","json":"/paper/2506.13472/citation-record.json","paper":"/paper/2506.13472"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.838992Z","title":null,"venue":null,"work_id":"ce643ee7-9a37-4e03-bbd9-b6bd1f84c2e4","year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.922804Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:6b19ed6198b45143175902394893c61b398922ae0d44ca4e8de87aa20672d5ae","observation_id":"1aefb22d-e352-4719-8269-9c9721c3a9ce","resolution":{"observed_at":"2026-08-15T20:06:29.843431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.824142Z","title":"Croci, Marcelo Gennari Do Nascimento, Torsten Hoefler, and James Hensman","venue":null,"work_id":"0333b008-20e1-4d0a-b2c4-96955b6d9251","year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.929039Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:dbf4aa801cc64071016ffe09aa8579408803e5cd8429f5132de1b663713459d7","observation_id":"86d3d280-82af-4df6-bfc7-3e045eace103","resolution":{"observed_at":"2026-08-15T20:06:29.828763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-16T14:04:57.666315Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-15T20:06:28.936550Z","title":"Croci, Bo Li, Martin Jaggi, Dan Alistarh, Torsten Hoefler, and James Hensman","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.936550Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:e79452854ff415f794ed43d259ad94a42f1b46d21fdec615295921c812dbcfeb","observation_id":"4664bd57-c8f4-4002-8414-8e0bab00d04e","resolution":{"observed_at":"2026-08-15T20:06:28.936550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:28.943205Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.943205Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:ec1261e0af79c57526485a5c159ece1b01518c519ad8af179132b161af46d4c5","observation_id":"da6a59af-0976-477e-a26d-7a811f433228","resolution":{"observed_at":"2026-08-15T20:06:28.943205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13304","last_updated":"2024-01-15T21:54:28Z","snapshot_observed_at":"2026-08-18T08:36:45.091453Z","submitted_at":"2023-07-25T07:44:06Z","title":"QuIP: 2-Bit Quantization of Large Language Models With Guarantees","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13304","snapshot_observed_at":"2026-08-15T20:06:28.948745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.948745Z"},"links":{"cited_paper":"/paper/2307.13304","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:22f4c37ab8b8264e54fbe04c50346d88609c178e5f3cdf53ff1c29165e3b71ea","observation_id":"4ab01711-4034-4302-bf23-d58ca9af81fe","resolution":{"observed_at":"2026-08-15T20:06:28.948745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-15T20:06:28.954480Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.954480Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:e44123d036cd40a365e53799f216f0cd864c19f239077c67d9abd94801377b13","observation_id":"1ec8aa7d-0cae-482b-8525-a271eac967ae","resolution":{"observed_at":"2026-08-15T20:06:28.954480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07339","snapshot_observed_at":"2026-08-15T20:06:28.962091Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.962091Z"},"links":{"cited_paper":"/paper/2208.07339","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:46beab103b4e281f9049661889cdf77f55d52ae572504aa180b0957529b753b9","observation_id":"b1be710e-edf7-4229-942f-6a6c7dce7b39","resolution":{"observed_at":"2026-08-15T20:06:28.962091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:28.968255Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.968255Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:6eddc9e133330ac3f446b744d07a73c8dbd12e519441afbd9c26f383bfd8f27e","observation_id":"78dfc645-f597-4cdc-86e3-ea815d0d1d5b","resolution":{"observed_at":"2026-08-15T20:06:28.968255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.788469Z","title":null,"venue":null,"work_id":"8b10a5c5-6e85-47f2-9902-7845547a52b5","year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.973430Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:249347e4bc5bd15aafd626c9e2fd071833ac642cf0c7fb99294d158583d5b43d","observation_id":"5612d465-c5a6-4f3d-a725-32862b7ebccb","resolution":{"observed_at":"2026-08-15T20:06:29.793002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-16T07:57:19.216626Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-15T20:06:28.978603Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.978603Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:14d9782a0c486049d474130883967f360a055725f333ecf59a53d09fa76e727c","observation_id":"5cc36fce-03fe-4682-a6fc-b507edf3fb66","resolution":{"observed_at":"2026-08-15T20:06:28.978603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-15T20:06:28.985678Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.985678Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:118fa0ca5a13e72567c2543f704bb87a3a60115407ca647c405b7b8cda070b30","observation_id":"bed45743-a03c-44ae-991d-3e23e5b2968f","resolution":{"observed_at":"2026-08-15T20:06:28.985678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14866","last_updated":"2024-04-16T03:18:38Z","snapshot_observed_at":"2026-08-16T14:16:41.761880Z","submitted_at":"2024-02-21T07:45:22Z","title":"APTQ: Attention-aware Post-Training Mixed-Precision Quantization for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.14866","doi":"10.48550/arxiv.2402.14866","metadata_source":"pith","pith_arxiv_id":"2402.14866","snapshot_observed_at":"2026-08-16T12:16:17.039197Z","title":"APTQ: Attention-aware Post-Training Mixed-Precision Quantization for Large Language Models","venue":"cs.LG","work_id":"ba16abb5-fc27-402c-a069-82b6a91d755b","year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.990681Z"},"links":{"cited_paper":"/paper/2402.14866","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:2603054426577339c0530af5def2bf7eafb2b1415431dcbfca776bde6e58e7eb","observation_id":"87caf8c7-1907-426f-a2b8-11d9402ac3e1","resolution":{"observed_at":"2026-08-15T20:06:29.213641Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-15T20:06:28.995873Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:28.995873Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:954afe92e1bdafbfee7eecf1bf046600345b5bcbe84db1618e043d24352cf464","observation_id":"49d250bd-d458-4c3d-bb04-03c88971ca6b","resolution":{"observed_at":"2026-08-15T20:06:28.995873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.774228Z","title":null,"venue":null,"work_id":"afa3ed58-f494-498e-a49d-04c1be94cc35","year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.002574Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:81d920fc1e14fda74d8ce795f348fbafdd8b287acb0fd5d032312bb16ccda189","observation_id":"29c62467-4573-445a-af7e-d346e707a5ca","resolution":{"observed_at":"2026-08-15T20:06:29.778589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.759855Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":"40655760-2a49-418a-87cd-e1ef0f740b39","year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.007984Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:d9ee5f30e51b38238149dbfe99c81c91695f32837b37a8ec37a551461eac9466","observation_id":"b2f9a187-c4ca-458e-ae8e-380759541173","resolution":{"observed_at":"2026-08-15T20:06:29.764152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10076","last_updated":"2024-02-15T16:38:41Z","snapshot_observed_at":"2026-08-16T14:18:15.328781Z","submitted_at":"2024-02-15T16:38:41Z","title":"QUICK: Quantization-aware Interleaving and Conflict-free Kernel for efficient LLM inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10076","snapshot_observed_at":"2026-08-15T20:06:29.013133Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.013133Z"},"links":{"cited_paper":"/paper/2402.10076","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:09670194ea988f462084d646e608aecd709cf361eb1b20b20db1835a8f314a3e","observation_id":"00134eea-9540-4f49-a2d3-036fa3d8b341","resolution":{"observed_at":"2026-08-15T20:06:29.013133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.017460Z","title":"u ttler, Mike Lewis, Wen - tau Yih, Tim Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.017460Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:b7d9f6bfd8b1509d90b54d439a8e81f6dc4b754b74bfac486b118f40f71388c7","observation_id":"2d363606-2a3e-4e8f-b7aa-b3b34880b9b7","resolution":{"observed_at":"2026-08-15T20:06:29.017460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.01113","last_updated":"2020-02-04T04:01:51Z","snapshot_observed_at":"2026-08-16T03:09:16.574897Z","submitted_at":"2020-02-04T04:01:51Z","title":"Efficient Riemannian Optimization on the Stiefel Manifold via the Cayley Transform","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.01113","snapshot_observed_at":"2026-08-15T20:06:29.022004Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.022004Z"},"links":{"cited_paper":"/paper/2002.01113","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:56f1f612d9d7b6a6c028b62c8dd5053757fa59198d0498d08a56179669d8b7ce","observation_id":"094132f1-a9dc-40a3-8377-c830932d7364","resolution":{"observed_at":"2026-08-15T20:06:29.022004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.732369Z","title":null,"venue":null,"work_id":"04071c30-ebb3-4ada-a370-c1f0fa660fc6","year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.027448Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:befbc6c665feb25166e3f29df4d3dc53b765114e269c1b2b64771726692e7b25","observation_id":"8ec1095b-ddec-4343-9166-a40ee26f7a25","resolution":{"observed_at":"2026-08-15T20:06:29.737434Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.715488Z","title":null,"venue":null,"work_id":"63e07c0d-99ef-4081-8498-e63a0fd7084a","year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.031910Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:4ef24d530a1a2bf058cd153f05f27d0b5fa9526696a804dad481224cd407b54b","observation_id":"35a334e3-efcd-4a1d-8e07-9ac2fa247b04","resolution":{"observed_at":"2026-08-15T20:06:29.720905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-16T15:28:47.324188Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-15T20:06:29.036055Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.036055Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:f5b06e1c2a1caa3dd32071b98ee16e89c5015e1ed9cea2397903e161134cf144","observation_id":"d9c60c10-be85-4594-8b36-9a6d9cc082a0","resolution":{"observed_at":"2026-08-15T20:06:29.036055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-08-16T17:18:05.876361Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-15T20:06:29.040883Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.040883Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:c97b8b52600c9e1b010ece1faf895cbbc8cd279de693ab750a5f9fe71718b5a6","observation_id":"b8b4158b-e1fa-49dd-8480-406767a9601b","resolution":{"observed_at":"2026-08-15T20:06:29.040883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-14T15:17:37.878305Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-15T20:06:29.046160Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.046160Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:c7b190f92043660020b001a48bcc87f8bb1696eea3a41a12832eb1e5c5ad9032","observation_id":"41c9165f-28d4-4644-a3cd-127acb7dcaa7","resolution":{"observed_at":"2026-08-15T20:06:29.046160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-08-17T01:46:43.513643Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-15T20:06:29.051490Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.051490Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:2097332a431a868607b595845258053cad726e7bdaf22b34fc685b58dd2a08e9","observation_id":"0bfb9fa2-957f-44e0-940b-c75a1154ddb8","resolution":{"observed_at":"2026-08-15T20:06:29.051490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.056321Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.056321Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:acb07493e9386c5bd45bfffe7b5d23a4c0aee1810cf9c15c2fefd2e3e92f59ae","observation_id":"c7c568fa-de08-4104-b046-8c1b728b76de","resolution":{"observed_at":"2026-08-15T20:06:29.056321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03788","last_updated":"2023-12-06T11:10:55Z","snapshot_observed_at":"2026-08-16T14:37:12.018998Z","submitted_at":"2023-12-06T11:10:55Z","title":"SmoothQuant+: Accurate and Efficient 4-bit Post-Training WeightQuantization for LLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03788","snapshot_observed_at":"2026-08-15T20:06:29.061027Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.061027Z"},"links":{"cited_paper":"/paper/2312.03788","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:1310418471ee3337fd945d37a19b2803c7ea7546bd2d155e1ef357dd7767f276","observation_id":"7d6486af-d977-4acb-ae5f-0f1adec75a23","resolution":{"observed_at":"2026-08-15T20:06:29.061027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-08-16T10:42:13.725165Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-08-15T20:06:29.066547Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.066547Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:9ef45303db430e114c4dd497a990655c37cb92a1e75d002cb9e90fafc3289f4f","observation_id":"2fa02b53-a7dd-418c-9bb6-79c93f873e20","resolution":{"observed_at":"2026-08-15T20:06:29.066547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.687670Z","title":null,"venue":null,"work_id":"bd3892f5-8005-4fe9-88b9-e66a3fb6792c","year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.071968Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:59b2fb834f4badca19865bdd18508f3c0755d7060a28ad255dccc05b0f48c941","observation_id":"f42dfd85-ec02-443f-af45-5d3483bbc15d","resolution":{"observed_at":"2026-08-15T20:06:29.692648Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10787","last_updated":"2025-07-01T19:43:45Z","snapshot_observed_at":"2026-08-16T14:17:56.269168Z","submitted_at":"2024-02-16T16:10:38Z","title":"Squat: Quant Small Language Models on the Edge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10787","snapshot_observed_at":"2026-08-15T20:06:29.077223Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.077223Z"},"links":{"cited_paper":"/paper/2402.10787","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:4598805452a0a8098a716fbdbfd7e0802894414a1e431e27c1776be685132936","observation_id":"5697b573-3d89-44d4-b334-dae46b698c98","resolution":{"observed_at":"2026-08-15T20:06:29.077223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.082442Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.082442Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:1dcbbd84d8c7745216ab05307b23f27c0981ba9fc7c030d0b42d0008f5ac36ce","observation_id":"6cb20a2d-e342-4686-8fe0-3374ef11e34f","resolution":{"observed_at":"2026-08-15T20:06:29.082442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T20:06:29.087836Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.087836Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:f9d9ebaa7f1374f054a8b3209a14f8488d76b56fb186647040bd4e8fe1c3cd1a","observation_id":"736268f8-c4dd-41e6-8619-a63550dcfc6c","resolution":{"observed_at":"2026-08-15T20:06:29.087836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.670804Z","title":null,"venue":null,"work_id":"ee59c10e-b899-46aa-b797-5816ef2a12c5","year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.092725Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:d2e7cdf4715a09b7331b768a30d510b141314b37ed5e3c0e616381094e18f6bf","observation_id":"1b5d301c-373d-43c0-8dfd-21e5b04cc6bd","resolution":{"observed_at":"2026-08-15T20:06:29.676110Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08583","last_updated":"2023-12-18T05:08:23Z","snapshot_observed_at":"2026-08-18T08:36:44.045833Z","submitted_at":"2023-12-14T01:06:37Z","title":"ZeroQuant(4+2): Redefining LLMs Quantization with a New FP6-Centric Strategy for Diverse Generative Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08583","snapshot_observed_at":"2026-08-15T20:06:29.097371Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.097371Z"},"links":{"cited_paper":"/paper/2312.08583","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:936f9e544e683998dd39ef34de08918181fb2cfe26927eb4c11a5449decf022c","observation_id":"480b2708-c084-44ac-944c-a4e908dfebbd","resolution":{"observed_at":"2026-08-15T20:06:29.097371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09782","last_updated":"2023-07-20T18:47:20Z","snapshot_observed_at":"2026-08-16T15:15:06.936046Z","submitted_at":"2023-07-19T06:58:03Z","title":"ZeroQuant-FP: A Leap Forward in LLMs Post-Training W4A8 Quantization Using Floating-Point Formats","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09782","snapshot_observed_at":"2026-08-15T20:06:29.102698Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.102698Z"},"links":{"cited_paper":"/paper/2307.09782","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:abb473b187b2d6d5093289cd6f7382be818dd0287b0221e12aedce8ab3318a11","observation_id":"fa820c6a-a411-4935-8fc6-a89de1b0e1a7","resolution":{"observed_at":"2026-08-15T20:06:29.102698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.653814Z","title":null,"venue":null,"work_id":"be6f6f6a-b6d9-4e64-9f09-06cd71946ffd","year":2023},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.108579Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:3864c01e058c42f8512c387507a8563168b8592ff137e592ede638fe00a3744d","observation_id":"7ba1c022-4f1d-4ad1-95e0-e865b3da50e7","resolution":{"observed_at":"2026-08-15T20:06:29.659189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-15T20:06:29.113411Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.113411Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:98014f8375d247eadd2fde1dba152b6376e39930ea4d6cf7fd6a2e33c9b260be","observation_id":"b77a6369-78ac-49f1-b916-83176836c546","resolution":{"observed_at":"2026-08-15T20:06:29.113411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01861","last_updated":"2022-06-04T00:28:21Z","snapshot_observed_at":"2026-08-16T16:55:23.882455Z","submitted_at":"2022-06-04T00:28:21Z","title":"ZeroQuant: Efficient and Affordable Post-Training Quantization for Large-Scale Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01861","snapshot_observed_at":"2026-08-15T20:06:29.118203Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.118203Z"},"links":{"cited_paper":"/paper/2206.01861","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:d36d4c95e7855a2e110c6e27e643159d71024f7ed8823cdcd1e177b4cf706ba7","observation_id":"8be7de8b-4369-49d6-98ba-720147f5f4b1","resolution":{"observed_at":"2026-08-15T20:06:29.118203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08302","last_updated":"2023-05-26T00:17:06Z","snapshot_observed_at":"2026-08-16T15:48:09.692405Z","submitted_at":"2023-03-15T01:27:15Z","title":"ZeroQuant-V2: Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08302","snapshot_observed_at":"2026-08-15T20:06:29.123982Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.123982Z"},"links":{"cited_paper":"/paper/2303.08302","citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:6a81e57beeae8fa664bc311f1d3806d4f91973f8a9f421e8b72fb1386fd90071","observation_id":"d7f95455-3a75-4a94-a33b-840c231f2507","resolution":{"observed_at":"2026-08-15T20:06:29.123982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.128711Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.128711Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:b22673234b1b0e233e933052a123902d55dc0d03fdf15cea2b2c62a53f0ca222","observation_id":"098b1892-fb25-44be-bced-c5e787093d76","resolution":{"observed_at":"2026-08-15T20:06:29.128711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.133028Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.133028Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:6eb12725a5c57bd45ee26c598003df4afed3e8e91e3153fdbcf4096694231d3a","observation_id":"0678551f-be8a-4dc2-9283-0d2758992b57","resolution":{"observed_at":"2026-08-15T20:06:29.133028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.137118Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.137118Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:fbbf2e36e4bc779b18e7a7c8468b44e38b4307415a411b045d49a0c48ad45422","observation_id":"150034a4-bb39-496e-ad82-c9564e4154dd","resolution":{"observed_at":"2026-08-15T20:06:29.137118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:29.141726Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T20:06:29.141726Z"},"links":{"citing_paper":"/paper/2506.13472"},"observation_digest":"sha256:02aceaddcfee49545bbc4819fa53fed2f0eb5da7b3837e08bc4a740c9b0f76a5","observation_id":"8b8ab5ea-84e8-413d-8af2-39f704c86fd9","resolution":{"observed_at":"2026-08-15T20:06:29.141726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.13472","last_updated":"2025-06-17T09:13:54Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T08:36:53.203615Z","submitted_at":"2025-06-16T13:30:33Z","title":"ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2506.13472."}