{"as_of":"2026-08-19T18:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d70b2d0397979600f2759dd70ce5093567b651ec5256bbee8185567c2e1ebd39","coverage":[{"denominator":136,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T17:12:37.492741Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.17733/citation-record","integrity":"/paper/2607.17733/integrity","json":"/paper/2607.17733/citation-record.json","paper":"/paper/2607.17733"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1804.01526","last_updated":"2018-12-02T15:11:18Z","snapshot_observed_at":"2026-08-14T19:29:26.763888Z","submitted_at":"2018-04-04T09:40:59Z","title":"Training DNNs with Hybrid Block Floating Point","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.01526","snapshot_observed_at":"2026-08-01T17:12:27.151541Z","title":"arXiv:1804.01526 [cs, stat] , author =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.151541Z"},"links":{"cited_paper":"/paper/1804.01526","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:fd04f7d7af79ffc5882fefc965bfadd2c5c2c18c8fa6338fac55da0a20c29227","observation_id":"b0389ef3-da40-46f6-b694-d9dd588926c7","resolution":{"observed_at":"2026-08-01T17:12:27.151541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09145","last_updated":"2023-10-23T08:48:31Z","snapshot_observed_at":"2026-08-19T11:13:37.720416Z","submitted_at":"2023-04-18T17:34:23Z","title":"Outlier Suppression+: Accurate quantization of large language models by equivalent and optimal shifting and scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09145","snapshot_observed_at":"2026-08-01T17:12:27.226905Z","title":"arXiv preprint arXiv:2304.09145 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.226905Z"},"links":{"cited_paper":"/paper/2304.09145","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:85327550855ab8399fb73252f3587c5ffa5c7eedac21a90b70de697eb860a252","observation_id":"e210193d-bab0-49e1-b61c-e1d60621ce0e","resolution":{"observed_at":"2026-08-01T17:12:27.226905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:27.293408Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.293408Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:62ec5eb048c7855314b2bb6c050594b626c0ba37c34025efc0081ba5cbd19b21","observation_id":"6ad65d40-01ba-469f-a601-1e9fa4083ded","resolution":{"observed_at":"2026-08-01T17:12:27.293408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.04404","last_updated":"2021-09-09T16:45:15Z","snapshot_observed_at":"2026-08-16T17:57:44.896488Z","submitted_at":"2021-09-09T16:45:15Z","title":"All Bark and No Bite: Rogue Dimensions in Transformer Language Models Obscure Representational Quality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.04404","snapshot_observed_at":"2026-08-01T17:12:27.357886Z","title":"arXiv preprint arXiv:2109.04404 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.357886Z"},"links":{"cited_paper":"/paper/2109.04404","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:e3bd80423ac834c7630024e404f6ca8e747c14b1817fd3aeb11c59f2c694b28b","observation_id":"dee5b13f-7326-4bb9-a742-9a0e250b63b4","resolution":{"observed_at":"2026-08-01T17:12:27.357886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.12948","last_updated":"2021-09-27T10:57:18Z","snapshot_observed_at":"2026-08-19T11:18:49.778754Z","submitted_at":"2021-09-27T10:57:18Z","title":"Understanding and Overcoming the Challenges of Efficient Transformer Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.12948","snapshot_observed_at":"2026-08-01T17:12:27.428735Z","title":"arXiv preprint arXiv:2109.12948 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.428735Z"},"links":{"cited_paper":"/paper/2109.12948","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:5c0a708df6a233461867c3d9e8c54014e7bfea7826dae6f228cba7b9f8642843","observation_id":"c1bb3eca-1d65-4534-ab2a-c7672dd1587e","resolution":{"observed_at":"2026-08-01T17:12:27.428735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:27.497511Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.497511Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:f2fb3b37ad771f23be652392b6cd5256670d5f63fa7a7185b0a4f73cfc3bdd15","observation_id":"0ab90303-b202-492b-bdd9-e5f065d5e817","resolution":{"observed_at":"2026-08-01T17:12:27.497511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10537","last_updated":"2023-10-19T16:38:33Z","snapshot_observed_at":"2026-08-19T14:12:52.683965Z","submitted_at":"2023-10-16T16:07:41Z","title":"Microscaling Data Formats for Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10537","snapshot_observed_at":"2026-08-01T17:12:27.562005Z","title":"arXiv preprint arXiv:2310.10537 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.562005Z"},"links":{"cited_paper":"/paper/2310.10537","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:b46b6032fb73f2e0e0b04fa853f78772b81ce2fd67ca5efbcac72062a01d56a3","observation_id":"be13ca87-9323-40a3-bad4-990ba4de8185","resolution":{"observed_at":"2026-08-01T17:12:27.562005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:27.623831Z","title":"Proceedings of the 36th ACM International Conference on Supercomputing , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.623831Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:695d9a20a2daa126beadbef432750765245b47a4a633c0d214680635ee8106e9","observation_id":"09757515-49e5-465d-a2b6-4d90a40f9eea","resolution":{"observed_at":"2026-08-01T17:12:27.623831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:27.685221Z","title":"Proceedings of the 52nd Annual International Symposium on Computer Architecture , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.685221Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:16acad0158ab80f1c7ade22635ed362197dc8b307bd1cc2cbb35fc65804aff49","observation_id":"c164e073-01a3-4777-ab6f-479d2ada1105","resolution":{"observed_at":"2026-08-01T17:12:27.685221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:27.746603Z","title":"MICRO-54: 54th Annual IEEE/ACM International Symposium on Microarchitecture , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.746603Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:eaf7bd8e7f2f820bf72d57350aa0f538c1c8bc6631143d3490f551d0b25533c7","observation_id":"ca3d3686-578e-44f1-a518-051294a96911","resolution":{"observed_at":"2026-08-01T17:12:27.746603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11380","last_updated":"2022-10-22T09:02:39Z","snapshot_observed_at":"2026-08-16T16:58:23.056760Z","submitted_at":"2022-05-23T15:19:09Z","title":"Outliers Dimensions that Disrupt Transformers Are Driven by Frequency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11380","snapshot_observed_at":"2026-08-01T17:12:27.817771Z","title":"arXiv preprint arXiv:2205.11380 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.817771Z"},"links":{"cited_paper":"/paper/2205.11380","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:36dab18ae741a2de5454a77240f34ea63e8025476902fcd46a01e0569915f169","observation_id":"ea9fbdea-66b5-4ed5-893a-3c13ad9b828f","resolution":{"observed_at":"2026-08-01T17:12:27.817771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09557","last_updated":"2024-04-01T06:09:41Z","snapshot_observed_at":"2026-08-16T16:51:52.635088Z","submitted_at":"2022-06-20T03:48:17Z","title":"LUT-GEMM: Quantized Matrix Multiplication based on LUTs for Efficient Inference in Large-Scale Generative Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.09557","snapshot_observed_at":"2026-08-01T17:12:27.877147Z","title":"arXiv preprint arXiv:2206.09557 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.877147Z"},"links":{"cited_paper":"/paper/2206.09557","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:a75f1a7da58adecd8b44892e9bd21b43deb95df8ea05576b18f417a45fcacf19","observation_id":"81a639f2-4965-41dc-a50c-f5979d8c4a27","resolution":{"observed_at":"2026-08-01T17:12:27.877147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-19T14:43:53.195907Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-01T17:12:27.941291Z","title":"arXiv preprint arXiv:2306.07629 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:27.941291Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:9de48344ee48ce22253ca9b9bf9272f9667ee2220274f732a39bd42fe27d1984","observation_id":"25b40a43-1701-4822-b146-c3fd2fdc511c","resolution":{"observed_at":"2026-08-01T17:12:27.941291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07339","snapshot_observed_at":"2026-08-01T17:12:28.018798Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:28.018798Z"},"links":{"cited_paper":"/paper/2208.07339","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:132be9844097b0acc480a4595293a2a11756e14967e409992fb199243ce20c00","observation_id":"baea74a0-fbe7-4d83-a4f2-5bd54d12bb5e","resolution":{"observed_at":"2026-08-01T17:12:28.018798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:28.080747Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:28.080747Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:f7c7ada41dce4d80767ea8f210b1c852509b614a2648018baecf5158e156e68d","observation_id":"60856a8d-2376-4ff0-ae21-e3b971402ee1","resolution":{"observed_at":"2026-08-01T17:12:28.080747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:28.165900Z","title":"2019 , eprint=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:28.165900Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:c2dee81ba671e087416067f7266fa069103012a3ba6e9dd95bd0fd6a7fa60b7d","observation_id":"b0f61271-4cc9-4183-9a57-8f0aa716cb7b","resolution":{"observed_at":"2026-08-01T17:12:28.165900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10537","last_updated":"2023-10-19T16:38:33Z","snapshot_observed_at":"2026-08-19T14:12:52.683965Z","submitted_at":"2023-10-16T16:07:41Z","title":"Microscaling Data Formats for Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10537","snapshot_observed_at":"2026-08-01T17:12:28.283144Z","title":"Microscaling Data Formats for Deep Learning , journal =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:28.283144Z"},"links":{"cited_paper":"/paper/2310.10537","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:10862d5032822b308001ea9db24eb26330acd6fd6edac0bfed4d26631dabfa37","observation_id":"d150366b-146d-4864-8500-6d7060c83dfc","resolution":{"observed_at":"2026-08-01T17:12:28.283144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:28.431686Z","title":"SparseGPT: Massive Language Models Can be Accurately Pruned in One-Shot , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:28.431686Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:513b6c89b3516c734963ebefbebc48f047729c9dae471f83196dd25ae3a6674e","observation_id":"a7eaa3de-7ed0-40dd-9210-432173e44e2a","resolution":{"observed_at":"2026-08-01T17:12:28.431686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-08-16T17:18:05.876361Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-01T17:12:28.552379Z","title":"arXiv preprint arXiv:2405.16406 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:28.552379Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:117c1a87d6ae8cdc2064447c034caece9c056875a5714972a6ca2383854c85ef","observation_id":"ce162646-48aa-4be1-9ce6-a3778d250254","resolution":{"observed_at":"2026-08-01T17:12:28.552379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-08-13T04:32:33.562415Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-01T17:12:28.673389Z","title":"Zico Kolter , title =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:28.673389Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:45e09ea0fb37e64a48f5655e75e05aa34382603829305f74a03bc71766b63ee6","observation_id":"25996b48-6dd8-422b-96bc-e1f2fada2255","resolution":{"observed_at":"2026-08-01T17:12:28.673389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08378","last_updated":"2021-04-16T21:27:32Z","snapshot_observed_at":"2026-08-16T18:30:58.242028Z","submitted_at":"2021-04-16T21:27:32Z","title":"Accelerating Sparse Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08378","snapshot_observed_at":"2026-08-01T17:12:28.796302Z","title":"Mishra and Jorge Albericio Latorre and Jeff Pool and Darko Stosic and Dusan Stosic and Ganesh Venkatesh and Chong Yu and Paulius Micikevicius , title =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:28.796302Z"},"links":{"cited_paper":"/paper/2104.08378","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:5969a979cc6ae7dbecbea9fa94aa9faf7f809bdee22aee4e696898b4c45724b0","observation_id":"9e82efbf-98d6-4a66-9323-68cde424840e","resolution":{"observed_at":"2026-08-01T17:12:28.796302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-01T17:12:28.913039Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:28.913039Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:9886f485d310951369820b3fb1dca1a64040b33a6d48c9fb4f2ff99a6a615449","observation_id":"966a36ac-594e-4460-85d5-7fc95c47b4af","resolution":{"observed_at":"2026-08-01T17:12:28.913039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:29.029903Z","title":"Proceedings of Machine Learning and Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:29.029903Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:22f65cfe7abe231b77fe9b5fd45a27bc7417edab553cc301aad0b622ff9053bc","observation_id":"2ce3fa1a-6ef3-410b-825c-6da4cac418d2","resolution":{"observed_at":"2026-08-01T17:12:29.029903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:29.203862Z","title":"Proceedings of the 50th Annual International Symposium on Computer Architecture , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:29.203862Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:09a25c0b389f25ffd308dad2737832f4002f8afd5f3257ecd357c4f0e7ebef02","observation_id":"6dc16e26-a030-47d0-bc34-98fe85a0e521","resolution":{"observed_at":"2026-08-01T17:12:29.203862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:29.352243Z","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:29.352243Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:fa53bfa5f46f5cc3c08becfa449e104b6e50f4ecb685a78c803a36a7b101f6c4","observation_id":"ffd64e2b-1494-475b-af17-45feca4df541","resolution":{"observed_at":"2026-08-01T17:12:29.352243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:29.460631Z","title":"5th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:29.460631Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:f3d3fee80e790ef0043890bc8c2a1c6a31e791d9c358b6bf78e7f296f98af934","observation_id":"e26c0881-9a2d-4871-9292-808ac00247b1","resolution":{"observed_at":"2026-08-01T17:12:29.460631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:29.579510Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:29.579510Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:ed4b307623522d9f9773ab9fdba101ceb7bd551e35781deebaed9c0505b9023b","observation_id":"f333cd00-d380-48cd-bdc3-4a4424b391ee","resolution":{"observed_at":"2026-08-01T17:12:29.579510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:29.693882Z","title":"Wikimedia Downloads","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:29.693882Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:2dbe7cb08019019135eee1a1f5c4e1211c6152e09fd85961e28713485c8dd88a","observation_id":"e6804e4d-f97a-4505-bab9-91bb0299cfdf","resolution":{"observed_at":"2026-08-01T17:12:29.693882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:29.834874Z","title":"The IEEE International Conference on Computer Vision (ICCV) , month =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:29.834874Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:e58929cecd36cd4d10538e5d3bf8ee9a181d02e15e62d68b877966e739da5877","observation_id":"8d3df61a-3d72-4515-a04f-de8cec42d0d2","resolution":{"observed_at":"2026-08-01T17:12:29.834874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:29.960689Z","title":"2009 IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:29.960689Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:2753cfeecff33c5675f6c14ade6783bb77b26c5389af910ddb2b14f21494b7a0","observation_id":"c68e3a6b-6601-45e1-b8d1-b1c1da5fab5a","resolution":{"observed_at":"2026-08-01T17:12:29.960689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:30.030535Z","title":"Gomez and Lukasz Kaiser and Illia Polosukhin , editor =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.030535Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:4cc2760ab187ef8782c5a342d78118350d36cbeee5ec094519475be3869bfb49","observation_id":"f6c9bd04-9fae-4297-887f-17543f335fa9","resolution":{"observed_at":"2026-08-01T17:12:30.030535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:30.114261Z","title":"Proceedings of the 2019 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.114261Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:a8c7b81acddfd88a3d6ac7333c8008f72b98bde6c5de442db97c33e48be8575f","observation_id":"def36568-02ca-476d-86f0-fb1192916241","resolution":{"observed_at":"2026-08-01T17:12:30.114261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:30.203691Z","title":"9th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.203691Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:d46283ba35a5ffca56d285f2f9e974d9e3f3b50b850d12b7a0a00ad6f08626fb","observation_id":"644754d7-4896-4a11-8dce-b379667eeb6c","resolution":{"observed_at":"2026-08-01T17:12:30.203691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:30.285158Z","title":"2019 , file =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.285158Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:ef660dc7fd2d8682fecd3449dca76834e357db7d71edf196d066637242012430","observation_id":"474a638d-3154-4452-a01e-77602f0cde8a","resolution":{"observed_at":"2026-08-01T17:12:30.285158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:30.372935Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.372935Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:a026d955be63522a34560fec14a94347d81d291281b06ba89bf533f703b4a40f","observation_id":"a877c2d5-a1f7-4888-9baf-33308fbe9605","resolution":{"observed_at":"2026-08-01T17:12:30.372935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03740","last_updated":"2018-02-15T20:04:02Z","snapshot_observed_at":"2026-08-12T13:00:33.339808Z","submitted_at":"2017-10-10T17:42:04Z","title":"Mixed Precision Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03740","snapshot_observed_at":"2026-08-01T17:12:30.460917Z","title":"arXiv:1710.03740 [cs, stat] , author =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.460917Z"},"links":{"cited_paper":"/paper/1710.03740","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:0f8901b8caed733f5a2db640f345641d7352f68e32f865982c928da281b5e697","observation_id":"1e7a4a44-a773-460e-928b-ad3ba0d012ae","resolution":{"observed_at":"2026-08-01T17:12:30.460917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:30.542653Z","title":"Chung and Zhaoxia (Summer) Deng and Sam Naghshineh and Jongsoo Park and Maxim Naumov , editor =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.542653Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:6431716692ee4c8d94abb3beceed2a968d7a0958f55ac9eb62dd04a83162fb3b","observation_id":"78f2d4e3-27db-43b5-96ff-c32b9f855a35","resolution":{"observed_at":"2026-08-01T17:12:30.542653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:30.653340Z","title":"Pushing the Limits of Narrow Precision Inferencing at Cloud Scale with Microsoft Floating Point , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.653340Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:4c54c2bf086db7502a6c138b7a1703251fda1321fb9390b906d622229e02ac31","observation_id":"10c5b0b5-783b-4aaa-a46e-b81edeb8e1e0","resolution":{"observed_at":"2026-08-01T17:12:30.653340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:30.710712Z","title":"2022 IEEE International Symposium on High-Performance Computer Architecture (HPCA) , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.710712Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:a33ea044ba4372f11fc64931fc524b29a76126ced5cb22b1b1cb17fd45fc922e","observation_id":"e1f1a71c-be6a-43d8-89dc-7a4fdc419470","resolution":{"observed_at":"2026-08-01T17:12:30.710712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.05433","last_updated":"2022-09-29T20:47:07Z","snapshot_observed_at":"2026-08-14T05:39:52.416140Z","submitted_at":"2022-09-12T17:39:55Z","title":"FP8 Formats for Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.05433","snapshot_observed_at":"2026-08-01T17:12:30.799204Z","title":"Oberman and Mohammad Shoeybi and Michael Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.799204Z"},"links":{"cited_paper":"/paper/2209.05433","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:a3aec3f411aa7b3bdcfd9bed817f646b434f0f3129da03dd9ab943aec26cba82","observation_id":"29762dc7-fc3d-43a3-be61-016b011f42e6","resolution":{"observed_at":"2026-08-01T17:12:30.799204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-01T17:12:30.911126Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models , journal =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.911126Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:95addd23b3ddc60e45d862106cabeca0b989783ac323306c248304433a3d73f4","observation_id":"42b3fb62-35de-4c9d-ab99-2c785ed18b7a","resolution":{"observed_at":"2026-08-01T17:12:30.911126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:30.991729Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:30.991729Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:bf02cebffcfba76027e42bc5925e3ee99b9ffa7fa1c716b873ade383d3164b82","observation_id":"05fb1707-c374-4d69-884e-ca9c5228a565","resolution":{"observed_at":"2026-08-01T17:12:30.991729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:31.046211Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:31.046211Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:e155a90cf3ba9f22d70ec1597346f344e937d526df9ae3467c8ee3650825929b","observation_id":"305d4f87-174e-49f1-b38d-6a611044d583","resolution":{"observed_at":"2026-08-01T17:12:31.046211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:31.128667Z","title":"ACM Transactions on Embedded Computing Systems (TECS) , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:31.128667Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:83e63de5047cdab16ea771bc18fd5a9acd7f9439b7008e0b4d4a4174eb3d4364","observation_id":"9e1c64f7-e564-4713-ab81-3c9b78de1a97","resolution":{"observed_at":"2026-08-01T17:12:31.128667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:31.201090Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:31.201090Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:b074ceb6dea0d651bd4ef84b64df6e200a72fd1624e0db4bcc2d50a11d1488cb","observation_id":"8fe9537c-75da-4cbd-8d2b-47820e39d969","resolution":{"observed_at":"2026-08-01T17:12:31.201090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:31.262683Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:31.262683Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:9b9c5dca1bb881c902b7f90a94b76036d04ce2fd20eef48fc4ff8fca3618ea48","observation_id":"64484466-22d4-4f93-b236-c19aa6ff4dd0","resolution":{"observed_at":"2026-08-01T17:12:31.262683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:31.291334Z","title":"International Conference on machine learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:31.291334Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:0a98e0112b43d0bb8a2d4ece3bc03754a70c9f1de9d2d37efe5382aaf624f92e","observation_id":"1815c434-9e51-456b-a152-bd5f2a7291e7","resolution":{"observed_at":"2026-08-01T17:12:31.291334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:31.414720Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:31.414720Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:a45eeb3752a82daf9ec8713892bbb66d0ee435658bd858ce2245beec812041df","observation_id":"797337d0-c682-466f-bdb8-ee247590fa9a","resolution":{"observed_at":"2026-08-01T17:12:31.414720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01892","last_updated":"2020-10-05T10:04:29Z","snapshot_observed_at":"2026-08-16T19:15:52.924225Z","submitted_at":"2020-10-05T10:04:29Z","title":"Joint Pruning & Quantization for Extremely Sparse Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.01892","snapshot_observed_at":"2026-08-01T17:12:31.547507Z","title":"arXiv preprint arXiv:2010.01892 , year=","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:31.547507Z"},"links":{"cited_paper":"/paper/2010.01892","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:d99897228cfdcb2b13d1d182d872fddea222d6559d015640f8c94b4320f48706","observation_id":"6424e814-38e0-4037-939a-c5b3d31e7335","resolution":{"observed_at":"2026-08-01T17:12:31.547507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07612","last_updated":"2023-06-11T10:01:07Z","snapshot_observed_at":"2026-08-16T15:55:11.149022Z","submitted_at":"2023-02-15T12:02:30Z","title":"Towards Optimal Compression: Joint Pruning and Quantization","version":2},"cited_work":{"arxiv_id":"2302.07612","doi":"10.48550/arxiv.2302.07612","metadata_source":"pith","pith_arxiv_id":"2302.07612","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Towards Optimal Compression: Joint Pruning and Quantization","venue":"cs.LG","work_id":"9130dc89-e27f-415f-b932-d3816de4a50b","year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:31.711966Z"},"links":{"cited_paper":"/paper/2302.07612","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:458a79bbd52a0981b4d4446c3e7ef0e25c8aeba8033bb48101594a89f2fa8e80","observation_id":"32dce6fb-050d-4af8-ad01-1edb704f03f4","resolution":{"observed_at":"2026-08-01T17:14:13.463510Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04532","last_updated":"2025-05-01T02:14:05Z","snapshot_observed_at":"2026-08-19T14:44:32.329439Z","submitted_at":"2024-05-07T17:59:30Z","title":"QServe: W4A8KV4 Quantization and System Co-design for Efficient LLM Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04532","snapshot_observed_at":"2026-08-01T17:12:31.870818Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:31.870818Z"},"links":{"cited_paper":"/paper/2405.04532","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:98ef5d0a0094dd56c11c082c7f08e0f8dab7cc09e95387a6b7cec64919df93eb","observation_id":"8446f3c8-35a7-4497-9763-2116970a036d","resolution":{"observed_at":"2026-08-01T17:12:31.870818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:32.020992Z","title":"Deep Compression of Pre-trained Transformer Models , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:32.020992Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:a6949dbd8a6260ff2ff7aaf34f9532f8ccd9099a9ef97e2e7885b30bb11b9c09","observation_id":"7941fbd8-78b7-48a4-8d00-31924986a027","resolution":{"observed_at":"2026-08-01T17:12:32.020992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08271","last_updated":"2021-11-01T09:06:55Z","snapshot_observed_at":"2026-08-16T17:48:58.509665Z","submitted_at":"2021-10-15T16:14:36Z","title":"Training Deep Neural Networks with Joint Quantization and Pruning of Weights and Activations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08271","snapshot_observed_at":"2026-08-01T17:12:32.251422Z","title":"arXiv preprint arXiv:2110.08271 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:32.251422Z"},"links":{"cited_paper":"/paper/2110.08271","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:4172fdacbc841bdcddc7b2065ce76e0a49533eeb8a99d61c9c59ce1ccc37e021","observation_id":"aba23c4a-96e7-4f66-b483-04d77f2d208b","resolution":{"observed_at":"2026-08-01T17:12:32.251422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:32.440054Z","title":"Frontiers in Artificial Intelligence , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:32.440054Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:44ea41cd7b2cf764cb963c13b6e0c776aba02178f4e900a575fcb10aec0fb07d","observation_id":"65dcef89-67da-49b8-99cc-08dedd0ad554","resolution":{"observed_at":"2026-08-01T17:12:32.440054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:32.631618Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:32.631618Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:c909ccaae6599b5e18798b9d2d8664e03d608c57bce9c2d5091cfdf8ccded980","observation_id":"b8c5b75c-c143-4f4f-981e-bf7e805fc667","resolution":{"observed_at":"2026-08-01T17:12:32.631618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:32.793626Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:32.793626Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:26061879ebd13f9c983bd1070ea838d7a6dc6b1d3e47275ca5261d0172f505c2","observation_id":"95579736-d00c-4d24-92b0-f59d40975db7","resolution":{"observed_at":"2026-08-01T17:12:32.793626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:32.906537Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:32.906537Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:94b9bdbb85badbb44a4056dde275ed850f732408ed59388573e551555c6486e8","observation_id":"c751855a-07e2-4107-bd3d-766c41280517","resolution":{"observed_at":"2026-08-01T17:12:32.906537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00149","last_updated":"2016-02-15T06:25:40Z","snapshot_observed_at":"2026-08-04T16:59:47.843960Z","submitted_at":"2015-10-01T09:03:44Z","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00149","snapshot_observed_at":"2026-08-01T17:12:33.043803Z","title":"arXiv preprint arXiv:1510.00149 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:33.043803Z"},"links":{"cited_paper":"/paper/1510.00149","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:8481fa6227b7902c9ffdcbfe2a7e4b81cff509698b328d9a6cb13cffdb8ddecf","observation_id":"0be79ddd-3208-48c3-a2a9-c320f0bd02c8","resolution":{"observed_at":"2026-08-01T17:12:33.043803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:33.180569Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:33.180569Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:d77fc987cfc64025853956b8f75bc8d7758bfd4d7370af4c767c98256b6438b1","observation_id":"5fed8344-2da6-4942-9f8c-b8a8c30f01b6","resolution":{"observed_at":"2026-08-01T17:12:33.180569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:33.314659Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:33.314659Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:8b7127ef7175318ca018d58bf163aae5b8830e2a7231d9a968d2c10d8e2c51d1","observation_id":"47b0d489-c94f-45a7-955e-f63e5af53786","resolution":{"observed_at":"2026-08-01T17:12:33.314659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:33.442558Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:33.442558Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:79a2923b70b57bad7d3a510d95c35466ebc2955715829f22387ea31fae58745c","observation_id":"13597980-b2fc-4589-86e2-9cbe858d1848","resolution":{"observed_at":"2026-08-01T17:12:33.442558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:33.514064Z","title":"IEEE international conference on neural networks , pages=","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:33.514064Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:24958bf1c0c8e3f1c5b2124dff84abfe68bb36d79aa6bf7547d07ba0401005ba","observation_id":"241dab0e-83f3-4a53-900d-5974b2afe19e","resolution":{"observed_at":"2026-08-01T17:12:33.514064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:33.611359Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:33.611359Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:442f34631cdb5dee1ffdde2627fe49aab63d31faa52c4f909c20575676f147fd","observation_id":"ada5906c-7e26-4b42-85b2-b6f5fd44572a","resolution":{"observed_at":"2026-08-01T17:12:33.611359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:33.714207Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:33.714207Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:49c7b108794a6b214e7d0b35c6eb913562fd0b1f036da07d769a10ec9f7ebc90","observation_id":"b4da7d07-508c-4ae8-9598-85399e46d19d","resolution":{"observed_at":"2026-08-01T17:12:33.714207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.07259","last_updated":"2022-10-17T23:24:22Z","snapshot_observed_at":"2026-08-19T11:06:08.255035Z","submitted_at":"2022-03-14T16:40:31Z","title":"The Optimal BERT Surgeon: Scalable and Accurate Second-Order Pruning for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.07259","snapshot_observed_at":"2026-08-01T17:12:33.850789Z","title":"arXiv preprint arXiv:2203.07259 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:33.850789Z"},"links":{"cited_paper":"/paper/2203.07259","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:efbe879362bdb32a1e58d8d42dc1f83216bcd50d36a8fe8e8a65bdf55858af9e","observation_id":"3d797cb1-e33a-4b9f-96dc-1652136e8d05","resolution":{"observed_at":"2026-08-01T17:12:33.850789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v33i01.33015676","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Thirty-Third","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"75048900-c3d7-48ac-8850-6ea1f0bd2b24","year":2019},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:33.984135Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:aee3295477ea09ae7696947db4beb4b28618d8f4b8af14d610c6f3e4cdc841fc","observation_id":"8746ab1d-cedf-43d5-99ce-89b99cd35aa2","resolution":{"observed_at":"2026-08-01T17:14:13.147953Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:34.100741Z","title":"Accelerator-Aware Pruning for Convolutional Neural Networks , journal =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:34.100741Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:cf045dc3801da7031d9e3d047c61422f2fddbf913a4297101bb7c59bc8f1d4b1","observation_id":"373a98bd-fdc6-4aaa-b8fa-48ec2557e0fd","resolution":{"observed_at":"2026-08-01T17:12:34.100741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:34.266577Z","title":"Channel Permutations for","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:34.266577Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:b5f914513069ce6c080baeb16672b61a7f06a59aa2d77ed3cc5f89895e2eaa3f","observation_id":"0a810e8b-7652-4b8a-b392-75ac3fbafffb","resolution":{"observed_at":"2026-08-01T17:12:34.266577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:34.408624Z","title":"9th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:34.408624Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:0a59e6ee07128c4394278976681860d6420c4c91c39e166832e640a945f62bac","observation_id":"343f5256-7909-482b-9295-dd4d1bfa9e39","resolution":{"observed_at":"2026-08-01T17:12:34.408624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:34.483305Z","title":"2021 , URL =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:34.483305Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:3d42f6a4cb69e36e69b2be1c7e111b0daf6cce06610bec1387c035bb15cfc17f","observation_id":"745da703-9490-4c08-b19e-4464f14a3ac0","resolution":{"observed_at":"2026-08-01T17:12:34.483305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:34.554232Z","title":"2022 , URL =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:34.554232Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:50cf13dbcab59822df262ec37d0cd275470601cbf3e6a3f892b9b451a5b84a28","observation_id":"4300319b-01b1-4228-b901-88b0544c573f","resolution":{"observed_at":"2026-08-01T17:12:34.554232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:34.637548Z","title":"2020 , URL =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:34.637548Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:b591535e47163c525b7618dc46fe946f1ade0e7078ddf4f33397fff2ce4e444e","observation_id":"70e9241b-bc2c-49aa-9631-a3ed4689380b","resolution":{"observed_at":"2026-08-01T17:12:34.637548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:34.735064Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:34.735064Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:a1086cd53abea64a7a5e35860170cba7dd6d8f6e910aadc0c8a672b463cb013b","observation_id":"bd403b5e-f19f-4d4a-b375-b4a06b601831","resolution":{"observed_at":"2026-08-01T17:12:34.735064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:34.815551Z","title":"Accelerated Sparse Neural Training:","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:34.815551Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:b9f49c3cb60c5790d2a425ffb0fc67587f4991907a9bbd01be4531a227780113","observation_id":"c0e05e7b-dd3a-45d1-a6a1-b47c56e23fbe","resolution":{"observed_at":"2026-08-01T17:12:34.815551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:34.917531Z","title":"International Conference on Machine Learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:34.917531Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:a486229135509e14f53e6a6cb81660a9693a7c6231b85c439c95b3820e821230","observation_id":"a0aa4e79-4833-4aff-b50c-ded34aa84d66","resolution":{"observed_at":"2026-08-01T17:12:34.917531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10737","last_updated":"2024-05-31T14:47:25Z","snapshot_observed_at":"2026-08-16T16:14:52.717690Z","submitted_at":"2022-11-19T16:17:11Z","title":"Accuracy Booster: Enabling 4-bit Fixed-point Arithmetic for DNN Training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10737","snapshot_observed_at":"2026-08-01T17:12:34.994910Z","title":"arXiv preprint arXiv:2211.10737 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:34.994910Z"},"links":{"cited_paper":"/paper/2211.10737","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:3c977627232f41a6f641208344119872663f0109586fd3d444bb5a9338a8f7a1","observation_id":"867f4a22-91d2-41b7-859e-50d858f61792","resolution":{"observed_at":"2026-08-01T17:12:34.994910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:35.100065Z","title":"Proceedings of the 37th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:35.100065Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:d01c21408ef30aadbe4b670be01e4b87236a90ccdabd5b01f69430d12701f73d","observation_id":"c9560cc0-c5e4-4a2c-a9ac-65191242fae9","resolution":{"observed_at":"2026-08-01T17:12:35.100065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:35.176718Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:35.176718Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:9ec5707af3c94f163d09ebbfbd4b9cdb3d31424ecd593a6bfff25b62c230398f","observation_id":"4b85aa1d-4cae-4590-9534-acc867ec750c","resolution":{"observed_at":"2026-08-01T17:12:35.176718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:35.291683Z","title":"Proceedings of Machine Learning and Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:35.291683Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:b350648f38f9f923fb64323b1f2ba82ab3c42aa64a57d5533211bf9187bc88ae","observation_id":"61014f32-1bc1-48f0-8eb1-7ab69133c344","resolution":{"observed_at":"2026-08-01T17:12:35.291683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:35.375508Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:35.375508Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:acf9b38b9515763186576e26eb9e036d5156726c31142986f3eab098ec61f0e2","observation_id":"07bcc682-d597-4f52-b2f9-1927492a6882","resolution":{"observed_at":"2026-08-01T17:12:35.375508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:35.476974Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:35.476974Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:584a06d661e70caa9fabcc2e910d4101b409f50831a3b28a453862c111bec4e2","observation_id":"69adbd2e-2e04-4f3a-a401-c2f24fb86b1b","resolution":{"observed_at":"2026-08-01T17:12:35.476974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:35.582690Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:35.582690Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:844ef654ae922ca6c8813f33e3b6462bf7371f91a2724ff951d44a547abf3871","observation_id":"4e17c489-6900-4efc-816d-db83e14640d2","resolution":{"observed_at":"2026-08-01T17:12:35.582690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08520","last_updated":"2023-09-15T16:29:27Z","snapshot_observed_at":"2026-08-16T15:00:21.058158Z","submitted_at":"2023-09-15T16:29:27Z","title":"Scaling Laws for Sparsely-Connected Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08520","snapshot_observed_at":"2026-08-01T17:12:35.695223Z","title":"arXiv preprint arXiv:2309.08520 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:35.695223Z"},"links":{"cited_paper":"/paper/2309.08520","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:458f965265049cf9ff1bc24fdac087687cce882bb7786058ef23cc70f53884fc","observation_id":"b58cbc9d-c761-451e-aa26-f54b78697daf","resolution":{"observed_at":"2026-08-01T17:12:35.695223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07617","last_updated":"2022-09-15T21:30:55Z","snapshot_observed_at":"2026-08-16T16:32:09.617185Z","submitted_at":"2022-09-15T21:30:55Z","title":"Training Recipe for N:M Structured Sparsity with Decaying Pruning Mask","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07617","snapshot_observed_at":"2026-08-01T17:12:35.769810Z","title":"arXiv preprint arXiv:2209.07617 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:35.769810Z"},"links":{"cited_paper":"/paper/2209.07617","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:6848216caae914976b78ea80a93bcbde5390ce17cb08526bd67d0d4565faf9c8","observation_id":"98c21efa-e11d-4d5b-aa82-16d3e1bf8ecc","resolution":{"observed_at":"2026-08-01T17:12:35.769810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02299","last_updated":"2024-02-21T23:31:49Z","snapshot_observed_at":"2026-08-16T15:35:53.866544Z","submitted_at":"2023-05-03T17:48:55Z","title":"Dynamic Sparse Training with Structured Sparsity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02299","snapshot_observed_at":"2026-08-01T17:12:35.883139Z","title":"arXiv preprint arXiv:2305.02299 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:35.883139Z"},"links":{"cited_paper":"/paper/2305.02299","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:d272c63274b05403352dc4efa6d7c7e61c0be31c889de4d3601972e2d37bf57c","observation_id":"ebd3c216-b495-4a92-bb44-6cd0934186f0","resolution":{"observed_at":"2026-08-01T17:12:35.883139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:35.977544Z","title":"Efficient Processing of Deep Neural Networks , series =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:35.977544Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:2c64381d407e357ced2ef17bced5ceda48b7f001ca907d5999d8d7cac38a4a05","observation_id":"f7af72ee-4284-4e6a-81e0-01d3a8ee0427","resolution":{"observed_at":"2026-08-01T17:12:35.977544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:36.026630Z","title":"7th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:36.026630Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:14d349be25eb57c86bca51b256c9126e38d11f1101228350681e3aaeb275eb5f","observation_id":"ab0625bd-c4f3-4105-b3b6-67e5e2ef27ef","resolution":{"observed_at":"2026-08-01T17:12:36.026630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:36.065756Z","title":"Intelligent Computing: Proceedings of the 2021 Computing Conference, Volume 3 , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:36.065756Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:7f1d5751f33b50962fe86d89940d8c32d6be128fe183e32e2e7a8df30fc57d53","observation_id":"cd48744e-1df3-435f-984b-5707532ed539","resolution":{"observed_at":"2026-08-01T17:12:36.065756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:36.119748Z","title":"Proceedings of the 37th International Conference on Machine Learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:36.119748Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:952ec835840587d2612fe2c0f589176f885b657991dcdbf639c78f7d8babe661","observation_id":"27dbc204-fc95-4273-8515-b26b13b2a05c","resolution":{"observed_at":"2026-08-01T17:12:36.119748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08553","last_updated":"2024-01-16T05:13:37Z","snapshot_observed_at":"2026-08-19T13:30:11.928158Z","submitted_at":"2023-12-13T22:53:54Z","title":"USM-Lite: Quantization and Sparsity Aware Fine-tuning for Speech Recognition with Universal Speech Models","version":3},"cited_work":{"arxiv_id":"2312.08553","doi":"10.48550/arxiv.2312.08553","metadata_source":"pith","pith_arxiv_id":"2312.08553","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"USM-Lite: Quantization and Sparsity Aware Fine-tuning for Speech Recognition with Universal Speech Models","venue":"eess.AS","work_id":"b0cda842-80f8-42de-bb74-2a8aa5831c08","year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:36.198632Z"},"links":{"cited_paper":"/paper/2312.08553","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:e9e4770c8d696e301173afafa37cbaa6f8d98633ea20d43341f74f755652b641","observation_id":"02e80b84-3ca6-4e61-a0fd-1b9befb9d992","resolution":{"observed_at":"2026-08-01T17:14:12.531140Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04744","last_updated":"2024-02-07T10:55:59Z","snapshot_observed_at":"2026-08-16T14:20:40.555782Z","submitted_at":"2024-02-07T10:55:59Z","title":"Progressive Gradient Flow for Robust N:M Sparsity Training in Transformers","version":1},"cited_work":{"arxiv_id":"2402.04744","doi":"10.48550/arxiv.2402.04744","metadata_source":"pith","pith_arxiv_id":"2402.04744","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Progressive Gradient Flow for Robust N:M Sparsity Training in Transformers","venue":"cs.LG","work_id":"2b281e01-adab-4726-a1c4-1b4bf54a5732","year":2024},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:36.315756Z"},"links":{"cited_paper":"/paper/2402.04744","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:a810319af01e64d8ac127924107e0a868867e6c8e3587f0f62966094447b05f0","observation_id":"0798e960-4843-403a-afec-510fafde30f7","resolution":{"observed_at":"2026-08-01T17:14:12.239179Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:36.476138Z","title":"Pixelated Butterfly: Simple and Efficient Sparse training for Neural Network Models , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:36.476138Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:302222e7bb713af30a3c422233e044f5b0da525002cd89f5a15c5d6d00baf280","observation_id":"8fb65693-9341-4d79-b5e9-98c056c4a409","resolution":{"observed_at":"2026-08-01T17:12:36.476138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:36.636279Z","title":"Prune and Tune: Improving Efficient Pruning Techniques for Massive Language Models , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:36.636279Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:f1f70205736d55c9c3470a2837cac5b8a2c4f05ca312d4181f3e6023b537ff6e","observation_id":"6d56828e-22be-413d-8a7f-eeddc0f13cef","resolution":{"observed_at":"2026-08-01T17:12:36.636279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:12:36.735369Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:36.735369Z"},"links":{"citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:09578c4e4260d61c696494ba4c9065d42997c8189fc9fa7ab60dd229d17a57c4","observation_id":"d2938dbe-005b-49dc-80d4-389d659c0a9c","resolution":{"observed_at":"2026-08-01T17:12:36.735369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-01T17:12:36.742446Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:36.742446Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:0d0d35b0d7d6fa3da96f1680c191e86b0cdb5b328608079649f54872a75b868f","observation_id":"e7cdbae7-6958-43f1-9bb5-4bc88e2f5aeb","resolution":{"observed_at":"2026-08-01T17:12:36.742446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-01T17:12:36.861472Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:36.861472Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:8fa758231d17fa15f9e005d34bbbbc51159190e1319fdd0590ab8418de1f284f","observation_id":"1ee4cc51-b346-419c-9899-a56708e9e1ce","resolution":{"observed_at":"2026-08-01T17:12:36.861472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16867","snapshot_observed_at":"2026-08-01T17:12:37.076833Z","title":"The Falcon Series of Open Language Models , journal =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:37.076833Z"},"links":{"cited_paper":"/paper/2311.16867","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:48c7c13f7872ace5fe108d674f11ae41d1999472768d2938bc64dcb58d54c966","observation_id":"46bde947-e50b-46bc-adf8-7158ecdea99a","resolution":{"observed_at":"2026-08-01T17:12:37.076833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-01T17:12:37.200752Z","title":"Gemma: Open Models Based on Gemini Research and Technology , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:37.200752Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:545654c8107a06766821650222c95209410dee6a3b54ca4ec345022e69aeed16","observation_id":"5e3f08f2-4f8f-4a72-9a3e-13b8900b7457","resolution":{"observed_at":"2026-08-01T17:12:37.200752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-16T14:04:57.666315Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-01T17:12:37.341730Z","title":"Croci and Bo Li and Martin Jaggi and Dan Alistarh and Torsten Hoefler and James Hensman , title =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:37.341730Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:bb723aaad538f74a65d79f871591e493e93cec3c78c74717af871400181d57dc","observation_id":"d329632a-b6e8-47b3-8adb-85009046346e","resolution":{"observed_at":"2026-08-01T17:12:37.341730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-01T17:12:37.492741Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:37.492741Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:490fb72b7574fdf61597f305a82f22f8e937f34eba230acabfcdc02038aa888d","observation_id":"c28d77a2-3c32-42fd-8617-a38ec0732f0a","resolution":{"observed_at":"2026-08-01T17:12:37.492741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":96,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":136},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 100 of 136 outbound references and 0 inbound Pith citation observations for arXiv:2607.17733."}