{"as_of":"2026-08-09T00:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d08ef87845ca1384c5af7a8c04eac79ea731f42343964a2898172d1b302877b6","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:57:56.534215Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.09616/citation-record","integrity":"/paper/2507.09616/integrity","json":"/paper/2507.09616/citation-record.json","paper":"/paper/2507.09616"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:06.338705Z","title":"Quantizable transformers: Removing outliers by helping attention heads do nothing","venue":null,"work_id":"ae2ab058-d707-442b-9dcb-6441e09d7763","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.017870Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:01c78234f78a55959ef49d4aabd72c534ef795ba431cf98c180749b66312f552","observation_id":"2bc49f04-be9f-4097-9f02-39c10022f363","resolution":{"observed_at":"2026-08-06T17:58:06.384533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:06.236999Z","title":"Cascade r-cnn: Delving into high quality object detection","venue":null,"work_id":"9e0c85c9-f927-4153-9d54-a04737a1b199","year":2018},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.144100Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:6fe09e9c47d8a2374fdd12cb4475d8e8f0de42b319e4faf0c3caf7fcf543994f","observation_id":"0c5ce7f7-090c-458d-9910-b2b4bd63a6a3","resolution":{"observed_at":"2026-08-06T17:58:06.284599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:06.123833Z","title":"End- to-end object detection with transformers","venue":null,"work_id":"3b99ec13-6089-4d0b-bbdb-a5c3056e71e6","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.281768Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:38145eb66001106aad9a05d7b6747bf2dd2eb4bdfbd626a45d139f0d46fe5fef","observation_id":"9326d636-c85b-4cc5-813d-b1cd8c2a3cfe","resolution":{"observed_at":"2026-08-06T17:58:06.176376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:06.026211Z","title":"Exploiting linear structure within con- Figure 5","venue":null,"work_id":"8667d97a-6592-46fd-b0c0-23af88e76931","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.426936Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:2ed85315de7e5cf4781422ea4557658f3731d1c468e9b8471c70607b910506b4","observation_id":"7a00937a-41ef-4055-8c5b-71dd34bef84a","resolution":{"observed_at":"2026-08-06T17:58:06.064657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.902660Z","title":"BERT: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":"da907ff2-c24d-4737-95b6-6ed3e5499d23","year":2019},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.562141Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:1e07e34944177aa8ffb9d2e0d304afe084d1997bb1e60d53457c15702ae6cbbf","observation_id":"e67f56a4-1935-4fe0-8550-e3283bbfbebe","resolution":{"observed_at":"2026-08-06T17:58:05.969884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.773559Z","title":"Towards accurate post- training quantization for vision transformer","venue":null,"work_id":"8f5a6223-b252-4244-84f5-848cf0ff59e1","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.715559Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:b3f1ec41c56fb9ee3fb60bbda093593556bd69656418e2b6c0d1bf5da65e113f","observation_id":"190e6d5b-0e05-40fe-979d-fd3e50e3ade3","resolution":{"observed_at":"2026-08-06T17:58:05.829161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.640134Z","title":"Learning to prune deep neural networks via layer-wise optimal brain surgeon","venue":null,"work_id":"3a199f61-844f-4897-9963-8f7afea9fb53","year":2017},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.810229Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:794ca9177d5b25994d5bc3da8a7d82b33a3d60cf0bd6b7dd82831df6104cb0b9","observation_id":"48693c59-6409-4a9f-a27a-1411bcf7f460","resolution":{"observed_at":"2026-08-06T17:58:05.705454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.511668Z","title":"HAWQ: Hessian aware quanti- zation of neural networks with mixed-precision","venue":null,"work_id":"cf86c5f1-c070-4f14-becf-773cf9a20220","year":2019},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:50.944594Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:3b0e17a43a44e12b8aa39846f5e1aacfabb2aaf231d2d474f2f6340e344b3322","observation_id":"958ba43a-f6a8-4a85-8cfb-3c94deb429b0","resolution":{"observed_at":"2026-08-06T17:58:05.575397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.371549Z","title":"Hawq-v2: Hessian aware trace-weighted quantization of neural networks","venue":null,"work_id":"c3f65e71-8b43-4dc2-8efd-d4cc770c4b8e","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.053499Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:feb1425b47aa0ebcc1a5f55c461463e3f442f3842cbb090cf2736e396492de2e","observation_id":"57f3748d-df36-4c3d-8527-bed830b13691","resolution":{"observed_at":"2026-08-06T17:58:05.431140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:51.124268Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.124268Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:20f19d08a8a0f6a4fcdb581484eac3099f70866c97b30ed9385109da81002fa6","observation_id":"fa2cd620-6067-4fc5-91cb-b7807f281cd6","resolution":{"observed_at":"2026-08-06T17:57:51.124268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:05.183449Z","title":"Optq: Accurate quantization for generative pre- trained transformers","venue":null,"work_id":"414d2b52-4bbc-45a1-b405-64c28eed7ce6","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.206626Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:10a75c4b1bfe3ffbfda6fe5fe5475088f16fe6f246cf0ff07c1fb41e82a802c7","observation_id":"64a35166-2df6-4c9b-afab-7c78372ca436","resolution":{"observed_at":"2026-08-06T17:58:05.269845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.971821Z","title":"A survey of quan- tization methods for efficient neural network inference","venue":null,"work_id":"70e38075-1e05-4fd7-8ba6-35279a2ca84b","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.295431Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:e345289f6b2155d7b17d4c15bf6448f34f1b89b6c8cb6425797aa0d66dcc1a52","observation_id":"73094ec3-5b3a-495d-9803-4af694c41b65","resolution":{"observed_at":"2026-08-06T17:58:05.063758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.777387Z","title":"Singular value decom- position and least squares solutions","venue":null,"work_id":"603e7a24-5314-4a61-83d5-922460837c41","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.339408Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:ce0cd05b718724561ce2a60ae14037b0a18b07516b18bfe35e953cc13dd3d994","observation_id":"f52a7b5c-5e36-4d3e-9435-32d12bae03e9","resolution":{"observed_at":"2026-08-06T17:58:04.868990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11531","last_updated":"2024-09-26T08:20:59Z","snapshot_observed_at":"2026-07-06T16:21:25.401345Z","submitted_at":"2023-09-20T10:50:28Z","title":"EPTQ: Enhanced Post-Training Quantization via Hessian-guided Network-wise Optimization","version":2},"cited_work":{"arxiv_id":"2309.11531","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.11531","snapshot_observed_at":"2026-08-06T17:57:56.792536Z","title":"EPTQ: Enhanced Post-Training Quantization via Hessian-guided Network-wise Optimization","venue":"cs.CV","work_id":"23629fdb-f93e-4cfa-8d98-ee5b2ba18278","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.387831Z"},"links":{"cited_paper":"/paper/2309.11531","citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:59a67426c536d8778d1c546fbd7e842762f68b57e078266381f273f24f686f98","observation_id":"aee0837f-f3ce-4821-8899-d3924f327830","resolution":{"observed_at":"2026-08-06T17:57:56.827309Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.551433Z","title":"Olive: Accelerating large language models via hardware- friendly outlier-victim pair quantization","venue":null,"work_id":"f2637f7a-7988-4b12-949d-e85982d3ce8a","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.474326Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:7b1c2bbe2f87b8122ed6a4bb104b5b1b7267bf11d2649c0c4bbe3e28f5952061","observation_id":"36c91d7c-9a7c-413b-a847-d9c05395f839","resolution":{"observed_at":"2026-08-06T17:58:04.645246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.378079Z","title":"Hmq: Hardware friendly mixed precision quantization block for cnns","venue":null,"work_id":"d10472f3-7e6e-4dcc-bf3a-167401c11d40","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.528619Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:63741b65810b7137712beb495ec5b7a88c4d64a526d165139fa1c430236626a4","observation_id":"c914f25d-cd06-4598-a5a4-98ee54a32c64","resolution":{"observed_at":"2026-08-06T17:58:04.453842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.155784Z","title":"Mask r-cnn","venue":null,"work_id":"ca6a10ba-6060-40ee-bae5-551451697d00","year":2017},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.633761Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:c285a86ce7fdd0e36f59294702119a2cc429249a2d2520cf0657b1df6ed6f40f","observation_id":"ac2d280a-cd6d-4979-a965-d301c465f464","resolution":{"observed_at":"2026-08-06T17:58:04.266133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:04.015562Z","title":"Language model compression with weighted low-rank factorization","venue":null,"work_id":"334fc3f7-28dc-4304-8c71-4bea84f4f5d4","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.788553Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:5091b6bc0f9bb5fd32a803a63b4759909702d143077170d3c28be332b89f77d7","observation_id":"32d873e1-3e27-423a-9a6d-411b5f006b52","resolution":{"observed_at":"2026-08-06T17:58:04.079484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:03.833069Z","title":"Numerical optimizations for weighted low-rank estimation on language models","venue":null,"work_id":"be712633-7852-42b9-b581-8d90510e367c","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:51.953461Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:d5667c03684700845fa8df3be03cbff43bb31eb327ba5f3847c44c04ddc77853","observation_id":"39f645b2-7ac0-4a62-98c3-ea5d1ee93da3","resolution":{"observed_at":"2026-08-06T17:58:03.921822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:03.616051Z","title":"Dynamic low-rank estimation for transformer-based language models","venue":null,"work_id":"d208aee1-7c0c-4ca7-a922-0ac4cea5a8aa","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.120876Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:dcfdc33ced88b949d5398229dec65d6899c1086734342d311b6abb816b843f2e","observation_id":"0448a017-fb27-40df-9611-0a6c3d38faf3","resolution":{"observed_at":"2026-08-06T17:58:03.712370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:03.414087Z","title":"Complexity-aware layer-wise mixed-precision schemes with sqnr-based fast analysis","venue":null,"work_id":"f5e94995-3428-40ef-9c50-58bdad600170","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.324037Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:b3fd7293bbdb514427f1e708f42bbe1c4b3987cdeae7fccd5d4b35e6bdf775e1","observation_id":"ebac63af-5b36-4e9c-b38e-198274b1891f","resolution":{"observed_at":"2026-08-06T17:58:03.517582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:03.171110Z","title":"One-shot model for mixed-precision quantization","venue":null,"work_id":"296959b2-5b41-40f7-84f9-910fcb5c3454","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.549888Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:2da475ae87579641b1d7bfc4741156195fca30075a481217a48517ec867e314b","observation_id":"382876d7-e880-4ab3-aff7-36302f816d8c","resolution":{"observed_at":"2026-08-06T17:58:03.281557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08342","last_updated":"2018-06-21T17:32:46Z","snapshot_observed_at":"2026-07-06T06:46:08.396066Z","submitted_at":"2018-06-21T17:32:46Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.08342","snapshot_observed_at":"2026-08-06T17:57:52.684694Z","title":"Quantizing deep convolu- tional networks for efficient inference: A whitepaper","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.684694Z"},"links":{"cited_paper":"/paper/1806.08342","citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:70a5a4051f5066d922f9aca1f918018f95076317c4015221ef04ed937eaeaf5a","observation_id":"54039bf7-20e5-41cf-afcb-e7c704a9eee1","resolution":{"observed_at":"2026-08-06T17:57:52.684694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:02.946076Z","title":"BRECQ: Push- ing the limit of post-training quantization by block recon- struction","venue":null,"work_id":"1767d871-871d-4b0a-9b6d-b3e757ccb37d","year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.818505Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:b676674793dce3605ea63afe47101a96f18e0f449ea2b8f10d860953f060792f","observation_id":"1f900107-0a20-4326-bc67-9dccb6816bf3","resolution":{"observed_at":"2026-08-06T17:58:03.051677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:02.695854Z","title":"Repq- vit: Scale reparameterization for post-training quantization of vision transformers","venue":null,"work_id":"b17667ba-8f47-4712-82fc-9c62022ac65a","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:52.939727Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:e15e14ae4127dad4feb4a38eda27bd1b48b5dea141d6efdf82af180e59c92a47","observation_id":"6f39fbbe-d068-4470-9e6f-d9ef8cba5cbc","resolution":{"observed_at":"2026-08-06T17:58:02.793116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:02.419866Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"db3dbcd7-d51f-48f9-addc-5e4a29f3d107","year":2014},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.053200Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:07f0d4f71123baf2ae713e61d9101f2a0a641bd12ecbabced8c5d09522fd1eee","observation_id":"c507d71a-5f93-4c64-bd26-0fb45e1492c2","resolution":{"observed_at":"2026-08-06T17:58:02.553252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:02.184845Z","title":"Pd-quant: Post-training quantiza- tion based on prediction difference metric","venue":null,"work_id":"c6cd27d9-a44c-445b-8a17-fd7d3b998b77","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.165222Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:0fcffa1653845a893c61e587f8b306e42a850796329d33cd75ca4f45bef43a15","observation_id":"aac99d73-7ae5-4bca-bb7d-41c860aa9826","resolution":{"observed_at":"2026-08-06T17:58:02.313589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:01.972090Z","title":"Noisyquant: Noisy bias-enhanced post-training activation quantization for vision transformers","venue":null,"work_id":"e862bcae-d210-4cf1-8da1-389546b705d8","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.275481Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:529677a9718f66d6cb548e06be65c97366322978a791ba75855d92473d3dff01","observation_id":"bacca9d1-8b7f-44a7-86b9-a2f4a86732ee","resolution":{"observed_at":"2026-08-06T17:58:02.078957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:53.397077Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.397077Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:45842dfa5eccb7c13724454a63851e304174fee04b6e26ec67d1c0d8a62290ae","observation_id":"d62957ab-4ac3-4c87-911c-c447cc661860","resolution":{"observed_at":"2026-08-06T17:57:53.397077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:01.697765Z","title":"Post-training quantization for vision trans- former","venue":null,"work_id":"c36511bf-7f45-43da-bba1-5ec021adf398","year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.533342Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:0d7c2baa25fb434168c00dad5ecb97fd471c0ac67a58af5e6ba015ba93c8d167","observation_id":"1c9a2afb-5b33-47d1-bcbe-552392358879","resolution":{"observed_at":"2026-08-06T17:58:01.849974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:01.487898Z","title":"Up or down? adap- tive rounding for post-training quantization","venue":null,"work_id":"0d67fd18-5faf-4fe4-a7d0-4fe5b1557fa7","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.613022Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:e541c7c57d75021f7c449c3a488197e8ddf79ca7800dec1e99d638614fb96c8c","observation_id":"74a35830-6ca5-4b25-b38c-ab1ab28dc51b","resolution":{"observed_at":"2026-08-06T17:58:01.580827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:01.281697Z","title":"Loss aware post-training quantization","venue":null,"work_id":"ca3a84bf-d5a7-4647-b7e3-1a72be90dbcc","year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.709871Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:f855693cad4cfc9f130645b9f509542fdae5e19d195f4bd572ff60e0779cac78","observation_id":"fff28c53-f68b-4c13-b4b4-1910bd97dd2d","resolution":{"observed_at":"2026-08-06T17:58:01.381740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:01.053116Z","title":"Compressing pre- trained language models by matrix decomposition","venue":null,"work_id":"424503b6-fce6-413e-abf0-ea625ee2a503","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.828878Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:29836837373c581811a9183cbba1ccd56f44ad0fdf04cf282e40f3545651573d","observation_id":"e5982f35-10c0-4f11-8981-2fc841a11360","resolution":{"observed_at":"2026-08-06T17:58:01.148711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05397","last_updated":"2023-02-10T17:47:54Z","snapshot_observed_at":"2026-08-02T22:31:22.531484Z","submitted_at":"2023-02-10T17:47:54Z","title":"A Practical Mixed Precision Algorithm for Post-Training Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05397","snapshot_observed_at":"2026-08-06T17:57:53.969669Z","title":"A practi- cal mixed precision algorithm for post-training quantization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:53.969669Z"},"links":{"cited_paper":"/paper/2302.05397","citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:24deb78f33b4241c9749189fc9e159bdef81ca05226151ca6f449a0e5c8667bb","observation_id":"c5fdc61c-1b55-40d7-859e-15b32cd48c45","resolution":{"observed_at":"2026-08-06T17:57:53.969669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:00.843749Z","title":"OR-Tools, 2024","venue":null,"work_id":"b823c908-2b09-4d1f-a5d3-733b87522588","year":2024},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.063780Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:7291680e04864114086371cb780018f60d8a868a30dc3930821258dce9ed0de7","observation_id":"9bbc7b22-1a39-4f60-8bc8-5984b830a58a","resolution":{"observed_at":"2026-08-06T17:58:00.959998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:00.562971Z","title":"Probabilistic weather forecasting with machine learn- ing","venue":null,"work_id":"c54c5a69-5f8d-44fd-8cf2-b20afae40668","year":2025},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.203549Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:6e639ad8e23399114a5794d32c2f42e5ce2c0fd9ca6aa3d8bfcc8927a3a035da","observation_id":"d19a2c72-0439-46c6-8303-b0c1afe3200f","resolution":{"observed_at":"2026-08-06T17:58:00.666490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11243","last_updated":"2024-01-20T14:53:19Z","snapshot_observed_at":"2026-07-06T17:18:16.042313Z","submitted_at":"2024-01-20T14:53:19Z","title":"LRP-QViT: Mixed-Precision Vision Transformer Quantization via Layer-wise Relevance Propagation","version":1},"cited_work":{"arxiv_id":"2401.11243","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.11243","snapshot_observed_at":"2026-08-06T17:57:56.654489Z","title":"LRP-QViT: Mixed-Precision Vision Transformer Quantization via Layer-wise Relevance Propagation","venue":"cs.CV","work_id":"83a91b21-d702-41db-bda8-0aaf31d954cd","year":2024},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.290497Z"},"links":{"cited_paper":"/paper/2401.11243","citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:531e295630afdc80a9bcfa3b8e123812ba35b028f92376fbd4d0815cd553e24f","observation_id":"0d0868c1-65fa-4f00-9701-aedebac066f1","resolution":{"observed_at":"2026-08-06T17:57:56.720638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:00.352858Z","title":null,"venue":null,"work_id":"a2f0ec9b-3217-4a93-b159-9941aae62eb6","year":2024},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.375429Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:32fb3d7e1937c8d2c4976c7947be72f059c9716089580f3a0ece6b965d1468e2","observation_id":"9ca63a41-4de8-4c51-88e8-bf818884d5b8","resolution":{"observed_at":"2026-08-06T17:58:00.448331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:58:00.171122Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":"294594b5-e998-4ee4-a450-f3c9e3428b09","year":2015},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.540170Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:5b98ae22ac5e0fb6084235b7efe9f9e744557b1d64d75627a3b3f30049419cac","observation_id":"49b5519a-de36-4d59-b68e-d34d044c106b","resolution":{"observed_at":"2026-08-06T17:58:00.245672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:59.959512Z","title":"Weighted low-rank ap- proximations","venue":null,"work_id":"92544bcf-e8a8-4595-a6db-66b8bb7d7d5a","year":2003},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.640071Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:ae1857c7e724752be7545d26cdefc0b5c8d4f1f5178b22be82c4f53c5370a3fc","observation_id":"70ecd6f7-61ec-47e7-a7a7-5da3642b4412","resolution":{"observed_at":"2026-08-06T17:58:00.081230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:59.737832Z","title":"Amp-vit: Optimizing vision transformer efficiency with adaptive mixed-precision post- training quantization","venue":null,"work_id":"cb9de30e-e759-4a7b-8cc3-99956b86a83e","year":2025},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.770745Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:562abadc8ae1cac4b20a146f2d3586856dbafd4b5a206ecc86ec0c60bdcb100e","observation_id":"5032eb93-9e85-449b-9433-d1dae40c3a14","resolution":{"observed_at":"2026-08-06T17:57:59.840379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:59.534875Z","title":"Training data-efficient image transformers & distillation through at- tention","venue":null,"work_id":"2612d620-7380-43cb-8f46-66b6f4506a72","year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:54.917890Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:5bdec1b39b6215beb9ec406c0472963e6eda5e3219e3428a48562a2ddc47f9d6","observation_id":"c8ea6b4a-5643-49dd-96ab-7fc658e480e8","resolution":{"observed_at":"2026-08-06T17:57:59.616398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:59.292403Z","title":"Mixed precision dnns: All you need is a good parametrization","venue":null,"work_id":"82122de0-58bd-4e39-bd87-88fd84b9df14","year":2020},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.014542Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:f64b5cf00b75713b1a00f577f8f4741d06ff5d8b406690c060e38dfb56342f8b","observation_id":"08666285-f918-469f-b094-d2b8fe7d9d1f","resolution":{"observed_at":"2026-08-06T17:57:59.390554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:59.099133Z","title":"Attention is all you need","venue":null,"work_id":"bb21c1dc-1454-40e3-836a-7a8041b1f762","year":2017},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.157253Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:c53eff544cd554e0df35357b9a855cbc88d256f294a54349c0fdb9c86085dd0f","observation_id":"8e237831-8e26-44ca-9827-746bab21e338","resolution":{"observed_at":"2026-08-06T17:57:59.200386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:58.915957Z","title":"GLUE: A multi-task benchmark and analysis platform for natural language un- derstanding","venue":null,"work_id":"d21842c9-d96d-4f1f-8ffc-51608feb402b","year":2018},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.309559Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:997b59828ed50f8032b80074cc99550bc511135cca4c4cef80a3159f20889579","observation_id":"96e3aa5b-7408-46e7-9fbc-1c95f1565a17","resolution":{"observed_at":"2026-08-06T17:57:59.016518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:58.729119Z","title":"SVD- LLM: Truncation-aware singular value decomposition for large language model compression","venue":null,"work_id":"9a8ba179-9d93-4b86-a5e0-68ebd4c5d0c8","year":2025},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.446429Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:3117fb96af2d9ce59b5cef2f12005e22a3e245b5c28968939bd9a8b59201d99f","observation_id":"4bdfa9e1-909f-4ab1-83f6-219fd590df1c","resolution":{"observed_at":"2026-08-06T17:57:58.825439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:58.569989Z","title":"QDrop: Randomly dropping quantization for extremely low-bit post-training quantization","venue":null,"work_id":"eaedc476-8e60-4e4b-be70-ae9b566b015d","year":2021},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.544210Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:6e1506ff7bbb7375ab5cef81f1c33cabc8cf9d37544e6c30fa9a75ff7a712b0b","observation_id":"5b2ab7ce-4735-4351-88e7-d83d18b9594c","resolution":{"observed_at":"2026-08-06T17:57:58.651727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:58.347592Z","title":"Outlier sup- pression+: Accurate quantization of large language models by equivalent and effective shifting and scaling","venue":null,"work_id":"d44cd16e-03ba-4db2-b736-df10bfe58426","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.639793Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:addd6cf4f78bba8b830518433fc4429444da097d69ef14836fe55e570293e6bd","observation_id":"4ed7f6cc-a8a6-43c8-93f4-ae97fdf5d9cd","resolution":{"observed_at":"2026-08-06T17:57:58.457105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:58.171371Z","title":"Pytorch image models","venue":null,"work_id":"8b96b1e2-4b48-48fa-a39a-0c396d26451e","year":2019},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.738099Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:4aedd27516892b262d205ee9aa24d52a01d86d778adfdaad5ce9c1c32183f431","observation_id":"5a8a6135-5aab-40c2-97bc-7edc411f9246","resolution":{"observed_at":"2026-08-06T17:57:58.272363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.950784Z","title":"Smoothquant: Accurate and ef- ficient post-training quantization for large language models","venue":null,"work_id":"f4372485-c78c-41b5-97b5-e2de506ba0d7","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.829339Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:2ace1e2aa1c2e660adc693dacd93891c4eda7a386ff652f0b666e838f3833b24","observation_id":"9f6189f4-6960-4547-9d46-3948900d1179","resolution":{"observed_at":"2026-08-06T17:57:58.040160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.803156Z","title":"Patch- wise mixed-precision quantization of vision transformer","venue":null,"work_id":"77e7210e-2234-4459-89a4-fe5cdbd628e0","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:55.950578Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:99511a0db9ecc05e370c159e6ac1c05419e2450accbe8e9214ba8122d398bb3b","observation_id":"d25eb928-a8e1-41a0-894f-35d0f4323085","resolution":{"observed_at":"2026-08-06T17:57:57.880135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.598678Z","title":"Efficient low-rank back- propagation for vision transformer adaptation","venue":null,"work_id":"c57c7d4d-66eb-464f-bf4a-dde3a39a6081","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.054469Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:6331add5fe7d2fce213918e196c1fa6d331f9df6800fa6ae6fffed959f387071","observation_id":"7821308a-bc30-4af9-86f6-e092eecc344d","resolution":{"observed_at":"2026-08-06T17:57:57.697143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.449423Z","title":"Compressing transformers: fea- tures are low-rank, but weights are not! In Proceedings of the AAAI Conference on Artificial Intelligence, pages 11007– 11015, 2023","venue":null,"work_id":"363cf89e-a40e-4025-8246-dccf47aec284","year":2023},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.197425Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:0f5f3c15aabeb0a0f6ff1e3a2926aa1564adc8679578d264ad303525e420715e","observation_id":"0e554148-530c-445d-b33c-4374c99b78db","resolution":{"observed_at":"2026-08-06T17:57:57.509909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.298034Z","title":"Hessian- aware pruning and optimal neural implant","venue":null,"work_id":"0ef59738-1ac5-452f-8f1b-9f58db29662c","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.286049Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:8363e3c4a20a11c66b48e65a2f7d631357e87ba7c614ee932561701c19f906ed","observation_id":"bb927ecd-fcb4-44b6-bb32-f4c1bb2e1d36","resolution":{"observed_at":"2026-08-06T17:57:57.378613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.171244Z","title":"Ptq4vit: Post-training quantization for vi- sion transformers with twin uniform quantization","venue":null,"work_id":"49517a97-2a7c-42cf-b970-a1d7df0bfeaf","year":2022},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.343556Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:10694842a9d13351edf652b1bee6df5924beda427c34af9c35873c9055969430","observation_id":"238b163c-1d14-4595-98ff-422a9cbb0e4a","resolution":{"observed_at":"2026-08-06T17:57:57.237453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:57.033059Z","title":"ERQ: Error reduction for post-training quanti- zation of vision transformers","venue":null,"work_id":"8f5e13ee-c624-48dd-a7e2-34ff530eb87c","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.408004Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:bc5fd876fc84bf791c398f7f451208c6aff31d2db5e09213a4754339f0430637","observation_id":"b1a24dbb-21c8-4226-b023-9c8ce00167a9","resolution":{"observed_at":"2026-08-06T17:57:57.082436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:56.889144Z","title":"Towards accurate post-training quantization of vision transformers via error reduction","venue":null,"work_id":"4540706f-8d66-410a-a1bd-9c5ce916755c","year":2025},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.534215Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:8bab355795189e08e03bf3bccf38334699936656c5a624218e75f457098ec84b","observation_id":"4ed5ad3c-5949-4c67-a3bd-10938a35cdfa","resolution":{"observed_at":"2026-08-06T17:57:56.919924Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:56.960260Z","title":null,"venue":null,"work_id":"34f87390-cebb-493a-b918-b560beadb169","year":null},"citing_paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:56.465479Z"},"links":{"citing_paper":"/paper/2507.09616"},"observation_digest":"sha256:f86bcece898c69498dc2bb92e95f8f642496be5e1616bb6e1e7cb2c909a90a5d","observation_id":"4683f16c-5aa0-43ad-9182-afa694e22af2","resolution":{"observed_at":"2026-08-06T17:57:56.991726Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.09616","last_updated":"2025-07-13T12:48:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T17:49:13.856980Z","submitted_at":"2025-07-13T12:48:46Z","title":"MLoRQ: Bridging Low-Rank and Quantization for Transformer Compression"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":49},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2507.09616."}