{"as_of":"2026-08-08T09:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8523a15af6d9594d5e11640a29511253a31cd3229c9a932e72cb66f3e31b794b","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:36:05.850300Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14638/citation-record","integrity":"/paper/2505.14638/integrity","json":"/paper/2505.14638/citation-record.json","paper":"/paper/2505.14638"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1902.08153","last_updated":"2020-05-07T03:30:49Z","snapshot_observed_at":"2026-08-07T23:40:04.424513Z","submitted_at":"2019-02-21T17:31:32Z","title":"Learned Step Size Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.08153","snapshot_observed_at":"2026-08-07T15:36:05.491210Z","title":"Learned step size quantization,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.491210Z"},"links":{"cited_paper":"/paper/1902.08153","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:9132b217fa77473a132b3ce8c0f7e1397f405c67f8fc7d8c7a150b51b171eb4a","observation_id":"236c17b8-9918-47c9-aa7d-3e09aa1d7f80","resolution":{"observed_at":"2026-08-07T15:36:05.491210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:07.074964Z","title":"Ef- fective training of convolutional neural networks with low- bitwidth weights and activations,","venue":null,"work_id":"312d7837-e630-4507-8604-8b3eebe38823","year":2021},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.498781Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:653cae6783c5d51d545fffabed806594d927d8a15ac6a67e03fc3a9dd86feeca","observation_id":"94b1badb-5fc8-4880-ac05-496904854c23","resolution":{"observed_at":"2026-08-07T15:36:07.082662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:07.048406Z","title":"Cluster- promoting quantization with bit-drop for minimizing net- work quantization loss,","venue":null,"work_id":"795d90b1-da76-4658-b7f1-8495ffeb367d","year":2021},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.506094Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:097fddce6f4423bd13935bbe306cbe6edfe5ef9ec74ca5398dae00c7fd5329ce","observation_id":"2c1403f1-ef5d-45e0-9004-6e41e8b4630e","resolution":{"observed_at":"2026-08-07T15:36:07.056103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-07T15:36:05.513839Z","title":"Llm-qat: Data- free quantization aware training for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.513839Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:99b40c77bc168d19e0127c5adc82944771e28f0f860c5e9027dac8d2ab760795","observation_id":"1c5fd896-d33d-4a13-8799-4efc3d93369b","resolution":{"observed_at":"2026-08-07T15:36:05.513839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:07.024097Z","title":"Data-free quantization through weight equalization and bias correction,","venue":null,"work_id":"a5bcbb7e-fb7c-45ac-afda-20dc8b43e863","year":2019},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.520642Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:d91ed82b8cb6b29be9ccb7964c9e101afa9067784f2ca632ead1f945c195402e","observation_id":"89a56030-cdbd-4dc1-94f1-e2a0167bf1b3","resolution":{"observed_at":"2026-08-07T15:36:07.030194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10518","last_updated":"2020-12-14T15:55:05Z","snapshot_observed_at":"2026-08-07T23:40:03.163791Z","submitted_at":"2020-06-14T16:07:55Z","title":"Improving Post Training Neural Quantization: Layer-wise Calibration and Integer Programming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10518","snapshot_observed_at":"2026-08-07T15:36:05.527071Z","title":"Improving post training neural quantization: Layer-wise calibration and integer programming,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.527071Z"},"links":{"cited_paper":"/paper/2006.10518","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:a4f182716b322be0a7d43ef43fe33a57060392151dca33293a40bec2f45c23ff","observation_id":"e0c27305-2a9d-404e-a070-7be9039062a8","resolution":{"observed_at":"2026-08-07T15:36:05.527071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:07.001091Z","title":"Accurate post training quantization with small calibra- tion sets,","venue":null,"work_id":"a298c6ea-78a8-499d-9184-9c487603dcc8","year":2021},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.534639Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:f7cf69bb70a9da7347dd1d2fec2e44d191df65611464d7c64245f954b7aa877a","observation_id":"13814e29-fb9e-4965-9a5a-ca9090c6622c","resolution":{"observed_at":"2026-08-07T15:36:07.009418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.981943Z","title":"Post-training quantization for vision transformer,","venue":null,"work_id":"5475532c-08b5-4af3-927b-9c49b3ce2058","year":2021},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.540267Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:236c0f0a78ae7ffd0c0e114e4670667a638968c597c6319b3764dde326138556","observation_id":"c581bb25-a830-4af4-a641-a331f5e4e420","resolution":{"observed_at":"2026-08-07T15:36:06.987699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.964565Z","title":"Loss aware post-training quantization,","venue":null,"work_id":"455591a0-e504-488d-a15d-a8f845e05e80","year":2021},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.545529Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:c41cc21ed3473cd0d50b157273e2a3eafd9892165d6d8011f127e371c5cae88e","observation_id":"0475f67b-30fc-4443-97e9-829742ba1e62","resolution":{"observed_at":"2026-08-07T15:36:06.970339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.947853Z","title":"Zeroquant: Efficient and affordable post-training quantization for large-scale transformers,","venue":null,"work_id":"5bb8865f-84e0-47cc-9348-a20fa23b064f","year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.551616Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:b2435f5469e8e50dda1451bc1dedb09f1fe29194b9a5dcd4578350a5a75abb01","observation_id":"080915ef-394e-4e00-845d-b555b13a803e","resolution":{"observed_at":"2026-08-07T15:36:06.953361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.930666Z","title":"Up or down? adaptive rounding for post- training quantization,","venue":null,"work_id":"b95a70b1-0a20-463a-8f25-199269cbf29c","year":2020},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.556800Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:db8c8de14db14dae2f4a7fc0c005ef16587843a47fea04ced527526d6b476690","observation_id":"5e6e918e-5112-4acb-8998-657589850c16","resolution":{"observed_at":"2026-08-07T15:36:06.935823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-07T15:36:05.562492Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.562492Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:68708695cec14f10fa344471e006d327012bcb472ffdd3f4562b1d1b48915ae5","observation_id":"26777c0e-02f8-4ef8-8aca-08f2bc01fa26","resolution":{"observed_at":"2026-08-07T15:36:05.562492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.912038Z","title":"Awq: Activation- aware weight quantization for on-device llm compression and acceleration,","venue":null,"work_id":"7d4fe579-af91-4439-9bb7-a2f3a5832424","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.569140Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:0a150a4cb2c96b392815bb2f408ceb37307db4f1bf87492d38548c642c17267b","observation_id":"eb585fe7-2705-479a-84eb-424dbe2362c1","resolution":{"observed_at":"2026-08-07T15:36:06.918359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.889355Z","title":"Q-vlm: Post-training quantization for large vision-language models,","venue":null,"work_id":"0fcbcf48-b1ed-4d7b-9b2a-0e754ffdba8c","year":2025},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.575244Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:f280524987464323ff6000b8b2bc2617b06c8385a73642aeb25a7a96e811c5e6","observation_id":"d959deeb-80d8-4ca0-9b45-3fab8ec4f7a9","resolution":{"observed_at":"2026-08-07T15:36:06.895542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.871199Z","title":"Advancing multimodal large language models with quantization-aware scale learning for efficient adaptation,","venue":null,"work_id":"e6a876f7-1196-408b-a95a-b5c757d2e1e9","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.581813Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:efe36c033cc9498f83ecf5e6aeea483c761d5137942c34038cbb78576b3eb9a6","observation_id":"d0470db3-9213-4550-b031-f30ff1dead43","resolution":{"observed_at":"2026-08-07T15:36:06.877051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.850796Z","title":"Reg-ptq: Regression-specialized post-training quantization for fully quantized object detector,","venue":null,"work_id":"addafee1-4951-46d9-8d8d-56c91a7734b3","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.588245Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:75ff3a87d083098e2a3a8214c0e6452434b5ea8bb6847275c2a10f0a6618255e","observation_id":"71c0371c-cbd3-4427-9d06-8d0ae17c2a4b","resolution":{"observed_at":"2026-08-07T15:36:06.857168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.827829Z","title":"Ptq4sam: Post- training quantization for segment anything,","venue":null,"work_id":"865b9cf2-ac0a-430c-9b7f-d2b44b7a56f5","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.594252Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:8eb70b2edb591f2d5483a1dfc6cffa3b438c13e0e97e2971341a0f33491a95a5","observation_id":"246f09ef-fe89-4379-8f6c-7cdabb71c9fb","resolution":{"observed_at":"2026-08-07T15:36:06.834265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.05433","last_updated":"2022-09-29T20:47:07Z","snapshot_observed_at":"2026-07-06T13:51:20.183063Z","submitted_at":"2022-09-12T17:39:55Z","title":"FP8 Formats for Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.05433","snapshot_observed_at":"2026-08-07T15:36:05.600094Z","title":"Fp8 formats for deep learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.600094Z"},"links":{"cited_paper":"/paper/2209.05433","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:e85cfe28a6a6c4d6fa3c2f94034f8712513ff711a3d9a883d0322040b2cf2342","observation_id":"16077d71-deda-48f9-8cb1-53adac73f52d","resolution":{"observed_at":"2026-08-07T15:36:05.600094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09975","last_updated":"2025-03-17T03:04:50Z","snapshot_observed_at":"2026-08-07T17:08:23.304756Z","submitted_at":"2025-03-13T02:21:39Z","title":"Faster Inference of LLMs using FP8 on the Intel Gaudi","version":3},"cited_work":{"arxiv_id":"2503.09975","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.09975","snapshot_observed_at":"2026-08-07T15:36:06.318277Z","title":"Faster Inference of LLMs using FP8 on the Intel Gaudi","venue":"cs.AR","work_id":"dc768db7-9bdd-498f-a02b-1413bf76e54a","year":2025},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.606709Z"},"links":{"cited_paper":"/paper/2503.09975","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:2254738325ee2db653ebda81436c1d04aa4420c98835bed09fd9bb3ddd4c12d7","observation_id":"1bd83e60-759d-4ada-924b-038855fe6362","resolution":{"observed_at":"2026-08-07T15:36:06.326317Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.808440Z","title":"Fp8 quantization: The power of the expo- nent,","venue":null,"work_id":"dbfd661c-466f-424f-bb92-5155730ffa4f","year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.613578Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:3b0d646972d8b86c79f959b072683a9322b4f9e71fe1cd8a6fb715b160cd7c60","observation_id":"838360a2-baa4-4155-99d9-7c9a44345f88","resolution":{"observed_at":"2026-08-07T15:36:06.814266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01070","last_updated":"2025-08-25T06:01:25Z","snapshot_observed_at":"2026-07-06T20:30:02.903743Z","submitted_at":"2025-02-03T05:26:22Z","title":"An Inquiry into Datacenter TCO for LLM Inference with FP8","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01070","snapshot_observed_at":"2026-08-07T15:36:05.619868Z","title":"An investigation of fp8 across accelerators for llm inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.619868Z"},"links":{"cited_paper":"/paper/2502.01070","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:85389adca2c2c437d302fd7902c003c6ce2e21fe754d1e2b23ec5e1f84db3ad0","observation_id":"c798dbe1-7d59-4c39-bb16-ae3069122cd4","resolution":{"observed_at":"2026-08-07T15:36:05.619868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-07-06T15:10:30.312833Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-08-07T15:36:05.626348Z","title":"Fp8 versus int8 for efficient deep learning inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.626348Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:275cbd8800c5bafaac18bb6fef79bde05d01ca5f18134c666fb27d0210d0b04f","observation_id":"2eb5b9e2-2d15-4d7e-a109-12e46ba393d6","resolution":{"observed_at":"2026-08-07T15:36:05.626348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04532","last_updated":"2025-05-01T02:14:05Z","snapshot_observed_at":"2026-08-08T04:42:16.973896Z","submitted_at":"2024-05-07T17:59:30Z","title":"QServe: W4A8KV4 Quantization and System Co-design for Efficient LLM Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04532","snapshot_observed_at":"2026-08-07T15:36:05.631849Z","title":"Qserve: W4a8kv4 quantization and sys- tem co-design for efficient llm serving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.631849Z"},"links":{"cited_paper":"/paper/2405.04532","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:71a62e00cf3dc88fe0aa320304084c670295dc30ecf29bc664804b889991d871","observation_id":"737d520a-c7aa-464c-97e5-ec41adcffdce","resolution":{"observed_at":"2026-08-07T15:36:05.631849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07191","last_updated":"2025-07-07T17:42:19Z","snapshot_observed_at":"2026-08-06T02:24:32.331127Z","submitted_at":"2024-11-11T18:05:48Z","title":"The Super Weight in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07191","snapshot_observed_at":"2026-08-07T15:36:05.638811Z","title":"The super weight in large language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.638811Z"},"links":{"cited_paper":"/paper/2411.07191","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:40097047e4ef3fb64e7a18190eaa45d72a73db79e93aa47c9bb2b2a0c5edd169","observation_id":"2041b6a0-c748-49ed-bdc0-c59c99c7781a","resolution":{"observed_at":"2026-08-07T15:36:05.638811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.786712Z","title":"Smoothquant: Accurate and efficient post-training quan- tization for large language models,","venue":null,"work_id":"fb43f654-85ce-482e-b13b-0b01ad2d84b1","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.645160Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:5d4795c5ddb90fea464d6040607153e019e5b4db4b63d28013c7d393a124c40f","observation_id":"256a2434-d6c1-47b5-af54-542cc5f7bff8","resolution":{"observed_at":"2026-08-07T15:36:06.792801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-05T10:45:45.389337Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-07T15:36:05.650647Z","title":"Quarot: Outlier-free 4-bit inference in rotated llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.650647Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:77e031e210fa3de350e4425f6ffe006c50e038b964d3d56219d22146d43d4a3e","observation_id":"7ff6de07-f271-49c8-89c7-15423dd1ddcc","resolution":{"observed_at":"2026-08-07T15:36:05.650647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-05T21:17:46.828705Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-07T15:36:05.656359Z","title":"Squeezellm: Dense- 9 and-sparse quantization,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.656359Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:4ec7657a63b22247dc9a464b8338cf43ed335bc9789bd59188df517a8284f1c9","observation_id":"776bbb39-0683-4ba8-a428-617b2fe31cc3","resolution":{"observed_at":"2026-08-07T15:36:05.656359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.766688Z","title":"Towards accurate post-training quantization for vi- sion transformer,","venue":null,"work_id":"fdbd2cd4-7966-432a-bfda-0c12b813ca8c","year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.661934Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:32edce0ca8cd5338b8533dcdce075f15e5e1d3e4c1555f109744e5ebc05434d4","observation_id":"3930d6bd-754d-4e32-b8df-b762c1043d1b","resolution":{"observed_at":"2026-08-07T15:36:06.774110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.746801Z","title":"Noisyquant: Noisy bias-enhanced post-training activation quantization for vision transformers,","venue":null,"work_id":"5ec68dc1-7eb7-42b8-8239-050c5b4656c6","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.666862Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:e50d85e08684993839a899b4cbd8a9455e884a221e19f55d31069c879e776d6e","observation_id":"95cf1fa8-c207-4e47-bc0a-7d556ba4f0a5","resolution":{"observed_at":"2026-08-07T15:36:06.752996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05516","last_updated":"2024-10-08T02:02:35Z","snapshot_observed_at":"2026-07-06T16:16:56.609388Z","submitted_at":"2023-09-11T14:58:23Z","title":"Optimize Weight Rounding via Signed Gradient Descent for the Quantization of LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05516","snapshot_observed_at":"2026-08-07T15:36:05.672891Z","title":"Optimize weight rounding via signed gradi- ent descent for the quantization of llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.672891Z"},"links":{"cited_paper":"/paper/2309.05516","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:b83eabeaa5a00cd4f44bd14d1afff846cfab12f7198a14225b6a38ccd947775e","observation_id":"6c4e8709-e7a7-4e5d-9709-47d47966f795","resolution":{"observed_at":"2026-08-07T15:36:05.672891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13137","last_updated":"2024-03-18T05:33:22Z","snapshot_observed_at":"2026-07-06T16:10:15.694898Z","submitted_at":"2023-08-25T02:28:35Z","title":"OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13137","snapshot_observed_at":"2026-08-07T15:36:05.678322Z","title":"Omniquant: Omni- directionally calibrated quantization for large language mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.678322Z"},"links":{"cited_paper":"/paper/2308.13137","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:19cae30cb384d4c6d59ad85cddd90d161762aa91f4863800059a8273ea2432bf","observation_id":"0f4a9bee-0eb8-4885-ac3b-a90dbc2e4367","resolution":{"observed_at":"2026-08-07T15:36:05.678322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.724178Z","title":"Half-quadratic quantization of large machine learning models,","venue":null,"work_id":"37a15501-8964-40e4-94b1-2a1d617e5cb6","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.684564Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:50403602916b5f85d91dded03e56436a5778de8a766fd8f517c31f968828f7f3","observation_id":"288a4b30-0a7e-44a2-9498-3fe66a8649ad","resolution":{"observed_at":"2026-08-07T15:36:06.730280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.700558Z","title":"Pd-quant: Post-training quantization based on prediction difference metric,","venue":null,"work_id":"2e764107-d18a-4d64-ad74-61d2af4d6c90","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.690691Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:aeccd14a3410639fad54429dd710c60ad72d00c8d3f1cfb7b77d5c99f6f407a5","observation_id":"0acc76a7-1570-4324-9422-4a8600415e8c","resolution":{"observed_at":"2026-08-07T15:36:06.706490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.680133Z","title":"Pd-quant: Post-training quantization based on prediction difference metric,","venue":null,"work_id":"bd0e66f0-db9c-4a23-96af-a9f15e07f2a2","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.696624Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:17f4b7502605dcaaa52e92472b6433ee603e032ba27d95e16f6872b2c558fd66","observation_id":"93cd2ddc-5142-4fe7-b545-2e32eeb6e68b","resolution":{"observed_at":"2026-08-07T15:36:06.686680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.661243Z","title":"Optimal brain sur- geon and general network pruning,","venue":null,"work_id":"265fd449-79d2-4125-96dc-07b46fb3d455","year":1993},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.702137Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:d3da787ec24def30167ac453ecd18ce4ccec794d635fb727e831efee963cf253","observation_id":"1bc2262d-b2c5-4f0c-ba8e-28df625beb99","resolution":{"observed_at":"2026-08-07T15:36:06.667965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.641452Z","title":"Optimal brain compression: A framework for accurate post-training quantization and prun- ing,","venue":null,"work_id":"af12e96b-c823-4221-aaa1-8052957fca87","year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.707688Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:a359e9dabf09e9fa99fdf5e555613dbe0b2d5033e6ea2b6fcea155490ac911b3","observation_id":"fa35d4cf-af9e-4a6c-b26c-467877ef1d27","resolution":{"observed_at":"2026-08-07T15:36:06.647598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.615628Z","title":"Ptq4vit: Post-training quantization for vision transformers with twin uniform quantization,","venue":null,"work_id":"331a51dc-97b5-4394-9f1d-f53b2266a613","year":2022},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.715369Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:52a060c149d98e91385d80929a29e79d32987707985cced63b205c16dc4c2e3a","observation_id":"24f09a99-4a9d-4cae-bad6-bd6e87e8ce7c","resolution":{"observed_at":"2026-08-07T15:36:06.623799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09904","last_updated":"2024-07-31T07:35:42Z","snapshot_observed_at":"2026-08-08T03:10:49.991472Z","submitted_at":"2024-06-14T10:23:45Z","title":"QQQ: Quality Quattuor-Bit Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09904","snapshot_observed_at":"2026-08-07T15:36:05.720980Z","title":"Qqq: Quality quattuor- bit quantization for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.720980Z"},"links":{"cited_paper":"/paper/2406.09904","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:648f6b364d4b4651ecaa53ec932df379a2b6b4f6759eda932f9b8bb7a3a17125","observation_id":"f168e218-e86b-4e7b-932e-e33431ef6247","resolution":{"observed_at":"2026-08-07T15:36:05.720980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.595247Z","title":"Qlora: Efficient finetuning of quantized llms,","venue":null,"work_id":"721ac125-4bbf-4532-942f-c3e2defa49b6","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.726742Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:84cecc0b81aec1c3d48480bf1014214c6161f250f153a58ed62e98b133237621","observation_id":"fd3c5138-7ee3-4af2-8310-3fa74fe23239","resolution":{"observed_at":"2026-08-07T15:36:06.601626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-07T15:36:05.731877Z","title":"Spinquant: Llm quantization with learned rotations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.731877Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:3955319044dbd0516ab0b3c8280db8c2db81698d2dfbb6ad828e42123d9a8e31","observation_id":"45deaeb0-6ad2-445a-a43a-de4b52f0b1e6","resolution":{"observed_at":"2026-08-07T15:36:05.731877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17762","last_updated":"2024-08-14T16:00:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T18:55:17Z","title":"Massive Activations in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17762","snapshot_observed_at":"2026-08-07T15:36:05.737732Z","title":"Mas- sive activations in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.737732Z"},"links":{"cited_paper":"/paper/2402.17762","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:85ebabc780a7e8dd091f232234ba44bfcfb1d31fae8eb17eb9917c1ec76b2f42","observation_id":"6f2c8c5c-774a-4a46-9200-b00f149dacea","resolution":{"observed_at":"2026-08-07T15:36:05.737732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.575159Z","title":"Mmmu: A massive multi-discipline multimodal understanding and rea- soning benchmark for expert agi,","venue":null,"work_id":"d253b154-988c-4605-ae29-35feb4aaaf3e","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.743472Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:321b96b0c78180285103b7a74c18fc9563d2e39387fe10d9b8f1c948906c132e","observation_id":"b8afbdc7-d703-48ec-8fb4-9b0bbc7b8aec","resolution":{"observed_at":"2026-08-07T15:36:06.581618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.555305Z","title":"Mmbench: Is your multi-modal model an all-around player?","venue":null,"work_id":"71880f45-0488-48cf-82f8-7c9d07968774","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.748996Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:5507440052315ae1e53649febf200ace35fb44e9aff21486e8f72c9c019d4801","observation_id":"4574bcbf-a4c9-4416-8eea-b5ec034b1866","resolution":{"observed_at":"2026-08-07T15:36:06.561697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-07T15:36:05.754358Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.754358Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:e9ae5cc05f17306b7a986fb6419b86258b1de644cec96fcdf0b8f8eb4643c360","observation_id":"3745ee05-ec80-4ae7-a844-0a136a981a5c","resolution":{"observed_at":"2026-08-07T15:36:05.754358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T15:36:05.760223Z","title":"Qwen2-vl: Enhancing vision- language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.760223Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:1147c108430b63272a2de204109e6f927f4b0292dc3bc26acf304c7906eae510","observation_id":"00b31de8-d9bc-4270-b39f-07fc5ad2812a","resolution":{"observed_at":"2026-08-07T15:36:05.760223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.532343Z","title":"Vlmevalkit: An open-source toolkit for evaluating large multi-modality models,","venue":null,"work_id":"84c1751d-495d-4b0d-b1b3-68f52d49aeff","year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.765099Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:5dbac9a4be24e4319e67286c88fb73c31a83e571f24db101b317a659b82fdb29","observation_id":"42cebc4f-9923-4baa-be4b-2fc40dc95cfb","resolution":{"observed_at":"2026-08-07T15:36:06.539573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T15:36:05.771908Z","title":"Llama 2: Open foundation and fine-tuned chat mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.771908Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:77e807f563cd182d19f71207ce356713d77f7be73f903c45932e8e667821251d","observation_id":"4bfbd2ce-a4ad-4242-abdb-26744edb88a7","resolution":{"observed_at":"2026-08-07T15:36:05.771908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:36:05.778165Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.778165Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:787f674fa8700d08d4503479fa3113dc0bd1e192b0dbd9f209b796ce175f9d88","observation_id":"7e06e537-d460-4808-8db1-67c7902ccab0","resolution":{"observed_at":"2026-08-07T15:36:05.778165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-07T15:36:05.783715Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.783715Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:6dec4475ca04bf072fbc296ad2046785552bd2ba0b6b57035baf4cec85fa22cd","observation_id":"6344a6fe-09f4-452f-8914-209142fd5ef1","resolution":{"observed_at":"2026-08-07T15:36:05.783715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T15:36:05.790299Z","title":"Measuring massive multitask language understanding,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.790299Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:8542acf608be4c34a1da3be1474a145aa59c6b7749c84600847106034d90a6eb","observation_id":"7c1037a0-f90d-49be-a677-3cf71978fae8","resolution":{"observed_at":"2026-08-07T15:36:05.790299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-07-31T00:09:56.948833Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-07T15:36:05.797383Z","title":"Hellaswag: Can a machine really finish your sentence?","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.797383Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:627bec920347cb3942ec8cbc07f10b9f80e45b0135e70666ae3ce6e1e0755a30","observation_id":"2d12ea00-6193-4ffc-83d4-73c7f518e560","resolution":{"observed_at":"2026-08-07T15:36:05.797383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.509116Z","title":"Language models are unsupervised mul- titask learners,","venue":null,"work_id":"62f3365d-46f5-4ff4-bf81-c09504ffdee1","year":2019},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.803578Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:c30f7339ed0f39f2c476e7ffbf139dcbbd232b32d22dba65cf92063167090fff","observation_id":"bff160fa-db2b-4996-9a0b-bc3ed1d1035b","resolution":{"observed_at":"2026-08-07T15:36:06.517796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-07-06T07:55:12.121264Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-07T15:36:05.809663Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.809663Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:276c10425ab22dd3c7411725ebf7a3f34a187cff5bf9d263fecc5fb2af84be17","observation_id":"200b87c5-d284-4a8d-9322-28264c0cb5e2","resolution":{"observed_at":"2026-08-07T15:36:05.809663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T15:36:05.815524Z","title":"Think you have solved ques- tion answering? try arc, the ai2 reasoning challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.815524Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:3b8df9c69c2eabddf1c92e99a5c8b09fea0b4fe52810804a897f4705bfd06bc4","observation_id":"d74b1fd4-21b7-48a3-be62-12be5560fa0b","resolution":{"observed_at":"2026-08-07T15:36:05.815524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.489116Z","title":"Reason- ing about physical commonsense in natural language,","venue":null,"work_id":"0965ef9c-3398-4f90-a2f8-ae24a48c2ae3","year":2019},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.821393Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:cb4c17c9c35078c0ba9f6ae40b6d868468df582add28cbf9ce22d7559a0817f8","observation_id":"773700e1-cc7f-484f-9068-9c7681b95810","resolution":{"observed_at":"2026-08-07T15:36:06.494418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-07-06T08:09:59.842324Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-08-07T15:36:05.826444Z","title":"An adversarial winograd schema challenge at scale,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.826444Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:92c49b8f17a61c23ce71ef23fb385148b76410c4bb18bf0079c78b7faa52d2c7","observation_id":"307dd09e-be6c-4d85-8b7f-2c63168013cf","resolution":{"observed_at":"2026-08-07T15:36:05.826444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-08T02:19:52.596062Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-07T15:36:05.831954Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.831954Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:a6931263d87b056362a6a2bc35034951a199e95c7959abdf65594aefda0fed7a","observation_id":"d2267353-2366-4298-b1d5-bf7637c81f46","resolution":{"observed_at":"2026-08-07T15:36:05.831954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.468276Z","title":"A framework for few-shot language model evaluation,","venue":null,"work_id":"c0af80e9-ba43-431f-abfb-b66fc5640ff2","year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.838070Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:dcff42cbbc91b1957bcb9e31217634522bc03d766ba5ef43fb4007ca31f50e16","observation_id":"14025751-8455-4e36-a77e-90ac1c071fa5","resolution":{"observed_at":"2026-08-07T15:36:06.476599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.448379Z","title":"Semantic parsing on Freebase from question-answer pairs,","venue":null,"work_id":"e4388942-5098-49c6-be93-500534fb8616","year":2013},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.843955Z"},"links":{"citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:568c8b631d615dd873099b707b12c3a21918a3db0f91d9cf978c8a90ab5a0153","observation_id":"3973de9a-8f95-417c-9b88-ddac976c38c2","resolution":{"observed_at":"2026-08-07T15:36:06.455038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T15:36:05.850300Z","title":"The pile: An 800gb dataset of diverse text for language modeling,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.850300Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:8a96fda6d2df23eaf29d8abdf62e8cca5855afa5098388944fff133012888a43","observation_id":"82a53ce8-7103-4aba-baf1-5aa3ba9503b1","resolution":{"observed_at":"2026-08-07T15:36:05.850300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T23:40:41.352977Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":1,"verified_fuzzy":31},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2505.14638."}