{"as_of":"2026-08-19T12:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:371c0ce3488b6b7e8700c45c7302e4bb65f254fdd0a6e5b517d6837593a0c45d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:35:55.927509Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T02:06:26.126499Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-08-11T04:24:03.825093Z","title":"Fp8 versus int8 for efficient deep learning inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18948","last_updated":"2024-12-25T17:05:00Z","snapshot_observed_at":"2026-08-17T00:23:17.007971Z","submitted_at":"2024-12-25T17:05:00Z","title":"A Power-Efficient Hardware Implementation of L-Mul","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T04:24:03.825093Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2412.18948"},"observation_digest":"sha256:011aea5350414300c993fe10d20936e880ecadd93c332d70c83d95a04c54b1ef","observation_id":"9f6ff70b-9dcf-4760-b790-c0e63e647dc1","resolution":{"observed_at":"2026-08-11T04:24:03.825093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-08-08T05:32:34.852822Z","title":"S., Ren, Y., Mahurin, E., Patel, C., Subramanian, S., Lee, S., Nagel, M., Soriaga, J., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08355","last_updated":"2025-02-12T12:30:49Z","snapshot_observed_at":"2026-08-16T17:21:08.954311Z","submitted_at":"2025-02-12T12:30:49Z","title":"Loss Landscape Analysis for Reliable Quantized ML Models for Scientific Sensing","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T05:32:34.852822Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2502.08355"},"observation_digest":"sha256:97afb5d58cf70ed8dad074721dfd142bb8e39fd06d1ce57dd11f93f9d655f957","observation_id":"6a62e610-6562-4d3f-8266-de584b3ecf2e","resolution":{"observed_at":"2026-08-08T05:32:34.852822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-08-15T21:55:07.846294Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08620","last_updated":"2025-05-13T14:39:33Z","snapshot_observed_at":"2026-08-19T11:13:57.717787Z","submitted_at":"2025-05-13T14:39:33Z","title":"Resource-Efficient Language Models: Quantization for Fast and Accessible Inference","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T21:55:07.846294Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2505.08620"},"observation_digest":"sha256:c51ae533d0df96d677840a40b5d226c5c9af77207ef92abe4bab9bf0070b7dfe","observation_id":"40a72d16-bfc1-49c1-a365-f495bba7c8a8","resolution":{"observed_at":"2026-08-15T21:55:07.846294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-08-07T15:36:05.626348Z","title":"Fp8 versus int8 for efficient deep learning inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14638","last_updated":"2025-05-20T17:26:12Z","snapshot_observed_at":"2026-08-15T10:44:48.060817Z","submitted_at":"2025-05-20T17:26:12Z","title":"Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.626348Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2505.14638"},"observation_digest":"sha256:3b07236910d85b63ed3331ff70e3b0533285a04ffd21520a917cfe2504f11232","observation_id":"2eb5b9e2-2d15-4d7e-a109-12e46ba393d6","resolution":{"observed_at":"2026-08-07T15:36:05.626348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-08-07T13:45:45.220121Z","title":"Fp8 ver- sus int8 for efficient deep learning inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21591","last_updated":"2025-05-27T13:40:47Z","snapshot_observed_at":"2026-08-15T01:29:01.896929Z","submitted_at":"2025-05-27T13:40:47Z","title":"Pioneering 4-Bit FP Quantization for Diffusion Models: Mixup-Sign Quantization and Timestep-Aware Fine-Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:45.220121Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2505.21591"},"observation_digest":"sha256:a6ef56343cc069967055d061ad18e1ea03c85349504f27b6315218b502b5a061","observation_id":"e5530f14-8c65-472e-b013-bfafdf5d73b6","resolution":{"observed_at":"2026-08-07T13:45:45.220121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":"2303.17951","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-07-02T02:06:26.126499Z","title":"van Baalen, A","venue":null,"work_id":"c1042045-61e3-424f-89ce-fae064220f68","year":2023},"citing_paper":{"arxiv_id":"2506.11277","last_updated":"2026-05-08T08:08:41Z","snapshot_observed_at":"2026-07-06T21:41:24.021272Z","submitted_at":"2025-06-12T20:33:50Z","title":"Analysis of Floating-Point Matrix Multiplication Computed via Integer Arithmetic","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-19T09:09:14.132268Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2506.11277"},"observation_digest":"sha256:a385656c44c82e661d9c38b772ac356364d6a286d5ba558de43da77200a3f2bc","observation_id":"2ff0c0d9-aa1c-404e-9a8d-bacc5aa10192","resolution":{"observed_at":"2026-05-19T09:12:14.853141Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":"2303.17951","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-07-02T02:06:26.126499Z","title":"van Baalen, A","venue":null,"work_id":"c1042045-61e3-424f-89ce-fae064220f68","year":2023},"citing_paper":{"arxiv_id":"2511.06838","last_updated":"2026-05-03T00:30:12Z","snapshot_observed_at":"2026-08-16T20:43:31.193649Z","submitted_at":"2025-11-10T08:29:34Z","title":"P3-LLM: An Integrated NPU-PIM Accelerator for Edge LLM Inference Using Hybrid Numerical Formats","version":4},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-18T00:16:27.497363Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2511.06838"},"observation_digest":"sha256:6d44e8841e3ff3b2cfba12da6ae269da57df011ee3c5b80dade88fa53c8d4579","observation_id":"a0879e73-781c-4dcd-a536-8001cd9782b6","resolution":{"observed_at":"2026-05-18T00:20:32.176875Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":"2303.17951","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-07-02T02:06:26.126499Z","title":"van Baalen, A","venue":null,"work_id":"c1042045-61e3-424f-89ce-fae064220f68","year":2023},"citing_paper":{"arxiv_id":"2602.10718","last_updated":"2026-04-28T04:57:29Z","snapshot_observed_at":"2026-08-13T05:11:10.404748Z","submitted_at":"2026-02-11T10:24:42Z","title":"SnapMLA: Efficient Long-Context MLA Decoding via Hardware-Aware FP8 Quantized Pipelining","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T05:58:03.113220Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2602.10718"},"observation_digest":"sha256:4c49d9200d8cf6a842d68499b01bb6303d7e16ce476f517d0c5c9df67dc08a87","observation_id":"2181953e-4a3c-40af-bae4-5cebd2f7a20d","resolution":{"observed_at":"2026-05-16T06:00:40.804585Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":"2303.17951","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-07-02T02:06:26.126499Z","title":"van Baalen, A","venue":null,"work_id":"c1042045-61e3-424f-89ce-fae064220f68","year":2023},"citing_paper":{"arxiv_id":"2606.04115","last_updated":"2026-07-14T14:04:32Z","snapshot_observed_at":"2026-08-02T05:34:23.902031Z","submitted_at":"2026-06-02T18:23:20Z","title":"dMX: Differentiable Mixed-Precision Assignment for Low-Precision Floating-Point Formats","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T11:20:06.292977Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2606.04115"},"observation_digest":"sha256:6d5781df9bc44996ca0202abaf9e4af2c127b06b7ed1ba04f667946a97a1ad68","observation_id":"6e5290f6-f705-442f-a0db-af0c68c9fe8b","resolution":{"observed_at":"2026-07-02T02:06:26.128760Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-07-15T10:56:54.155632Z","title":"FP8 versus INT8 for efficient deep learning inference.arXiv preprint arXiv:2303.17951, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04115","last_updated":"2026-07-14T14:04:32Z","snapshot_observed_at":"2026-08-02T05:34:23.902031Z","submitted_at":"2026-06-02T18:23:20Z","title":"dMX: Differentiable Mixed-Precision Assignment for Low-Precision Floating-Point Formats","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-15T10:56:54.155632Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2606.04115"},"observation_digest":"sha256:10c3425146f9cda0e2c30665397cb098e223ccf58df0dcd3733e51a1bd2b900f","observation_id":"9278231b-8ec9-4fc8-a0cb-8329141765f4","resolution":{"observed_at":"2026-07-15T10:56:54.155632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-08-01T17:12:37.713808Z","title":"Nair and Yuwei Ren and Eric Mahurin and Chirag Patel and Sundar Subramanian and Sanghyuk Lee and Markus Nagel and Joseph Soriaga and Tijmen Blankevoort , title =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17733","last_updated":"2026-07-20T09:23:10Z","snapshot_observed_at":"2026-08-18T17:26:57.285460Z","submitted_at":"2026-07-20T09:23:10Z","title":"MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-08-01T17:12:37.713808Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2607.17733"},"observation_digest":"sha256:403b3dd2e3daf4b61733c22e49305ae4912264a50f4587748f53df08c4e1c732","observation_id":"adbd1a6a-5354-443e-b6e1-14b8cbc2bca6","resolution":{"observed_at":"2026-08-01T17:12:37.713808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17951","snapshot_observed_at":"2026-08-16T00:35:55.927509Z","title":"FP8 versus INT8 for efficient deep learning inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.11693","last_updated":"2026-08-14T06:06:04Z","snapshot_observed_at":"2026-08-19T12:10:28.112968Z","submitted_at":"2026-08-12T06:04:30Z","title":"Spec Sheets Are Not Kernels: An ISA- and Source-Level Audit of INT8 Availability on NVIDIA Blackwell Ultra","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:35:55.927509Z"},"links":{"cited_paper":"/paper/2303.17951","citing_paper":"/paper/2608.11693"},"observation_digest":"sha256:2c19ef16e74c3d98b2dd93abe9b6b28238838f0ab141becb0f690343ef9baa19","observation_id":"141eceff-fef8-4451-83d0-7da8968eb6ed","resolution":{"observed_at":"2026-08-16T00:35:55.927509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2303.17951/citation-record","integrity":"/paper/2303.17951/integrity","json":"/paper/2303.17951/citation-record.json","paper":"/paper/2303.17951"},"outbound":[],"paper":{"arxiv_id":"2303.17951","last_updated":"2023-06-15T08:14:02Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T15:43:49.006717Z","submitted_at":"2023-03-31T10:29:17Z","title":"FP8 versus INT8 for efficient deep learning inference"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2303.17951."}