{"as_of":"2026-08-11T13:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2b18b11009e5a91dbe1196a70d8aea6fd744fab3960a76ee4ea8ab791255c26d","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T22:56:29.732612Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T10:34:16.525398Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-15T10:35:27.465387Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"cited_work":{"arxiv_id":"2511.10909","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.10909","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","venue":"cs.AR","work_id":"fe06541a-e519-4ade-8c03-67865a2376b2","year":2025},"citing_paper":{"arxiv_id":"2603.15042","last_updated":"2026-08-05T05:18:06Z","snapshot_observed_at":"2026-08-08T23:09:22.115133Z","submitted_at":"2026-03-16T09:48:34Z","title":"Determinism-Preserving GPU Spatial Sharing with Vitamin-E","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-15T10:34:16.525398Z"},"links":{"cited_paper":"/paper/2511.10909","citing_paper":"/paper/2603.15042"},"observation_digest":"sha256:60fed9543dbc9ed4668067ac3817fcd77161aec2548a51b69f6cccd7b780df25","observation_id":"61cad61e-84fe-4c1d-890c-1bb8159ac5a1","resolution":{"observed_at":"2026-05-15T10:35:27.467353Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2511.10909/citation-record","integrity":"/paper/2511.10909/integrity","json":"/paper/2511.10909/citation-record.json","paper":"/paper/2511.10909"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.00091","doi":"10.1109/ipdpsw.2018.00091","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Markidis, S","venue":null,"work_id":"663dc4fa-2d62-4ea2-92d7-9e142be818bb","year":2018},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:30d667d133369cd803ae2976911402d0f09b7f7b4d1ade098753fdd1a871b562","observation_id":"9496f98e-0eda-478a-91c1-312988b7ec0a","resolution":{"observed_at":"2026-05-17T23:00:25.387050Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.321782","doi":"10.1109/tpds.2022.3217824","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dissecting Tensor Cores via Microbenchmarks: Latency, Throughput and Numeric Behaviors","venue":"IEEE Transactions on Parallel and Distributed Systems","work_id":"7853f9e4-9aa4-4ffc-9e05-4310ba6af11d","year":2023},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:b4f471ad870cb0bc3ab6f4a20a20543e6768da6556720c5173b29c484f07423e","observation_id":"ec433e77-0297-4595-89c3-313c4cb4ac00","resolution":{"observed_at":"2026-05-17T23:00:25.370424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1541.2024","doi":"10.1109/ispass61541.2024.00012","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LIBRA: Enabling Workload-Aware Multi-Dimensional Network Topology Optimization for Distributed Training of Large AI Models","venue":null,"work_id":"f8880ac8-b753-4a3a-84e9-c49f43978e60","year":2024},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:7a6ef699d31ba2af498b087f4ef87f2bb9b177985922dc0f76e9cf4636afd4df","observation_id":"3dae3ba7-6bc2-4e08-85ac-1306700a73e4","resolution":{"observed_at":"2026-05-17T23:00:25.364761Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:a46c3de7c71aaa4cb345410f983f4ab2f1bff6cd2face723055e320ed61eb0e2","observation_id":"f20dbfc4-8cce-403b-9f52-6b175cd9fb01","resolution":{"observed_at":"2026-05-17T23:00:25.408885Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PyTorch Developer Notes - Numerical accuracy","venue":null,"work_id":"dc43b0c6-56ff-45fc-badb-84c312ff9086","year":null},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:b71c99467acf8620e37b878803ddda4a57bba2e0941395850bf20c786bb0e046","observation_id":"77eda989-8ba9-46db-8104-5e32607f3316","resolution":{"observed_at":"2026-05-17T23:02:12.423842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Available: https://docs.pytorch.org/docs/stable/notes/ numerical accuracy.html","venue":null,"work_id":"6c5d22a6-8ba0-4acd-ae15-790a76083fad","year":null},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:c0d3ee899288f8e2a4bbcd862cfa792584dd75ff13f75bfb4b69dd2d03ce1c55","observation_id":"b387ed00-4d6f-45c5-a8a5-07adf8db0b50","resolution":{"observed_at":"2026-05-17T23:02:12.410875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9990.2024","doi":"10.1109/ccgrid59990.2024.00013","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FTTN: Feature-Targeted Testing for Numerical Properties of NVIDIA & AMD Matrix Accelerators","venue":null,"work_id":"96738778-11cb-4301-a9a1-67b2a25f151e","year":2024},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:d4cf4b9e4a24f6ac54d5f6469a654bc99eaacba3a3939168bc6e34a4b8cfb370","observation_id":"f17ceaea-d66f-4995-90f1-5ffda048c8ce","resolution":{"observed_at":"2026-05-17T23:00:25.374072Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.7717/peerj-cs.330","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Numerical behavior of NVIDIA tensor cores","venue":"PeerJ Computer Science","work_id":"29701d3e-d72c-4436-b18c-a5fd7e0973f5","year":2021},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:a5d47cd52b77d5d181c9a502c7428bf01ad03c482e6f2a9d9fc52484feca0653","observation_id":"3bc1ff37-4eb8-4f1a-a113-98a6b8a6ca39","resolution":{"observed_at":"2026-05-17T23:00:25.379864Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9990.2024","doi":"10.1109/ccgrid59990.2024.00013","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FTTN: Feature-Targeted Testing for Numerical Properties of NVIDIA & AMD Matrix Accelerators","venue":null,"work_id":"96738778-11cb-4301-a9a1-67b2a25f151e","year":2024},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:99e8938ea237587cc66695b183dbf4cbe71f8a1a9fbf7f08aff001d6f71fe0c6","observation_id":"d96c5f6b-e8f9-4dfe-bf43-c9caf97bb66e","resolution":{"observed_at":"2026-05-17T23:00:25.412093Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Revealing Floating-Point Accumulation Orders in Software/Hardware Implementations","venue":null,"work_id":"82bb04f5-cac1-4c33-9216-ffea86824d37","year":2025},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:6e64fce1e6a5bc238a7a335b564e21a8606016e0108bf24f41a540129298ef00","observation_id":"6013eae5-aeb1-4042-ae07-da48f499f802","resolution":{"observed_at":"2026-05-17T23:02:12.414291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.15439/2015f29","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Estimation of numerical reproducibility on CPU and GPU","venue":"Annals of Computer Science and Information Systems","work_id":"6d0b9611-c844-4cbd-91d9-f72244a68b90","year":2015},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:71e34219f33ba524cbd583d0a390d9e472a4174cad2c8efddb153da6e857af04","observation_id":"9635bf0f-9c11-4986-aba0-7b9c60841a09","resolution":{"observed_at":"2026-05-17T23:00:25.367021Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3240.2024","doi":"10.1109/scw63240.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Expediting Higher Fidelity Plasma State Reconstructions for the DIII-D Na- tional Fusion Facility Using Leadership Class Computing Resources","venue":null,"work_id":"95baa9c8-b99b-4582-84e7-6142c9cb84bd","year":2024},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:86088373533692d86f6d3637ddbf7db8e216223f8c5026af2be32e01e7acbe22","observation_id":"254f7c8d-0a66-4d27-868b-cd63532e3f60","resolution":{"observed_at":"2026-05-17T23:00:25.377440Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4884.341654","doi":"10.1145/3324884.3416545","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Problems and Opportunities in Training Deep Learning Software Systems: An Analysis of Variance","venue":null,"work_id":"ee47ac91-a299-48e9-9355-09016386c4c7","year":2020},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:fd08196a7ff0163d792ca04886d715229361dc0d7a41cb7a1dea82c668e8939d","observation_id":"c6334b89-898a-488c-9aca-d4931589d8d1","resolution":{"observed_at":"2026-05-17T23:00:25.383524Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3510003","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In Proceedings of the 44th International Conference on Software Engineering (Pittsburgh, Pennsylvania) (ICSE ’22)","venue":null,"work_id":"ba48d644-e467-4979-b004-d8d92c270650","year":2022},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:854ea4196aa7bc085a0ef9a9e9f23c0d889a4cf6c4c9b61c615a9c375f3a19c0","observation_id":"65995f33-0ff4-423f-81d3-2dabf242e2e7","resolution":{"observed_at":"2026-05-17T23:00:25.405927Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Defeating Nondeterminism in LLM Inference","venue":null,"work_id":"bf2839cf-010a-4d55-8c7a-8b058776b8cd","year":2025},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:77f5d4aab5ca63c6a7b7d53769d0c24bd15c76bdf424db3751ee13124f2a538e","observation_id":"94d18f1d-28fd-465e-8567-8f5b40fdd180","resolution":{"observed_at":"2026-05-17T23:02:12.416988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.00016","doi":"10.1109/ase.2019.00016","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Zheng, C","venue":null,"work_id":"5d3947b6-9953-4546-82f9-ec51077e26f3","year":2019},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:dff63fce59d12cb9f26ae10fab8c3944d966c0e473fb39551ad7aec82266850d","observation_id":"847a5233-eff6-4793-84db-86af55e61270","resolution":{"observed_at":"2026-05-17T23:00:25.400134Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.00031","doi":"10.1109/aike.2019.00031","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chechik and T","venue":null,"work_id":"4014da35-e946-4662-b1ec-ae89c62a730b","year":2019},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:1d2fd40fe2d745857645937325b699076e4f0bb2131ef00affff44f2b2f5c1f2","observation_id":"000d57f8-3424-42dc-9b28-a9e9178176c1","resolution":{"observed_at":"2026-05-17T23:00:25.403491Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15999","last_updated":"2025-02-21T23:22:56Z","snapshot_observed_at":"2026-08-07T17:57:17.970478Z","submitted_at":"2025-02-21T23:22:56Z","title":"An SMT Formalization of Mixed-Precision Matrix Multiplication: Modeling Three Generations of Tensor Cores","version":1},"cited_work":{"arxiv_id":"2502.15999","doi":"10.48550/arxiv.2502.15999","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.15999","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An SMT Formalization of Mixed-Precision Matrix Multiplication: Modeling Three Generations of Tensor Cores","venue":"ArXiv.org","work_id":"2b5e6460-3d6e-4a83-b15a-8696c2d297ac","year":2025},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"cited_paper":"/paper/2502.15999","citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:9d2e65eb0335b3cb698a55e5ca6c389a0bb91bdf8fc879757e16e8d68578328c","observation_id":"4283967d-7290-4a75-aace-ce4c7aa259d5","resolution":{"observed_at":"2026-05-17T23:00:25.391180Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Standard for Floating-Point Arithmetic","venue":null,"work_id":"d4870783-1375-45e6-934d-3ffb870f1a41","year":2019},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:2b5d4293f7cfb51a1ed26c7b5dc8c2b02428a7fb87beb09514e8c71856f8ee88","observation_id":"22e35561-1e17-407b-a472-23487a72fce9","resolution":{"observed_at":"2026-05-17T23:02:12.420347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.05433","last_updated":"2022-09-29T20:47:07Z","snapshot_observed_at":"2026-08-10T16:19:00.326414Z","submitted_at":"2022-09-12T17:39:55Z","title":"FP8 Formats for Deep Learning","version":2},"cited_work":{"arxiv_id":"2209.05433","doi":"10.48550/arxiv.2209.05433","metadata_source":"pith","pith_arxiv_id":"2209.05433","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FP8 Formats for Deep Learning","venue":"cs.LG","work_id":"c7217bc9-e53d-40c5-a437-25a74abc36cd","year":2022},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"cited_paper":"/paper/2209.05433","citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:fd670c1162f635f1022d3e4c0ddac7a45cd3523979865bb301e1737cb122ee47","observation_id":"5a64b25c-92f9-4b5d-935f-c2ca08fe0171","resolution":{"observed_at":"2026-05-17T23:00:25.397056Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:35.618396+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:35.618396+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OCP Microscaling Formats (MX) Specifica- tion","venue":null,"work_id":"48d211d0-7640-4a81-8b53-1d4998e56d3f","year":2023},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:b2e33c17f44f6eeb8ba7ae141ac820765a86794556013b45a04ed177c483c22b","observation_id":"f36a9617-34fe-4fa4-9f07-591c5bdf95de","resolution":{"observed_at":"2026-05-17T23:02:12.407691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2206","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:20:46.873089Z","title":"Limit results for distribu ted estimation of invariant subspaces in multiple networks inference and pca","venue":null,"work_id":"883a6817-7cab-439a-b21a-a5b2dd744334","year":2022},"citing_paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-17T22:56:29.732612Z"},"links":{"citing_paper":"/paper/2511.10909"},"observation_digest":"sha256:7d790cc59803abf40c92570fe692c21ef84e5c9040a2b28e596fc5728708fe11","observation_id":"68c992b6-97b1-49d1-af8f-993fe058cac8","resolution":{"observed_at":"2026-05-17T23:00:25.393867Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2511.10909","last_updated":"2026-04-14T08:00:46Z","latest_version":2,"primary_category":"cs.AR","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-14T02:45:15Z","title":"Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":9,"parse_uncertain":0,"unresolved":0,"verified_exact":7,"verified_fuzzy":6},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 1 inbound Pith citation observation for arXiv:2511.10909."}