A consumer-laptop benchmark shows CUDA matrix multiplication outpacing a naive sequential C++ baseline by up to 593x, but the claimed shared-memory optimization is absent from the supplied code.
Openmp: an industry standard api for shared-memory programming,
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
method 1
citation-polarity summary
fields
cs.DC 1years
2025 1verdicts
REJECT 1roles
method 1polarities
use method 1representative citing papers
citing papers explorer
-
Accelerating Matrix Multiplication: A Performance Comparison Between Multi-Core CPU and GPU
A consumer-laptop benchmark shows CUDA matrix multiplication outpacing a naive sequential C++ baseline by up to 593x, but the claimed shared-memory optimization is absent from the supplied code.