A consumer-laptop benchmark shows CUDA matrix multiplication outpacing a naive sequential C++ baseline by up to 593x, but the claimed shared-memory optimization is absent from the supplied code.
A survey of cpu-gpu heterogeneous computing techniques,
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
background 1
citation-polarity summary
fields
cs.DC 1years
2025 1verdicts
REJECT 1roles
background 1polarities
support 1representative citing papers
citing papers explorer
-
Accelerating Matrix Multiplication: A Performance Comparison Between Multi-Core CPU and GPU
A consumer-laptop benchmark shows CUDA matrix multiplication outpacing a naive sequential C++ baseline by up to 593x, but the claimed shared-memory optimization is absent from the supplied code.