On a 64-core RISC-V chip, FFTW with MPI scales to 64 cores, OpenMP needs measured planning, and x86-64 remains about 8 times faster for a double-precision 2D FFT.
al.: FFT benchmark performance experimentson systems targeting exascale
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
background 1
citation-polarity summary
fields
cs.DC 1years
2025 1verdicts
CONDITIONAL 1roles
background 1polarities
background 1representative citing papers
citing papers explorer
-
Parallel FFTW on RISC-V: A Comparative Study including OpenMP, MPI, and HPX
On a 64-core RISC-V chip, FFTW with MPI scales to 64 cores, OpenMP needs measured planning, and x86-64 remains about 8 times faster for a double-precision 2D FFT.