A parameter-efficient dual-encoder model with differentiable Choquet integral fusion improves underwater acoustic classification accuracy over single-encoder baselines on DeepShip and ShipsEar datasets.
SSAST: Self- supervised audio spectrogram transformer,
2 Pith papers cite this work, alongside 263 external citations. Polarity classification is still indexing.
2
Pith papers citing it
263
external citations · OpenAlex
verdicts
UNVERDICTED 2representative citing papers
RoMAE applies rotary positional embeddings to masked autoencoders to enable representation learning and interpolation on continuous positional data across irregular time-series, images, and audio without modality-specific modifications.
citing papers explorer
-
Rotary Masked Autoencoders are Versatile Learners
RoMAE applies rotary positional embeddings to masked autoencoders to enable representation learning and interpolation on continuous positional data across irregular time-series, images, and audio without modality-specific modifications.