A controlled benchmark of 13 pretrained audio models shows source direction, distance, and class are much more decodable than room size, shape, and reverb time.
X-ares: A comprehensive framework for assessing audio encoder performance,
2 Pith papers cite this work. Polarity classification is still indexing.
2
Pith papers citing it
fields
cs.SD 2representative citing papers
AU-Harness introduces an efficient unified evaluation framework for audio LLMs featuring batch optimizations, multi-turn dialogue support, and standardized protocols for fair comparisons.
citing papers explorer
-
Probing Spatial Structure in Pretrained Audio Representations
A controlled benchmark of 13 pretrained audio models shows source direction, distance, and class are much more decodable than room size, shape, and reverb time.
-
AU-Harness: An Open-Source Toolkit for Holistic Evaluation of Audio LLMs
AU-Harness introduces an efficient unified evaluation framework for audio LLMs featuring batch optimizations, multi-turn dialogue support, and standardized protocols for fair comparisons.