Pith. sign in

Paper Citation Record · LEDGER

AudioBench: A Universal Benchmark for Audio Large Language Models

As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2406.16020.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2406.16020 v5

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 20 of 20 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-11T06:34:44.6726+00:00

measured 20 of 20 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-10T22:40:25.563518Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-05T02:28:24.338817Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

4
pith, observed 2026-08-05T02:28:24.338817Z

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation b1a9b804-2953-4666-8849-742c3f602ebf · inbound

VoiceBench: Benchmarking LLM-Based Voice Assistants cites this paper.

VoiceBench: Benchmarking LLM-Based Voice Assistants AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 99

Resolution
verified exact
arxiv_id, observed 2026-05-17T00:50:14.018476Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=arxiv_source observed=2026-05-17T00:50:13.841689Z digest=sha256:5befe6b8384ebc9ef09bc1143120309b1319b570ef3fdad1c272bf319c44f667

Observation b22e8a33-f036-4fe4-bb3f-4b9bd2faa5a3 · inbound

Advancing Singlish Understanding: Bridging the Gap with Datasets and Multimodal Models cites this paper.

Advancing Singlish Understanding: Bridging the Gap with Datasets and Multimodal Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-10T22:40:25.563518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T22:40:25.563518Z digest=sha256:c3844f85cb40eef24f6090c42abaee10f35e56f085e62a5f6106907e494f97bb

Observation e87f1a87-d1f4-4327-82aa-c7ad876f3b05 · inbound

VoxEval: Benchmarking the Knowledge Understanding Capabilities of End-to-End Spoken Language Models cites this paper.

VoxEval: Benchmarking the Knowledge Understanding Capabilities of End-to-End Spoken Language Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-10T21:24:18.256256Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T21:24:18.256256Z digest=sha256:4ab05bd34d74e0e42aa779f95e963536020a0053ddc30952074d362c21f09a7c

Observation ac52300f-da3f-4ae7-a13e-246550a4259a · inbound

Audio-Language Models for Audio-Centric Tasks: A Systematic Survey cites this paper.

Audio-Language Models for Audio-Centric Tasks: A Systematic Survey AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 160

Resolution
unresolved
no resolver link, observed 2026-08-10T14:36:19.925145Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T14:36:19.925145Z digest=sha256:ef9f6d00ece75b523f08b03beb0d034a5fd1e7ec55cd2de4b63364b9e1736fc7

Observation cbe61ebe-1ea8-4841-a900-d20a5fa16e6f · inbound

Audio Large Language Models Can Be Descriptive Speech Quality Evaluators cites this paper.

Audio Large Language Models Can Be Descriptive Speech Quality Evaluators AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 2005

Resolution
unresolved
no resolver link, observed 2026-08-10T12:30:52.122984Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T12:30:52.122984Z digest=sha256:d3410ea0f76b736d021e4c19fb0f3285a04afa56cae9fb7be551a394ede00bd2

Observation 6d0e6881-6005-4f12-aecb-dac4844dd551 · inbound

Do Audio-Visual Segmentation Models Truly Segment Sounding Objects? cites this paper.

Do Audio-Visual Segmentation Models Truly Segment Sounding Objects? AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-09T19:24:20.433964Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T19:24:20.433964Z digest=sha256:0768c0cc077a611ed75f6386383e48add11a18f338db98c63de63885ab7ad782

Observation 2d19c0f1-da05-420b-90a0-6e611388aff7 · inbound

On The Landscape of Spoken Language Models: A Comprehensive Survey cites this paper.

On The Landscape of Spoken Language Models: A Comprehensive Survey AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 45

Resolution
verified exact
arxiv_id, observed 2026-05-22T20:45:08.211361Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-05-22T20:44:57.476464Z digest=sha256:76e86431cdd569de09d6f124f73ec7706b6606158fb157d0dfba6ec0498e408a

Observation 20831a34-18e7-4c68-9a0e-3efe59b7320f · inbound

ALAS: An Automatic Latent Alignment Score for Audio Language Models cites this paper.

ALAS: An Automatic Latent Alignment Score for Audio Language Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:23.503947Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:07:23.503947Z digest=sha256:87efd36e6742931b8250e5addf342828c8deb36c0fd29a2ceefa81ed808022a7

Observation 29ce5b87-dae4-464e-bda0-2ea07661c841 · inbound

Breaking the Barriers of Text-Hungry and Audio-Deficient AI cites this paper.

Breaking the Barriers of Text-Hungry and Audio-Deficient AI AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 138

Resolution
unresolved
no resolver link, observed 2026-08-07T11:28:59.437281Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:28:59.437281Z digest=sha256:16ff914ee7d0cc03629a587be5c3ffbcfb912b184a3a21325379d50d2f5b52e7

Observation 0db694d5-841a-41cf-99e1-1c9efe1a8c85 · inbound

SOVA-Bench: Benchmarking the Speech Conversation Ability for LLM-based Voice Assistant cites this paper.

SOVA-Bench: Benchmarking the Speech Conversation Ability for LLM-based Voice Assistant AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T11:26:23.203188Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:26:23.203188Z digest=sha256:0afaf794da63a7a1e9361ecdf3bbcae63a1f741d8dc6eb003ba45f244bf7270d

Observation 6512d42e-079e-4ed9-8525-b66be04faeb0 · inbound

CMI-Bench: A Comprehensive Benchmark for Evaluating Music Instruction Following cites this paper.

CMI-Bench: A Comprehensive Benchmark for Evaluating Music Instruction Following AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T00:59:48.715523Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:59:48.715523Z digest=sha256:b765aae05758c19c7d0c29abbc5a1258f58a57f72ed9cd13c38341b40e9c0195

Observation 68ba51d8-c7cb-41db-bfb0-5262436c9773 · inbound

Zero-Shot Cognitive Impairment Detection from Speech Using AudioLLM cites this paper.

Zero-Shot Cognitive Impairment Detection from Speech Using AudioLLM AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-06T23:41:49.687916Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:41:49.687916Z digest=sha256:25f0ebd468b7de64b121e4038fa0eef17b3f381e08f05e817f44eee63c84820d

Observation c0e91432-1f42-4e51-96d7-0148ee36ad85 · inbound

XModBench: Benchmarking Cross-Modal Capabilities and Consistency in Omni-Language Models cites this paper.

XModBench: Benchmarking Cross-Modal Capabilities and Consistency in Omni-Language Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 20

Resolution
verified exact
arxiv_id, observed 2026-05-18T05:45:56.145885Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-05-18T05:45:07.700571Z digest=sha256:1128a64f9115f0bc0e7a5e7e30888725fea1bc6589459ab02157442cc9bea85a

Observation 3d039abb-ea5e-429e-ae52-6d05891267e9 · inbound

All That Glitters Is Not Audio: Rethinking Text Priors and Audio Reliance in Audio-Language Evaluation cites this paper.

All That Glitters Is Not Audio: Rethinking Text Priors and Audio Reliance in Audio-Language Evaluation AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 33

Resolution
verified exact
arxiv_id, observed 2026-05-11T23:16:36.090825Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-05-07T17:39:38.234052Z digest=sha256:d543188766eb5e28a4b8e2639822e176dea9f5f1eacc9a51e846adae7b35f839

Observation 8c1f157e-598f-42d7-b795-c58e8df79f59 · inbound

PitchBench: Measuring Pitch Hearing in Audio-Language Models cites this paper.

PitchBench: Measuring Pitch Hearing in Audio-Language Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 3

Resolution
metadata mismatch
arxiv_id, observed 2026-06-29T22:44:02.190822Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-06-29T21:05:59.172850Z digest=sha256:4cfa5bb634ec73684fe91204c5f0cd7bb288ff2ecfba5f6ebc5d59ec54815b13

Observation bf6034b7-fcef-4acd-9d12-1857c9035139 · inbound

GlobeAudio: A Multilingual Multicultural Benchmark for Naturalistic Evaluation of Large Audio-Language Models cites this paper.

GlobeAudio: A Multilingual Multicultural Benchmark for Naturalistic Evaluation of Large Audio-Language Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 80

Resolution
verified exact
arxiv_id, observed 2026-07-02T21:17:24.545637Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=arxiv_source observed=2026-06-27T19:51:59.265579Z digest=sha256:5d360c6cb38f494fe8a35eb8f35a1babaaaa32ab56b614053d0764c69cedf7ec

Observation d81f3354-8dc4-4430-bafe-563f94290b38 · inbound

Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents cites this paper.

Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 179

Resolution
metadata mismatch
arxiv_id, observed 2026-06-30T22:15:05.582467Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=arxiv_source observed=2026-06-30T22:11:44.891731Z digest=sha256:729693915a12304ce5a49419d48b3fc1acfd96bc3b1e20380bb1bc1e18636124

Observation 8bff6c29-2a2f-4479-a0c5-a5c03635bc2e · inbound

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing cites this paper.

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 35

Resolution
verified exact
local_arxiv, observed 2026-07-07T14:53:55.866469Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.

source=pdf_text observed=2026-07-07T14:52:35.127533Z digest=sha256:dd574251e9fbf27de1641d3b7f08553c5a1baf5c8aca5e3844713930a9eabb93

Observation 7b4e7f6d-8971-441e-87c9-1faa15b3e281 · inbound

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing cites this paper.

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-02T08:34:05.324498Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T08:34:05.324498Z digest=sha256:84d5f65dc1ca2797fd380d33969de99838d781fab685afb200a816555e45c2d5

Observation e5c0c47f-6b82-4139-b0e8-2c95d94bf9d0 · inbound

X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment cites this paper.

X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 79

Resolution
unresolved
no resolver link, observed 2026-08-01T07:12:15.816142Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T07:12:15.816142Z digest=sha256:d6c83a360c6792aa44ba8fe12bdd6435b2f5f00e34762186e64bf462f241ec2a