Pith. sign in

Paper Citation Record · LEDGER

AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2402.07729.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2402.07729 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 11 of 11 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-03T06:30:56.289259+00:00

measured 11 of 11 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-02T08:34:05.200834Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-07-10T14:17:10.084435Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 9de28d32-1abd-42dd-a3cc-1902ce0618aa · inbound

VoiceBench: Benchmarking LLM-Based Voice Assistants cites this paper.

VoiceBench: Benchmarking LLM-Based Voice Assistants AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

Reference 104

Resolution
verified exact
arxiv_id, observed 2026-05-17T00:50:14.034936Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=arxiv_source observed=2026-05-17T00:50:13.841689Z digest=sha256:56b8cad986799b01feed36f935fd2bb0c357acc4389e1fadadd685f0912a37de

Observation fc7e5d27-5328-4f67-afc0-0d2e03382f8a · inbound

The World is Not Mono: Enabling Spatial Understanding in Large Audio-Language Models cites this paper.

The World is Not Mono: Enabling Spatial Understanding in Large Audio-Language Models AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

Reference 21

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T17:01:07.779505Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-05-16T16:58:42.970074Z digest=sha256:df19146a7ec688f2157f064992144cf8eca95c9c26efde1847a0ccda66d07b18

Observation 8bc80bec-426a-48d4-9f30-a2a415fd3ab0 · inbound

Mitigating Multimodal LLMs Hallucinations via Relevance Propagation at Inference Time cites this paper.

Mitigating Multimodal LLMs Hallucinations via Relevance Propagation at Inference Time AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

Reference 36

Resolution
verified exact
arxiv_id, observed 2026-05-11T10:31:01.638215Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-05-10T15:27:23.591345Z digest=sha256:f01eba0b0c2f977fda2d28987e46bc73f3b45886854244d40d177a9e66b71ed4

Observation 4fb07874-fd0c-445d-8f5b-bf62d19f52bf · inbound

DuplexSLA: A Full-Duplex Spoken Language Model with Synchronized Speech, Language, and Action cites this paper.

DuplexSLA: A Full-Duplex Spoken Language Model with Synchronized Speech, Language, and Action AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-05-21T02:43:54.995777Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-05-21T02:41:13.583493Z digest=sha256:925c0076bf93e5e565fa5a1be8865b49197feeb9c90d85d22459481c8059d342

Observation 54f92202-0963-446c-b3c9-10a8abe0ae5d · inbound

DuplexSLA: A Full-Duplex Spoken Language Model with Synchronized Speech, Language, and Action cites this paper.

DuplexSLA: A Full-Duplex Spoken Language Model with Synchronized Speech, Language, and Action AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-06-30T17:34:57.327536Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-06-30T17:32:58.848455Z digest=sha256:8b0cd606928dbc50ccaf35861cd6ba457595cae562dadac92ce50574d418f84b

Observation d0c51ded-a237-4e37-8afa-e567bec4833c · inbound

Audio-Mind: An Auditable Agentic Framework for Audio Understanding cites this paper.

Audio-Mind: An Auditable Agentic Framework for Audio Understanding AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

Reference 48

Resolution
verified exact
arxiv_id, observed 2026-06-29T10:13:17.630607Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=arxiv_source observed=2026-06-29T10:03:54.653164Z digest=sha256:4feea440a8be3259ab1c048def731a3cf79f421fc7951d99a2b6bcc4176b9ae3

Observation 472e1cda-62c2-4d56-84f3-075352d87b33 · inbound

GlobeAudio: A Multilingual Multicultural Benchmark for Naturalistic Evaluation of Large Audio-Language Models cites this paper.

GlobeAudio: A Multilingual Multicultural Benchmark for Naturalistic Evaluation of Large Audio-Language Models AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

Reference 84

Resolution
verified exact
arxiv_id, observed 2026-07-02T21:17:24.522233Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=arxiv_source observed=2026-06-27T19:51:59.265579Z digest=sha256:05f22318a0b914e703c3030b2c5f83ab9d2b94f5f2d0c21124c59e5de4b18fb1

Observation a8fae2f7-38d8-4ca4-a295-b536f70a11a1 · inbound

From Sounds to Scenes: A Benchmark for Evaluating Context-Aware Auditory Scene Understanding in Large Audio Language Models cites this paper.

From Sounds to Scenes: A Benchmark for Evaluating Context-Aware Auditory Scene Understanding in Large Audio Language Models AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

Reference 11

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T20:10:07.916009Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=arxiv_source observed=2026-06-25T20:36:24.901454Z digest=sha256:2163753ead41269ed814d0b10fdbc8b01495857253febbee6c08b9283891ce03

Observation 48e0c198-d0e2-432b-8a19-31fb192418d3 · inbound

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing cites this paper.

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

Reference 34

Resolution
verified exact
local_arxiv, observed 2026-07-07T14:53:55.855535Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-07-07T14:52:35.127533Z digest=sha256:2ac3a5a853389fb6f49f8ec3b719390f0f13d7c80d84fe9f055b702f4c0f7611

Observation b4e88589-4075-4e31-82ee-d7115afe1b33 · inbound

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing cites this paper.

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-02T08:34:05.200834Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T08:34:05.200834Z digest=sha256:0b27aaa7b3ec6ecd3eba398a081e2624ec45ca31d4bfb41b9f42f2f9f8c5c57e

Observation 94cd768e-0a03-4f15-8b22-c35b40ebdf73 · inbound

A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents cites this paper.

A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension

Reference 10

Resolution
verified exact
local_arxiv, observed 2026-07-10T14:17:10.085901Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-07-10T14:13:50.737253Z digest=sha256:b949a412fe587ea55fa789bfc3dd412b8d3ba0656c507bf80c322b91f598d0f1