Pith. sign in

Paper Citation Record · LEDGER

Audio Large Language Models Can Be Descriptive Speech Quality Evaluators

As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2501.17202.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2501.17202 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 8 of 8 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 8 of 8 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T11:28:47.037457Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T19:00:05.360195Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation ffd1783b-d96b-45b3-875b-cd32e9e3f7cc · inbound

Breaking the Barriers of Text-Hungry and Audio-Deficient AI cites this paper.

Breaking the Barriers of Text-Hungry and Audio-Deficient AI Audio Large Language Models Can Be Descriptive Speech Quality Evaluators

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T11:28:47.037457Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:28:47.037457Z digest=sha256:302ab3ebfd105eaa5a7014867856d3ea0cf8e26cd0829cb8dbc3c6b347fecbcf

Observation 4438c967-708a-4a77-b424-5c1fea0523df · inbound

A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations cites this paper.

A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations Audio Large Language Models Can Be Descriptive Speech Quality Evaluators

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T10:17:45.789315Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:17:45.789315Z digest=sha256:aa777efeaed5d8e7e1a23952fd2b2904104cf709049bd744b4c1a9d1354cdc13

Observation 96ac5bb8-720a-4bd5-9a60-a338f7edbafb · inbound

LLM-Guided Reinforcement Learning for Audio-Visual Speech Enhancement cites this paper.

LLM-Guided Reinforcement Learning for Audio-Visual Speech Enhancement Audio Large Language Models Can Be Descriptive Speech Quality Evaluators

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T18:15:19.109526Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:15:19.109526Z digest=sha256:17f160801572bc86c602b4c7ac83cc2c8fd940964b54d16842c2f1ae952ea1cb

Observation 2f15453f-4e66-438b-9c6a-b6ef15e87eff · inbound

Character Beyond Speech: Leveraging Role-Playing Evaluation in Audio Large Language Models via Reinforcement Learning cites this paper.

Character Beyond Speech: Leveraging Role-Playing Evaluation in Audio Large Language Models via Reinforcement Learning Audio Large Language Models Can Be Descriptive Speech Quality Evaluators

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-05-10T14:25:30.041088Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-10T14:22:25.660785Z digest=sha256:4c4540bf435f3e8bef4e971216d0db5351b555780a269b0f01e18c55919d2019

Observation 87afe5aa-34f3-4a35-8bf4-c560a04f6c03 · inbound

JASTIN: Aligning LLMs for Zero-Shot Audio and Speech Evaluation via Natural Language Instructions cites this paper.

JASTIN: Aligning LLMs for Zero-Shot Audio and Speech Evaluation via Natural Language Instructions Audio Large Language Models Can Be Descriptive Speech Quality Evaluators

Reference 33

Resolution
verified exact
arxiv_id, observed 2026-05-11T18:01:08.390150Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-08T16:43:33.397158Z digest=sha256:c0cbed978a095e92e0b46b7d5a5ee79c81d69ebe8a28a04b8c5b74ad3fb147a9

Observation 7c8cc6cd-a618-4569-aef5-029501514883 · inbound

Leveraging Audio-LLMs to Filter Speech-to-Speech Training Data cites this paper.

Leveraging Audio-LLMs to Filter Speech-to-Speech Training Data Audio Large Language Models Can Be Descriptive Speech Quality Evaluators

Reference 21

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T14:38:28.985717Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-06-27T07:00:53.430064Z digest=sha256:786557d3364bb51be83ab776ba4e2c8582865b9a98270c9805e492cd564c7767

Observation cde5ebd0-4423-4e58-9e2a-a4b0db38dcef · inbound

ParaPairAudioBench: Paralinguistic Pairwise Audio Benchmark for LALM-as-a-Judge cites this paper.

ParaPairAudioBench: Paralinguistic Pairwise Audio Benchmark for LALM-as-a-Judge Audio Large Language Models Can Be Descriptive Speech Quality Evaluators

Reference 24

Resolution
verified exact
arxiv_id, observed 2026-07-04T19:00:05.362056Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-06-25T22:07:10.531784Z digest=sha256:21fc7a2ed16020df0e46c4cb07a2d14d1c62df161868a49c24a73c7b1191486d

Observation f011e11f-c333-499d-8a32-f0ac6a4bab85 · inbound

X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment cites this paper.

X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment Audio Large Language Models Can Be Descriptive Speech Quality Evaluators

Reference 145

Resolution
unresolved
no resolver link, observed 2026-08-01T07:12:17.685669Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T07:12:17.685669Z digest=sha256:1c2daf11ce6e848aa962cbfd6fece8bdf706def2530fc330cd3c9c6852456c3a