Pith. sign in

Paper Citation Record · LEDGER

Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2501.07246.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2501.07246 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 24 of 24 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 24 of 24 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-16T11:17:44.347967Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T07:57:44.602800Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 5380246a-a48d-41ff-8600-a81a1a2b2424 · inbound

Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey cites this paper.

Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 118

Resolution
verified exact
arxiv_id, observed 2026-05-15T17:18:53.165169Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-15T17:18:52.996467Z digest=sha256:6b89fb6f0a9b107bab0e59323579bfbc6ca2e60cc2f100f159fd271cdb0036b6

Observation bc3161dd-030f-4b76-be3e-a2a5c3d100f3 · inbound

SARI: Structured Audio Reasoning via Curriculum-Guided Reinforcement Learning cites this paper.

SARI: Structured Audio Reasoning via Curriculum-Guided Reinforcement Learning Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-16T11:17:44.347967Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:17:44.347967Z digest=sha256:391d882181d980666b2a0f8653388cf1ab415d38e1217b6134ce26f0e83f5f56

Observation 52293daa-1209-4ad3-ad7a-f8bc2b0277cf · inbound

100 Days After DeepSeek-R1: A Survey on Replication Studies and More Directions for Reasoning Language Models cites this paper.

100 Days After DeepSeek-R1: A Survey on Replication Studies and More Directions for Reasoning Language Models Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 85

Resolution
unresolved
no resolver link, observed 2026-08-16T04:43:44.310863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-16T04:43:44.310863Z digest=sha256:3f6a3acb8d19731314f0d56e4eb0696bc63862a32fc6972b5f47f8ecc2b3930c

Observation 3aa8c113-b218-47d7-b6f4-1c436207028d · inbound

MMAR: A Challenging Benchmark for Deep Reasoning in Speech, Audio, Music, and Their Mix cites this paper.

MMAR: A Challenging Benchmark for Deep Reasoning in Speech, Audio, Music, and Their Mix Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-15T20:25:12.644847Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:25:12.644847Z digest=sha256:806c9a075dc2d39a07c314adbfb2b52343cbcebda0318b1910d0aea0496d46f9

Observation 13a23776-4513-41db-ab68-e23694a70cd5 · inbound

AURA: Agent for Understanding, Reasoning, and Automated Tool Use in Voice-Driven Tasks cites this paper.

AURA: Agent for Understanding, Reasoning, and Automated Tool Use in Voice-Driven Tasks Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T21:55:54.386404Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:55:54.386404Z digest=sha256:2732c100a3e957ac5da9de9f002e2ac92548a355c22a7092f484236f488103aa

Observation aeccd722-b14f-4a26-9f9d-afbb627ffbb9 · inbound

MixAssist: An Audio-Language Dataset for Co-Creative AI Assistance in Music Mixing cites this paper.

MixAssist: An Audio-Language Dataset for Co-Creative AI Assistance in Music Mixing Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-06T19:12:03.971484Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T19:12:03.971484Z digest=sha256:6292ee432e63c2fa1f3b79525de836c2f4a12714f22b1763bf71c55ab6be227e

Observation a50a7049-c8dd-4a2b-a12a-59b3bb6e311c · inbound

Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models cites this paper.

Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 80

Resolution
verified exact
arxiv_id, observed 2026-05-15T03:42:44.780651Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-15T03:42:44.523919Z digest=sha256:c258cf53fa50dcf560f338fdd80d54b15438016e82862f06ab02fc9014c6e2f9

Observation 55f84e21-e92a-4fcf-9637-01eb02f816c3 · inbound

Empowering Multimodal LLMs with External Tools: A Comprehensive Survey cites this paper.

Empowering Multimodal LLMs with External Tools: A Comprehensive Survey Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 165

Resolution
unresolved
no resolver link, observed 2026-08-05T20:28:59.038715Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T20:28:59.038715Z digest=sha256:5f9ee907684fedbb2fa63bc0102d059834829576815fe0bc2f2391a2e9832fa9

Observation cde40ad5-62e2-4b8c-9419-fc4ae9ffae6f · inbound

WoW-Bench: Evaluating Fine-Grained Acoustic Perception in Audio-Language Models via Marine Mammal Vocalizations cites this paper.

WoW-Bench: Evaluating Fine-Grained Acoustic Perception in Audio-Language Models via Marine Mammal Vocalizations Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-05T14:43:29.201863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T14:43:29.201863Z digest=sha256:ff1c3155ecd86732aa1c9eede46b86098b34948a6f8e175877fd37a24f581975

Observation c50a83db-4ce6-42c9-8cbf-1e099d99e059 · inbound

Investigating Faithfulness in Large Audio Language Models cites this paper.

Investigating Faithfulness in Large Audio Language Models Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-15T15:48:03.462433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T15:48:03.462433Z digest=sha256:4fa3113b0629a975b3b345cd490faa6bfeb7e1fed543f2bc57a59ae7f7d7ebf3

Observation 1719fbd3-f860-4a3a-8498-d9b655d6e714 · inbound

CapTalk: Unified Voice Design for Single-Utterance and Dialogue Speech Generation cites this paper.

CapTalk: Unified Voice Design for Single-Utterance and Dialogue Speech Generation Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 27

Resolution
verified exact
arxiv_id, observed 2026-05-11T07:16:00.091350Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-10T17:15:28.918204Z digest=sha256:07f000f7c113470fe707f40f8246169ad9eabf86b747c27db62b1802dc02e803

Observation 573a377e-7948-4806-93bf-82d7c680b46e · inbound

Audio-Cogito: Towards Deep Audio Reasoning in Large Audio Language Models cites this paper.

Audio-Cogito: Towards Deep Audio Reasoning in Large Audio Language Models Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 27

Resolution
verified exact
arxiv_id, observed 2026-05-10T14:10:28.284460Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-10T14:10:03.707886Z digest=sha256:db635c894115270807b791b86c9a2f2acf0731e32edab21a77d9a45b1da375a7

Observation c52941fc-617e-4149-83df-0a3feeb17730 · inbound

Audio-Cogito: Towards Deep Audio Reasoning in Large Audio Language Models cites this paper.

Audio-Cogito: Towards Deep Audio Reasoning in Large Audio Language Models Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 27

Resolution
unresolved
no resolver link, observed 2026-07-12T21:18:46.566338Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T21:18:46.566338Z digest=sha256:cee08c8315401a44152d0831285f272d27370512fe3c67a7e633867b1260ba79

Observation 175ca406-d890-4c58-a09e-05a6b7acb062 · inbound

Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models cites this paper.

Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 84

Resolution
verified exact
arxiv_id, observed 2026-05-12T00:41:26.451182Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-07T14:29:18.348031Z digest=sha256:1c89f686b59d4d7772dd6f8c97e116588c95e344cdf6eaa6350dcb920015923c

Observation 76084fc5-e8de-4826-8f2d-079b026f4194 · inbound

VocalParse: Towards Unified and Scalable Singing Voice Transcription with Large Audio Language Models cites this paper.

VocalParse: Towards Unified and Scalable Singing Voice Transcription with Large Audio Language Models Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 20

Resolution
verified exact
arxiv_id, observed 2026-05-11T17:51:09.757516Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-08T16:59:25.973854Z digest=sha256:c63c605b8042edf0fda08e11f3bf05ddc2c7a212e47607f57ceedfac46091449

Observation de39710d-62e0-40fb-b156-2400a34e14d7 · inbound

A Survey of Audio Reasoning in Multimodal Foundation Models cites this paper.

A Survey of Audio Reasoning in Multimodal Foundation Models Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 44

Resolution
verified exact
arxiv_id, observed 2026-05-21T02:09:24.059663Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-21T02:08:06.976461Z digest=sha256:9e7253196163f91634d051e9a6615eaef04f61ba2489395613e6c3d922c51979

Observation 9b2aa08d-227c-4b95-bd7a-197abbc39417 · inbound

Learning When to Think While Listening in Large Audio-Language Models cites this paper.

Learning When to Think While Listening in Large Audio-Language Models Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-06-29T18:43:50.751241Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-06-29T18:37:34.409802Z digest=sha256:62f5a6434c469352d511d45d439978b1aeb3157583d85af014cae32f11dec62a

Observation ab455650-dc21-44a6-b3ac-a30ed14f413d · inbound

VISA: A Visual Information Strengthened Audio-Reasoning System for the Interspeech 2026 ARC Agent Track cites this paper.

VISA: A Visual Information Strengthened Audio-Reasoning System for the Interspeech 2026 ARC Agent Track Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-07-02T20:07:21.325490Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-06-27T21:02:19.300441Z digest=sha256:ff62fe74b6db9a39022a121b0c67903356b18c6008fe5d7f1f0e40b260c3fc4e

Observation 3d9f9e8d-5f9e-4426-a25f-0c2a226b3bf4 · inbound

TinyGiantALM: A Compact Audio-Language Model for Intent-Aware Reasoning under Resource Constraints cites this paper.

TinyGiantALM: A Compact Audio-Language Model for Intent-Aware Reasoning under Resource Constraints Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 38

Resolution
verified exact
arxiv_id, observed 2026-07-02T23:17:29.817376Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-06-27T18:18:41.816342Z digest=sha256:781fe801b1ce76efc822243776df0a0f9560e8ef7ff4868998cef72f01ab6ff2

Observation 2017c47c-82d9-43f0-a6f4-89138b205358 · inbound

Towards Deep Contextual Reasoning from Broad Descriptions for ASR with Speech-LLM via Metadata-Driven Reasoning Chains cites this paper.

Towards Deep Contextual Reasoning from Broad Descriptions for ASR with Speech-LLM via Metadata-Driven Reasoning Chains Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-07-03T07:57:44.604366Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-06-27T11:35:16.646773Z digest=sha256:06d60484e2c611684bff8bc788c3da7ef4ff774cd288ba41c4a4e5bcb6224096

Observation f3641d3d-397c-4875-ac20-768f76134745 · inbound

Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models cites this paper.

Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-01T11:20:17.838169Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T11:20:17.838169Z digest=sha256:2816aef35abd61d4c6da1282940f1b44c8da2fb8ab77b5b24c64bc9e6467b7bb

Observation 4ed1485f-57ef-4921-baab-20702ce030ac · inbound

X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment cites this paper.

X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 108

Resolution
unresolved
no resolver link, observed 2026-08-01T07:12:17.582095Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T07:12:17.582095Z digest=sha256:e9ab84f7bc27752ddc6719be141cd6864e23f6a8ea4d1a1f364e52b207b774eb

Observation d596c087-c165-4388-85fd-298506c7bd68 · inbound

Weak-to-Strong On-Policy Distillation cites this paper.

Weak-to-Strong On-Policy Distillation Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 116

Resolution
unresolved
no resolver link, observed 2026-08-01T00:26:29.186928Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T00:26:29.186928Z digest=sha256:aa1cfa76a117a160f9e66910365a48de728361b0f70e715d41fd22f64bd1a4df

Observation e69da737-0048-43c4-87f9-0e5d530e99fa · inbound

Reinforcement Learning with Evolving Rubrics as Rewards for Audio Reasoning cites this paper.

Reinforcement Learning with Evolving Rubrics as Rewards for Audio Reasoning Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Reference 72

Resolution
unresolved
no resolver link, observed 2026-08-15T15:03:20.385682Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T15:03:20.385682Z digest=sha256:37e4fad5a9c130074bad19ab0250b499c22e922dbff5c4e30eaeb783e83f32f1