{"as_of":"2026-08-04T18:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:56783ffa36b19034c4415b8e2200e36c7f90bd170ce638e77dcc36b6ae46dd26","coverage":[{"denominator":101,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T14:29:18.348031Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T05:20:03.080402Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25591","snapshot_observed_at":"2026-08-02T05:20:03.080402Z","title":"Walking through un- certainty: An empirical study of uncertainty estimation for audio- aware large language models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13408","last_updated":"2026-07-26T03:09:03Z","snapshot_observed_at":"2026-08-02T11:29:40.513819Z","submitted_at":"2026-07-15T03:13:06Z","title":"Improving Text-to-Audio Instruction Following via Fine-Grained Feedback from Audio-Aware Large Language Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T05:20:03.080402Z"},"links":{"cited_paper":"/paper/2604.25591","citing_paper":"/paper/2607.13408"},"observation_digest":"sha256:4bb3013fe56f2bd19725be0c3de3f5f5b8fea739f120fd4a430c50f000c5074b","observation_id":"11e27ef6-1daa-4dc8-89f9-9050d62389a4","resolution":{"observed_at":"2026-08-02T05:20:03.080402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.25591/citation-record","integrity":"/paper/2604.25591/integrity","json":"/paper/2604.25591/citation-record.json","paper":"/paper/2604.25591"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:27b40080d5686c519f0dbae23b5b6b51d21a30fc2b366e9413e9ee07277e5883","observation_id":"c83de2bb-95a8-4bd1-be56-3b662f885fd9","resolution":{"observed_at":"2026-05-12T00:41:26.544156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Listen, think, and understand","venue":null,"work_id":"9fb706a4-4c7b-4587-85a0-9035292d9afc","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:4414a4cf411f2ae261e17718a64294c74c540b6c725a8d6b5d960fdf0912a943","observation_id":"59191103-3eb3-46fd-9ef3-d14cdc35dad1","resolution":{"observed_at":"2026-05-27T04:23:32.865493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Joint audio and speech understanding","venue":null,"work_id":"b791d47c-1eb3-4d65-bf81-b14f5a6ca1e5","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:df9c42cab61ce685dc162d1fec13fd995258f19c10e1f37e50a7fe3d89fd3b04","observation_id":"c9973ee3-1b5f-453f-9090-55867215c73f","resolution":{"observed_at":"2026-05-27T04:23:32.867754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00916","last_updated":"2024-05-28T14:26:28Z","snapshot_observed_at":"2026-07-06T16:13:34.788427Z","submitted_at":"2023-09-02T11:46:05Z","title":"BLSP: Bootstrapping Language-Speech Pre-training via Behavior Alignment of Continuation Writing","version":2},"cited_work":{"arxiv_id":"2309.00916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00916","snapshot_observed_at":"2026-07-04T12:49:52.412623Z","title":"Blsp: Bootstrapping language-speech pre-training via behavior alignment of continuation writing","venue":null,"work_id":"8876c365-fa92-4830-bca3-0372cd37fedc","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2309.00916","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:a612ef9d84a4d21070c31c3b85be5241bcfdd3d4b50c63a4f3ee9495507cc227","observation_id":"ab3104e4-f65f-48cc-bd16-1de81931578b","resolution":{"observed_at":"2026-05-12T00:46:12.325651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Audiochatllama: Towards general-purpose speech abilities for llms","venue":null,"work_id":"da2d3370-69b1-4c3e-9760-36a6fc2edcf6","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:00276cedd018824d2f5d2538fec1e01314cb907d2e5e172c69758ec751c79927","observation_id":"af84fc18-910c-4a08-a972-c48a202bf8c0","resolution":{"observed_at":"2026-05-27T04:23:32.870357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech-copilot: Leveraging large language models for speech process- ing via task decomposition, modularization, and program generation","venue":null,"work_id":"02744ac2-dc47-4190-8443-2f320ac01d27","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:489ebbe0f74279f471101a8365c7d44a85db74d8426f4e0e0c92820874aaaeca","observation_id":"3fccf2f8-ce1e-4c07-9ebf-0cd0268b2c7b","resolution":{"observed_at":"2026-05-27T04:23:32.860523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speechprompt: Prompting speech language models for speech processing tasks","venue":null,"work_id":"23873117-10a7-4a61-b2b0-c0adf690919b","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:022fcf45198208738b1e6916ba40f99ff1b62119e8f12591db966909a4a21036","observation_id":"a726fc27-a51c-4189-833e-512f42ddf53c","resolution":{"observed_at":"2026-05-27T04:23:32.858038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Blsp-emo: Towards empathetic large speech-language models","venue":null,"work_id":"89c91378-bd86-4205-9f44-3d15eded042d","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:989608776740aa2f404d296c0c746020c22261064c1aecb697fc4ebbe39e241e","observation_id":"7d2eb1f3-0697-45a1-afd7-693867e83eed","resolution":{"observed_at":"2026-05-27T04:23:32.853124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Audio flamingo 3: Advancing audio intelligence with fully open large audio language models","venue":null,"work_id":"ecba1a28-8aca-4c58-9265-05fb78bd33bf","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:af73fe0e3559535800481e87f53d1a00c32458fb61563a060594a8bbd4f65da5","observation_id":"2ff02174-0df6-48d7-af84-4d565047f767","resolution":{"observed_at":"2026-05-27T04:23:32.855733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13264","last_updated":"2025-07-17T16:17:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-17T16:17:37Z","title":"Voxtral","version":1},"cited_work":{"arxiv_id":"2507.13264","doi":"10.48550/arxiv.2507.13264","metadata_source":"pith","pith_arxiv_id":"2507.13264","snapshot_observed_at":"2026-07-10T20:27:36.606337Z","title":"V oxtral","venue":"cs.SD","work_id":"d8af79fd-31af-429f-b7c7-b98cea5e46ed","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2507.13264","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:a97ef32f4d6ea4b20c194cf0e01897fc61ee1b8d762b6dcadc040bbc439a1ce7","observation_id":"cddb048c-95c5-4ca8-89b1-7f2772e7c382","resolution":{"observed_at":"2026-05-12T00:46:12.313110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20215","last_updated":"2025-03-26T04:17:55Z","snapshot_observed_at":"2026-08-03T04:23:51.274879Z","submitted_at":"2025-03-26T04:17:55Z","title":"Qwen2.5-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2503.20215","doi":"10.48550/arxiv.2503.20215","metadata_source":"pith","pith_arxiv_id":"2503.20215","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Qwen2.5-Omni Technical Report","venue":"cs.CL","work_id":"438f105c-fa9b-44aa-ad52-43acb8045cda","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2503.20215","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:a71bf870313b3888a007b3708155314952aed63184eff153d20677eecdc04148","observation_id":"9673a38e-34e7-449c-974a-e97960b868f8","resolution":{"observed_at":"2026-05-12T00:46:12.319812Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:18:44.887499+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:18:44.887499+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07111","last_updated":"2024-12-27T07:29:19Z","snapshot_observed_at":"2026-07-06T19:48:32.368124Z","submitted_at":"2024-11-11T16:37:40Z","title":"Building a Taiwanese Mandarin Spoken Language Model: A First Attempt","version":2},"cited_work":{"arxiv_id":"2411.07111","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.07111","snapshot_observed_at":"2026-07-04T11:59:50.259182Z","title":"Building a taiwanese mandarin spoken language model: A first attempt","venue":null,"work_id":"124b430d-5f85-4a49-a1a2-0e0ff371dbcb","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2411.07111","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:1430dd2d55fdedc1d2b83a24e45f1a176174c4027424df48d55dd839c1b6699a","observation_id":"7ecd962a-b249-4b20-9e00-962d7e7a1171","resolution":{"observed_at":"2026-05-12T00:41:26.282093Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Teaching audio-aware large language mod- els what does not hear: Mitigating hallucinations through synthesized negative samples","venue":null,"work_id":"f5391ca8-410b-4ff0-8ae7-3ec6a25407fd","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:e6c304e81fd78c89b27fd43df3f294e3910b0c814c9ad6057cfab6cf2c3f8f1f","observation_id":"617b4a92-2d87-4919-9e3e-eef9e907b787","resolution":{"observed_at":"2026-05-27T04:23:32.786330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From alignment to advancement: Bootstrapping audio-language alignment with synthetic data","venue":null,"work_id":"4899cafd-e6c8-432e-a384-fec566cae5da","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:9a91f05f02d4249f2885c4c241d009ebc8e5c0c6072326284f3c31155686f8c8","observation_id":"798bb727-acef-423b-b303-30854677bdbb","resolution":{"observed_at":"2026-05-27T04:23:32.810042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T06:52:04.453353Z","title":"Recent advances in discrete speech tokens: A review","venue":null,"work_id":"3289dae4-4591-40df-8a83-76ebb63b1571","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:47d4d5b0917ccbbc92e4dc75a23b621606c53bff42ca7ce1b7eb1e830ee0014a","observation_id":"f4a26c85-cd0f-49d7-ab4e-e064337ae55c","resolution":{"observed_at":"2026-05-27T04:23:32.875165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13236","last_updated":"2024-02-20T18:50:25Z","snapshot_observed_at":"2026-07-06T17:33:00.716054Z","submitted_at":"2024-02-20T18:50:25Z","title":"Towards audio language modeling -- an overview","version":1},"cited_work":{"arxiv_id":"2402.13236","doi":"10.48550/arxiv.2402.13236","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13236","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Felix Wu, Kwangyoun Kim, Shinji Watanabe, Kyu J","venue":null,"work_id":"ec26714a-6e17-47fa-82e4-b956fcd16591","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2402.13236","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:983dc5a330f738393c4b76c9e1710152a8e802426336e9ba449c7474282c2ac3","observation_id":"2d628b51-8860-41ea-8eb3-39352ed9185c","resolution":{"observed_at":"2026-05-12T00:41:26.269011Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.10274","doi":"10.48550/arxiv.2506.10274","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Discrete audio tokens: More than a survey!","venue":null,"work_id":"c89ef171-a1ea-49a1-8800-b9d5ef2dc175","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:d94810ece2b53207d15cfd0245c266a8e28f667289764334c26865a7a1b75537","observation_id":"09cbc37e-00d5-4604-a8f4-6c3ff1dbf1c9","resolution":{"observed_at":"2026-05-12T00:41:26.366893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recent advances in speech language models: A survey","venue":null,"work_id":"e452eeb4-e13a-4784-8146-62b92e454109","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:209553b5079b4f59f4033e800a74fbb5d2901d43fb44fb56ec8eec18a5fef481","observation_id":"cdf24200-0e71-47b6-a969-923c3cc45bb2","resolution":{"observed_at":"2026-05-27T04:23:32.783193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on speech large language models for understanding","venue":null,"work_id":"cdab7565-620b-4a83-9e03-0b7f1dcf8563","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:35630105117650c6c1c2134a849e0bde36eac42653f6a9005487b3196ca5ee33","observation_id":"9c6db1d4-802a-4a41-9480-0b5c1a935081","resolution":{"observed_at":"2026-05-27T04:23:32.750477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13577","last_updated":"2024-11-26T09:20:48Z","snapshot_observed_at":"2026-08-04T15:39:52.629037Z","submitted_at":"2024-11-15T04:16:45Z","title":"WavChat: A Survey of Spoken Dialogue Models","version":2},"cited_work":{"arxiv_id":"2411.13577","doi":"10.48550/arxiv.2411.13577","metadata_source":"pith","pith_arxiv_id":"2411.13577","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"WavChat: A survey of spoken dialogue models.arXiv preprint arXiv:2411.13577","venue":"eess.AS","work_id":"3e856eda-dc15-4393-81a6-064114906c75","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2411.13577","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:f4dbb3f381a7e855a5dc6ff3305d44a55c2cf9243893492246ddd7b5f58ee1ed","observation_id":"e8014a72-e25e-48c7-9938-bfde1e7c5e27","resolution":{"observed_at":"2026-05-12T00:41:26.363121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:18:53.17237+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:18:53.17237+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":"2503.01743","doi":"10.18653/v1/2023.wmt-1.23","metadata_source":"pith","pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","venue":"cs.CL","work_id":"83956045-536a-41ff-af02-b80e2a614eab","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:f1545659ae8f5b108c177fcdaf59d9c17e6059bd3d96e7cb13c982d88582545a","observation_id":"b8f59b96-2c41-4705-9995-ca30cc122839","resolution":{"observed_at":"2026-05-12T00:41:26.438714Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:88822c7cd460cc06fb32879985deca3a6d49636ef653c9b59d6b4c0b81268e03","observation_id":"1775c3e5-8081-4e52-b8cd-0f3c92798af8","resolution":{"observed_at":"2026-05-12T00:41:26.445894Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the landscape of spoken language models: A comprehensive survey","venue":null,"work_id":"ec2e5145-3e2d-4f94-8502-58af8bd70ab4","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:219a6dec113b144a99f0fce5c02ec893814f2718a3d5b3bc437599c2ccba6a03","observation_id":"94db9852-a35b-4528-951b-c2ed82e553a5","resolution":{"observed_at":"2026-05-27T04:23:32.816157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Audio flamingo 2: An audio-language model with long-audio understanding and expert reasoning abilities","venue":null,"work_id":"d7d037f2-67a1-4689-946d-ebee82a21272","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:b1a88984ee0668e925b624d90c0abe8b05eabef57b93b84cd992d1ed52c6caf3","observation_id":"e0b896c9-efc2-4c08-879e-074a7491b092","resolution":{"observed_at":"2026-05-27T04:23:32.801849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.22267","last_updated":"2026-05-13T14:33:44Z","snapshot_observed_at":"2026-08-03T10:51:29.519900Z","submitted_at":"2026-03-23T17:51:40Z","title":"TiCo: Time-Controllable Spoken Dialogue Model","version":2},"cited_work":{"arxiv_id":"2603.22267","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.22267","snapshot_observed_at":"2026-07-03T05:07:39.491383Z","title":"TiCo: Time-Controllable Spoken Dialogue Model","venue":"cs.CL","work_id":"7a127a16-f363-484d-b677-9864a1ca9a30","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2603.22267","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:cbb9472caf7a2642db138e361e410c1b61c1c9c426a06fa7e41bdc875460d051","observation_id":"5f68f27a-f387-49c2-88a3-5f48aef41324","resolution":{"observed_at":"2026-05-14T02:56:21.785942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mmau: A massive multi- task audio understanding and reasoning benchmark","venue":null,"work_id":"40131154-6e17-406c-ae52-0208ceef74ea","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:4d9cbd1f484ae1597361592a4e2582ae139131861cf7ad1d2a121c84c72ee4e2","observation_id":"5dfeee5c-60cf-4b2a-b6df-16b20bd74bde","resolution":{"observed_at":"2026-05-27T04:23:32.767855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13032","last_updated":"2025-05-19T12:18:42Z","snapshot_observed_at":"2026-08-02T08:58:30.438344Z","submitted_at":"2025-05-19T12:18:42Z","title":"MMAR: A Challenging Benchmark for Deep Reasoning in Speech, Audio, Music, and Their Mix","version":1},"cited_work":{"arxiv_id":"2505.13032","doi":"10.48550/arxiv.2505.13032","metadata_source":"pith","pith_arxiv_id":"2505.13032","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Mmar: A challenging benchmark for deep reasoning in speech, audio, music, and their mix","venue":"cs.SD","work_id":"fe97a573-dedf-4e07-af07-b22508260a10","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2505.13032","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:5887eb1d3277d59e0dc33a746a90c1ac6dbefeb894f07185016dcdfe41ee4418","observation_id":"d36301f1-b210-4179-b7d9-79d79e33735f","resolution":{"observed_at":"2026-05-12T00:41:26.472451Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13992","last_updated":"2025-08-19T16:33:49Z","snapshot_observed_at":"2026-07-06T22:15:08.135791Z","submitted_at":"2025-08-19T16:33:49Z","title":"MMAU-Pro: A Challenging and Comprehensive Benchmark for Holistic Evaluation of Audio General Intelligence","version":1},"cited_work":{"arxiv_id":"2508.13992","doi":"10.48550/arxiv.2508.13992","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.13992","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Mmau-pro: A challenging and comprehensive benchmark for holistic evaluation of audio general intelligence","venue":null,"work_id":"34fbbc93-cd79-4b11-a99d-32d597b71a37","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2508.13992","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:fa7448fc4f2d8722a0582d5cedd144d0b45762e4f30958768338b7cb228f4bb8","observation_id":"51ff07d7-eeee-47dc-ac61-93f1c282e891","resolution":{"observed_at":"2026-05-12T00:41:26.485335Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04779","last_updated":"2026-03-16T09:24:19Z","snapshot_observed_at":"2026-08-02T22:58:18.776196Z","submitted_at":"2025-06-05T09:09:36Z","title":"MMSU: A Massive Multi-task Spoken Language Understanding and Reasoning Benchmark","version":3},"cited_work":{"arxiv_id":"2506.04779","doi":"10.48550/arxiv.2506.04779","metadata_source":"pith","pith_arxiv_id":"2506.04779","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"MMSU: A Massive Multi-task Spoken Language Understanding and Reasoning Benchmark","venue":"cs.CL","work_id":"1a24d3b1-2d00-407c-90f0-b0aeec13bfe6","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2506.04779","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:3fe8a530304df90139985a6d77b396f017a7b7121fc84e532e17d236d9dacd14","observation_id":"6a6f05de-885c-46e1-a53d-a1c5eeac4aa8","resolution":{"observed_at":"2026-05-17T17:21:50.902611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:22:14.816429+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:22:14.816429+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sakura: On the multi-hop reasoning of large audio-language models based on speech and audio information","venue":null,"work_id":"c5f2e457-05dd-4ba8-8faa-70b537ed91b6","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:9d72b290b065832063416d3bc37d5a26b46a255a0bac1f58c8c653505a4301de","observation_id":"77bff379-df2f-4174-a0ad-53a861ba0896","resolution":{"observed_at":"2026-05-27T04:23:32.761925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Understanding sounds, missing the questions: The challenge of object hallucination in large audio-language models","venue":null,"work_id":"1d679937-4a46-4759-bcf8-c5defe33f05c","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:93d1d76266172c7fd6b923a49e075ac7816c666154bba4d5189006a8bee750f2","observation_id":"72a2ccab-809b-46b9-9017-e15cb816e910","resolution":{"observed_at":"2026-05-27T04:23:32.780738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can large audio-language models truly hear? tackling hallucinations with multi-task assessment and stepwise audio reasoning","venue":null,"work_id":"aed8fec2-745d-4807-ac87-6e51d138ed83","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:39c07bff9614edae1499a32cb2bffc894d578f860739e9bb239a97687b73c62b","observation_id":"2eb5e03a-2ee1-4457-b063-1a9b9756631c","resolution":{"observed_at":"2026-05-27T04:23:32.778351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamic-superb: Towards a dynamic, collaborative, and compre- hensive instruction-tuning benchmark for speech","venue":null,"work_id":"68fe15ed-cc9a-4ccc-b45c-4e31e96175eb","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:3564b25d72cb954239a656550ff92b35bcd9dca58faf415de28115cc68333505","observation_id":"429d4cd1-8061-45c1-aca8-1cbfa4642966","resolution":{"observed_at":"2026-05-27T04:23:32.775499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamic- superb phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks","venue":null,"work_id":"3d0c0c02-8621-4771-9717-e58351ed7374","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:de769865ccbfd5d8676ffa4d898799bab185146e23a25db5cf32facf5869450c","observation_id":"497c1a4c-770f-470a-9e2b-41b31dea1f00","resolution":{"observed_at":"2026-05-27T04:23:32.821217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Listen and speak fairly: a study on semantic gender bias in speech integrated large language models","venue":null,"work_id":"cf0f7f10-33e3-4367-a298-b0b7a0202b84","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:03cebe68a3f87c2018f08117aaf95bf4713e17d7dd88963e1cc580f3db41d90d","observation_id":"d0fd806d-8768-4962-8864-469703aec8e6","resolution":{"observed_at":"2026-05-27T04:23:32.842735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spoken stereoset: on evaluating social bias toward speaker in speech large language models","venue":null,"work_id":"ac6537e3-df87-4eb3-af4f-0d7b9920212d","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:9f750dc16f7343d380c57e4168c921099c383275d2db6a504f9f8d303a13bfb9","observation_id":"de9baca7-70ff-4304-86e4-de7c6bc0bbab","resolution":{"observed_at":"2026-05-27T04:23:32.770392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Av-superb: A multi- task evaluation benchmark for audio-visual representation models","venue":null,"work_id":"81e55dc5-82a8-4b8f-b6ee-c0cfd3202921","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:60ca88ee3bfe8b62d904d912a3d843a77b108498f03470bd365f2286be09ca3a","observation_id":"bf4fee46-deda-4ece-ac65-8773f392e8ea","resolution":{"observed_at":"2026-05-27T04:23:32.791688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beyond single-audio: Advancing multi-audio processing in audio large language models","venue":null,"work_id":"f03ce6a5-2cdf-4762-8d73-984656574ca9","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:2eb74b05c141ae0c438ada52afebdbd3ebe4abe791d2d315c49730868e998baf","observation_id":"5466642d-f353-46d7-940c-4f070cae7989","resolution":{"observed_at":"2026-05-27T04:23:32.795127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07293","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:53:55.839119Z","title":"Audiomarathon: A comprehensive benchmark for long-context audio understanding and efficiency in audio llms","venue":null,"work_id":"09d1fac2-ebc7-4758-8efd-e47325ca4f45","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:47504e1d55caf1dd15823eb324c987bb3d0abea6f2e8d7ef859f71e3dff4b88c","observation_id":"4f29760f-c301-4d30-a950-8e5a816d477b","resolution":{"observed_at":"2026-05-12T00:41:26.289094Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech-ifeval: Evaluating instruction-following and quantifying catastrophic forgetting in speech- aware language models","venue":null,"work_id":"5608ca82-4886-4e35-81b9-ba52226faaa2","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:15be6ccd3c223e2367799c3aa903bb0e8d6f662804e7fbdd9937f23339f08b44","observation_id":"80b5c9be-de42-47e1-b854-77a0f07a1ecd","resolution":{"observed_at":"2026-05-27T04:23:32.798881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22251","last_updated":"2025-06-05T10:40:05Z","snapshot_observed_at":"2026-07-06T21:32:09.192939Z","submitted_at":"2025-05-28T11:39:59Z","title":"Evaluation of LLMs in Speech is Often Flawed: Test Set Contamination in Large Language Models for Speech Recognition","version":2},"cited_work":{"arxiv_id":"2505.22251","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22251","snapshot_observed_at":"2026-06-28T22:52:44.973580Z","title":"Evaluation of llms in speech is often flawed: Test set contamination in large language models for speech recognition","venue":null,"work_id":"1c3cb60f-fb00-4678-a5e8-e7485c30c7dd","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2505.22251","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:bac313cad270078f576460afed3e991a53f3a9cd8199ba95d9aeab225fce4ad8","observation_id":"a74ba727-e03f-42d1-a4b3-ce8ce35bf26d","resolution":{"observed_at":"2026-05-12T00:41:26.371213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.08723","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:00:05.346696Z","title":"Paras2s: Benchmarking and aligning spoken language models for paralinguistic- aware speech-to-speech interaction","venue":null,"work_id":"1710115e-84a4-4b58-a02c-b049fdbf9743","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:ebc5a80b0d79daf08520ae1293dd3eeb3f0ea95dcd390c58be60e687b7451615","observation_id":"88b25f30-060f-4b24-80d9-a49ff7705dd0","resolution":{"observed_at":"2026-05-12T00:41:26.401458Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.10723","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mos-bias: From hidden gen- der bias to gender-aware speech quality assessment","venue":null,"work_id":"a695166b-1078-4f06-958c-2d07babc6ee9","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:db07efec25307fc208b75bbe82b34e213b3bb1dde15a5f012bea3a477dd4b018","observation_id":"965ba637-0f9f-46c7-8ffb-aaf5cf4dc5b3","resolution":{"observed_at":"2026-05-12T00:41:26.329799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aqua-bench: Beyond finding answers to knowing when there are none in audio question answering","venue":null,"work_id":"8912a737-1086-4ab1-93bc-60b9bf351636","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:4bdb575f357e0be8f553dbfe7e3d2ba79e63f6ea85a4db2db9d12d2dc300f49a","observation_id":"96a56b04-9af5-42fe-a154-d735be634997","resolution":{"observed_at":"2026-05-27T04:23:32.753371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.14728","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aqascore: Evaluating seman- tic alignment in text-to-audio generation via audio question answering","venue":null,"work_id":"5472d539-0a55-49b2-b01c-40eddc00c741","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:d44c9cb56096964262bbfc96d51d4977a661cac0f5f53cc7847249101d96dc4e","observation_id":"2fbaab75-28ee-467e-ac7d-8e002936ec64","resolution":{"observed_at":"2026-05-12T00:41:26.480891Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.13768","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T02:39:24.630746Z","title":"Causal tracing of audio-text fusion in large audio language models","venue":null,"work_id":"7730fab7-433e-4d13-b46a-3254c2e717c7","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:47654e63157b8b195eea3e7302a2504e16d5975a40c2bd296da899cb06e1ddee","observation_id":"478c79b7-ac60-4a61-89b1-d390327a418c","resolution":{"observed_at":"2026-05-12T00:41:26.376407Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.28378","last_updated":"2026-06-16T01:03:58Z","snapshot_observed_at":"2026-07-13T16:22:05.277888Z","submitted_at":"2026-03-30T12:45:28Z","title":"Membership Inference Attacks against Large Audio Language Models","version":2},"cited_work":{"arxiv_id":"2603.28378","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.28378","snapshot_observed_at":"2026-06-19T17:09:53.626252Z","title":"Membership inference attacks against large audio language models","venue":null,"work_id":"b77e3979-3624-4b9e-ad1e-bad133368664","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2603.28378","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:ef706626dbf17ca6e9a39e4d97b51a81d7aacfc61996f3a5eeac82daf30fdebb","observation_id":"c5444331-0f7d-431a-bddd-a69fc3d52fd2","resolution":{"observed_at":"2026-06-19T17:09:53.626252Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.22758","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Echomind: An interrelated multi-level benchmark for evaluating empathetic speech language models","venue":null,"work_id":"e4bbde73-4623-4fee-a3ff-18565649b14a","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:46c9a51f6181f57b084cefc8c966f0b1535caed6d2d37df84811cfebb29f77a0","observation_id":"9b9da01c-1ddf-442c-b74c-568438344da6","resolution":{"observed_at":"2026-05-12T00:41:26.312928Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.09232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T11:59:50.227325Z","title":"How contrastive decoding enhances large audio language models?","venue":null,"work_id":"c28c1b42-3a62-42ea-a4f7-4c92f6d9c63a","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:f41cacc2d5f7ee516db5822aa378a5b61bb6f30cc6af84603a71192709cb14f7","observation_id":"4fd2e84f-14d4-442d-833b-b350483a82dd","resolution":{"observed_at":"2026-05-12T00:41:26.355087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.21478","last_updated":"2026-06-20T08:38:30Z","snapshot_observed_at":"2026-07-13T20:50:19.737617Z","submitted_at":"2026-03-23T01:44:45Z","title":"TaigiSpeech: A Low-Resource Real-World Speech Intent Dataset and Preliminary Results with Scalable Data Mining In-the-Wild","version":2},"cited_work":{"arxiv_id":"2603.21478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.21478","snapshot_observed_at":"2026-06-23T03:12:46.979564Z","title":"Taigis- peech: A low-resource real-world speech intent dataset and prelim- inary results with scalable data mining in-the-wild","venue":null,"work_id":"007421ac-a643-406b-94bc-94526e85947b","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2603.21478","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:7d68f4df17d677add8a63890bf37ba52bd377acc6ee4d6298e5ff3bf92f390ed","observation_id":"6a11c11d-2bed-445d-b96b-f711c975ae13","resolution":{"observed_at":"2026-06-23T03:12:46.979564Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.17248","last_updated":"2026-07-03T19:14:23Z","snapshot_observed_at":"2026-08-04T09:23:59.836631Z","submitted_at":"2026-04-19T04:22:47Z","title":"VIBE: Voice-Induced open-ended Bias Evaluation for Large Audio-Language Models via Real-World Speech","version":2},"cited_work":{"arxiv_id":"2604.17248","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.17248","snapshot_observed_at":"2026-07-04T13:59:52.879900Z","title":"VIBE: Voice-Induced open-ended Bias Evaluation for Large Audio-Language Models via Real-World Speech","venue":"eess.AS","work_id":"3a5dd6eb-9f93-4e09-8796-7e8e8ea9f9cc","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2604.17248","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:2e7372cae46729f5265d18757e39e9ba3b25376435473a87f4044a89185d70c6","observation_id":"1852f61b-8335-4de2-8238-0794a11c2b5c","resolution":{"observed_at":"2026-05-12T00:41:26.276400Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Game-time: Evaluating temporal dynamics in spoken language models","venue":null,"work_id":"afc40c77-4286-4d25-9f55-b51e699311c4","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:bb2b842dceffb2ecc6a7273ed7c8d9d5d68c57c42bcfbd3a7114b6bf01377505","observation_id":"7b28180b-6eeb-4acd-969b-72bd335d95e9","resolution":{"observed_at":"2026-05-27T04:23:32.788928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.24052","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T19:35:32.861541Z","title":"Aha: Aligning large audio-language models for reasoning hallucinations via counterfactual hard negatives","venue":null,"work_id":"213b5547-0ac9-4e6c-a246-6e921455cfae","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:3edbfe3ef00c9a1c2188bdfa89b1972fc2419aacc3d7cb90ca6289e7af1b04aa","observation_id":"1339f14f-dbf3-44ff-9ce5-9e67c8428a6e","resolution":{"observed_at":"2026-05-12T00:41:26.529745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19300","last_updated":"2026-04-21T10:05:28Z","snapshot_observed_at":"2026-08-03T21:49:52.344628Z","submitted_at":"2026-04-21T10:05:28Z","title":"HalluAudio: A Comprehensive Benchmark for Hallucination Detection in Large Audio-Language Models","version":1},"cited_work":{"arxiv_id":"2604.19300","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19300","snapshot_observed_at":"2026-07-02T17:07:12.125850Z","title":"HalluAudio: A Comprehensive Benchmark for Hallucination Detection in Large Audio-Language Models","venue":"cs.SD","work_id":"3dd7dec0-c7d6-4829-90e0-edf4379001c0","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2604.19300","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:37fb4f29c810346f21fa0c229c57653971b4b8f4cbc4da0a160d34a1641a974c","observation_id":"01f1f085-9d09-4be0-95b0-2b1773ba824e","resolution":{"observed_at":"2026-05-12T00:41:26.521802Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.16211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Audiotrust: Benchmarking the multifaceted trustworthiness of audio large language models","venue":null,"work_id":"ddc276b0-adb9-4470-99e0-fa7f1b36a213","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:8081c482d9ff3d9f216802021ed790db87bfc89abbc625222014570d93de7dd4","observation_id":"b95cae0e-99ca-48a7-b586-8cc079588481","resolution":{"observed_at":"2026-05-12T00:41:26.517229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.21060","doi":"10.48550/arxiv.2509.21060","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Measuring audio’s impact on correctness: Audio-contribution-aware post-training of large audio language models","venue":null,"work_id":"78aac118-cc6b-4c29-bfd2-7104eaab9861","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:c5b6a7d69047e9f6ac34ecaa39fe6971ad8821e0231c89b0e0a0e7ba3dee7904","observation_id":"a476ef6f-6c82-4bc4-8a3d-41e222a3d059","resolution":{"observed_at":"2026-05-12T00:41:26.476774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02136","last_updated":"2018-10-03T07:32:57Z","snapshot_observed_at":"2026-08-02T06:41:33.803920Z","submitted_at":"2016-10-07T04:06:01Z","title":"A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks","version":3},"cited_work":{"arxiv_id":"1610.02136","doi":"10.48550/arxiv.1610.02136","metadata_source":"pith","pith_arxiv_id":"1610.02136","snapshot_observed_at":"2026-07-10T19:27:32.286105Z","title":"A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks","venue":"cs.NE","work_id":"010332fc-8aad-4ab2-a1de-1ddd0a3c4b7f","year":2016},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/1610.02136","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:9110e92a5ae19c0c9812330c6a80bb121de031c1045bb1102305a84a72fb5d07","observation_id":"04946bf8-8db3-4663-b1e5-d8ad32ae10fb","resolution":{"observed_at":"2026-05-12T18:23:45.262282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:23:24.594975+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:23:24.594975+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can you trust your model’s uncertainty? evaluating predictive uncertainty under dataset shift","venue":null,"work_id":"984ebcb1-369b-42f8-a976-f00ca63a9051","year":2019},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:f5a68c0f87a39a500a602e4855a6f1ac96e47559b222637a7de311d40c7a78e7","observation_id":"e9b22d5a-fb70-494c-a8c0-a0558dacfe3a","resolution":{"observed_at":"2026-05-27T04:23:32.756271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Calibration of pre-trained transformers","venue":null,"work_id":"00a5d141-7060-4884-b8c1-111ce95772e5","year":2020},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:657a6aa39851b140b73e2a5b6278baf2d08d4f4f272f249b64e20a0e8217797b","observation_id":"c3316c0a-5739-4f24-a603-850ce2b39491","resolution":{"observed_at":"2026-05-27T04:23:32.807267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:8e104c0212eef00a7e1728608d00c8a653e23deb7662cdb4e59de52565aca9f6","observation_id":"4b2d4a92-62be-4a2c-b808-ae570bdbc654","resolution":{"observed_at":"2026-05-12T00:41:26.407246Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How can we know when language models know? on the calibration of language models for ques- tion answering","venue":null,"work_id":"6483bc03-b931-4848-bac5-6cf2b1e6adc4","year":2021},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:59b13ddcbdcd21c13687fecd3f97714f281b1f8819b761ffc300025be9790eca","observation_id":"64b38bb4-4f8f-4835-a2df-e2c179aeec8f","resolution":{"observed_at":"2026-05-27T04:23:32.804604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":"2207.05221","doi":"10.1145/3618260.3649777","metadata_source":"pith","pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Language Models (Mostly) Know What They Know","venue":"cs.CL","work_id":"8ca58a10-da41-4f70-baae-7e449512e345","year":2022},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:e4b031d5e38dae14788a2297f5535cfdc41f8c3118f9fec476bd4865c2b02216","observation_id":"4dec203d-36a1-469e-b736-ded8835b0fa9","resolution":{"observed_at":"2026-05-12T00:41:26.322498Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reducing conversational agents’ overconfidence through linguistic calibration","venue":null,"work_id":"de21432f-d18b-4da7-b102-093f6f25fe7b","year":2022},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:c2a0a933bc2a385322c2d1fabbbea7397521e94cd41f1a17550964508d6baa4e","observation_id":"d40632c2-0567-41dd-bc57-21b56d549fb0","resolution":{"observed_at":"2026-05-27T04:23:32.759068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beyond the imitation game: Quantifying and extrapolating the capabilities of language models","venue":null,"work_id":"4fe72d20-7998-443f-81ea-ca74cf093fdc","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:f37f461a4f67866eb41e2210ba691165967a949352643a3e9388bedba2880bbf","observation_id":"5295a13d-f08f-46aa-a99c-35f158798eb3","resolution":{"observed_at":"2026-05-27T04:23:32.764932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semantic uncertainty: Linguistic invariances for uncertainty estimation in natural language generation","venue":null,"work_id":"43bdbea1-af09-4a31-9485-448605166ecd","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:3030e715aa1f29339b9aaff8cccff86356478e21d7e01d0cd4e9f0f6d0373c15","observation_id":"6df076e2-86ad-419b-9926-a01b36492caf","resolution":{"observed_at":"2026-05-27T04:23:32.772779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Detecting hallucinations in large language models using semantic entropy","venue":null,"work_id":"09d82651-930b-48d1-8e65-f3c3307800f9","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:6adc3006749779ce36e8eb202bda12f077d9c186fae5e8c94468e2a935a46635","observation_id":"7ea998fd-df88-4894-878e-1f0bcaac20e2","resolution":{"observed_at":"2026-05-27T04:23:32.818709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:07:54.687190Z","title":"Kernel language entropy: Fine-grained uncertainty quantification for llms from semantic similarities","venue":null,"work_id":"b30e15cc-a944-4f4e-9698-920e131e4900","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:07d15da24adf37ec0e1f93321a271b1215223bb36cbcfc2ebde4bdb3ee18ea7c","observation_id":"4a302e89-2b3e-4793-aeb0-7208d213005d","resolution":{"observed_at":"2026-05-27T04:23:32.847243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beyond semantic entropy: Boosting llm uncertainty quantification with pairwise semantic similarity","venue":null,"work_id":"3d673293-5f48-4894-bfeb-7897f9533da5","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:f06bf0a6c0ecc739ca769a3bfed1661c013380e7fbf832a8ede84514df1d251a","observation_id":"a9931b1c-6a2f-4bc8-8203-cfdf8bf2a544","resolution":{"observed_at":"2026-05-27T04:23:32.840199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":"eef0bda4-ccbb-4678-8def-4331780ce18d","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:4e52590712276d1628fbaa713d72eea06c30c6820acdb4a612b56df5cb6fd758","observation_id":"d46d6f9e-1369-4ff6-8edd-39d82380c59e","resolution":{"observed_at":"2026-05-27T04:23:32.844915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the calibration of large language models and alignment","venue":null,"work_id":"290cffa1-8ce5-436f-8414-b36250cacb58","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:88dadff25b52a708326aad191fccd7357675edfae7ab79616099ed1188cc2a61","observation_id":"63757525-db87-4f19-94c9-86b998c1e4ff","resolution":{"observed_at":"2026-05-27T04:23:32.849969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T19:27:32.459885Z","title":"On calibration of modern neural networks","venue":null,"work_id":"0e64fbed-6673-49ad-80ac-c4f356f82bac","year":2017},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:e7f59750a6021b0a1290d85a8b98657959bbd991daf186010369790fbcf42ce1","observation_id":"4fd97f8f-4126-4a6d-b0ad-79700c2f02de","resolution":{"observed_at":"2026-05-27T04:23:32.813046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14334","last_updated":"2022-06-13T05:04:53Z","snapshot_observed_at":"2026-08-03T04:20:54.522222Z","submitted_at":"2022-05-28T05:02:31Z","title":"Teaching Models to Express Their Uncertainty in Words","version":2},"cited_work":{"arxiv_id":"2205.14334","doi":"10.1093/jamiaopen/ooaf058","metadata_source":"pith","pith_arxiv_id":"2205.14334","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Teaching Models to Express Their Uncertainty in Words","venue":"cs.CL","work_id":"5dfa654a-4d1b-41c5-a6e0-769ffe4b7741","year":2022},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2205.14334","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:c378aead744185b09799f0e93d83275befcfabd0f9da8167c23aa55176e2311f","observation_id":"c8fdfe0a-8b32-4f5b-81df-13eac91926bd","resolution":{"observed_at":"2026-05-16T17:36:08.649609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Do large language models know what they don’t know?","venue":null,"work_id":"de04e348-dad2-4695-b85a-69f9904de850","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:7a23c9a1ad7e0483c03f42705a151c984c427eec921bbf84717a551fbdf46e7d","observation_id":"e2cb5573-e8e5-473a-9b09-4c6dbe3bd984","resolution":{"observed_at":"2026-05-27T04:23:32.863332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16820","last_updated":"2025-02-25T05:03:51Z","snapshot_observed_at":"2026-07-06T20:41:23.980642Z","submitted_at":"2025-02-24T04:05:08Z","title":"Uncertainty Quantification of Large Language Models through Multi-Dimensional Responses","version":2},"cited_work":{"arxiv_id":"2502.16820","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.16820","snapshot_observed_at":"2026-07-04T10:09:45.348643Z","title":"arXiv preprint arXiv:2502.16820 , year=","venue":null,"work_id":"a680a0e6-9304-4f8b-9011-d931416c4893","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2502.16820","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:b389f98825f5d013b71183499e8379d6d2e3a6aa291da70eeefcc7dce8f945a8","observation_id":"6b4482ea-2175-466f-b606-e9f6b71c4254","resolution":{"observed_at":"2026-05-12T00:41:26.498733Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15326","last_updated":"2024-10-20T07:55:44Z","snapshot_observed_at":"2026-07-06T19:36:36.994783Z","submitted_at":"2024-10-20T07:55:44Z","title":"A Survey of Uncertainty Estimation in LLMs: Theory Meets Practice","version":1},"cited_work":{"arxiv_id":"2410.15326","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15326","snapshot_observed_at":"2026-07-08T10:04:51.463562Z","title":"arXiv preprint arXiv:2410.15326 , year=","venue":"cs.CL","work_id":"1b88c974-fc69-4d66-960f-8839ddb09098","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2410.15326","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:6601dd94fba3377e38c23ad55a122bb570ad7aca9fbec6b4aad99273614f0b36","observation_id":"2bbc881b-0296-4ee9-b474-8bf5a3dfe955","resolution":{"observed_at":"2026-05-12T00:41:26.338831Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04459","last_updated":"2023-06-05T06:46:53Z","snapshot_observed_at":"2026-07-06T15:39:45.449997Z","submitted_at":"2023-06-05T06:46:53Z","title":"Uncertainty in Natural Language Processing: Sources, Quantification, and Applications","version":1},"cited_work":{"arxiv_id":"2306.04459","doi":"10.48550/arxiv.2306.04459","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.04459","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Uncertainty in natural language processing: Sources, quantification, and applications","venue":null,"work_id":"f0251096-fe13-4dcf-ab73-aacdde67282d","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2306.04459","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:354a95a9855f48f732d63ae2aa44e6b3c8c82a5e596b84b0145bd32a1b6b7cf1","observation_id":"bc9dbb73-1cb5-43e8-b137-6dd6f437cfaa","resolution":{"observed_at":"2026-05-12T00:41:26.342918Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey of uncertainty estimation methods on large language models","venue":null,"work_id":"c5528770-59fb-4a1c-b925-cb6dc707300b","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:e3ffb1d9d85e560b0f9713748cadd126bec7e1100eb37d0cdeeb608cb8d41748","observation_id":"b890f583-7276-4219-ab93-208c5fdfa659","resolution":{"observed_at":"2026-05-27T04:23:32.872765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15176","last_updated":"2026-04-20T11:16:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T18:51:06Z","title":"Rethinking Uncertainty Estimation in LLMs: A Principled Single-Sequence Measure","version":3},"cited_work":{"arxiv_id":"2412.15176","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15176","snapshot_observed_at":"2026-07-10T08:36:59.926683Z","title":"Rethinking Uncertainty Estimation in LLMs: A Principled Single-Sequence Measure","venue":"cs.LG","work_id":"78d05a02-b97f-4790-a088-e39cca35f171","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2412.15176","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:21d6c68918a943dd1d42bbd5ab403175ad0c4c0c181a880f00e961d29c708a11","observation_id":"d127b1ff-b9e0-411d-8f77-ff245cdc9d7f","resolution":{"observed_at":"2026-05-12T00:41:26.304074Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12346","last_updated":"2025-05-18T10:20:59Z","snapshot_observed_at":"2026-07-31T14:59:07.628754Z","submitted_at":"2025-05-18T10:20:59Z","title":"SEED-GRPO: Semantic Entropy Enhanced GRPO for Uncertainty-Aware Policy Optimization","version":1},"cited_work":{"arxiv_id":"2505.12346","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12346","snapshot_observed_at":"2026-07-04T13:49:52.427933Z","title":"arXiv preprint arXiv:2505.12346 , year=","venue":null,"work_id":"1a5aa60e-eb9c-41b1-968f-cfa8336af063","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2505.12346","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:1cb3f82d6818861a7cade2e269317733cfee408affb03dd35f8e899c4f74c094","observation_id":"40b4c59d-42a6-46d5-a2f3-85242df039df","resolution":{"observed_at":"2026-05-12T00:41:26.300159Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-07-31T18:33:34.529799Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":"2305.05176","doi":"10.48550/arxiv.2305.05176","metadata_source":"pith","pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-07-10T20:57:34.659174Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","venue":"cs.LG","work_id":"5c567414-35de-4373-ae7a-1790da594e8d","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:dd6fbae76e7bf522c2cf8ea4b31ae9d830a42f1b86dfc73ecb819225f08f043a","observation_id":"6974d774-2f4e-4717-b400-e3ec63f500ea","resolution":{"observed_at":"2026-05-12T00:41:26.317005Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:20.871342+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:20.871342+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12963","last_updated":"2025-01-19T15:59:56Z","snapshot_observed_at":"2026-07-06T16:35:48.413898Z","submitted_at":"2023-10-19T17:57:39Z","title":"AutoMix: Automatically Mixing Language Models","version":5},"cited_work":{"arxiv_id":"2310.12963","doi":"10.48550/arxiv.2310.12963","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.12963","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Automix: Automatically mixing language models","venue":null,"work_id":"721159b7-a5b2-42e0-94e9-8aa5e1088d57","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2310.12963","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:7c82600c49ac1b5d008dc374febbd1a477713d2cde95deeedd0ab8dfb07b4ec4","observation_id":"50d98c08-2a46-4f73-bf8c-d7461116f7db","resolution":{"observed_at":"2026-05-12T00:41:26.346764Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11021","last_updated":"2025-02-16T07:08:47Z","snapshot_observed_at":"2026-07-06T20:37:13.753772Z","submitted_at":"2025-02-16T07:08:47Z","title":"Leveraging Uncertainty Estimation for Efficient LLM Routing","version":1},"cited_work":{"arxiv_id":"2502.11021","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.11021","snapshot_observed_at":"2026-07-02T16:17:08.823121Z","title":"Leveraging uncertainty estimation for efficient llm routing","venue":null,"work_id":"126f923d-ac30-4d9a-9ebc-42289929dc2a","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2502.11021","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:acd4c458538c6a868892885531368f026241c68d7af53f84391a5ab59103b764","observation_id":"dd003406-8bfd-451b-811a-66fb74096ad6","resolution":{"observed_at":"2026-05-12T00:41:26.414597Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04445","last_updated":"2026-04-21T10:38:10Z","snapshot_observed_at":"2026-07-06T22:47:50.848191Z","submitted_at":"2026-02-23T21:57:27Z","title":"Dynamic Model Routing and Cascading for Efficient LLM Inference: A Survey","version":2},"cited_work":{"arxiv_id":"2603.04445","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.04445","snapshot_observed_at":"2026-07-10T20:57:34.855543Z","title":"Dynamic Model Routing and Cascading for Efficient LLM Inference: A Survey","venue":"cs.NI","work_id":"194d3c1f-5d07-497d-be5e-3c74b61f1a0f","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2603.04445","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:9da2900c030c4449c9deb5e38b04a797fc5ca3ef7e6209eb5de957664c020228","observation_id":"b021f907-c83d-45e9-9f5f-0b492a3d9bd0","resolution":{"observed_at":"2026-05-12T00:41:26.537579Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07246","last_updated":"2025-01-13T11:54:40Z","snapshot_observed_at":"2026-08-01T10:25:58.860404Z","submitted_at":"2025-01-13T11:54:40Z","title":"Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model","version":1},"cited_work":{"arxiv_id":"2501.07246","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.07246","snapshot_observed_at":"2026-07-03T07:57:44.602800Z","title":"Audio-cot: Exploring chain-of-thought reasoning in large audio language model","venue":null,"work_id":"a29ac5b5-b39a-4024-b423-9a8a9f536e29","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2501.07246","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:2c7eebdfa31650c8ba27885a018a62147708eaf228d534d2aebe3e16e8f3e7fc","observation_id":"175ca406-d890-4c58-a09e-05a6b7acb062","resolution":{"observed_at":"2026-05-12T00:41:26.451182Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.02318","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T00:04:22.645021Z","title":"Audio-reasoner: Improving reasoning capability in large audio language models","venue":null,"work_id":"a04842be-5517-4c05-977a-3581be081263","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:d779a67b424f18e59b5ef246bc8d3649b3b60cec021bf92f6ac20e49abf1f555","observation_id":"d678d119-86a6-4aff-af34-51a88e9934f2","resolution":{"observed_at":"2026-05-12T00:41:26.421712Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T20:07:22.080867Z","title":"Incentivizing consistent, effective and scalable reasoning capability in audio llms via reasoning process rewards","venue":null,"work_id":"b4484a14-7325-4866-b4f5-1e2969505a52","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:849e74c5f4d19d9f65ce928a351f36c8e5b2751f9719e030750571b8af01d45f","observation_id":"32998176-e768-4b9c-b6f6-e9ac0d7bbe7b","resolution":{"observed_at":"2026-05-12T00:41:26.507745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The sound of syntax: Finetuning and comprehensive evaluation of language models for speech pathology","venue":null,"work_id":"89b12cf0-a6f8-431a-bfad-04e5de19e17a","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:22355505eb9c7d5b0e9680affddf533e22cd66e624aa3bb6a8d1e994c246eba7","observation_id":"fb7db3ad-f483-4921-acc4-6b26a6760f5d","resolution":{"observed_at":"2026-05-27T04:23:32.830715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptthink: Reasoning models can learn when to think","venue":null,"work_id":"308d3573-4b1d-4f39-a91d-37226cd81890","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:5bce438d2d310124241e61fb242c4f0ce51bb88c2bf4c8639700865f8d85d93b","observation_id":"23c6b300-f881-4a22-be39-d20d403d8cad","resolution":{"observed_at":"2026-05-27T04:23:32.832924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":"2408.03314","doi":"10.18653/v1/2025.acl-long.1486","metadata_source":"pith","pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","venue":"cs.LG","work_id":"a8d50b24-bdf5-46ed-bc4f-2927dfd81f1d","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:32011a5baed82c2d32a92a41ad093355b562c196b2ce957acc9a9761aad13559","observation_id":"33efe020-ffe5-40ac-9585-4c6660901b5f","resolution":{"observed_at":"2026-05-12T00:41:26.358751Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01070","last_updated":"2026-06-29T20:15:47Z","snapshot_observed_at":"2026-08-03T05:52:20.722857Z","submitted_at":"2026-02-01T07:30:22Z","title":"What If We Allocate Test-Time Compute Adaptively?","version":5},"cited_work":{"arxiv_id":"2602.01070","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.01070","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What If We Allocate Test-Time Compute Adaptively?","venue":"cs.CL","work_id":"bba84be1-f2ec-4406-8397-3397ca50235b","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2602.01070","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:705865e2310a628bba9871e9c53a90753eb54c581abd4b7c51284d679b29c715","observation_id":"d944f2f8-5462-4036-8a94-761c34810b2e","resolution":{"observed_at":"2026-05-12T00:41:26.393464Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.04210","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:54:21.089669Z","title":"Does thinking more always help? mirage of test-time scaling in reasoning models","venue":null,"work_id":"9fbd67ee-d029-4fd4-ae8b-8a65c2de6a6d","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:155018d6dd3bf498aed80da741ee2ece710fd1e55e96bedae0ba12128a781686","observation_id":"0170a213-993d-4df5-99e3-2d1f338f83f7","resolution":{"observed_at":"2026-05-12T00:41:26.333983Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.03975","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive test-time compute allocation via learned heuristics over categorical structure","venue":null,"work_id":"030e2c64-7bfb-4ec3-a43d-8f6a7d8213bc","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:30a631f8c59c5a1d33d8cfdd4101fae6550f21219579d4dbc54c6764354188fc","observation_id":"cc759654-52f0-4235-8fcd-a8ceb2fc0ef6","resolution":{"observed_at":"2026-05-12T00:41:26.489494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.16188","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:06:16.645894Z","title":"Think or not think: A study of ex- plicit thinking in rule-based visual reinforcement fine-tuning","venue":null,"work_id":"d1ffd78f-b453-4e7e-b731-2c1ac285a354","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:4fb41cb75ff7dc0a49f32734852dae6c559785ae33f0d226cda3a87f108b17d6","observation_id":"0da3826d-5803-4fbb-a647-c896190d2fa3","resolution":{"observed_at":"2026-05-12T00:41:26.272743Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey of confidence estimation and calibration in large language models","venue":null,"work_id":"58f5db72-b40e-4cba-835d-18810f80d781","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:6ad07b27fd99b0eae1114b3de55b050c097a3b1f01deed93a62f90d25022d35f","observation_id":"953f14e3-7353-4338-8f64-bddcd0f59bd5","resolution":{"observed_at":"2026-05-27T04:23:32.835159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Selfcheckgpt: Zero-resource black-box hallucination detection for generative large language mod- els","venue":null,"work_id":"975bd885-6448-4a89-9773-a627c144f295","year":2023},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:2169a1fa60d3b1f00cc0d7e46e58af4f41b01b6a599a0f5b60fd80a442f3ca14","observation_id":"5a841fa0-99f1-47cf-8a38-28292d5a2558","resolution":{"observed_at":"2026-05-27T04:23:32.825990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Investigating selective prediction approaches across several tasks in IID, OOD, and adversarial settings","venue":null,"work_id":"4bc0cc75-6a8d-4a17-8a5f-9f8b8ee16b90","year":2022},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:52ae5aaecdc36c5c8ecfaf454b41671be87e9789b27ddda6aae2451507ef744e","observation_id":"fb9ef5ff-3007-4d95-b2d9-d9010cd8fe2c","resolution":{"observed_at":"2026-05-27T04:23:32.828376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Don’t hallucinate, abstain: Identifying llm knowledge gaps via multi- llm collaboration","venue":null,"work_id":"037232df-a52e-4391-9269-c2f6aa1b0518","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:01ae15f6b9ee3c319f826d00fb2cad8698cf8056e32085b9fdf670c49e390b5b","observation_id":"a817a522-9002-4f5b-982a-35b6c1159ad5","resolution":{"observed_at":"2026-05-27T04:23:32.837488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Know your limits: A survey of abstention in large language models","venue":null,"work_id":"bf06aeca-5862-49a9-ba4f-1a49ab7116ca","year":2025},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:04c2b2f3ec08dfacc7d46e4ec93a215bdf20ff29261ae06e12b3ca524d2a6d44","observation_id":"ce6f6c85-d1ce-48f3-b723-d91fb47e3e2e","resolution":{"observed_at":"2026-05-27T04:23:32.823470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14418","last_updated":"2024-02-24T12:30:40Z","snapshot_observed_at":"2026-07-06T17:33:54.693207Z","submitted_at":"2024-02-22T10:04:17Z","title":"Uncertainty-Aware Evaluation for Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2402.14418","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14418","snapshot_observed_at":"2026-07-04T19:50:10.509380Z","title":"Uncertainty-aware evaluation for vision-language models","venue":null,"work_id":"80feee2a-004d-4183-b1de-2142e2291535","year":2024},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2402.14418","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:6aed450c37c23c6355adab11de5e713a05c0e02918432e2ac0465fdb80cb0535","observation_id":"39280975-ba2e-4c1b-816a-b56562c4077e","resolution":{"observed_at":"2026-05-12T00:41:26.534101Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.09214","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vlm- uqbench: A benchmark for modality-specific and cross-modality uncer- tainties in vision language models","venue":null,"work_id":"d97b7041-9d6a-4225-a871-e2e5e8baee0e","year":2026},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:66844986640b3d1cec897183a94b3d6e06b425277737249d69da2431ed9aecc5","observation_id":"4c392d07-b59c-4d31-9a52-38b194f2148f","resolution":{"observed_at":"2026-05-12T00:41:26.541478Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-07-06T23:11:25.757664Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":0,"verified_exact":48,"verified_fuzzy":48},"total_outbound_references":101},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 100 of 101 outbound references and 1 inbound Pith citation observation for arXiv:2604.25591."}