{"as_of":"2026-08-08T13:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cf3e84c25784b18aaf9a2ae83f8ac86d87bacb9ae030ae54ec898285f2b6c929","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:36:05.382288Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:36:05.068351Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T15:36:05.992218Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"cited_work":{"arxiv_id":"2505.14518","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.14518","snapshot_observed_at":"2026-08-07T15:36:05.992218Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","venue":"eess.AS","work_id":"57f46b87-a3a0-4870-a62d-80ea6342cc2e","year":2025},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.068351Z"},"links":{"cited_paper":"/paper/2505.14518","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:72c4d1871ff88add93076cb1e3dc2e56a47e022b8442c3b46f9ef494bf58fe51","observation_id":"0280248b-6ca7-45b5-a5c7-3d5366219030","resolution":{"observed_at":"2026-08-07T15:36:05.999867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14518/citation-record","integrity":"/paper/2505.14518/integrity","json":"/paper/2505.14518/citation-record.json","paper":"/paper/2505.14518"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.654144Z","title":"These models can process audio, speech, and text in- puts at the same time, using text prompts to extract relevant information from audio and speech","venue":null,"work_id":"bcd445a1-1cf9-41cd-b689-fc36dbb805a3","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.049299Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:91444e30e45191a95076c0d5ab44c523c24913d44350269564ab56bb407cfc3f","observation_id":"c4f1b436-897a-48e5-b3ba-808817bae70e","resolution":{"observed_at":"2026-08-07T15:36:06.659290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.636828Z","title":null,"venue":null,"work_id":"c5fde3c2-e9f5-4b19-8bfe-a7ec7380eea9","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.054761Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:b85dce386c7989c164cf019aad537fdc6623f7c977e54aa3ec9f27b1e866d58f","observation_id":"75dea77b-fdc2-4e7f-9441-67ad801a1281","resolution":{"observed_at":"2026-08-07T15:36:06.642485Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.619136Z","title":"This is achieved by leveraging a backbone-LLM- synthesized dataset, which automatically generates audio- text pairs and contrastive data across general audio scenarios","venue":null,"work_id":"6d90e095-0ac0-453f-a2e5-b6dda87a52ef","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.060552Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:9a6204dec6147db5eadb65ae22116f748df2409586ab9ccc9981760aae9b4f2b","observation_id":"e6e12cee-b610-460a-8574-3860481d703c","resolution":{"observed_at":"2026-08-07T15:36:06.624963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"cited_work":{"arxiv_id":"2505.14518","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.14518","snapshot_observed_at":"2026-08-07T15:36:05.992218Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","venue":"eess.AS","work_id":"57f46b87-a3a0-4870-a62d-80ea6342cc2e","year":2025},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.068351Z"},"links":{"cited_paper":"/paper/2505.14518","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:72c4d1871ff88add93076cb1e3dc2e56a47e022b8442c3b46f9ef494bf58fe51","observation_id":"0280248b-6ca7-45b5-a5c7-3d5366219030","resolution":{"observed_at":"2026-08-07T15:36:05.999867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.603688Z","title":null,"venue":null,"work_id":"12ab78cb-97f4-4c66-8d84-1cbe8061d36a","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.074285Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:1f4133fbf407df5227e3ea9a05860782c0b98b05aa293c2722d84c344a2a623a","observation_id":"4b49fbe8-c3f8-41aa-aa0b-139433f3aa65","resolution":{"observed_at":"2026-08-07T15:36:06.608610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.586251Z","title":"For example, Replay the audio","venue":null,"work_id":"77a903b0-39e1-49d6-b72b-e06f5dd4e8a8","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.078959Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:3a6fe80f3175d77b9ddafff27c3dd9feb1dd2c861141555e85c20ce52080efb7","observation_id":"fd548852-9e47-4d82-ae5c-7c9c93d96b22","resolution":{"observed_at":"2026-08-07T15:36:06.592156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.570469Z","title":"For example, Identify sounds that are absent as con- trasting examples","venue":null,"work_id":"7b0ef8f3-e23c-4bc1-baa0-f457dc589683","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.083888Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:cb5a6be2d48795462bc0593fc59aea2ef4ac2b811e646be9f224624aef3e5e69","observation_id":"4eafbe61-5039-4fd9-8492-4e508434e98f","resolution":{"observed_at":"2026-08-07T15:36:06.575502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.553545Z","title":"It aims to generate descriptions of both the sound events that are present and those that are ab- sent in the audio","venue":null,"work_id":"949f04f4-839e-4aaa-ac32-137dbec0a1b7","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.088930Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:ce38f5807ce6e4eaa6035cc1634b479bd9e97b3f8b0d479699e159152caa2c26","observation_id":"469d3f93-108c-42c4-ae69-6ab4a7775bfe","resolution":{"observed_at":"2026-08-07T15:36:06.558975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.537746Z","title":"We utilize the foundation model Whisper 2","venue":null,"work_id":"88a7322a-1539-414b-8ed4-69b8c8ae58bf","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.093619Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:f62ac3c02683099ffe28e12d84b815302395f9b0bf5b5a21fc477fc6af18d360","observation_id":"3d1bb6d6-4898-459a-93a1-f395612811ea","resolution":{"observed_at":"2026-08-07T15:36:06.542602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00916","last_updated":"2024-05-28T14:26:28Z","snapshot_observed_at":"2026-07-06T16:13:34.788427Z","submitted_at":"2023-09-02T11:46:05Z","title":"BLSP: Bootstrapping Language-Speech Pre-training via Behavior Alignment of Continuation Writing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00916","snapshot_observed_at":"2026-08-07T15:36:05.217051Z","title":"Blsp: Bootstrapping language-speech pre- training via behavior alignment of continuation writing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.217051Z"},"links":{"cited_paper":"/paper/2309.00916","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:2fa3fe77b0da6c8d965490830b2d827d5cfdf95f4ae880e201d18d78e25a0e34","observation_id":"9ee2869b-0654-4519-8eb0-b6f4ff4d55d2","resolution":{"observed_at":"2026-08-07T15:36:05.217051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.505076Z","title":"Birds chirping 3","venue":null,"work_id":"f4ebb6a6-c3c1-4d3a-b94a-f9aa564a9693","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.105038Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:e110f2d947d519109faa939e417ece2673bccbf6e8224d2a70ba4105bb374357","observation_id":"6c22f2cb-911a-4f9c-b747-96980c7ce5c7","resolution":{"observed_at":"2026-08-07T15:36:06.510773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.487640Z","title":"Water pouring Contrastive examples of specific sound events not present in the provided audio:","venue":null,"work_id":"0fb17799-9fd8-4b17-afba-8b4533ba4105","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.109759Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:cd3d151de28c6a9a1d45583650b31a0e186ea469a447f4abe4cdddc418ce015c","observation_id":"cd18291c-a7ab-44f5-ac71-f74799a1a1a7","resolution":{"observed_at":"2026-08-07T15:36:06.493382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.470476Z","title":"A dog barking 3","venue":null,"work_id":"4a5fe53b-bf29-4229-a967-2d9f6a2c4295","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.115197Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:b2176f8e51eeca737b3e6ac4d1b22c9907055583b13f5b80e98f3e55fb3efb9e","observation_id":"0c68f654-9c13-4206-9363-6336c62a81af","resolution":{"observed_at":"2026-08-07T15:36:06.475584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.450754Z","title":"This study employs the instruction-tuned LLaMA-3.1-8B 3 [26] as the core large language model","venue":null,"work_id":"309f33c0-14e2-4acd-86db-f3ae68a2a414","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.120346Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:57cdfcc2cdcfe6986920092b0e04d43457a739e648014ca9896dfde130c2d570","observation_id":"3e5d6622-a47d-4884-8ba0-13685ee69c8d","resolution":{"observed_at":"2026-08-07T15:36:06.456880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.434065Z","title":"The only trainable component is the audio modality adapter, which is randomly initialized","venue":null,"work_id":"9c6393fb-3c9c-410f-a286-70e6cfe68f22","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.125344Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:752eb3cd5559ea4096ebd9b7d2daae9481299667b7fc93a2235b71d24900285e","observation_id":"1f355e0a-7368-4b96-8982-c1b4a618a1d9","resolution":{"observed_at":"2026-08-07T15:36:06.439017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.415137Z","title":"yes” and “no","venue":null,"work_id":"558a8376-45cf-490d-93c4-2107e219ff26","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.131174Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:229190552576f8e93e9335510d3597d7894f0597555942ad91ce473ba1c0b072","observation_id":"9f58033f-dffe-4a94-84cd-1906ac3f5a24","resolution":{"observed_at":"2026-08-07T15:36:06.421900Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.393232Z","title":"Table 3: Evaluation results of our proposed models and other baseline models","venue":null,"work_id":"94ec70c2-4bb1-442e-824c-36504e873cb1","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.136258Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:e68cbd54574895701a77834e384ac98bc0466b0854d7ebe7fb436b59b58ba85f","observation_id":"73d30f03-ffa5-4921-bfc0-ac948d59e3b7","resolution":{"observed_at":"2026-08-07T15:36:06.398659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.374941Z","title":null,"venue":null,"work_id":"482fdcc6-b7be-48c0-92df-d7b1682d0a7b","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.142059Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:034fa72d4668ca1756e83f6be621ec7374f51f2f7da9cd55849016ff5bc8f215","observation_id":"46477ba4-d8cf-4d09-9b06-f83fb282d92a","resolution":{"observed_at":"2026-08-07T15:36:06.381357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.356348Z","title":"A combined sam- ple includes both sound events that are present and those that are absent within a single sample","venue":null,"work_id":"bc7944b9-923b-4bec-b2b9-ab493eacd0ed","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.147047Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:1b8fa5e534d98b6ee198695e26108cc539016bce41a79ee1cc972e83032cd30f","observation_id":"5aa1a652-4638-4162-91f6-bfd795b5ca29","resolution":{"observed_at":"2026-08-07T15:36:06.362735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.338369Z","title":null,"venue":null,"work_id":"4dbbafb8-24e8-4e69-8af1-23f6f72a6e74","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.151871Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:9a21502a851d7ac6666450e5841fe1af75551629a0874d938c1d985281b9c04f","observation_id":"e98f23b4-17f8-4c5a-bb9f-46ffd8f625fb","resolution":{"observed_at":"2026-08-07T15:36:06.343924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.319074Z","title":"Additionally, we achieve impressive results on audio un- derstanding and reasoning benchmarks, demonstrating the ro- bustness and versatility of this approach","venue":null,"work_id":"345d2e53-49df-4b5c-b424-ebf5a687367f","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.157172Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:d1c275bc6cd6218371720a2a0ce173a318e75ba5ead2ec718432fd4a885d08e7","observation_id":"b5804312-4735-47b5-94cf-2a482074cda7","resolution":{"observed_at":"2026-08-07T15:36:06.324918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.299067Z","title":"Can large audio-language models truly hear? tackling hallucinations with multi-task assessment and stepwise audio reasoning,","venue":null,"work_id":"02282efb-c8a2-453e-9bb4-a320bb2300cf","year":2025},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.164063Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:614339699c97fa0fc1a0ca1e43931da467afd6fb345984f5d02f2cca5e04dae4","observation_id":"e9d9af8f-5a80-480f-a6df-349e62748f55","resolution":{"observed_at":"2026-08-07T15:36:06.304876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.522120Z","title":null,"venue":null,"work_id":"dd709472-fc6b-4a5f-a284-7c8e3c38892d","year":null},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.099029Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:374c0b6012e17f4a0481afdbb6094c2878863eb502ad6fef2ed6c5492da42ced","observation_id":"b1951192-a5f2-4a01-960b-1584a69c1371","resolution":{"observed_at":"2026-08-07T15:36:06.527171Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.280829Z","title":"Understanding sounds, missing the questions: The challenge of object hallucination in large audio-language models,","venue":null,"work_id":"3550c6bb-cb9a-42d3-a7e9-a88b341260ef","year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.169985Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:96db52e7072fa3120461d400d23cf528dc13fd6aa6980b3d6528bfea56079920","observation_id":"94ecf3d1-352d-4326-8166-25c207e8235b","resolution":{"observed_at":"2026-08-07T15:36:06.287343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05922","last_updated":"2023-09-12T02:34:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-12T02:34:06Z","title":"A Survey of Hallucination in Large Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05922","snapshot_observed_at":"2026-08-07T15:36:05.175875Z","title":"A survey of hallucination in large foundation models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.175875Z"},"links":{"cited_paper":"/paper/2309.05922","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:74e6bc7e7b9b8a5da46b7176795d5b77c00761877099889ce4a76a4d634224b1","observation_id":"947c0734-ee66-4116-a7d4-88bbf7f6a839","resolution":{"observed_at":"2026-08-07T15:36:05.175875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01219","snapshot_observed_at":"2026-08-07T15:36:05.181805Z","title":"Siren’s song in the ai ocean: a survey on halluci- nation in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.181805Z"},"links":{"cited_paper":"/paper/2309.01219","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:9fb9c9e3c776e162c9b228a227f65e85a6dea5f35de6d9d72e12e087dd138e16","observation_id":"0efa8b6b-08f4-4b6f-a1ec-433f9142b586","resolution":{"observed_at":"2026-08-07T15:36:05.181805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-07T15:36:05.187966Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.187966Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:bb9467475011d44f27ee482dd679dfe4db73bd3fa4ca3681ff8249e772121b12","observation_id":"50aa18dc-f008-4cd9-905d-c0258fc47d71","resolution":{"observed_at":"2026-08-07T15:36:05.187966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18344","last_updated":"2023-10-22T14:45:14Z","snapshot_observed_at":"2026-07-06T16:39:40.673808Z","submitted_at":"2023-10-22T14:45:14Z","title":"Chainpoll: A high efficacy method for LLM hallucination detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18344","snapshot_observed_at":"2026-08-07T15:36:05.194841Z","title":"Chainpoll: A high efficacy method for llm hallucination detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.194841Z"},"links":{"cited_paper":"/paper/2310.18344","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:7fa5a6cf674463ce24701537dd45d19a6c6d918efadaa8c52ec5a614f55979f0","observation_id":"899a92dc-d6d8-43f3-9cf3-ecfca2d1d066","resolution":{"observed_at":"2026-08-07T15:36:05.194841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-07T15:36:05.200197Z","title":"A survey on hallucination in large vision- language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.200197Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:ef7b20f41190669a9dca91bb094bf2cb50191f57f35854820bf88fe2652b9572","observation_id":"f16b41d7-dbea-452a-b8dc-f9fa2a49215b","resolution":{"observed_at":"2026-08-07T15:36:05.200197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06753","last_updated":"2024-04-12T18:55:22Z","snapshot_observed_at":"2026-08-02T08:58:25.969928Z","submitted_at":"2023-11-12T06:56:14Z","title":"AudioChatLlama: Towards General-Purpose Speech Abilities for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06753","snapshot_observed_at":"2026-08-07T15:36:05.205353Z","title":"Towards general-purpose speech abilities for large language models using unpaired data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.205353Z"},"links":{"cited_paper":"/paper/2311.06753","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:678528975a11da19ee6ce55c1e852a8240b72616ddfa5472d6e45040237987fd","observation_id":"63a548d8-ea27-418a-9405-3d6510adc614","resolution":{"observed_at":"2026-08-07T15:36:05.205353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20007","last_updated":"2025-01-27T08:46:09Z","snapshot_observed_at":"2026-08-05T02:18:00.592980Z","submitted_at":"2024-09-30T07:01:21Z","title":"DeSTA2: Developing Instruction-Following Speech Language Model Without Speech Instruction-Tuning Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20007","snapshot_observed_at":"2026-08-07T15:36:05.211406Z","title":"Developing instruction-following speech lan- guage model without speech instruction-tuning data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.211406Z"},"links":{"cited_paper":"/paper/2409.20007","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:da4d2079425de4ad1fb2d536c5bcd2782df07900d0acc9c291a970eaab722611","observation_id":"e32b1938-11de-4f94-be17-2b46538f74ee","resolution":{"observed_at":"2026-08-07T15:36:05.211406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03872","last_updated":"2024-06-06T09:02:31Z","snapshot_observed_at":"2026-08-04T22:33:15.502958Z","submitted_at":"2024-06-06T09:02:31Z","title":"BLSP-Emo: Towards Empathetic Large Speech-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03872","snapshot_observed_at":"2026-08-07T15:36:05.223027Z","title":"Blsp-emo: Towards empathetic large speech-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.223027Z"},"links":{"cited_paper":"/paper/2406.03872","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:6bbc9c8d6df153e04395c8b590026ccf49eae803280c4bea467c0e6ca9bc2782","observation_id":"e6f3ca03-9bf5-4559-9d97-c60b4a42442b","resolution":{"observed_at":"2026-08-07T15:36:05.223027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T15:36:05.229747Z","title":"Qwen-audio: Advancing universal audio understand- ing via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.229747Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:30af7fc497ccf10acfa5afbc1fa5b3e6cadd133956dac65cd2d889e4ebbc0796","observation_id":"c72d2687-f312-4ef5-9dd6-25246c4334ff","resolution":{"observed_at":"2026-08-07T15:36:05.229747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-07T15:36:05.234847Z","title":"Qwen2-audio technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.234847Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:268bb4ac98d2fc656c88831485fe1dd657a931ff1296cc7aa7e7451a7a8bc789","observation_id":"fea80d42-5259-4f28-9d9e-ca33e2f66681","resolution":{"observed_at":"2026-08-07T15:36:05.234847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13289","last_updated":"2024-04-08T06:12:52Z","snapshot_observed_at":"2026-08-02T21:51:36.809095Z","submitted_at":"2023-10-20T05:41:57Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13289","snapshot_observed_at":"2026-08-07T15:36:05.240818Z","title":"Salmonn: Towards generic hearing abilities for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.240818Z"},"links":{"cited_paper":"/paper/2310.13289","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:ea9d244f2af70cd938df669632f7d2a30cac6313f76657b5cb3c573bfb2c999f","observation_id":"9da4d6fc-7fda-4c8a-8d55-0d068e4613d0","resolution":{"observed_at":"2026-08-07T15:36:05.240818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:05.246793Z","title":"Joint audio and speech understanding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.246793Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:fcc99e1ec1c7d8b81e90f73e9c70488302ae36e04bce048fcbe25e8ea8b1a058","observation_id":"5551c408-3c1d-4ff3-93ea-dcaa35d7e734","resolution":{"observed_at":"2026-08-07T15:36:05.246793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.250744Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":"2688423a-74a1-4da9-9fe9-7db52a84f98b","year":2021},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.251833Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:dfc7d15222acd49466a3ed3eda6de26e33c5cac56b3b2934ccc4fc7b116f730c","observation_id":"58143505-a894-43eb-afc5-089c1337a98a","resolution":{"observed_at":"2026-08-07T15:36:06.256738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.231813Z","title":"Minigpt- 4: Enhancing vision-language understanding with advanced large language models,","venue":null,"work_id":"ede8bc07-e695-4fc0-b93c-4bd9ba46c713","year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.257062Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:149968b9e96a3385e7e88b932fba05b88f12af7cca09ce863defd5aee4829ead","observation_id":"8149759d-1f1a-47ba-9ca2-8662405adcd8","resolution":{"observed_at":"2026-08-07T15:36:06.238208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18871","last_updated":"2024-06-27T03:52:35Z","snapshot_observed_at":"2026-08-06T09:14:18.018297Z","submitted_at":"2024-06-27T03:52:35Z","title":"DeSTA: Enhancing Speech Language Models through Descriptive Speech-Text Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18871","snapshot_observed_at":"2026-08-07T15:36:05.263202Z","title":"Desta: Enhancing speech language mod- els through descriptive speech-text alignment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.263202Z"},"links":{"cited_paper":"/paper/2406.18871","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:75f3699990574592ebd21b438824a1f1ee5a64e2dcdc450961bb15574f4ee2cc","observation_id":"c9704f10-ca59-4fde-a91b-0c38e62b6af4","resolution":{"observed_at":"2026-08-07T15:36:05.263202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09886","last_updated":"2024-09-23T16:45:04Z","snapshot_observed_at":"2026-07-06T18:45:52.286287Z","submitted_at":"2024-07-13T13:26:43Z","title":"Speech-Copilot: Leveraging Large Language Models for Speech Processing via Task Decomposition, Modularization, and Program Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09886","snapshot_observed_at":"2026-08-07T15:36:05.271017Z","title":"Speech-copilot: Leveraging large language models for speech processing via task decomposition, modularization, and program generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.271017Z"},"links":{"cited_paper":"/paper/2407.09886","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:596bafd53ca8d91e47aef2102ce8dde95308a44348205cec7446a104b3c8b209","observation_id":"a733ccb4-0c34-4845-87ea-8fbd8657e308","resolution":{"observed_at":"2026-08-07T15:36:05.271017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.211966Z","title":"Dynamic-superb: Towards a dynamic, col- laborative, and comprehensive instruction-tuning benchmark for speech,","venue":null,"work_id":"759af515-914e-4f75-ba37-93007d9c1f6a","year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.276624Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:0fc0664a474a776bd6150ad8889f83ac04e8b381c77fcc15e823f81991f4dec4","observation_id":"aaf93c1a-b881-4f7b-b57f-b6b74eb67bc2","resolution":{"observed_at":"2026-08-07T15:36:06.218844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-07-06T19:47:16.854192Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-08-07T15:36:05.282635Z","title":"Dynamic-superb phase-2: A collaboratively expanding benchmark for measuring the capabil- ities of spoken language models with 180 tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.282635Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:dc19e0f1fc6dcdfbf037fb08b3db5a545281777b16482b54725db09d33cb4730","observation_id":"c1daf752-92ab-424b-9087-ce9f84192261","resolution":{"observed_at":"2026-08-07T15:36:05.282635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:36:05.288005Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.288005Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:085dac8997a11b275fa318089c3e4bed3d492a2040297781308cf2b7e49fdd58","observation_id":"1cfbde63-dbe9-409a-abac-3438c11f0782","resolution":{"observed_at":"2026-08-07T15:36:05.288005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:05.293881Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.293881Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:9706767e52cc5fe48e81e33562677d5b7a83b9e1f9a96399c697340b5c1e2530","observation_id":"b6d267d4-164b-4f24-9cf5-0974a5cdf182","resolution":{"observed_at":"2026-08-07T15:36:05.293881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.178940Z","title":"Whisper-at: Noise-robust automatic speech recognizers are also strong audio event taggers,","venue":null,"work_id":"c4fd0d32-93bf-45f4-91dd-16f19da71cdd","year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.305383Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:10b513a315b4023731f8f314e96e6d6ad80d0859b0b6ea400cfda94cead3adcd","observation_id":"0032467e-b94f-4ce2-8acc-2a0cb0182610","resolution":{"observed_at":"2026-08-07T15:36:06.185045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09363","last_updated":"2024-03-28T16:31:26Z","snapshot_observed_at":"2026-08-05T17:43:54.675059Z","submitted_at":"2023-11-15T20:52:56Z","title":"Investigating the Emergent Audio Classification Ability of ASR Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09363","snapshot_observed_at":"2026-08-07T15:36:05.312182Z","title":"Investigating the emergent audio classification ability of asr foundation models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.312182Z"},"links":{"cited_paper":"/paper/2311.09363","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:3dc3c13338bb63accad5888993ff3fcbec310a9049554df0cbd521d065514931","observation_id":"baa7458a-3db0-4e98-9cc3-2b3f018e6efc","resolution":{"observed_at":"2026-08-07T15:36:05.312182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:36:05.317879Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.317879Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:e8a4040a32e07b75db9f3856a64577e2a8316fbd4c714ded9442c74d4633038b","observation_id":"442c1b89-5608-4404-bffc-1aa7a6840d8c","resolution":{"observed_at":"2026-08-07T15:36:05.317879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:05.322965Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.322965Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:8eabd813381920164f0057db27e5c02edcb9f40db55b094ea9c63215079a2d85","observation_id":"53a4cc54-84cf-47db-ba68-63991dd43509","resolution":{"observed_at":"2026-08-07T15:36:05.322965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:05.328829Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.328829Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:beec51bfdc02926652b6c71ee111a65f843852443abe9178b6f0082bf880de60","observation_id":"f2073a1f-f2a2-4ec3-bf6b-424a85df2694","resolution":{"observed_at":"2026-08-07T15:36:05.328829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.138491Z","title":"Audiocaps: Generat- ing captions for audios in the wild,","venue":null,"work_id":"b4446815-87b1-4318-b42b-8333dfff9c1f","year":2019},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.334531Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:825f07814de2bfa98f658ddcc5b66e64b5d608cdec423a8ddad8952bc85b5ac9","observation_id":"657373a1-6163-4ee2-8fe8-96ee22e535f5","resolution":{"observed_at":"2026-08-07T15:36:06.143910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.119222Z","title":"Fsd50k: an open dataset of human-labeled sound events,","venue":null,"work_id":"a7314bd7-98b1-4008-bf6f-ee122dfd8288","year":2021},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.339782Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:f659c5fc3101be361ba35bc246efd5f0fb484809fa8c376c826bcbec1fab7db3","observation_id":"addbd51c-2bf0-4e82-a861-619b15881c24","resolution":{"observed_at":"2026-08-07T15:36:06.124876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.099841Z","title":"Sound event envelope estimation in polyphonic mixtures,","venue":null,"work_id":"2563df37-b8cc-4458-802e-885bbfb91ea7","year":2019},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.344867Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:abae7c4062204fd6d4b12f408f9433f0d5f05b86faa0473cfa865230787111d2","observation_id":"819f028b-2fba-4549-bdd4-149be57c1ac9","resolution":{"observed_at":"2026-08-07T15:36:06.106117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:05.350164Z","title":"ESC: Dataset for Environmental Sound Classi- fication,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.350164Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:09a3671e7a02c3dcbd85ae77a360498604d37e796788b7b7a5b328849f737db6","observation_id":"583f01e1-27e1-4817-ae55-08b307ffa2f1","resolution":{"observed_at":"2026-08-07T15:36:05.350164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.079710Z","title":"A dataset and taxonomy for urban sound research,","venue":null,"work_id":"92df7aa9-4897-4487-91ec-63993a659e4e","year":2014},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.355490Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:13a8296e413e0ec2b8985772c030db7d2acb79615932b49fa4e3c93693c20772","observation_id":"053ac22b-de92-4431-8d9f-e1cb13272102","resolution":{"observed_at":"2026-08-07T15:36:06.087252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.060809Z","title":"Clotho- aqa: A crowdsourced dataset for audio question answering,","venue":null,"work_id":"5a989aa3-d1c1-47fd-b33b-3836ba222c4a","year":2022},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.361096Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:66e34a1dd0340fa841bb0c0e0ece4978e992806447959e154c80fe825662ea24","observation_id":"f83ed0ac-928b-4b17-b340-18cfb2f1b5a7","resolution":{"observed_at":"2026-08-07T15:36:06.066791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.036368Z","title":"V ocalsound: A dataset for improv- ing human vocal sounds recognition,","venue":null,"work_id":"7832b424-343c-4193-bcfe-da109e136f14","year":2022},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.368392Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:29b77a267bea3f876b6a98dc6c2464251e2ee966149eaf556ef253f14ce49811","observation_id":"d0dc9d1c-5198-4574-80bf-55f128e4c85b","resolution":{"observed_at":"2026-08-07T15:36:06.043758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T15:36:05.375649Z","title":"Gemini 1.5: Un- locking multimodal understanding across millions of tokens of context,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.375649Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:2ebb3949b108aec0e4a2c0ce9bc6ee486aae95747759d740643eac4d4eeae091","observation_id":"52dcb272-344a-4460-959a-850a1a95db75","resolution":{"observed_at":"2026-08-07T15:36:05.375649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:06.014752Z","title":"What do mllms hear? examining the interaction between llm and audio encoder com- ponents in multimodal large language models,","venue":null,"work_id":"bddf7983-3f50-4375-b318-036f06d381c6","year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.382288Z"},"links":{"citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:5d19d045aaa43d79f23aa1ada10ceaa47b738ca650576dded13ad97cfe2d1136","observation_id":"d96c217d-6b28-4ea2-aeb0-321c26923575","resolution":{"observed_at":"2026-08-07T15:36:06.021026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T15:30:36.978077Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 1 inbound Pith citation observation for arXiv:2505.14518."}