{"as_of":"2026-08-04T10:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cf252b189623e81af08fe346469269f8ffeac486b82baad40d49110b01e3374e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:13:43.050999Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T14:17:10.084435Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2402.07729","doi":"10.48550/arxiv.2402.07729","metadata_source":"pith","pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-07-10T14:17:10.084435Z","title":"Air-bench: Benchmarking large audio-language models via generative comprehension","venue":"eess.AS","work_id":"d370d7c7-6672-4149-b423-fd65d5cc3cd1","year":2024},"citing_paper":{"arxiv_id":"2410.17196","last_updated":"2024-12-11T15:45:21Z","snapshot_observed_at":"2026-07-06T19:37:56.214143Z","submitted_at":"2024-10-22T17:15:20Z","title":"VoiceBench: Benchmarking LLM-Based Voice Assistants","version":3},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-05-17T00:50:13.841689Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2410.17196"},"observation_digest":"sha256:fc0a65ed2116e8926cb6f89fb8f9b79bf9088524e8336b879514d6d2da280dcd","observation_id":"9de28d32-1abd-42dd-a3cc-1902ce0618aa","resolution":{"observed_at":"2026-05-17T00:50:14.034936Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-08-04T10:13:43.050999Z","title":"Aohan Zeng, Zhengxiao Du, Mingdao Liu, Kedong Wang, Shengmin Jiang, Lei Zhao, Yuxiao Dong, and Jie Tang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.11098","last_updated":"2026-07-06T08:06:32Z","snapshot_observed_at":"2026-08-04T10:13:38.677008Z","submitted_at":"2025-10-13T07:45:52Z","title":"VCB Bench: An Evaluation Benchmark for Audio-Grounded Large Language Model Conversational Agents","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T10:13:43.050999Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2510.11098"},"observation_digest":"sha256:6aeb1bc4832bbc0fe89e27dc8317e8150226330ab8f35e9b6ae363449cfc1852","observation_id":"89fec82b-9d5b-47dc-8151-12878371b9f5","resolution":{"observed_at":"2026-08-04T10:13:43.050999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2402.07729","doi":"10.48550/arxiv.2402.07729","metadata_source":"pith","pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-07-10T14:17:10.084435Z","title":"Air-bench: Benchmarking large audio-language models via generative comprehension","venue":"eess.AS","work_id":"d370d7c7-6672-4149-b423-fd65d5cc3cd1","year":2024},"citing_paper":{"arxiv_id":"2601.02954","last_updated":"2026-05-10T15:03:28Z","snapshot_observed_at":"2026-07-06T22:40:51.136169Z","submitted_at":"2026-01-06T11:54:47Z","title":"The World is Not Mono: Enabling Spatial Understanding in Large Audio-Language Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T16:58:42.970074Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2601.02954"},"observation_digest":"sha256:8f163a0cc564082d32c83b06e490c8a4eac1e71446e9682593bf5b5b9cd088e4","observation_id":"fc7e5d27-5328-4f67-afc0-0d2e03382f8a","resolution":{"observed_at":"2026-05-16T17:01:07.779505Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2402.07729","doi":"10.48550/arxiv.2402.07729","metadata_source":"pith","pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-07-10T14:17:10.084435Z","title":"Air-bench: Benchmarking large audio-language models via generative comprehension","venue":"eess.AS","work_id":"d370d7c7-6672-4149-b423-fd65d5cc3cd1","year":2024},"citing_paper":{"arxiv_id":"2605.01766","last_updated":"2026-05-03T07:58:02Z","snapshot_observed_at":"2026-07-31T08:00:39.590873Z","submitted_at":"2026-05-03T07:58:02Z","title":"Mitigating Multimodal LLMs Hallucinations via Relevance Propagation at Inference Time","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T15:27:23.591345Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2605.01766"},"observation_digest":"sha256:9128449560cdb28f907ecb0ac21af6a3c89fda29850c9db48bc7568606fdffc4","observation_id":"8bc80bec-426a-48d4-9f30-a2a415fd3ab0","resolution":{"observed_at":"2026-05-11T10:31:01.638215Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2402.07729","doi":"10.48550/arxiv.2402.07729","metadata_source":"pith","pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-07-10T14:17:10.084435Z","title":"Air-bench: Benchmarking large audio-language models via generative comprehension","venue":"eess.AS","work_id":"d370d7c7-6672-4149-b423-fd65d5cc3cd1","year":2024},"citing_paper":{"arxiv_id":"2605.20755","last_updated":"2026-06-11T05:13:51Z","snapshot_observed_at":"2026-08-02T13:39:32.672112Z","submitted_at":"2026-05-20T05:54:08Z","title":"DuplexSLA: A Full-Duplex Spoken Language Model with Synchronized Speech, Language, and Action","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T02:41:13.583493Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2605.20755"},"observation_digest":"sha256:1717dd4f41704d31be87083b76325c63b480465caac4b8e19b0e5b63c9c1f431","observation_id":"4fb07874-fd0c-445d-8f5b-bf62d19f52bf","resolution":{"observed_at":"2026-05-21T02:43:54.995777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2402.07729","doi":"10.48550/arxiv.2402.07729","metadata_source":"pith","pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-07-10T14:17:10.084435Z","title":"Air-bench: Benchmarking large audio-language models via generative comprehension","venue":"eess.AS","work_id":"d370d7c7-6672-4149-b423-fd65d5cc3cd1","year":2024},"citing_paper":{"arxiv_id":"2605.20755","last_updated":"2026-06-11T05:13:51Z","snapshot_observed_at":"2026-08-02T13:39:32.672112Z","submitted_at":"2026-05-20T05:54:08Z","title":"DuplexSLA: A Full-Duplex Spoken Language Model with Synchronized Speech, Language, and Action","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T17:32:58.848455Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2605.20755"},"observation_digest":"sha256:c5eb37d246775addce5177976ca41636f120fa206c4bfb67682ea4bc7b9e738c","observation_id":"54f92202-0963-446c-b3c9-10a8abe0ae5d","resolution":{"observed_at":"2026-06-30T17:34:57.327536Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2402.07729","doi":"10.48550/arxiv.2402.07729","metadata_source":"pith","pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-07-10T14:17:10.084435Z","title":"Air-bench: Benchmarking large audio-language models via generative comprehension","venue":"eess.AS","work_id":"d370d7c7-6672-4149-b423-fd65d5cc3cd1","year":2024},"citing_paper":{"arxiv_id":"2605.28480","last_updated":"2026-05-27T13:39:14Z","snapshot_observed_at":"2026-07-06T23:38:04.621658Z","submitted_at":"2026-05-27T13:39:14Z","title":"Audio-Mind: An Auditable Agentic Framework for Audio Understanding","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-29T10:03:54.653164Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2605.28480"},"observation_digest":"sha256:0df2de445b857da2cd8575887fc18313686fd4f17f6dbcedcc1e98a4bc25af3f","observation_id":"d0c51ded-a237-4e37-8afa-e567bec4833c","resolution":{"observed_at":"2026-06-29T10:13:17.630607Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2402.07729","doi":"10.48550/arxiv.2402.07729","metadata_source":"pith","pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-07-10T14:17:10.084435Z","title":"Air-bench: Benchmarking large audio-language models via generative comprehension","venue":"eess.AS","work_id":"d370d7c7-6672-4149-b423-fd65d5cc3cd1","year":2024},"citing_paper":{"arxiv_id":"2606.08194","last_updated":"2026-06-06T14:24:05Z","snapshot_observed_at":"2026-08-02T20:27:06.280658Z","submitted_at":"2026-06-06T14:24:05Z","title":"GlobeAudio: A Multilingual Multicultural Benchmark for Naturalistic Evaluation of Large Audio-Language Models","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-06-27T19:51:59.265579Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2606.08194"},"observation_digest":"sha256:3041ba80fcf7394f1a69306d24719a3daf017ab3a7c0adc972d2c99214ed9716","observation_id":"472e1cda-62c2-4d56-84f3-075352d87b33","resolution":{"observed_at":"2026-07-02T21:17:24.522233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2402.07729","doi":"10.48550/arxiv.2402.07729","metadata_source":"pith","pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-07-10T14:17:10.084435Z","title":"Air-bench: Benchmarking large audio-language models via generative comprehension","venue":"eess.AS","work_id":"d370d7c7-6672-4149-b423-fd65d5cc3cd1","year":2024},"citing_paper":{"arxiv_id":"2606.25391","last_updated":"2026-06-24T04:42:57Z","snapshot_observed_at":"2026-08-02T09:48:07.276963Z","submitted_at":"2026-06-24T04:42:57Z","title":"From Sounds to Scenes: A Benchmark for Evaluating Context-Aware Auditory Scene Understanding in Large Audio Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-25T20:36:24.901454Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2606.25391"},"observation_digest":"sha256:988872c9aa4d5e1c4341b0ec597f629709e0b3cc1597fd3cc82f51e7b293cdd9","observation_id":"a8fae2f7-38d8-4ca4-a295-b536f70a11a1","resolution":{"observed_at":"2026-07-04T20:10:07.916009Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2402.07729","doi":"10.48550/arxiv.2402.07729","metadata_source":"pith","pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-07-10T14:17:10.084435Z","title":"Air-bench: Benchmarking large audio-language models via generative comprehension","venue":"eess.AS","work_id":"d370d7c7-6672-4149-b423-fd65d5cc3cd1","year":2024},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-03T03:09:40.573819Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-07T14:52:35.127533Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:cdca562071730138f4f1bfe4a1f44157aeb6fef3799baa9e4fdf1f1d857c9a58","observation_id":"48e0c198-d0e2-432b-8a19-31fb192418d3","resolution":{"observed_at":"2026-07-07T14:53:55.855535Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-08-02T08:34:05.200834Z","title":"AIR-Bench: Benchmarking large audio-language models via generative comprehen- sion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-03T03:09:40.573819Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:05.200834Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:0b27aaa7b3ec6ecd3eba398a081e2624ec45ca31d4bfb41b9f42f2f9f8c5c57e","observation_id":"b4e88589-4075-4e31-82ee-d7115afe1b33","resolution":{"observed_at":"2026-08-02T08:34:05.200834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2402.07729","doi":"10.48550/arxiv.2402.07729","metadata_source":"pith","pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-07-10T14:17:10.084435Z","title":"Air-bench: Benchmarking large audio-language models via generative comprehension","venue":"eess.AS","work_id":"d370d7c7-6672-4149-b423-fd65d5cc3cd1","year":2024},"citing_paper":{"arxiv_id":"2607.07985","last_updated":"2026-07-08T23:24:55Z","snapshot_observed_at":"2026-08-01T15:07:36.313077Z","submitted_at":"2026-07-08T23:24:55Z","title":"A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-10T14:13:50.737253Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2607.07985"},"observation_digest":"sha256:c776ddda4fb6c884fdcd0750bf287a3c0a7d3c2b70b8c2abf5e609482bde25f7","observation_id":"94cd768e-0a03-4f15-8b22-c35b40ebdf73","resolution":{"observed_at":"2026-07-10T14:17:10.085901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.07729/citation-record","integrity":"/paper/2402.07729/integrity","json":"/paper/2402.07729/citation-record.json","paper":"/paper/2402.07729"},"outbound":[],"paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-07-06T17:28:56.092370Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2402.07729."}