{"as_of":"2026-08-18T19:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9cd44cd27fbc5d08fdc8ef6badda9a0541f0cf857c222dbadf01655ea5428127","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:05:27.345407Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T05:51:09.778662Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-08-10T21:24:18.189539Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04962","last_updated":"2025-05-27T16:14:30Z","snapshot_observed_at":"2026-08-17T03:02:03.416801Z","submitted_at":"2025-01-09T04:30:12Z","title":"VoxEval: Benchmarking the Knowledge Understanding Capabilities of End-to-End Spoken Language Models","version":4},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T21:24:18.189539Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2501.04962"},"observation_digest":"sha256:e12c312ed9a99e332a760c0056e6d7314d4f303cceadf286e2481b017b734f0b","observation_id":"11c44623-f80e-45ca-b817-daca864c1833","resolution":{"observed_at":"2026-08-10T21:24:18.189539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-08-07T20:02:51.333001Z","title":"Dynamic-superb phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09940","last_updated":"2025-02-14T06:34:08Z","snapshot_observed_at":"2026-08-16T18:28:28.040058Z","submitted_at":"2025-02-14T06:34:08Z","title":"A Preliminary Exploration with GPT-4o Voice Mode","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T20:02:51.333001Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2502.09940"},"observation_digest":"sha256:43a16e90896d7e64eb57717cb9e98ad66485666485edf7c858463b0cd5a1e6d0","observation_id":"effb8c2d-a8ee-4f4b-ad31-ee6a915cf8df","resolution":{"observed_at":"2026-08-07T20:02:51.333001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-08-16T00:05:27.345407Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03054","last_updated":"2025-05-12T19:49:55Z","snapshot_observed_at":"2026-08-17T00:13:33.833008Z","submitted_at":"2025-05-05T22:28:53Z","title":"BLAB: Brutally Long Audio Bench","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T00:05:27.345407Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2505.03054"},"observation_digest":"sha256:7e820f747e3cdbff6763acc90b3c896d4dc017cf5b38ed87c5bd799a19898927","observation_id":"4de67696-d25a-4949-8830-bf817564285e","resolution":{"observed_at":"2026-08-16T00:05:27.345407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-08-07T15:36:05.282635Z","title":"Dynamic-superb phase-2: A collaboratively expanding benchmark for measuring the capabil- ities of spoken language models with 180 tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14518","last_updated":"2025-07-01T02:25:58Z","snapshot_observed_at":"2026-08-09T07:57:02.799032Z","submitted_at":"2025-05-20T15:44:01Z","title":"Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:05.282635Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2505.14518"},"observation_digest":"sha256:0989b1a59e5a5f6d94bfe4a163de6bb26dc284325f51109b0fc45b33dae96a1d","observation_id":"c1daf752-92ab-424b-9087-ce9f84192261","resolution":{"observed_at":"2026-08-07T15:36:05.282635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-08-07T14:49:28.620577Z","title":"Dynamic-superb phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17496","last_updated":"2025-05-23T05:50:14Z","snapshot_observed_at":"2026-08-17T11:25:27.362657Z","submitted_at":"2025-05-23T05:50:14Z","title":"Analyzing Mitigation Strategies for Catastrophic Forgetting in End-to-End Training of Spoken Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:28.620577Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2505.17496"},"observation_digest":"sha256:154ae0c0ba2865febac4f4e72ae48f8ca8529212c637eaeca2ba7d3b329cf3b4","observation_id":"6e3323cd-c372-4bd9-8862-80d0d81e1159","resolution":{"observed_at":"2026-08-07T14:49:28.620577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-08-07T11:26:23.197926Z","title":"Dynamic- SUPERB Phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02457","last_updated":"2025-06-03T05:21:51Z","snapshot_observed_at":"2026-08-14T21:56:28.538771Z","submitted_at":"2025-06-03T05:21:51Z","title":"SOVA-Bench: Benchmarking the Speech Conversation Ability for LLM-based Voice Assistant","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:23.197926Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2506.02457"},"observation_digest":"sha256:ccb73e60c57525a1bb3be8335432f024640a38a87d89e762921694d853d9021d","observation_id":"5aad3ced-54b1-4a76-8309-61beb49207e2","resolution":{"observed_at":"2026-08-07T11:26:23.197926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-08-07T05:44:35.914407Z","title":"Dynamic-superb phase-2: A collaboratively expand- ing benchmark for measuring the capabilities of spoken language models with 180 tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07237","last_updated":"2025-06-11T17:28:22Z","snapshot_observed_at":"2026-08-10T08:31:33.686868Z","submitted_at":"2025-06-08T17:45:46Z","title":"Multi-Distillation from Speech and Music Representation Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:44:35.914407Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2506.07237"},"observation_digest":"sha256:aa7902d4cfd1c97f385c56e3678ca54f8bbf77db1114187d5626c0a05ba06349","observation_id":"05b77574-85b5-4e7f-8c00-7224fed46ca4","resolution":{"observed_at":"2026-08-07T05:44:35.914407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-08-07T10:17:46.611415Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10019","last_updated":"2025-06-06T11:09:46Z","snapshot_observed_at":"2026-08-17T19:45:22.860227Z","submitted_at":"2025-06-06T11:09:46Z","title":"A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations","version":1},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:46.611415Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2506.10019"},"observation_digest":"sha256:c8dadee7823a51de3dd69e2b3a959e55d30b1b52ad5b1253615b953d4443130e","observation_id":"2020553c-8add-41be-a6f6-88fe1e2b4c62","resolution":{"observed_at":"2026-08-07T10:17:46.611415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-08-04T11:06:45.452664Z","title":"Dynamic-superb phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken lan- guage models with 180 tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07355","last_updated":"2026-05-28T11:55:17Z","snapshot_observed_at":"2026-08-16T08:16:49.998738Z","submitted_at":"2025-10-08T14:13:28Z","title":"AV-EMO-Reasoning: Benchmarking Emotional Reasoning Capabilities in Omni-modal LLMS with Audio-visual Cues","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T11:06:45.452664Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2510.07355"},"observation_digest":"sha256:d857999508fa40297fd232d0feaa6dc35886fca06590bf4ccaeec9fedeff243e","observation_id":"2e7e6682-6c59-46bc-a742-1b2da70970a0","resolution":{"observed_at":"2026-08-04T11:06:45.452664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-07-13T16:09:50.207908Z","title":"Dynamic-superb phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.28737","last_updated":"2026-06-20T22:01:30Z","snapshot_observed_at":"2026-08-16T17:58:07.855123Z","submitted_at":"2026-03-30T17:50:07Z","title":"ParaSpeechCLAP: A Dual-Encoder Speech-Text Model for Rich Stylistic Language-Audio Pretraining","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T16:09:50.207908Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2603.28737"},"observation_digest":"sha256:71c95de78b7e14be2ed0156baf35585a96918f84496f397af387d250ad207ebb","observation_id":"2c4d4b4c-7559-43a4-8d3d-dd5bbd1163e0","resolution":{"observed_at":"2026-07-13T16:09:50.207908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","version":2},"cited_work":{"arxiv_id":"2411.05361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.05361","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://github.com/SALT-NLP/CAVA","venue":null,"work_id":"4efc1853-225d-4af4-9460-abdfaf18df91","year":2024},"citing_paper":{"arxiv_id":"2605.00022","last_updated":"2026-04-20T00:57:31Z","snapshot_observed_at":"2026-08-12T21:38:26.110278Z","submitted_at":"2026-04-20T00:57:31Z","title":"Putting HUMANS first: Efficient LAM Evaluation with Human Preference Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T05:50:05.920842Z"},"links":{"cited_paper":"/paper/2411.05361","citing_paper":"/paper/2605.00022"},"observation_digest":"sha256:6234eccf1fa23da47e116c16ee302a306bc739cb91abcb226d52b20d6ecefd50","observation_id":"93844cbf-f821-4643-85a8-7b8266add351","resolution":{"observed_at":"2026-05-10T05:51:09.779986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.05361/citation-record","integrity":"/paper/2411.05361/integrity","json":"/paper/2411.05361/citation-record.json","paper":"/paper/2411.05361"},"outbound":[],"paper":{"arxiv_id":"2411.05361","last_updated":"2025-06-09T16:36:12Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:01:51.403793Z","submitted_at":"2024-11-08T06:33:22Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2411.05361."}