{"as_of":"2026-08-08T14:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:29e9a35dea0b241fed21e234c1761bb3a329ec4421ee4eca6f0419cf8251a20c","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:02.533642Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:34:58.940094Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:35:02.664010Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"cited_work":{"arxiv_id":"2505.24200","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.24200","snapshot_observed_at":"2026-08-07T12:35:02.664010Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","venue":"cs.SD","work_id":"ec9bdd81-d4d3-432e-800d-05af2ecd43c1","year":2025},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:58.940094Z"},"links":{"cited_paper":"/paper/2505.24200","citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:8e0d34c01908c7e463ea1f5c86f491818e5c04559f744caf2c1654c29a031321","observation_id":"944ae7c7-580d-44d4-9f5b-a430229bb551","resolution":{"observed_at":"2026-08-07T12:35:02.756250Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.24200/citation-record","integrity":"/paper/2505.24200/integrity","json":"/paper/2505.24200/citation-record.json","paper":"/paper/2505.24200"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:08.958031Z","title":null,"venue":null,"work_id":"fe9e19ed-cbef-4cdc-aca0-536f508e30a0","year":null},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:58.793128Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:836cb3224cb76b42c6315bdad39254cb8a4497d09ddc4c5738f387d3881bc93e","observation_id":"1e948f24-0805-4c5c-a762-8ca0913a58fd","resolution":{"observed_at":"2026-08-07T12:35:09.123181Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:08.615388Z","title":null,"venue":null,"work_id":"727a68bb-3555-483e-b828-1c9d8d2233b2","year":null},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:58.850589Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:bd0cd7925eb12178937fa7717c7f94f50b32f7df28501fde4d8408737a524e42","observation_id":"28b76465-4680-4ec2-938a-3609ff4e7429","resolution":{"observed_at":"2026-08-07T12:35:08.828683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"cited_work":{"arxiv_id":"2505.24200","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.24200","snapshot_observed_at":"2026-08-07T12:35:02.664010Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","venue":"cs.SD","work_id":"ec9bdd81-d4d3-432e-800d-05af2ecd43c1","year":2025},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:58.940094Z"},"links":{"cited_paper":"/paper/2505.24200","citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:8e0d34c01908c7e463ea1f5c86f491818e5c04559f744caf2c1654c29a031321","observation_id":"944ae7c7-580d-44d4-9f5b-a430229bb551","resolution":{"observed_at":"2026-08-07T12:35:02.756250Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:08.469470Z","title":"2 Models are evaluated on the development sets due to the unavailability of the test set","venue":null,"work_id":"81678b5d-1015-4fc8-b68c-7f6777b1e949","year":2025},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.006089Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:151d5f33f88198c2bac7ceb37ab113d11d42db54511e803157c2ae5261c1eb0f","observation_id":"513df0b2-18e6-4c60-bd3f-86289e8e1053","resolution":{"observed_at":"2026-08-07T12:35:08.509815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:08.332858Z","title":"Training strategies with multilingual SFMs Table 1 shows LID and ASR results across SFMs and training strategies on ML-SUPERB 2.0","venue":null,"work_id":"7be41fd8-df41-4b50-a702-9925ab5dbc3f","year":null},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.099044Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:897a8cf074be963563f27323b9c651a2a46d1c6a6b0cf01693cf1182956ac420","observation_id":"1f2b0059-b8fc-4653-b7c1-f1b89a86b494","resolution":{"observed_at":"2026-08-07T12:35:08.388518Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:08.187285Z","title":"We evalu- ate MMS, XEUS, and OWSM-CTC under downstream training with frozen upstream, upstream fine-tuning, and LoRA","venue":null,"work_id":"264888a9-9489-4467-8512-44f1befbd236","year":2025},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.191789Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:1baaa5134b70596777af9e824b2a122aa4477b99b0178a737dc7842df58c4856","observation_id":"4ff96bd4-f962-473a-9397-c4be9beb7a08","resolution":{"observed_at":"2026-08-07T12:35:08.255806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:08.065723Z","title":null,"venue":null,"work_id":"b2cd7cdd-04ed-4616-b004-13d5ace181aa","year":null},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.286172Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:ffd56a6ef2f248ba2c0a9de19bd34acae9d5697bcdcd8795744c8f2956a9e1a0","observation_id":"913ec992-d565-4e1f-a979-6fba8c805e34","resolution":{"observed_at":"2026-08-07T12:35:08.124253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:07.912674Z","title":null,"venue":null,"work_id":"8dd2d721-9a56-4dc5-bf2e-ac9bdb6be11b","year":2011},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.354742Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:52b7e10c4f2c7ad10496b5d2112838c71df51f081f41c1f550ea7643828c18e9","observation_id":"6998a5c3-c91d-4b82-a565-2b98ccce63d7","resolution":{"observed_at":"2026-08-07T12:35:07.998893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:07.791274Z","title":"XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale,","venue":null,"work_id":"45cbf2f2-ed2e-47d7-a362-4c2633189fc9","year":2021},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.458975Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:e66778580079572f42949e215a53aae7d37c8f3dc7a77f73bd54cc7259f9a070","observation_id":"cd5324fc-53cd-44bf-ba12-b0c8911c8edf","resolution":{"observed_at":"2026-08-07T12:35:07.838636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:07.635318Z","title":"ASR2K: Speech recognition for around 2000 languages without audio,","venue":null,"work_id":"04a2eed0-8333-40e4-a803-1e5438811194","year":2000},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.535994Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:71ded3f280c40210fb14850c0a89af34f40783f04f5a87559e8028e03c7e3bce","observation_id":"c32267e7-16e6-456d-8b30-32d1e41cbece","resolution":{"observed_at":"2026-08-07T12:35:07.726772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:07.518281Z","title":"Joint prediction and denoising for large-scale multilingual self-supervised learning,","venue":null,"work_id":"7c29a890-afa0-4a9e-bf36-e7bdea07ac4c","year":2023},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.645736Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:628943776a713eba235be482bd8b4c490dc7ac80b90ead7c34931ffce85060bc","observation_id":"bb873ce9-86db-4644-9ed2-ed59a7340d98","resolution":{"observed_at":"2026-08-07T12:35:07.579113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:07.374464Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":"72fe9d1c-3483-4928-8959-b8f96f77d9db","year":2024},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.722095Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:9dd5f5f82e127f691049378fe35bf0283b14579661ea1482e6241d1d27e06068","observation_id":"5331b52b-a069-4077-8802-b366eb3ece36","resolution":{"observed_at":"2026-08-07T12:35:07.460116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:07.260508Z","title":"Towards robust speech representation learning for thousands of languages,","venue":null,"work_id":"e122bb22-b3d7-4693-a51e-d8e7c04b6036","year":2024},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.799875Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:893077ce5ac081c8a8b3bfcb6c453f66f3bc21de7e925bb46b67ab7a6a68b0ae","observation_id":"ff82f576-bbf1-4bc2-8ca4-b6020e0a0d37","resolution":{"observed_at":"2026-08-07T12:35:07.301390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:07.098838Z","title":"mHuBERT- 147: A compact multilingual HuBERT model,","venue":null,"work_id":"c13bc6b3-7989-4ed6-866d-ef08c83d570f","year":2024},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.874212Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:057ca2c64eeba78dc0f21e3c4980b346d53874845beae4ad565bc22fdbd15c5d","observation_id":"17be225e-280c-4e9f-84cc-e481d8b4c899","resolution":{"observed_at":"2026-08-07T12:35:07.150268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:06.967828Z","title":"A configurable multilingual model is all you need to recognize all languages,","venue":null,"work_id":"821582cc-9d24-40ff-af4a-ad2727b85c6e","year":2021},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:59.964124Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:6407fdb2c0555680473a67a657a1c9e841d4d409f7468fe1296edb6b6f261d40","observation_id":"a9a2bdab-663e-4b7e-91df-3d8bcbb7cfb4","resolution":{"observed_at":"2026-08-07T12:35:07.031401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:06.733027Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":"3ad4d352-6c30-4389-9de5-a59420592b55","year":2023},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:00.077855Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:bcdf18fcedec6294ce1c50feb77f1e6ada6c2b04cd5a4a7662d1293dc3800fc5","observation_id":"c093eb10-53aa-4999-83b6-9cedeab33a56","resolution":{"observed_at":"2026-08-07T12:35:06.819589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:06.518096Z","title":"OWSM v3.1: Bet- ter and faster open Whisper-style speech models based on E- Branchformer,","venue":null,"work_id":"bb53a650-b458-4b44-be1a-2a135f45dca4","year":2024},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:00.187711Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:044ab432e169f1f91d4674e52f1e22733e8a19826ebf6f701d3e11b56f780bb5","observation_id":"3af49afc-b940-408d-a97b-6768305b4ffd","resolution":{"observed_at":"2026-08-07T12:35:06.615191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:00.295811Z","title":"OWSM-CTC: An open encoder-only speech foundation model for speech recog- nition, translation, and language identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:00.295811Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:9487fb9034682484221c200ac735b550d470d2e943bdc1c767b705d46bd9a728","observation_id":"8af116c1-9646-47a6-809b-b98504f385a6","resolution":{"observed_at":"2026-08-07T12:35:00.295811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:06.288327Z","title":"ML-SUPERB 2.0: Benchmarking multilingual speech models across modeling constraints, languages, and datasets,","venue":null,"work_id":"6ba9ef2a-8a48-47e1-af26-c578bae772d7","year":2024},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:00.396639Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:fc694fe347308bb87ddec58415fb90c9d246b4ebb2e00045226dff2ee1a3d209","observation_id":"20098328-91a5-4062-b210-3afd133a2480","resolution":{"observed_at":"2026-08-07T12:35:06.370250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:06.135841Z","title":"ML-SUPERB: Multilingual speech universal performance benchmark,","venue":null,"work_id":"471e45a1-86af-4c59-9450-a960e373e429","year":2023},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:00.466136Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:960e50ec7340adc20deece9280a84cef95a36899cf89c3d64594a6940ca6058d","observation_id":"f0898c31-385c-4498-bfa4-6de0d0bb9164","resolution":{"observed_at":"2026-08-07T12:35:06.183730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:00.544624Z","title":"Con- nectionist temporal classification: labelling unsegmented se- quence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:00.544624Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:f06b6f4d2b46b3fba52f7000b7a84162d5c302b7dffebeb43570e7a9e1fed6d3","observation_id":"ec16efb9-a8af-4f88-bb29-9e73fe4ef407","resolution":{"observed_at":"2026-08-07T12:35:00.544624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:05.972665Z","title":"Deja-vu: Dou- ble feature presentation and iterated loss in deep transformer net- works,","venue":null,"work_id":"e8ddc9fc-bbb4-4ba1-858e-eaea8457f84d","year":2020},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:00.643704Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:95aeff57f3da95e6bdbf985ca2cb7771945d6db940db3b1a4bd9384c10db4c84","observation_id":"9c36dbbf-7648-41a2-9cf4-576b0714e0f0","resolution":{"observed_at":"2026-08-07T12:35:06.044217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:00.723893Z","title":"Intermediate loss regularization for CTC-based speech recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:00.723893Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:fbb9bdc8a2b63ec2c7aa68ef4efc23456cb0e425e5ee4155065502670f7e41ca","observation_id":"e0d7632b-470c-4b4c-8371-b744a690b0a3","resolution":{"observed_at":"2026-08-07T12:35:00.723893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:05.744581Z","title":"Relaxing the conditional indepen- dence assumption of CTC-based ASR by conditioning on inter- mediate predictions,","venue":null,"work_id":"7de4de3a-0d1e-4168-83bf-c98ee7876ec2","year":2021},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:00.814663Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:a4628038f396f3e09f7b0166229de429e6b96d18313ede13bdf86c0311176761","observation_id":"6983251b-00fe-4df6-93dd-6fbcb7f0449b","resolution":{"observed_at":"2026-08-07T12:35:05.840181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:05.500868Z","title":"Improving massively mul- tilingual ASR with auxiliary CTC objectives,","venue":null,"work_id":"21d74eaf-9133-4d6a-b018-fc45918155a8","year":2023},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:00.926171Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:7b5febac1fc2db927120acd9e0db961e303a3852b228c736fec5dcccb25737da","observation_id":"01ee8c5f-44c3-4526-be76-ae181b5fcad5","resolution":{"observed_at":"2026-08-07T12:35:05.642959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:05.345203Z","title":"Massively multilin- gual ASR: A lifelong learning solution,","venue":null,"work_id":"b3312ae6-076f-4bc9-899a-2eeb0daa1cfd","year":2022},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:01.043462Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:2d0dea1359ccff9a84d7402f1d94956fb3757b8531f99f510923b492bf8e7e90","observation_id":"312bcf2a-26c0-4844-ae19-c546fa4aa83a","resolution":{"observed_at":"2026-08-07T12:35:05.428140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:05.140179Z","title":"Making more of little data: Improving low-resource automatic speech recognition using data augmentation,","venue":null,"work_id":"0cac532c-fcc6-47ce-820c-cba92fcae5aa","year":2023},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:01.141039Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:ed4f09895cad1323cd1b6001b3156128cbf584e5281895c1825acc404b1916c5","observation_id":"b96b0fd0-aeee-459a-95b7-2b686d4b84d0","resolution":{"observed_at":"2026-08-07T12:35:05.218589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:01.249951Z","title":"Audio augmentation for speech recognition,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:01.249951Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:a95c3f484567cfcedc186773d06fd96e8104c890bdbd9be2989f00d239189524","observation_id":"52d4f11f-78ba-4d8d-b36d-b678ee26d99d","resolution":{"observed_at":"2026-08-07T12:35:01.249951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:04.959290Z","title":"Specaugment: A simple data augmentation method for automatic speech recog- nition,","venue":null,"work_id":"625d381e-a712-4285-a6f7-f77e708b9fa6","year":2019},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:01.431199Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:f099a34d3621d5e13dd86b4a22f1e20932a623b553b72c7de1fc85cbbbb82601","observation_id":"3e7ab5ea-4740-4035-a8c9-3cedf51c85ad","resolution":{"observed_at":"2026-08-07T12:35:05.041123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:04.792999Z","title":"SSHR: Leveraging self-supervised hierarchical representations for multilingual auto- matic speech recognition,","venue":null,"work_id":"7bc901b8-cc96-4cac-90ca-4bdb590eab81","year":2024},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:01.546181Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:9900dcaf3aa35034cc13f8fd8ea708523ae53e254518c918a64450fc8d1b0584","observation_id":"907d4fe1-70e6-4879-8cdb-778ddd2b7206","resolution":{"observed_at":"2026-08-07T12:35:04.862029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:04.639123Z","title":"Attention is all you need,","venue":null,"work_id":"2e363845-76a3-4cf1-8ff1-bc4f767ca17e","year":2017},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:01.640422Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:e467cc44963ed1560c9b325770ee997b66a948d7a042a1580434131e44f4734a","observation_id":"aa479f67-1f39-4185-a55c-200805a4e490","resolution":{"observed_at":"2026-08-07T12:35:04.717838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:04.492739Z","title":"E-Branchformer: Branch- former with enhanced merging for speech recognition,","venue":null,"work_id":"f5626d99-750c-49bc-81f0-1e7e3baa65c6","year":2023},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:01.794642Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:3c1201f99446974a8425b5dc8d6790cf196bed8ef23ce427a23fdb57320bf315","observation_id":"ebf94a9d-904d-4253-8843-9d5adcc6fcb2","resolution":{"observed_at":"2026-08-07T12:35:04.564568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:04.324040Z","title":"Deep contextualized word representations,","venue":null,"work_id":"96217da3-4532-4bbe-b1ab-43f5db2a4239","year":2018},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:01.856478Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:29813a170bca9f0f8cfd05f046c1e3059c992ce711718ba9d5e61e53dc6c8f28","observation_id":"01b3ce71-6a11-4670-90b8-04e2073782b5","resolution":{"observed_at":"2026-08-07T12:35:04.398185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:04.136011Z","title":"SU- PERB: Speech processing universal performance benchmark,","venue":null,"work_id":"d11b468f-7351-4ea4-9402-3160b7f24c2b","year":2021},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:01.917927Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:00c486e8d4c889b5af676d5959dbcc1b40bd75d2fec5f4f76253f39a7dfe84e5","observation_id":"416a2466-ce4e-4bd3-b00e-17f84c281645","resolution":{"observed_at":"2026-08-07T12:35:04.215038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:03.929540Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":"fee4947d-7073-44f4-8537-fccfa845a1ee","year":2022},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:02.029696Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:0b637771321dbe92d05a9bc076ee486f6abdf7185d0bc103bb2cbbb20dffcdd9","observation_id":"a0595366-76e3-439d-9a6d-9eb4b717a307","resolution":{"observed_at":"2026-08-07T12:35:04.024037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:03.721169Z","title":"Common voice: A massively-multilingual speech corpus,","venue":null,"work_id":"a44062ef-42bf-4d31-a89b-b7245f85f7cd","year":2020},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:02.156417Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:2c106ca3a447a6f9c55aebdc706c8f35be1d4a4a81cfc928d8f7e212942a238e","observation_id":"76021507-1f96-4ef7-9c54-96c9da3ec33b","resolution":{"observed_at":"2026-08-07T12:35:03.823340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:03.522397Z","title":"XLS-R: Self- supervised cross-lingual speech representation learning at scale,","venue":null,"work_id":"78e7b853-6ce2-40fc-a97b-ab81698964eb","year":2022},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:02.266303Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:7e2703885477efa8cfacdae32203278b0fef85341f533224f6522819373c92de","observation_id":"e5ea9c45-a76f-41a3-8476-45db10f633f7","resolution":{"observed_at":"2026-08-07T12:35:03.591150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:03.298243Z","title":"OWSM v4: Improving open Whisper-style speech models via data scaling and cleaning,","venue":null,"work_id":"1a2a353c-b732-4b7a-8a08-6329e49ac3fb","year":2025},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:02.333025Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:da0791a1a97675ba280dd353a0046050298c7d2ee54fd86e3380eded3f1dc81a","observation_id":"885cbc31-c8fc-44e8-af10-7bd49b82bcf0","resolution":{"observed_at":"2026-08-07T12:35:03.405754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:03.146840Z","title":"ESPnet: End-to-end speech processing toolkit,","venue":null,"work_id":"3599ad50-b55f-4552-92b2-4529ea3f4728","year":2018},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:02.427989Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:343be45d293ba15f91bae1c8e9bd8c6a9e657e225f26ba58a957b862cfb0b025","observation_id":"36c75989-0168-4a8b-bb9c-e17994d917cc","resolution":{"observed_at":"2026-08-07T12:35:03.209319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:02.944459Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":"1947f290-a90a-40f1-ad31-33a4053efd01","year":2015},"citing_paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:02.533642Z"},"links":{"citing_paper":"/paper/2505.24200"},"observation_digest":"sha256:e331dd251c72961e13915a0bc0aabc9b8e6437380df1a0edd7574b84a45425a7","observation_id":"18c9a414-c350-4883-b1d3-f34f13c566ec","resolution":{"observed_at":"2026-08-07T12:35:03.041939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.24200","last_updated":"2025-06-03T15:19:07Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T12:27:47.985895Z","submitted_at":"2025-05-30T04:25:15Z","title":"Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 1 inbound Pith citation observation for arXiv:2505.24200."}