{"as_of":"2026-08-16T07:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3e37e868d7383011cbf1e3698ec02e1381a99fb7bf873c15489543fb0f19b86e","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:54:41.302863Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T18:43:47.005650Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T18:43:47.187288Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"cited_work":{"arxiv_id":"2501.00425","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.00425","snapshot_observed_at":"2026-08-10T18:43:47.187288Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","venue":"cs.CL","work_id":"72c9b5e2-92ba-4bed-bded-ef78b4a83fbb","year":2024},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-16T04:14:01.781359Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.005650Z"},"links":{"cited_paper":"/paper/2501.00425","citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:4a2729e258950b88a0fc39c064af1f2fa5f1d7caca51a48829c7176c6b2757f1","observation_id":"89e8cd90-4c2f-47dd-bd95-02add609d68e","resolution":{"observed_at":"2026-08-10T18:43:47.190924Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.00425/citation-record","integrity":"/paper/2501.00425/integrity","json":"/paper/2501.00425/citation-record.json","paper":"/paper/2501.00425"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.991826Z","title":"Dialect-specific models for automatic speech recognition of african american vernacular english","venue":null,"work_id":"ebbfc205-bdd4-4788-adc8-50ad8ab43575","year":2019},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.172677Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:b36381aaa528d61f9c3999b85bc9ad970b36cab62c7438bd7add00c548fd93f3","observation_id":"e6da0fc7-e8bc-4218-b044-0f42865e781b","resolution":{"observed_at":"2026-08-10T22:54:41.996947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.944548Z","title":"Data augmentation based unsupervised pre-training for low-resource speech recognition","venue":null,"work_id":"6af1e94f-06d8-417d-b859-63da81eca718","year":2024},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.188028Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:a801d4c5a5a95c66f549886361a9b16e10878bbea815e95ee3911cfd6524fd9c","observation_id":"da3a0dc6-e8d9-4b03-87cc-c95c3f89a564","resolution":{"observed_at":"2026-08-10T22:54:41.949685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.913366Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations","venue":null,"work_id":"7f9f91bc-a7cf-45ac-acb1-c7f685eb814a","year":2020},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.207483Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:5cdfa715ae9f0937015c0d72b92b06981b28deaa1cb604b1ead4afc2f958f48a","observation_id":"9e267dd8-9ecf-40e4-baf8-1b753f01691a","resolution":{"observed_at":"2026-08-10T22:54:41.918606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.06581","last_updated":"2022-09-11T15:05:42Z","snapshot_observed_at":"2026-08-16T04:13:59.783804Z","submitted_at":"2022-09-11T15:05:42Z","title":"Applying wav2vec2 for Speech Recognition on Bengali Common Voices Dataset","version":1},"cited_work":{"arxiv_id":"2209.06581","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.06581","snapshot_observed_at":"2026-08-10T22:54:41.491841Z","title":"Applying wav2vec2 for Speech Recognition on Bengali Common Voices Dataset","venue":"eess.AS","work_id":"24cb1c16-830d-4495-8568-981c3198df96","year":2022},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.217141Z"},"links":{"cited_paper":"/paper/2209.06581","citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:5e40e0abe1569fd6a80cd122973de7f731e192bf157b00b0aab9e4209ac7d70f","observation_id":"0dceeb26-7b48-4090-bb1d-4a9ba842f279","resolution":{"observed_at":"2026-08-10T22:54:41.497010Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.883424Z","title":"Hubert: How much can a bad teacher benefit asr pre-training? In ICASSP 2021-2021 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pages 6533–6537","venue":null,"work_id":"6c6cdd37-ab6d-40e2-a929-e24f1f88e839","year":2021},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.227978Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:b370442f4caf54c95022ac7df8c6868c276c9ac5851b6898d9bdcc75873cca1d","observation_id":"e259409a-53b1-4a27-b493-d5185e89d97c","resolution":{"observed_at":"2026-08-10T22:54:41.888231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.867635Z","title":"Unsupervised methods for speaker diarization: An integrated and iterative approach","venue":null,"work_id":"8b0f1a02-be58-415e-ae72-b27b05f670ca","year":2015},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.243149Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:2ce8e9bc2ebd9a3a5223778114026d12361ef3c4420d752b0523f595335b4cfc","observation_id":"da638638-8257-41e3-b364-a3b80a2ae026","resolution":{"observed_at":"2026-08-10T22:54:41.872830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.835849Z","title":"Speaker-dependent live quranic verses recitation recognition system using sphinx-4 framework","venue":null,"work_id":"b55182d0-130c-421c-92f6-9240f1e6690f","year":2014},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.252438Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:60f1abca54f58950be44904c03b85cd88751e461b181a2285c98b5db583ae6a3","observation_id":"b7a0e015-f6c5-403d-80d9-05a17b610c3c","resolution":{"observed_at":"2026-08-10T22:54:41.841401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14171","last_updated":"2022-10-28T00:55:08Z","snapshot_observed_at":"2026-08-15T13:02:43.544753Z","submitted_at":"2022-03-26T23:28:55Z","title":"A Speech Representation Anonymization Framework via Selective Noise Perturbation","version":2},"cited_work":{"arxiv_id":"2203.14171","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.14171","snapshot_observed_at":"2026-08-10T22:54:41.405045Z","title":"A Speech Representation Anonymization Framework via Selective Noise Perturbation","venue":"eess.AS","work_id":"2159e699-ee27-4512-ab1a-b8352437d0bb","year":2022},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.262582Z"},"links":{"cited_paper":"/paper/2203.14171","citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:5b108b49d301afdb5f71f1affb3ae0d707c4717027339c594750e1d163680322","observation_id":"479b46e5-f504-44f3-ba89-b3db4e829920","resolution":{"observed_at":"2026-08-10T22:54:41.412413Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12446","last_updated":"2022-05-25T02:29:03Z","snapshot_observed_at":"2026-08-16T04:13:12.060866Z","submitted_at":"2022-05-25T02:29:03Z","title":"FLEURS: Few-shot Learning Evaluation of Universal Representations of Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12446","snapshot_observed_at":"2026-08-10T22:54:41.267748Z","title":"Fleurs: Few-shot learning evaluation of universal representations of speech","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.267748Z"},"links":{"cited_paper":"/paper/2205.12446","citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:ca7ea6c83b91239c6b36cd903aa895c24c6d8ba97949431d58502eac0906d185","observation_id":"6edc091d-4c06-4325-aef1-c506d177465e","resolution":{"observed_at":"2026-08-10T22:54:41.267748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06670","last_updated":"2020-03-05T20:37:08Z","snapshot_observed_at":"2026-08-12T13:38:15.911519Z","submitted_at":"2019-12-13T19:22:44Z","title":"Common Voice: A Massively-Multilingual Speech Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06670","snapshot_observed_at":"2026-08-10T22:54:41.272845Z","title":"Common voice: A massively-multilingual speech corpus","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.272845Z"},"links":{"cited_paper":"/paper/1912.06670","citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:1255ce991df31d2b5d6c07c9d4a2c91e6f1565759a6f76b7df824b0134f73b97","observation_id":"aa485003-a78d-4b0c-920b-5c604ec2c12c","resolution":{"observed_at":"2026-08-10T22:54:41.272845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.820289Z","title":"V oice-based gender recognition using neural network","venue":null,"work_id":"be0ed175-071e-412c-b02f-9b77d930af7b","year":2020},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.277736Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:05845b5a2de62e138920ab9837839a983a5a976f974c687a424d3bd90484e2f8","observation_id":"c8f52638-b88b-4942-aef7-228e37c6be5d","resolution":{"observed_at":"2026-08-10T22:54:41.825162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.804736Z","title":"Data augmentation for low resource languages","venue":null,"work_id":"7b710217-9463-4293-a94d-388b82b2ead7","year":2014},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.282481Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:ea24bb2a7b0efc5fc4962e3c8b48817f6433f1bdc5ace30f40ef68441e35a860","observation_id":"4ca325f8-e22b-48e6-90fb-f7be6d614807","resolution":{"observed_at":"2026-08-10T22:54:41.809860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.787149Z","title":"Synthetic data augmen- tation for improving low-resource asr","venue":null,"work_id":"8f0d0682-2c25-4b7b-9856-5bacbc837507","year":2019},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.287267Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:139a00e11ab4d2c84ba653d19641cb2bbc4cd91833800dd827f57bd5f9d78127","observation_id":"a5a9f3e9-e2ba-4b10-916f-c481d48e896f","resolution":{"observed_at":"2026-08-10T22:54:41.792948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-08-13T19:48:28.322536Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-10T22:54:41.292201Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.292201Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:483d9060f54d03f227280620b8474cf22dd7ead4a2017a005970e48aa649a35f","observation_id":"092ce753-2ff7-464e-a030-4266d7621472","resolution":{"observed_at":"2026-08-10T22:54:41.292201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-10T22:54:41.297251Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.297251Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:736f067af0fe2509bae812b60713aee872d5e61ae79431ea7166d2b089c19e8b","observation_id":"23e9ac2a-142f-41db-98fd-9067014b6e72","resolution":{"observed_at":"2026-08-10T22:54:41.297251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.898258Z","title":"Investigating transformer encoders and fusion strategies for speech emotion recognition in emergency call center conversations","venue":null,"work_id":"e5aca260-4acd-4586-ad3d-119d528f03d8","year":2022},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":1996,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.212333Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:818992203fbb3e33661afb2c168a264180d4ef37187d954ef9ff8c94188496b2","observation_id":"af88de90-3386-4198-a08c-fe8fa0a474ae","resolution":{"observed_at":"2026-08-10T22:54:41.903308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.852933Z","title":"Towards fast and accurate streaming end-to-end asr","venue":null,"work_id":"7229a1d7-e418-41d3-93f9-e25fe3cd152e","year":2020},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.247695Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:ef5c7fa32739755e14392abb0205c380fa847fb22180b74324ae441203df7fc1","observation_id":"41cd191d-f9de-4772-9b23-d5e60dd34773","resolution":{"observed_at":"2026-08-10T22:54:41.857834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.929096Z","title":"O’Shea, Johnathan Corgan, and T","venue":null,"work_id":"679afab7-eeea-4aba-b2cf-ecea29684b26","year":2016},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.197892Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:24b5fc78bd1e8c7f341e0f1c7c13fd45e92df86d520d5aeefe417b378b3d31b8","observation_id":"d0f42430-e63a-496f-b811-6f3078c51e7f","resolution":{"observed_at":"2026-08-10T22:54:41.934083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-08-15T12:11:16.120794Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-10T22:54:41.257036Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.257036Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:d5f87a1a87bbfdafe7d8c1841f8be1c6f690c98e0349b3704b1f4900aecee091","observation_id":"bf1d231d-dcab-4b57-b14a-24a7fd16adaf","resolution":{"observed_at":"2026-08-10T22:54:41.257036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.75283","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.660351Z","title":"Thanh Toan Nguyen, Minh Tam Pham, Thanh Tam Nguyen, Thanh Trung Huynh, Quoc Viet Hung Nguyen, Thanh Tho Quan, et al","venue":null,"work_id":"f44a0afa-3639-4abd-b24e-415143f067a3","year":2016},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.202716Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:b72de05bafe10de74d546685b1adbe4d27fccc2dc9e7c0d9de91008bbe0a837a","observation_id":"a7f13f8e-7509-4889-9594-fcd79b1314d4","resolution":{"observed_at":"2026-08-10T22:54:41.668470Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10393","last_updated":"2019-07-23T04:17:58Z","snapshot_observed_at":"2026-08-14T16:03:29.067907Z","submitted_at":"2019-07-23T04:17:58Z","title":"LSTM based Similarity Measurement with Spectral Clustering for Speaker Diarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10393","snapshot_observed_at":"2026-08-10T22:54:41.238006Z","title":"Lstm based similarity measurement with spectral clustering for speaker diarization","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.238006Z"},"links":{"cited_paper":"/paper/1907.10393","citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:172d18ad9bb8e417a91012493a0721a5a17bc1c4da87f12540973898440d5a25","observation_id":"c868e4b6-5734-4006-b441-ff640ce658b8","resolution":{"observed_at":"2026-08-10T22:54:41.238006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.771575Z","title":"Hierarchical conditional end-to-end asr with ctc and multi-granular subword units","venue":null,"work_id":"870f7a10-de43-401b-91e9-bc99bcf4f16d","year":2022},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.302863Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:d218d69d9b93f4feceb8f309499e5d6ca40ee4c828ff7d826e2efddbc9c0589d","observation_id":"255a2ce8-e53d-4df1-8d51-9d4c57604619","resolution":{"observed_at":"2026-08-10T22:54:41.776524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.976995Z","title":"Improving noise robust automatic speech recognition with single-channel time-domain enhancement network","venue":null,"work_id":"c4de772e-275b-44db-aa10-038dc8b7acbe","year":2020},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.178011Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:e98e71de11a22ba62c13bfeba4520b491afdb3a0bad93d60e3ebcf8a1ac629ca","observation_id":"c050a680-2230-437f-b03d-425adc99b5b7","resolution":{"observed_at":"2026-08-10T22:54:41.982017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13511","last_updated":"2019-07-31T14:07:27Z","snapshot_observed_at":"2026-08-14T15:59:35.565838Z","submitted_at":"2019-07-31T14:07:27Z","title":"Personalizing ASR for Dysarthric and Accented Speech with Limited Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13511","snapshot_observed_at":"2026-08-10T22:54:41.222445Z","title":"Personalizing asr for dysarthric and accented speech with limited data","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.222445Z"},"links":{"cited_paper":"/paper/1907.13511","citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:44821efe8a3b8a682b8669aad55b24cd6fd07a2da9c4aca017505cddb6ffaf8b","observation_id":"ce315c9e-2fbe-4d65-9705-4b2695bd66c1","resolution":{"observed_at":"2026-08-10T22:54:41.222445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.960969Z","title":"Dialectal arabic speech recognition using cnn-lstm based on end-to-end deep learning","venue":null,"work_id":"988fc644-502e-4f6d-9df4-0781eb5dca22","year":2022},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.183044Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:b9bdef69f681ad864e17bc329ac53b2b16382ab80ba762470a8512cc2b891d75","observation_id":"acbce505-8bb2-4d4f-84aa-6c3ac0063834","resolution":{"observed_at":"2026-08-10T22:54:41.966339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09367","last_updated":"2020-05-17T06:53:34Z","snapshot_observed_at":"2026-07-06T09:13:44.069836Z","submitted_at":"2020-04-20T15:12:29Z","title":"ClovaCall: Korean Goal-Oriented Dialog Speech Corpus for Automatic Speech Recognition of Contact Centers","version":2},"cited_work":{"arxiv_id":"2004.09367","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.09367","snapshot_observed_at":"2026-08-10T22:54:41.755205Z","title":"ClovaCall: Korean Goal-Oriented Dialog Speech Corpus for Automatic Speech Recognition of Contact Centers","venue":"cs.LG","work_id":"56317313-6205-479b-8151-7c7a4d25b10c","year":2020},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.166992Z"},"links":{"cited_paper":"/paper/2004.09367","citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:d5d1245595ca06afdc225855f8e162d463a27c032079bfd9bd8709b85a13b4ff","observation_id":"eea46360-1f09-465e-9608-da6315fdbc4a","resolution":{"observed_at":"2026-08-10T22:54:41.760599Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.01206","last_updated":"2020-05-18T17:47:01Z","snapshot_observed_at":"2026-08-16T04:10:05.683735Z","submitted_at":"2020-05-18T17:47:01Z","title":"A Thousand Words are Worth More Than One Recording: NLP Based Speaker Change Point Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.01206","snapshot_observed_at":"2026-08-10T22:54:41.232814Z","title":"A thousand words are worth more than one recording: Nlp based speaker change point detection","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.232814Z"},"links":{"cited_paper":"/paper/2006.01206","citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:dcded47c6d8e0628ca9684df22ff6e965964574e278cfaaf7c7e2a931b1d3270","observation_id":"7e291949-b18f-4edc-83c0-4ea31f0071e1","resolution":{"observed_at":"2026-08-10T22:54:41.232814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:54:41.192707Z","title":"Anuroop Sriram, Michael Auli, and Alexei Baevski","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:41.192707Z"},"links":{"citing_paper":"/paper/2501.00425"},"observation_digest":"sha256:17dfca6080ae154758a146e4c4ac99fa8c636521b4fd9ea9a2802e6cd8c03ac2","observation_id":"ccc970f0-1489-4b0a-b5ec-3855f670cc3f","resolution":{"observed_at":"2026-08-10T22:54:41.192707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T04:13:20.260047Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":9,"verified_exact":3,"verified_fuzzy":15},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 1 inbound Pith citation observation for arXiv:2501.00425."}