{"as_of":"2026-08-07T10:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eaf0bd927b1e586833dc68733e284a76da4b2855c78913880398829b0ddc073a","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:45:39.749843Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:03:12.107390Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T18:30:01.425102Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01931","snapshot_observed_at":"2026-08-05T13:03:12.107390Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00988","last_updated":"2025-08-31T20:51:59Z","snapshot_observed_at":"2026-08-06T01:57:40.894764Z","submitted_at":"2025-08-31T20:51:59Z","title":"A Unified Denoising and Adaptation Framework for Self-Supervised Bengali Dialectal ASR","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:03:12.107390Z"},"links":{"cited_paper":"/paper/2507.01931","citing_paper":"/paper/2509.00988"},"observation_digest":"sha256:21ff510d458767f461db41e0590ee8d9938bd9fa725fcc7426844acf6c74c864","observation_id":"1b0de384-eff4-49e2-82ad-5cbf193e9c2f","resolution":{"observed_at":"2026-08-05T13:03:12.107390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"cited_work":{"arxiv_id":"2507.01931","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.01931","snapshot_observed_at":"2026-07-04T18:30:01.425102Z","title":"Aminur , title =","venue":null,"work_id":"b91e2a43-13c0-42b5-a40f-2d63ea3024d2","year":null},"citing_paper":{"arxiv_id":"2606.24244","last_updated":"2026-06-23T07:30:39Z","snapshot_observed_at":"2026-07-06T23:58:49.574536Z","submitted_at":"2026-06-23T07:30:39Z","title":"When Surveys Become Conversations: Adaptive Matrix Validation for AI-Assisted Interviews","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-25T22:50:09.596640Z"},"links":{"cited_paper":"/paper/2507.01931","citing_paper":"/paper/2606.24244"},"observation_digest":"sha256:f7d0f207a0371dc0574ac037ccafa204bd4a3bc8ecf071169cb30ef19681231b","observation_id":"32c240d1-d391-43b6-9c51-5995af0aa456","resolution":{"observed_at":"2026-07-04T18:30:01.426736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.01931/citation-record","integrity":"/paper/2507.01931/integrity","json":"/paper/2507.01931/citation-record.json","paper":"/paper/2507.01931"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.906252Z","title":"A comparison of sequence-to-sequence models for speech recognition","venue":null,"work_id":"1690f368-1329-46eb-bc96-3686c608b2bb","year":2017},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.692292Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:8139154ba30c7969ef2caaebf585bd1bb2e6d3faddee7b25129810da5adfcc59","observation_id":"c83ea2da-cdd2-4e10-b365-daa65cd75f37","resolution":{"observed_at":"2026-08-06T20:45:39.908761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.898763Z","title":"Transformers: State- of-the-art natural language processing,","venue":null,"work_id":"92972277-9f13-4c59-8145-b970e775df78","year":2020},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.695469Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:d9128402a56ea7c9d8bea9117d7e3ce3859b7b7c83408b4a8f504768f86b1255","observation_id":"6a2d5dce-026e-4b13-bc87-171011154d15","resolution":{"observed_at":"2026-08-06T20:45:39.901347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.697945Z","title":"A survey on contrastive self-supervised learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.697945Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:824bb663463c312bf192b6171d426dc62ce1dcf90797ce55f7f56d10df5036c6","observation_id":"627bec8e-5485-4205-a636-386202464ab8","resolution":{"observed_at":"2026-08-06T20:45:39.697945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.888182Z","title":"Bangla speech recognition system using lpc and ann,","venue":null,"work_id":"88e1fac8-de89-46a3-8346-f28049266c3b","year":2009},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.700756Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:cffb504a9e4203c5c5571efe7be15a9449271dea08b5c7b24558f55c19de9926","observation_id":"2647bede-74af-4cda-a2d6-fe5da5ba037e","resolution":{"observed_at":"2026-08-06T20:45:39.890606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.880937Z","title":"Bangladeshi bangla speech corpus for automatic speech recognition research,","venue":null,"work_id":"d9bf02a3-0545-40c2-85dd-6c5f9c422a12","year":2022},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.703372Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:8db0601398f8bf507f57d6633944883b0ffea878d16778c528cc7a7cb42ab813","observation_id":"dca13932-4ce9-42a5-a7cd-bfe7d2d54a11","resolution":{"observed_at":"2026-08-06T20:45:39.883579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.871546Z","title":"w2v-bert: Combining contrastive learning and masked language modeling for self-supervised speech pre-training,","venue":null,"work_id":"a3a13850-8398-4f68-a501-4d85ca35b2d1","year":2021},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.705764Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:1c0d0eebf6dd543cd5bf9a1fb499f5c3281a5c0416415bbb1aee654dd6794e7e","observation_id":"3d08d9f5-6199-450d-aeb3-7302cf1c77e7","resolution":{"observed_at":"2026-08-06T20:45:39.875728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.863671Z","title":"Evaluating openai’s whisper asr: Performance analysis across diverse accents and speaker traits,","venue":null,"work_id":"75d817c3-6f7f-4e99-b73b-0807f0a651e3","year":2024},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.708848Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:0c8fc721a9542dcc20cdaae103fe6b7f3a8a0e3c5b10280e6baa0cdc126e8269","observation_id":"ab315b37-3c58-4c51-a833-c2430e3bb56d","resolution":{"observed_at":"2026-08-06T20:45:39.866775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.710905Z","title":"Common voice: A massively-multilingual speech corpus,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.710905Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:591ba445a5a0f4c90b81288e5332a5506f57504234712050e0f227ba18b0b197","observation_id":"b03d16ef-870c-4898-b9f7-2c63df82ecbf","resolution":{"observed_at":"2026-08-06T20:45:39.710905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/sltu.2018-11","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.781021Z","title":"Crowd-Sourced Speech Corpora for Javanese, Sundanese, Sinhala, Nepali, and Bangladeshi Bengali,","venue":null,"work_id":"ef91aff2-6a51-4b3a-96d9-ee26ec9c4bbe","year":2018},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.713106Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:95e3ccedc55e55db89c832008a56b7059104e5113737b396af2be03a52b11ac7","observation_id":"2cadfbe4-f7f3-4e49-850b-0da3abeb0dc6","resolution":{"observed_at":"2026-08-06T20:45:39.783479Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/sltu.2018-14","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.770103Z","title":"A Step-by-Step Process for Building TTS V oices Using Open Source Data and Framework for Bangla, Javanese, Khmer, Nepali, Sinhala, and Sundanese,","venue":null,"work_id":"9a178c4f-9242-459a-9498-6cb641237615","year":2018},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.716021Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:cbf74aa27d2631a8956566373860ecf924827d62699a1eb8be53a6a9eb6fb301","observation_id":"f931c13f-663d-4954-9248-15197473207d","resolution":{"observed_at":"2026-08-06T20:45:39.775592Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.851493Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":"5658b3fd-af58-4ed4-9ec0-5054e96d9cf0","year":null},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.719361Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:4d7c123160583bdd7b8ec569b8055fd1fa356effbce67f1378414eb802fc2c2f","observation_id":"096f34c1-bf5a-40e9-bb55-b3af93468ca2","resolution":{"observed_at":"2026-08-06T20:45:39.854162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.843235Z","title":"The cnn: The architecture behind artificial intelligence develop- ment,","venue":null,"work_id":"5eec1816-a04a-4305-bc12-af335fd38365","year":2023},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.726811Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:18a660c50643487e3846cae7a5ba0b1808e82929497524a089292731b5e28ae9","observation_id":"9bfbe91c-05f6-4f08-a872-34bd9849179d","resolution":{"observed_at":"2026-08-06T20:45:39.846347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.835555Z","title":"A wav2vec2-based experimental study on self-supervised learning methods to improve child speech recognition,","venue":null,"work_id":"a6dce810-e790-423f-b3e8-31193ef3b07f","year":2023},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.729862Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:e53c2b827641054931369279c46c69ea8425abf2450863b9c5999ee3fc0d612b","observation_id":"0c6dd336-e347-440b-9c91-533b78d97e2b","resolution":{"observed_at":"2026-08-06T20:45:39.838437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.826335Z","title":"Modular domain adaptation for conformer-based streaming asr,","venue":null,"work_id":"adc2cc9c-2bbe-4f76-a851-18072431b9d7","year":2023},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.732110Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:f832a55dc944c0b050bebd25b0f6818c9bb42944606f1c0ed1d8d9903b24298e","observation_id":"7ecede00-13b8-4324-8945-dce2a55e8b86","resolution":{"observed_at":"2026-08-06T20:45:39.830130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T20:45:39.735104Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.735104Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:721c67c791c454d750c4ece9f95eb9860dd55bd46e9be3828c4243de8b2c8cd6","observation_id":"d9ed9fd2-2301-4e5a-b691-277ec47f3c9f","resolution":{"observed_at":"2026-08-06T20:45:39.735104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.818159Z","title":"Kazakh speech recognition: Wav2vec2. 0 vs. whisper,","venue":null,"work_id":"44afd5a8-4c3a-406a-9ef2-d75353c6c99d","year":2023},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.737690Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:f4ce64380cb27f17d431a708cd25cfd6bfdcb2e6add4bd2104f1bd4247cdd861","observation_id":"0e45650e-c40c-4334-b89a-b23c26ee1814","resolution":{"observed_at":"2026-08-06T20:45:39.820782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-07-06T14:28:21.844826Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-06T20:45:39.740292Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.740292Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:9e45e3fdf3ac3810beaed409004ea91d7962dbe7dbed4069ae17abfc1624fb6a","observation_id":"eb8410f3-ebf4-48a8-935b-b5172942e000","resolution":{"observed_at":"2026-08-06T20:45:39.740292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07948","last_updated":"2023-07-16T05:25:51Z","snapshot_observed_at":"2026-07-06T15:54:28.831510Z","submitted_at":"2023-07-16T05:25:51Z","title":"Model Adaptation for ASR in low-resource Indian Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07948","snapshot_observed_at":"2026-08-06T20:45:39.742858Z","title":"Model adaptation for asr in low-resource indian languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.742858Z"},"links":{"cited_paper":"/paper/2307.07948","citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:1b7d9386fc167d1899fe625daa55446652af85c3e9e79654117ec6575fad9cbb","observation_id":"166244c0-4e49-4de9-97f0-df765f7251eb","resolution":{"observed_at":"2026-08-06T20:45:39.742858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.809895Z","title":"Whisper-at: Noise- robust automatic speech recognizers are also strong general audio event taggers,","venue":null,"work_id":"117e80e3-83a9-484f-b7bc-811790573cbf","year":2023},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.746013Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:2f1ea539c4e3a1e15b281abc18ec2e5a5ade28bca40d2714f5a5c4c2ad04d3e6","observation_id":"e7a12a61-1103-4155-899a-67f0f78dab1c","resolution":{"observed_at":"2026-08-06T20:45:39.812646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11477","last_updated":"2020-10-22T06:09:10Z","snapshot_observed_at":"2026-08-07T05:13:16.889179Z","submitted_at":"2020-06-20T02:35:02Z","title":"wav2vec 2.0: A Framework for Self-Supervised Learning of Speech Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11477","snapshot_observed_at":"2026-08-06T20:45:39.723023Z","title":"Available: https://arxiv.org/abs/2006.11477","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.723023Z"},"links":{"cited_paper":"/paper/2006.11477","citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:a025b14626db4825e4a260ff8319e97d9641632fb0e7b5a1784ce7a268f5c9ce","observation_id":"7089244b-1730-41e4-8e23-a377841663df","resolution":{"observed_at":"2026-08-06T20:45:39.723023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:45:39.749843Z","title":"Available: http://dx.doi.org/10.21437/Interspeech.2023- 2193","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:39.749843Z"},"links":{"citing_paper":"/paper/2507.01931"},"observation_digest":"sha256:d0d8635d481efc1fa208627c9aa38f57240e0eb8fbcafa53ec52e6718ecf7abd","observation_id":"4b1fbccc-a9bd-430c-b827-083ededcec63","resolution":{"observed_at":"2026-08-06T20:45:39.749843Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.01931","last_updated":"2025-07-02T17:44:54Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T05:01:03.185303Z","submitted_at":"2025-07-02T17:44:54Z","title":"Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":12},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 2 inbound Pith citation observations for arXiv:2507.01931."}