{"as_of":"2026-08-16T15:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f3d49db38414650f43addb8f67102c6ed533171961ce70edf39f475377b26eac","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:19:59.764201Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:19:59.656455Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T19:19:59.861302Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"cited_work":{"arxiv_id":"2506.16969","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.16969","snapshot_observed_at":"2026-08-15T19:19:59.861302Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","venue":"eess.AS","work_id":"2a49ad3d-34ea-4f78-a983-7b553b0b7f18","year":2025},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.656455Z"},"links":{"cited_paper":"/paper/2506.16969","citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:847359b24ab81748ead798dbdd6f781d5b55d7748d452ec8a4c48478834cda81","observation_id":"29b7e862-1586-40f1-b092-eaa59ece4617","resolution":{"observed_at":"2026-08-15T19:19:59.866003Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.16969/citation-record","integrity":"/paper/2506.16969/integrity","json":"/paper/2506.16969/citation-record.json","paper":"/paper/2506.16969"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"cited_work":{"arxiv_id":"2506.16969","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.16969","snapshot_observed_at":"2026-08-15T19:19:59.861302Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","venue":"eess.AS","work_id":"2a49ad3d-34ea-4f78-a983-7b553b0b7f18","year":2025},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.656455Z"},"links":{"cited_paper":"/paper/2506.16969","citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:847359b24ab81748ead798dbdd6f781d5b55d7748d452ec8a4c48478834cda81","observation_id":"29b7e862-1586-40f1-b092-eaa59ece4617","resolution":{"observed_at":"2026-08-15T19:19:59.866003Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:20:00.149139Z","title":"The primary distinction lies in how they are produced","venue":null,"work_id":"9a384dd4-7710-4b2c-89e2-ad42c91f793e","year":null},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.661179Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:76761d351e1ccfef231169ada4c9e2ce93e7d2f7cc600c198445ac16e0fe2705","observation_id":"e43acfad-951c-4d1e-9cbd-aa0b1b243dfc","resolution":{"observed_at":"2026-08-15T19:20:00.153712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:20:00.136419Z","title":"Specifically, we introduce the wTIMIT and CHAINS","venue":null,"work_id":"112ed695-5de6-4ca3-9a04-93e7ba433384","year":null},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.665829Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:241ace128f4164ca80482666c4c24eea56a40151f21f7177b8ca463fd55036c8","observation_id":"72731bd3-fea3-495e-881a-1693122076c0","resolution":{"observed_at":"2026-08-15T19:20:00.140770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:20:00.113681Z","title":"As a base- line, we evaluated the performance of the pre-trained Whisper Large-v2 model on the test set to assess the need for a special- ized system for the proposed challenges","venue":null,"work_id":"5c485aff-6caa-4a86-ba8b-2c904e385509","year":null},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.673878Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:d509122b36f1e7bede9046ac3a3d53d4172a7941d00264a0d0c17467b752b7ca","observation_id":"67f7ec60-44c6-4a08-b8cd-6cc40b262965","resolution":{"observed_at":"2026-08-15T19:20:00.118240Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:20:00.101462Z","title":"These challenges can severely degrade the performance of traditional systems, highlighting the necessity of developing ASR models specifically tailored to handle whispered speech","venue":null,"work_id":"9aa4265e-dc9e-4107-89fe-2d5cf076fb05","year":null},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.677498Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:688f4798f0bbdede05c050affa312ca2a2366e96f32a14f989ff73fe3e09407f","observation_id":"85f063d8-b6b9-4e73-99ed-7ab21a4699e6","resolution":{"observed_at":"2026-08-15T19:20:00.105826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.999565Z","title":"Gener- ative models for improved naturalness, intelligibility, and voicing of whispered speech,","venue":null,"work_id":"00301c23-343a-40a4-acbf-2660b700e063","year":2022},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.699284Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:2f64c580c28f7a874f8a058a931f04db02e5c164564003273b50b4283486577f","observation_id":"affd1cb9-744f-4efd-a73e-75489f3cc4a2","resolution":{"observed_at":"2026-08-15T19:20:00.004955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:20:00.087976Z","title":"Gammatonegram representation for end-to-end dysarthric speech processing tasks: Speech recogni- tion, speaker identification, and intelligibility assessment,","venue":null,"work_id":"d2f927a7-d806-475d-bb62-354c19686dca","year":2024},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.680878Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:31386bb519f61bda694c72f169aeac5a7ec467063f35e1a0a39c927b4451c9a3","observation_id":"738ba118-8258-482e-ad88-17290d9a97ed","resolution":{"observed_at":"2026-08-15T19:20:00.092558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:20:00.072728Z","title":"Dysarthric speaker identification with different degrees of dysarthria severity using deep belief networks,","venue":null,"work_id":"f41ae9d4-d4d9-44bd-ab8b-8385c852f526","year":2018},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.684390Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:a0540531ec853c95accb47e12ed51b8c3c50e3b0a8903db75382b7a728aba3b9","observation_id":"6ad10499-a51d-4611-9320-2e6c29dc32ca","resolution":{"observed_at":"2026-08-15T19:20:00.078638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:20:00.051728Z","title":"Analysis of deep generative model impact on feature extraction and dimension reduction for short ut- terance text-independent speaker verification,","venue":null,"work_id":"d16f608d-6348-4f82-b6d8-566662de5750","year":2024},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.687768Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:82009bb61d1ff38a9e0367804e24eca7b7d686b895f68697bad2de5ca9df97ea","observation_id":"01904d7e-5fcf-4b9c-831a-a633d837ca66","resolution":{"observed_at":"2026-08-15T19:20:00.059860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21211","last_updated":"2024-11-03T15:39:21Z","snapshot_observed_at":"2026-08-16T13:29:43.625434Z","submitted_at":"2024-07-30T21:45:37Z","title":"Leveraging Self-Supervised Models for Automatic Whispered Speech Recognition","version":2},"cited_work":{"arxiv_id":"2407.21211","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.21211","snapshot_observed_at":"2026-08-15T19:19:59.847593Z","title":"Leveraging Self-Supervised Models for Automatic Whispered Speech Recognition","venue":"eess.AS","work_id":"98e8232a-a35e-4b89-add0-70b02a308fb9","year":2024},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.692042Z"},"links":{"cited_paper":"/paper/2407.21211","citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:7dafdda828174c39f2185173e6a22c0f3fd62221bc0dc7e0f691ed55ddf83534","observation_id":"50adb962-8278-4a59-a9de-fef72ff4b763","resolution":{"observed_at":"2026-08-15T19:19:59.851655Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:20:00.030671Z","title":"Whisper to normal speech conversion using sequence-to-sequence mapping model with auditory attention,","venue":null,"work_id":"7461fa02-858d-46ab-9b07-8f2104b5cd9b","year":2019},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.696042Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:12a6b95ad4d952203abcbc4ae19b8c50b3fa94774e1c732c1aa9610b25e36fc1","observation_id":"4943a0d9-d4ad-432e-af54-cb1bbb2372df","resolution":{"observed_at":"2026-08-15T19:20:00.038672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.720018Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.720018Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:00b409e3daec65840ca039b074fc826b66f3e83b1c8d04e3c951fa5ac3ec457b","observation_id":"55a6288d-e757-4447-9c5d-d46c9eec9c55","resolution":{"observed_at":"2026-08-15T19:19:59.720018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.985945Z","title":"End-to- end whispered speech recognition with frequency-weighted ap- proaches and pseudo whisper pre-training,","venue":null,"work_id":"45d828ed-2033-46a4-bbd9-27f197e36510","year":2021},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.702683Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:6ea5e28adcefc133e6bb464dc1cf164479b2729b1f606cd02406dc8a5708fc68","observation_id":"5f77349d-2b6e-4c09-84c3-cd8e6901e049","resolution":{"observed_at":"2026-08-15T19:19:59.990581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.975853Z","title":"Improving whispered speech recognition performance using pseudo-whispered based data augmentation,","venue":null,"work_id":"9ad4be37-8855-4832-82b4-fd9aec03db9d","year":2023},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.705892Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:f221efacac216f179efac564dc5720654b3628ec1b85ad0554008c5eb156d9df","observation_id":"a7d48d02-748e-431a-88cf-186b49dd3d7b","resolution":{"observed_at":"2026-08-15T19:19:59.979546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.965582Z","title":"Whispered speech recogni- tion using deep denoising autoencoder and inverse filtering,","venue":null,"work_id":"d1cdaea0-fc17-4a47-99ad-58b5652c657b","year":2017},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.709042Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:6c3b0de7a8c3faa7ec8cc26b128f1de14cb6e49102ff8c428c22ac6e2b5ca4fb","observation_id":"c8dddfea-b597-45e4-af39-88a511962d43","resolution":{"observed_at":"2026-08-15T19:19:59.969448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:20:00.125506Z","title":null,"venue":null,"work_id":"a47151d8-6d39-4d0a-aee4-8748ddfb1287","year":null},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.669766Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:42070086f1e5e304848c91f7a98093b55c043b262f1498652e8123fbec79b590","observation_id":"9f526990-9172-46e9-a10f-5ca1c4f7725b","resolution":{"observed_at":"2026-08-15T19:20:00.129015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.954794Z","title":"Multi-dialect speech recognition with a single sequence-to-sequence model,","venue":null,"work_id":"c19fde04-387a-43c7-b284-1e56ccaed08c","year":2018},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.712964Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:9fc0587436ea20f5a979f9885f7419ddc416a93768f09e211ca79cad7edfd581","observation_id":"b7e8fbd9-361e-489d-8881-e8b372672603","resolution":{"observed_at":"2026-08-15T19:19:59.958953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.945152Z","title":"Multi-dialect speech recognition in english using attention on ensemble of experts,","venue":null,"work_id":"9878ec7d-e534-4d4c-be67-2f1127d53ee4","year":2021},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.716538Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:c1478512ac2fa8e5fe6f000c95fa1bf16735a66cc633d7a628540b11c1fd9fcb","observation_id":"9b0bc379-8d2c-483d-abaf-4f8ad4c63302","resolution":{"observed_at":"2026-08-15T19:19:59.948819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.723374Z","title":"Wavlm: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.723374Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:d7a07b5e3804078c0a8d4036b07552832dcbbd18a4f9f9e991f82254980a4986","observation_id":"8167bd77-c85d-4ebe-a24d-47dc0900bcc8","resolution":{"observed_at":"2026-08-15T19:19:59.723374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.726713Z","title":"Hubert: Self-supervised speech represen- tation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.726713Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:da30d9a6019ea53b148e8a2f1685cb2f588aee895332e9ff103c5e9142baca6c","observation_id":"716cfe03-0fb3-442c-9049-245d6aff0cd3","resolution":{"observed_at":"2026-08-15T19:19:59.726713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.730071Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.730071Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:0f737f7c8d97f93eea4aaf2019d5c6962a169315fb04b2cee4a52e182ea8629c","observation_id":"8be2b83c-d5b6-4c6a-acdd-c7196df6fdeb","resolution":{"observed_at":"2026-08-15T19:19:59.730071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.911929Z","title":"wtimit whispered timit dataset,","venue":null,"work_id":"24c8102c-b9fa-4e65-95fb-9e31bc542a09","year":2010},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.733128Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:b2dadda877361ad7393ae11dbebdb5ba69d2c4bc83340c162b70516090b558fb","observation_id":"dc6196fd-7e5b-4638-82c3-9ba663f4d6a4","resolution":{"observed_at":"2026-08-15T19:19:59.915703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.901610Z","title":"Acoustic analysis of consonants in whispered speech,","venue":null,"work_id":"057cb5c0-f53e-4bd8-9c1b-a3e970cc5e84","year":2008},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.736135Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:1ba982b0d895ed850571a1f21e0fcc88e37766fe98b4b1c1da3305837e264dba","observation_id":"f52d3c34-3268-4ca5-a590-b987f8bc954c","resolution":{"observed_at":"2026-08-15T19:19:59.905064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.890306Z","title":"La- ryngeal adjustment in whispering: magnetic resonance imaging study,","venue":null,"work_id":"1b011001-6249-453f-84b7-a3ce21d2ff04","year":1997},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.739285Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:f9f75142dfa82a8f1b6030461688c06691a143a8e8c79eeaa53b9bb72bae5f64","observation_id":"b776020f-0336-45ca-a896-51d2636d081e","resolution":{"observed_at":"2026-08-15T19:19:59.894509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.880016Z","title":"Acoustic differences between voiced and whispered speech in gender diverse speakers,","venue":null,"work_id":"a7dffba8-81cf-42cc-aef9-d16c4b6e4cee","year":2020},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.742466Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:d54f0e3a1ab24ae6a5f0c65db9acd849b440742487da4bbb5dd19d49dee288d4","observation_id":"bd8b54c9-73bb-40e4-a82c-872769e8dc83","resolution":{"observed_at":"2026-08-15T19:19:59.883849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:19:59.745826Z","title":"Lib- rispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.745826Z"},"links":{"citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:f3670eed818624448a59d5cff8d51abedc5f739d2509703d58c6b8d41649f240","observation_id":"f736476c-e39d-4dea-83bf-601666351fed","resolution":{"observed_at":"2026-08-15T19:19:59.745826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-15T19:19:59.749075Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.749075Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:a4981f9db34dbba58c275b374848bd0ad8199d03e41fca1bb4cff78ddaf54065","observation_id":"44223e4c-b682-40b9-8e45-7b50687989da","resolution":{"observed_at":"2026-08-15T19:19:59.749075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09732","last_updated":"2024-07-13T00:35:21Z","snapshot_observed_at":"2026-08-16T13:34:35.558554Z","submitted_at":"2024-07-13T00:35:21Z","title":"Speech Slytherin: Examining the Performance and Efficiency of Mamba for Speech Separation, Recognition, and Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09732","snapshot_observed_at":"2026-08-15T19:19:59.752685Z","title":"Speech slytherin: Examining the performance and efficiency of mamba for speech separation, recognition, and synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.752685Z"},"links":{"cited_paper":"/paper/2407.09732","citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:70f0b642aa13d747a6859ecd862360fbf3e7d7166c3f7b0cfccdeb8485d4149a","observation_id":"882bca90-7434-4f43-a582-00645041aa4c","resolution":{"observed_at":"2026-08-15T19:19:59.752685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08779","last_updated":"2019-12-03T18:19:07Z","snapshot_observed_at":"2026-08-15T18:44:59.455586Z","submitted_at":"2019-04-18T17:53:38Z","title":"SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08779","snapshot_observed_at":"2026-08-15T19:19:59.756520Z","title":"Specaugment: A simple data augmen- tation method for automatic speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.756520Z"},"links":{"cited_paper":"/paper/1904.08779","citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:abffe144128c2e3cdbdc25c14bc169a91c418a3d2dbc1e01282060dcde9f7054","observation_id":"72e2873c-942a-42b9-bb99-33a848072dd0","resolution":{"observed_at":"2026-08-15T19:19:59.756520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-15T19:19:59.760069Z","title":"Decoupled weight decay regulariza- tion,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.760069Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:26ea342d28dedd01c085583b823d9f46cf24df7fda45795222f8e073a4704d64","observation_id":"05da14a7-142e-4e02-90c1-1a083138f265","resolution":{"observed_at":"2026-08-15T19:19:59.760069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12007","last_updated":"2022-05-20T10:14:53Z","snapshot_observed_at":"2026-08-13T15:40:10.676245Z","submitted_at":"2022-05-20T10:14:53Z","title":"PaddleSpeech: An Easy-to-Use All-in-One Speech Toolkit","version":1},"cited_work":{"arxiv_id":"2205.12007","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.12007","snapshot_observed_at":"2026-08-15T19:19:59.793217Z","title":"PaddleSpeech: An Easy-to-Use All-in-One Speech Toolkit","venue":"eess.AS","work_id":"3466e722-0bbe-4150-9b15-649e1ddfa1f1","year":2022},"citing_paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T19:19:59.764201Z"},"links":{"cited_paper":"/paper/2205.12007","citing_paper":"/paper/2506.16969"},"observation_digest":"sha256:dfcd30d9e410682b111b29ae5b9ca6581a1a5fbd484bce203abfc04c0296183d","observation_id":"415652aa-8cc6-4254-9525-79464aa22cee","resolution":{"observed_at":"2026-08-15T19:19:59.799570Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.16969","last_updated":"2025-06-27T11:57:06Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-15T19:12:46.982492Z","submitted_at":"2025-06-20T12:59:35Z","title":"State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":10,"verified_exact":2,"verified_fuzzy":17},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2506.16969."}