{"as_of":"2026-08-15T22:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4524cb93d3053154eb178f8ecb7e1355f4897730fbbe49bf567d7e8ebac9354f","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T18:43:47.115567Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.11065/citation-record","integrity":"/paper/2501.11065/integrity","json":"/paper/2501.11065/citation-record.json","paper":"/paper/2501.11065"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.628710Z","title":"Introduction to convolutional neural networks","venue":null,"work_id":"0cb24419-dc37-4ef0-95cc-9c6fe2bc75bc","year":2017},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.961078Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:7c6ab6bdbe2ee59fd9556c21e523cc21434d5d310ee97198a10dbe43228ce2dd","observation_id":"610e07d4-119b-40cf-9d71-e7db298d33a8","resolution":{"observed_at":"2026-08-10T18:43:47.631775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.620162Z","title":"Machine health monitoring with lstm networks","venue":null,"work_id":"3fdbfe3d-16a5-4c05-9198-b0f7a0531696","year":2016},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.964357Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:3c786b40e4fba158554341d8f599eae5ad0f889294c89810a9bec6f4569399b3","observation_id":"7db8b348-e764-43f0-873a-02ed0eec7fc5","resolution":{"observed_at":"2026-08-10T18:43:47.623017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.610644Z","title":"An integrated cnn-lstm model for bangla lexical sign language recognition","venue":null,"work_id":"7921aa60-5d75-49a1-877e-b7d30772de26","year":2020},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.967293Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:9375a598997700dff672e78f8f3b591330044b8ac40363754f4506d8c8e6cbcc","observation_id":"3a889f43-00b3-4c9b-acc8-54946028b84a","resolution":{"observed_at":"2026-08-10T18:43:47.613857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.601030Z","title":"Universal attribute charac- terization of spoken languages for automatic spoken language recognition","venue":null,"work_id":"b10df0b6-87a6-46f9-a39f-9fb116999091","year":2013},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.970446Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:fe238a4fdb123b2b88eb37602e3031b612344d081a4fe4d0a94ddf02728d2a2f","observation_id":"786ad820-0c01-4640-ba06-9a96103d76c8","resolution":{"observed_at":"2026-08-10T18:43:47.604556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.12530","last_updated":"2021-03-19T19:32:15Z","snapshot_observed_at":"2026-08-13T22:02:26.513648Z","submitted_at":"2020-07-24T14:07:01Z","title":"A Comprehensive Study on Deep Learning-based Methods for Sign Language Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.12530","snapshot_observed_at":"2026-08-10T18:43:46.973548Z","title":"A com- prehensive study on sign language recognition methods","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.973548Z"},"links":{"cited_paper":"/paper/2007.12530","citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:11434c75a2415c84f23f13f96daf11fa47589248d56086f4989d896381467574","observation_id":"2b1f62e5-e1e3-45a8-950c-4ff6f12b99a6","resolution":{"observed_at":"2026-08-10T18:43:46.973548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:46.977170Z","title":"Accelerated profile hmm searches","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.977170Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:9b6e5f4222d48a7c0384db6816debeb33946dd732a92fb631590a8047b756637","observation_id":"2b572c43-0f3a-46a4-8f40-fd47d59d2e0f","resolution":{"observed_at":"2026-08-10T18:43:46.977170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.586498Z","title":"Spoken lan- guage recognition using cnn","venue":null,"work_id":"2ec18fc9-fa09-46c4-95dd-c2bfab734db8","year":2019},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.980683Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:cf6205f33780c8666c443888b6c14ca5f324c9129e8943dfd12332a51c740460","observation_id":"66022a9e-aef5-455f-bfe2-ab5c2d096a2f","resolution":{"observed_at":"2026-08-10T18:43:47.589305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.578513Z","title":"Graph lstm with context-gated mechanism for spoken language understanding","venue":null,"work_id":"a8252b50-28de-4456-8dfe-ddd1b8113d07","year":2020},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.983745Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:5c2d987208352c1921b6a10951eaebf81722142517e53aeedbd9fefb3525ba46","observation_id":"df336c1c-6add-483a-8634-f676c7a2e66d","resolution":{"observed_at":"2026-08-10T18:43:47.581338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.03486","last_updated":"2019-04-23T13:27:29Z","snapshot_observed_at":"2026-08-14T16:50:40.905948Z","submitted_at":"2019-04-06T16:32:12Z","title":"Self-supervised speaker embeddings","version":2},"cited_work":{"arxiv_id":"1904.03486","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.03486","snapshot_observed_at":"2026-08-10T18:43:47.212829Z","title":"Self-supervised speaker embeddings","venue":"cs.CV","work_id":"aca78d3f-4d73-4eb9-b8f6-d4227b9a25c5","year":2019},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.986774Z"},"links":{"cited_paper":"/paper/1904.03486","citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:70f9b3ba83278188963e3ae5298676a878d2c34a697dda2f292d88268ec451a4","observation_id":"de76410d-2f3d-4cd3-a282-413a103891ba","resolution":{"observed_at":"2026-08-10T18:43:47.215894Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.569911Z","title":"A stethoscope for drones: Transformers-based methods for uavs acoustic anomaly detection","venue":null,"work_id":"362869be-a4f6-45b5-a351-0ad171d06ff4","year":2023},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.990464Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:69baf18a750acf1a9690b0572f6d2e34a1fdee9ddd8358f6a3a3dcfb22dc6197","observation_id":"babbf746-6bf6-4629-a1bd-156e4186eb6d","resolution":{"observed_at":"2026-08-10T18:43:47.573358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.560628Z","title":"X-vectors: Robust dnn embeddings for speaker recognition","venue":null,"work_id":"5866c775-4340-435f-9063-ca8a3246411d","year":2018},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.993505Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:f11305e0fa075e5c091120989279a2ce325df3d3f5de10f3e5426ecdbd0f614d","observation_id":"938d165a-b3db-4928-8231-6205161bbb6e","resolution":{"observed_at":"2026-08-10T18:43:47.564055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.551887Z","title":null,"venue":null,"work_id":"31f87d00-7555-48b0-addb-142cec7e4019","year":2011},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:46.996569Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:3c7533e2b1e965157946828a41d65a0763bc6c5521559ae09d95bbb96bdabbcc","observation_id":"634da37b-ad4d-4230-a325-2878552e70c8","resolution":{"observed_at":"2026-08-10T18:43:47.554916Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.10984","last_updated":"2020-08-12T22:58:20Z","snapshot_observed_at":"2026-08-14T04:41:05.899709Z","submitted_at":"2020-08-12T22:58:20Z","title":"End-to-End Neural Transformer Based Spoken Language Understanding","version":1},"cited_work":{"arxiv_id":"2008.10984","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.10984","snapshot_observed_at":"2026-08-10T18:43:47.200737Z","title":"End-to-End Neural Transformer Based Spoken Language Understanding","venue":"cs.CL","work_id":"b0d72011-e218-4e90-ad4d-ca06547e4754","year":2020},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.000012Z"},"links":{"cited_paper":"/paper/2008.10984","citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:74d2b51b2b5017017197d28454928210ae2e089767526246578a32d7cff9c000","observation_id":"f5dbee87-145c-402a-924d-d794f28f3495","resolution":{"observed_at":"2026-08-10T18:43:47.204031Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.543408Z","title":"Challenges and issues in adopting speech recognition","venue":null,"work_id":"c186968c-8fc9-4baa-95b1-99f19eb6fdd2","year":2015},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.003247Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:de63343c36c9ffb19d9ae0dd68060e3d9df7c7c77885d45cc07b8be1dba5670e","observation_id":"ed94d566-3676-4079-ac01-52b9c35465c3","resolution":{"observed_at":"2026-08-10T18:43:47.546431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00425","last_updated":"2024-12-31T13:03:20Z","snapshot_observed_at":"2026-08-10T22:49:09.575066Z","submitted_at":"2024-12-31T13:03:20Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","version":1},"cited_work":{"arxiv_id":"2501.00425","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.00425","snapshot_observed_at":"2026-08-10T18:43:47.187288Z","title":"Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages","venue":"cs.CL","work_id":"72c9b5e2-92ba-4bed-bded-ef78b4a83fbb","year":2024},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.005650Z"},"links":{"cited_paper":"/paper/2501.00425","citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:9a97c0dd1469ad54f2ce4538fb1f76527183aecaf4756606a24a69cdc894c40a","observation_id":"89e8cd90-4c2f-47dd-bd95-02add609d68e","resolution":{"observed_at":"2026-08-10T18:43:47.190924Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.533864Z","title":"Harnessing the power of wav2vec2 and cnns for robust speaker identification on the voxceleb and librispeech datasets","venue":null,"work_id":"4e826e4e-2862-4ac2-9917-5d3ad3c2e122","year":2024},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.008443Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:9e8697d055b1057df42b810b582ccb012be368dcee94af20ec92c50ce5e67286","observation_id":"279d6aba-c9a8-492c-94ac-077e7de0bdbd","resolution":{"observed_at":"2026-08-10T18:43:47.536898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.525796Z","title":"Extending limited datasets with gan-like self-supervision for sms spam detection","venue":null,"work_id":"e5e2f115-7bb8-44c2-9cab-d9ce637057d2","year":2024},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.010902Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:90cde1127df71489d7ef7980741e9ffc44eb47cc0b4a3b36d3997fcd3c1f8a91","observation_id":"6c7e65ac-22b9-49bb-8903-e032fe032f54","resolution":{"observed_at":"2026-08-10T18:43:47.528728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.516987Z","title":"Full-covariance ubm and heavy-tailed plda in i-vector speaker verification","venue":null,"work_id":"38f9509f-08c9-4e25-a524-2dc6100a1216","year":2011},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.013351Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:5d783dec1b729915028b6be0c261d628369d7f254be59f7b8d905ee75f195288","observation_id":"55c353ac-7fdf-4b04-939f-5d77c9af047d","resolution":{"observed_at":"2026-08-10T18:43:47.520013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.508757Z","title":"Discriminative neural embedding learning for short-duration text-independent speaker verification","venue":null,"work_id":"2a5f100c-a194-4f48-8197-5a64ba38c153","year":2019},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.015732Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:ccfae7c6d24fd35f452cd72eadc15bc60f6ecaa37f2bc42815ff9a32272f18c2","observation_id":"57fd41ec-3bdd-4cbe-8532-6bcf0bf09b01","resolution":{"observed_at":"2026-08-10T18:43:47.511732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.500529Z","title":"Multiclass discriminative training of i-vector language recognition","venue":null,"work_id":"a0323672-0951-4e72-9f49-eb6df9ca1546","year":2016},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.018275Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:e5ee250a5aa4cd960f72122997e35f0d1cb433e2c0eb0d520bf052654ca3793f","observation_id":"d3196a60-83a0-4f05-87f7-44be816786fb","resolution":{"observed_at":"2026-08-10T18:43:47.503504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.492531Z","title":"Spo- ken language recognition using x-vectors","venue":null,"work_id":"ef6bb852-498b-4635-acbb-d1aa27569292","year":2018},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.020941Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:22fb5b8a0a844996623a2d2d08694af62148e648bf08e7e2b1f47f8069ab84fc","observation_id":"dbc04cb3-425a-453f-9716-c614762077eb","resolution":{"observed_at":"2026-08-10T18:43:47.495399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.483960Z","title":null,"venue":null,"work_id":"ceb2ccda-535d-452e-868f-c5327ebb8d55","year":2014},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.023491Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:c25ab57ccb6d28ce48686a6f46ab2046a2e02be59e768fba7e45eb1ee3f523af","observation_id":"db62e5e1-9ad7-4d75-af91-bc962ef35d6e","resolution":{"observed_at":"2026-08-10T18:43:47.487347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.474349Z","title":"Improved conditional generative adversarial net classification for spoken language recognition","venue":null,"work_id":"83a4a5dc-e37a-4fc8-90c7-b91f954617f0","year":2018},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.026009Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:e089afcbf06b5e6897926ea509ccdc5730f7b84586d774cbbcfe4a0008962fbe","observation_id":"1abea61b-6378-4f08-8e45-c657aa6105e3","resolution":{"observed_at":"2026-08-10T18:43:47.477777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.463730Z","title":"A dcrnn-based ensemble classifier for speech emotion recognition in odia language","venue":null,"work_id":"7b851403-8091-4e6a-8d40-5e7399d16f05","year":2022},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.028647Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:cf210c5155b21f9ee0eb0f5ae75e373f22412d187634bec7af51e6a521ede3af","observation_id":"56f7b177-6796-41d5-aaf0-ea36744c24a5","resolution":{"observed_at":"2026-08-10T18:43:47.467127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.454760Z","title":"V oxlingua107: a dataset for spoken language recognition","venue":null,"work_id":"ecaba7df-fa68-4350-8e97-1d43294a5613","year":2021},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.031178Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:44a75c6c03f142586cf9e7188ba8b46a1c6e0a770e2a2de208b14fbbfdad27d8","observation_id":"6473ace4-c338-47d3-b152-7dd85e924f7c","resolution":{"observed_at":"2026-08-10T18:43:47.458106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.445697Z","title":"Stacked long-term tdnn for spoken language recognition","venue":null,"work_id":"7934d54e-13d0-4624-b0f8-28b8a36cba03","year":2016},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.033837Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:a46fb994a965b61be11229ff60a0171dd9351255aabe22d1d35958f81bed25d9","observation_id":"c74a7773-c28a-40d1-bb4c-3f112195bf3f","resolution":{"observed_at":"2026-08-10T18:43:47.448824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.436890Z","title":"V oxlingua107: A dataset for spoken language recognition","venue":null,"work_id":"76ba940a-67c3-4da1-bcb9-b868aa2ee904","year":2020},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.036633Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:993f5a18335de8a34258b83d30843d3619237079465382bde847ae8e6093b107","observation_id":"44b30c81-4362-4475-b7a6-37f79bc7a743","resolution":{"observed_at":"2026-08-10T18:43:47.439668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06670","last_updated":"2020-03-05T20:37:08Z","snapshot_observed_at":"2026-08-12T13:38:15.911519Z","submitted_at":"2019-12-13T19:22:44Z","title":"Common Voice: A Massively-Multilingual Speech Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06670","snapshot_observed_at":"2026-08-10T18:43:47.039372Z","title":"Common voice: A massively-multilingual speech corpus","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.039372Z"},"links":{"cited_paper":"/paper/1912.06670","citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:f7d66f736779afa2b4442942862879a66ada3666d5b532e45577b0475bc818b3","observation_id":"9d73cbc9-6125-4053-9972-51c881cd0a5e","resolution":{"observed_at":"2026-08-10T18:43:47.039372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.428722Z","title":"Self report in clinical and epidemiological studies with non-english speakers: the challenge of language and culture","venue":null,"work_id":"cfeba53a-266b-4f84-a3ff-016d16e95913","year":2004},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.042801Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:ecb8ceea29b4218ff35755a86cf3c1fb7ca7f244f0099b06903404ad6f466db4","observation_id":"e0d51409-030a-425f-89d2-71bbc4385a91","resolution":{"observed_at":"2026-08-10T18:43:47.431793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.420916Z","title":"Indo-European language and culture: An introduction","venue":null,"work_id":"5c883679-9e4f-4266-b5fe-e78632ebcce1","year":2011},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.045344Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:63538f78243b1d646ab9b8dd60f8dd23431d80aae994b56933ae177d580db264","observation_id":"a3d2e956-b445-476e-8f47-cdabae0c88e5","resolution":{"observed_at":"2026-08-10T18:43:47.423754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.413381Z","title":"Semitic languages","venue":null,"work_id":"d55f0bb2-3e0d-47a6-997a-11d41e8e1368","year":2009},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.048008Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:85d6a35b07059ca942220d8ef8720f7ba6f80288d41fd12242546b3d618c2b02","observation_id":"72fa7982-7724-41bb-9d9e-df60eccde3b8","resolution":{"observed_at":"2026-08-10T18:43:47.415975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.405426Z","title":"The topography of certain phonetic and morphological characteristics of south east asian languages","venue":null,"work_id":"f017e551-df43-4941-9411-4c85085b09ee","year":1965},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.050632Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:be475ac9701012bffc0e03fb4c5d6cae17effe63553065655804fd09faecd035","observation_id":"e7fbd378-4afb-48b3-b05d-6f250ced7a25","resolution":{"observed_at":"2026-08-10T18:43:47.408207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.397731Z","title":"Principles of spoken language recognition","venue":null,"work_id":"e2ca4618-d782-425b-8248-51f5a2e25e69","year":2008},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.053670Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:2a483bb8e34e996b5079232b0fb1d7b1c1c7ff4a9d8749ad2a33148215b57622","observation_id":"9629bb71-60b4-451f-977c-0eee727005bf","resolution":{"observed_at":"2026-08-10T18:43:47.400422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.389850Z","title":"Stacked long-term tdnn for spoken language recognition","venue":null,"work_id":"cc5b5ccf-9db4-448b-9969-214312f15078","year":2016},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.056311Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:4dc04b9bb1178f0e1879406aebf93e2f15f665e510a2804d905abad4dc76034e","observation_id":"ff57501b-3da3-4c6e-9e88-f5cdffcdfdee","resolution":{"observed_at":"2026-08-10T18:43:47.392619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.381981Z","title":"Comparing apples with apples: The importance of clean data","venue":null,"work_id":"6726a5ae-0dd7-4a2e-b7d7-07c867a70af1","year":2019},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.059324Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:34e094077003c5aaf86c708f708e98e79ae519d31ff97dc4b778b847fdb336a5","observation_id":"ae0bbb60-70c2-42e2-b757-8572b333f162","resolution":{"observed_at":"2026-08-10T18:43:47.384777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.374278Z","title":"The importance of balanced data sets: Analyzing a vehicle trajectory prediction model based on neural networks and distributed representations","venue":null,"work_id":"9250dc9f-585e-47ef-a920-18d2a1ac5ac7","year":2020},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.062244Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:4d87bc4625a782b33bbb17a50b677a210d118ae7e94558a2c098aba1a75ec53e","observation_id":"5e369609-3159-46d9-ad30-c50290f3d023","resolution":{"observed_at":"2026-08-10T18:43:47.377105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08779","last_updated":"2019-12-03T18:19:07Z","snapshot_observed_at":"2026-08-15T18:44:59.455586Z","submitted_at":"2019-04-18T17:53:38Z","title":"SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08779","snapshot_observed_at":"2026-08-10T18:43:47.065183Z","title":"Specaugment: A simple data augmentation method for automatic speech recognition","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.065183Z"},"links":{"cited_paper":"/paper/1904.08779","citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:048e6d82830075cbac8072161a6e37f90e72a9bc234c2c0672b6d69ed789bda4","observation_id":"fed1feb7-e486-4175-bffa-60c67e2761ce","resolution":{"observed_at":"2026-08-10T18:43:47.065183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.365032Z","title":"Audio augmentation for speech recogni- tion","venue":null,"work_id":"958f86d3-eba7-4046-82e9-e8594b604253","year":2015},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.068197Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:098f68d373449fac3829c3805214d3051099a9f7cf6ac175402d5b72aec9b3b7","observation_id":"eedc24a4-e5fd-42e9-b80e-2b44444b7fc2","resolution":{"observed_at":"2026-08-10T18:43:47.368520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.356074Z","title":"Out domain data augmentation on punjabi children speech recognition using tacotron","venue":null,"work_id":"a76a482b-42c2-48d0-ba8f-053e7c48250b","year":1950},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.070892Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:b8e5f1ceebb16dcf8858b589d396423b3b52eb409d65029605c48f8f0e5c87cd","observation_id":"49c5fd39-db26-4058-b91b-f7cd4a30fe18","resolution":{"observed_at":"2026-08-10T18:43:47.359375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09596","last_updated":"2018-10-22T08:43:01Z","snapshot_observed_at":"2026-08-14T19:41:55.427034Z","submitted_at":"2018-02-26T20:41:17Z","title":"Tunability: Importance of Hyperparameters of Machine Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09596","snapshot_observed_at":"2026-08-10T18:43:47.073588Z","title":"Tunability: Importance of hyperparameters of ma- chine learning algorithms","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.073588Z"},"links":{"cited_paper":"/paper/1802.09596","citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:aa729c79a20c0cd9d5dc538af6e953c30f10fd1ba9003d7cac4282731254dda4","observation_id":"8569c9ee-0813-4141-af03-a44b934aefe1","resolution":{"observed_at":"2026-08-10T18:43:47.073588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.346938Z","title":"Character-level language modeling with deeper self-attention","venue":null,"work_id":"5cf1d797-f911-435f-bae7-ef0657cf477c","year":2019},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.076429Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:d956c6b20593ef4bdc2a6f8df2112288d54a6907690b5f7dbd3707ca897a5bcb","observation_id":"96075076-e7c4-412a-a049-a4e1f798f508","resolution":{"observed_at":"2026-08-10T18:43:47.350282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.338704Z","title":"The importance of bottle- necks in protein networks: correlation with gene essentiality and expression dynamics","venue":null,"work_id":"dbd76b21-b497-4709-91cb-864b9decab8d","year":2007},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.079038Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:57c0a3719e532560c3224149025ca82fa7e806880dd8d4c779c956a82d18b3ea","observation_id":"cbc7563e-c73e-4b60-a76f-8d4ddc76a685","resolution":{"observed_at":"2026-08-10T18:43:47.341663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.331237Z","title":"Automatic lyrics transcription using dilated convolutional neural networks with self-attention","venue":null,"work_id":"2953c239-e2a5-440f-8b74-d43979503935","year":2020},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.082044Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:35f0ebbe6759a585e0f974b29e5fdedb65f47378a6771d819962716e20a3e8b9","observation_id":"7872973a-6db6-44d9-90bc-fb273cb92933","resolution":{"observed_at":"2026-08-10T18:43:47.333921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.323167Z","title":"Densely connected time delay neural network for speaker verification","venue":null,"work_id":"6c4b9fc7-3b50-4dd2-9283-f186ef9d6ffb","year":2020},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.085155Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:ff200010a58cdc8dcff37f1833283137e2dfc8ac4b6938cb3c4c1757064df5f5","observation_id":"8b6ec472-8fbf-4a96-a814-0aaf3bdd0c6d","resolution":{"observed_at":"2026-08-10T18:43:47.325965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.314634Z","title":"Wire detection using synthetic data and dilated convolutional networks for unmanned aerial vehicles","venue":null,"work_id":"ef15f416-9a5d-4ced-aae7-707773106072","year":2017},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.088487Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:6bac5cdd5279a6df769fb5a0ea219a38ec5b50b30f3d34c35c80c1e8cb54251e","observation_id":"7e19d940-9372-44f1-a089-1e7c804db157","resolution":{"observed_at":"2026-08-10T18:43:47.317413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.306449Z","title":"Multi-resolution speech analysis for automatic speech recognition using deep neural networks: Experiments on timit.PloS one, 13(10):e0205355, 2018","venue":null,"work_id":"b2ad2d0d-2c66-446b-a6b9-91d0728d97af","year":2018},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.091566Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:b8e2f446181a9093663021fc3ee9121fadfb56dd929e882661db92cec5d2751d","observation_id":"0d188b36-ef9d-4fd8-82ba-e7b3de20626d","resolution":{"observed_at":"2026-08-10T18:43:47.309365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.298062Z","title":"Improving ctc- based acoustic model with very deep residual time-delay neural networks","venue":null,"work_id":"409f383f-f131-4a1c-b548-0fa38fecd5d5","year":2018},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.094637Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:7a61ef4acfbf5b31794912bf57db2d0cd0857942a4c8ee1fcd6c871517148317","observation_id":"453f5769-bd90-4f99-9b51-53941e13a2e9","resolution":{"observed_at":"2026-08-10T18:43:47.301083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.289554Z","title":"Deep learning and the information bottleneck principle","venue":null,"work_id":"c9554e37-23d2-42be-b6b8-c8752b57cd35","year":2015},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.097228Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:cf322f1d3e2f3b262b0fc7297732f9c3e5865ea1b32759e3d6d0faa54e153df7","observation_id":"adb304f4-c661-4153-93e3-c1e5f418c406","resolution":{"observed_at":"2026-08-10T18:43:47.292626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.280866Z","title":"Speech and multilingual nat- ural language framework for speaker change detection and diarization","venue":null,"work_id":"3f12ac94-647e-48fc-83fc-5496278785f1","year":2023},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.099895Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:e629ef1146b7b3e4b26193bd7714ce04cdbe767888a775d32dbea2c663ee8a91","observation_id":"1de7663c-1f95-4090-94bc-3f3c85358f22","resolution":{"observed_at":"2026-08-10T18:43:47.283901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.270599Z","title":"Hybrid speech and text analysis methods for speaker change detection","venue":null,"work_id":"b5c88b5a-4355-4ef1-9726-b9563672ce88","year":2021},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.102455Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:b2fb87cb5648e9485d0ef553eb673b6687b6a0e91bf89f1513f20e462884538e","observation_id":"eabbb707-3701-4b6e-bb46-ed704488511d","resolution":{"observed_at":"2026-08-10T18:43:47.274125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.260353Z","title":"A thousand words are worth more than one recording: Word-embedding based speaker change detection","venue":null,"work_id":"c332b102-1374-4de6-bf88-01413dd0b568","year":2021},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.105036Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:a62bf8c3e40d77520154dc6263dbb84173c54ae80729f9fa5a503e3b22e1f6d8","observation_id":"faaaa77d-764c-4d25-9695-3d8bbd6875b4","resolution":{"observed_at":"2026-08-10T18:43:47.264114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.01206","last_updated":"2020-05-18T17:47:01Z","snapshot_observed_at":"2026-07-06T09:25:10.629961Z","submitted_at":"2020-05-18T17:47:01Z","title":"A Thousand Words are Worth More Than One Recording: NLP Based Speaker Change Point Detection","version":1},"cited_work":{"arxiv_id":"2006.01206","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.01206","snapshot_observed_at":"2026-08-10T18:43:47.144272Z","title":"A Thousand Words are Worth More Than One Recording: NLP Based Speaker Change Point Detection","venue":"cs.CL","work_id":"6d71c339-f23c-4ab4-bb06-93691b4aa434","year":2020},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.107555Z"},"links":{"cited_paper":"/paper/2006.01206","citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:024d0eed4bb20029379a6a799f48a390de270eb67c4c82a36f36d8eeb5c6479e","observation_id":"e0cd7e9c-0acb-4cd5-8726-e2f72205f054","resolution":{"observed_at":"2026-08-10T18:43:47.149639Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.249623Z","title":"Crossing language identification: Multilingual asr framework based on semantic dataset creation & wav2vec 2.0.Machine Learning with Applications, 13:100489, 2023","venue":null,"work_id":"1f8c27a2-af44-454a-a192-bb90214dfdc7","year":2023},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.110525Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:4ce1079f4be19802c8aaa79a80b1457c0f9bdaabb773be3e0f7c2ad71c446121","observation_id":"99928a2a-17d3-4c59-8611-30fa1ca85764","resolution":{"observed_at":"2026-08-10T18:43:47.253546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.239763Z","title":"The use of occurrences of ideas for con- structing and characterizing the design space","venue":null,"work_id":"7e20866f-4e25-4aa8-b3b9-510ca44194c6","year":2024},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.113024Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:75f784117ebca0f9ed67f94aa9f9d0bdb24b43ff3d11d06d577ae8441ccc9e1e","observation_id":"0664b290-3ecb-4ce2-8f1a-fbcac4f1b9ef","resolution":{"observed_at":"2026-08-10T18:43:47.243196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:43:47.230777Z","title":"A data-driven nlp approach to analyzing framing and reframing in design protocols","venue":null,"work_id":"381ca063-009d-4567-9bc9-7cab39007d5f","year":null},"citing_paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T18:43:47.115567Z"},"links":{"citing_paper":"/paper/2501.11065"},"observation_digest":"sha256:66574ef1abe81380ae1647a4b258ad5244394491a1a2770e41200546c5dd5c4a","observation_id":"c97ef577-df6d-4d88-803d-a07d6a935c03","resolution":{"observed_at":"2026-08-10T18:43:47.233805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.11065","last_updated":"2025-01-19T14:49:43Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-15T16:01:03.073769Z","submitted_at":"2025-01-19T14:49:43Z","title":"Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":4,"verified_fuzzy":44},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2501.11065."}