{"as_of":"2026-08-15T09:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea3b3bf3502be462e740081ab19e19f754232669914e09d3e9c5f256a836781a","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:43:53.867082Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08235/citation-record","integrity":"/paper/2608.08235/integrity","json":"/paper/2608.08235/citation-record.json","paper":"/paper/2608.08235"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.696156Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.696156Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:a576ab2ad3fca14dd31c48b06fd073f5bac6096a45b30dfdde0f93f7a392c16e","observation_id":"dc72462b-4bc7-42b6-ad06-140e9a3da42e","resolution":{"observed_at":"2026-08-14T04:43:53.696156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-13T12:33:46.085209Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-14T04:43:53.703121Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.703121Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:00b73590c823b892112ba7519d3876f70937d702e663e3f5e00cef12582a2bc9","observation_id":"d33f1801-531f-4b66-938e-bc191ad93947","resolution":{"observed_at":"2026-08-14T04:43:53.703121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09296","last_updated":"2021-12-16T18:29:22Z","snapshot_observed_at":"2026-08-14T06:46:00.873540Z","submitted_at":"2021-11-17T18:49:42Z","title":"XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09296","snapshot_observed_at":"2026-08-14T04:43:53.712680Z","title":"XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale.arXiv preprint arXiv:2111.09296, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.712680Z"},"links":{"cited_paper":"/paper/2111.09296","citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:6ec5c4ff124be59af4206b77d54a295897aca62339e4c205381cb1196456e447","observation_id":"914273cf-8fac-4fdc-b12f-181bbd07541e","resolution":{"observed_at":"2026-08-14T04:43:53.712680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.720877Z","title":"Indicconformer-600m-multilingual","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.720877Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:f002ee29ce7f8c98ee12c0d6279075dae5c7f0ccb1dfe2222a8c69dd2600ae39","observation_id":"9e152c00-2839-484a-84a8-85b716b0a54e","resolution":{"observed_at":"2026-08-14T04:43:53.720877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.728022Z","title":"Saaras: State-of-the-Art Indic ASR","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.728022Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:79122b0fa4c27dfa533f52a0cbbc43f897ba4069b6098068d25f9d53dd9bd0b4","observation_id":"468638db-c2be-4ecd-8a77-43884ac26d47","resolution":{"observed_at":"2026-08-14T04:43:53.728022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.734122Z","title":"Fast conformer with linearly scalable attention for efficient speech recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.734122Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:b690b5dd2c8507a5dde7d08effc6db0364f753194297c38d71a7948f98d9ad9a","observation_id":"2a5f4c5e-e65f-4922-9082-b77523bbd2be","resolution":{"observed_at":"2026-08-14T04:43:53.734122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.28714","last_updated":"2026-05-26T18:40:18Z","snapshot_observed_at":"2026-08-14T21:08:52.135770Z","submitted_at":"2026-03-30T17:30:53Z","title":"VAANI: Capturing the language landscape for an inclusive digital India","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.28714","snapshot_observed_at":"2026-08-14T04:43:53.740724Z","title":"Vaani: Capturing the language landscape for an inclusive digital india.arXiv preprint arXiv:2603.28714, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.740724Z"},"links":{"cited_paper":"/paper/2603.28714","citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:62ed03ff6b1015dcf349b3a3686ad9ad43b95bbf5bcc3cb0bd5596c0c6ddb374","observation_id":"15ee5f15-537e-4462-b4c8-529f6b7832e7","resolution":{"observed_at":"2026-08-14T04:43:53.740724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.747759Z","title":"wav2vec 2.0: A Framework for Self-Supervised Learning of Speech Representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.747759Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:34c172657e72f53b95c156336a82fb122ca1da19ca42c26e894f4036d57a0197","observation_id":"360d8d98-a14b-49d0-a4b0-6372c9441909","resolution":{"observed_at":"2026-08-14T04:43:53.747759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.752778Z","title":"Common voice: A massively-multilingual speech corpus","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.752778Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:93a7b0d915516fd1201520da0351db4bbd70c55ca151d31c99cb2eddeff33d46","observation_id":"28ee39de-22a3-47ee-9e1f-ac3e6e84f045","resolution":{"observed_at":"2026-08-14T04:43:53.752778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.758490Z","title":"Fleurs: Few-shot learning evaluation of universal representations of speech","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.758490Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:50d42d9c6ab8a447e8deaeb440ee32dc72d8266dfd563c3f00d919c92bd8be77","observation_id":"3e91c709-9d8d-4088-997d-39f9c8083f78","resolution":{"observed_at":"2026-08-14T04:43:53.758490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.764424Z","title":"Indic TTS: A text-to-speech database for indian languages, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.764424Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:dd9ad565ad16f1355a7c2440139b5c92c61e76ce02072a8f04f83eb927f88973","observation_id":"0f80e8bf-709c-430a-8461-dad1a6a54934","resolution":{"observed_at":"2026-08-14T04:43:53.764424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.769547Z","title":"Indicsuperb: A speech processing universal performance benchmark for indian languages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.769547Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:8c131e4d006dcc8d836568cbf521387f23aaed67b3580b1d2cb2afeebaf5fb03","observation_id":"19cb95f1-7585-470e-8adb-70717d70bae0","resolution":{"observed_at":"2026-08-14T04:43:53.769547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.774658Z","title":"Respin-s1.0: A read speech corpus of 10000+ hours in dialects of nine indian languages","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.774658Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:57941284cb4445c5014e3d1fd7ffd1f5e7bd7ab88b719dca1da848a933949f23","observation_id":"3214c0f7-e376-420f-a888-25a9e407410f","resolution":{"observed_at":"2026-08-14T04:43:53.774658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.780532Z","title":"Gram vaani asr challenge on spontaneous telephone speech recordings in regional variations of hindi","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.780532Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:72f1fde13d1e26ac7077b0a01ab0e7071f913935e9f75a8fe8b7dc9273cc4d33","observation_id":"c7342d31-e996-4b2e-8ced-01aedf8cc3ee","resolution":{"observed_at":"2026-08-14T04:43:53.780532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.00235","last_updated":"2021-04-01T03:37:01Z","snapshot_observed_at":"2026-08-13T19:47:47.898265Z","submitted_at":"2021-04-01T03:37:01Z","title":"Multilingual and code-switching ASR challenges for low resource Indian languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.00235","snapshot_observed_at":"2026-08-14T04:43:53.786744Z","title":"Multilingual and code-switching asr challenges for low resource indian languages.arXiv preprint arXiv:2104.00235, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.786744Z"},"links":{"cited_paper":"/paper/2104.00235","citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:83d87d096e1ba28b0059cd655b8fbe61caa2a9cbabae46cd193f8f008190d88c","observation_id":"cebea4f9-5e90-4c92-9ac1-42ec68f4ab87","resolution":{"observed_at":"2026-08-14T04:43:53.786744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.796903Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.796903Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:0d4167529693e83d5b77383379cc298ca24716609b4464050ad51b8b7bb48946","observation_id":"f2ffed11-866d-4883-aa4a-e4f95ff0543e","resolution":{"observed_at":"2026-08-14T04:43:53.796903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.804287Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.804287Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:8dc5761a15a95b10c8e6b2c3b6557d8f97cbd85ef9c5f186c0d4ddf25b7a87b3","observation_id":"633ed468-3ee3-4b0c-8592-7331845b95f7","resolution":{"observed_at":"2026-08-14T04:43:53.804287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.809876Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.809876Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:b018fd3bfd6adfa2ab61f43bd74f1c8818d7bd7ca9f87491ef620d46ae512edc","observation_id":"9ecba9fb-c608-480c-962c-66251379ae4f","resolution":{"observed_at":"2026-08-14T04:43:53.809876Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.815258Z","title":"Park, William Chan, Yu Zhang, Chung-Cheng Chiu, Barret Zoph, Ekin D","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.815258Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:fb98da52baf8b5df24907cbd8e39a495233f5d23551169fc720b80731d9adcdc","observation_id":"724021df-2cd7-4727-8142-8c4199578c91","resolution":{"observed_at":"2026-08-14T04:43:53.815258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.820248Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.820248Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:f566f5c3975ebd172fc94ce88603cd47be8c926ab9b9a4a7ae24d7ac89a4deb8","observation_id":"7fc2b1c9-7823-4f96-beab-7c63d550970a","resolution":{"observed_at":"2026-08-14T04:43:53.820248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.825486Z","title":"Colbert: Efficient and effective passage search via contextualized late interaction over bert","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.825486Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:6d0cceec81673fce063de53e84748637332defa4878c04be772e8b8e81d799e1","observation_id":"3f7090d7-8ca9-48e0-9f1f-3adaf3cab6f1","resolution":{"observed_at":"2026-08-14T04:43:53.825486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.830401Z","title":"Siglip 2: Multilingual vision-language encoders with improved semantic understanding, localization, and dense features, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.830401Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:da53caa7e1eaa7d946c1dc3bb4a50e1b89d74de491332c513daa73d85c73bac2","observation_id":"9d70d454-83b1-494a-a532-37e201999066","resolution":{"observed_at":"2026-08-14T04:43:53.830401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.835491Z","title":"Efficient Sequence Transduction by Jointly Predicting Tokens and Durations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.835491Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:0966b72bc28c5ab54aefa8109117710d6e2c2cba195730f3cc8b40765eae64cb","observation_id":"19c8f0d3-8df3-4277-b2f9-232ca07f194d","resolution":{"observed_at":"2026-08-14T04:43:53.835491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.840783Z","title":"Indicvoices: Towards building an inclusive multilingual speech dataset for indian languages","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.840783Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:8b8e39c83aef1ea5e62ec7694034d9dd3ccabfacbce23692566cf6b38f8071d4","observation_id":"5ea1c5a1-7165-482d-b99d-f347c494b06e","resolution":{"observed_at":"2026-08-14T04:43:53.840783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14654","last_updated":"2023-10-24T06:03:14Z","snapshot_observed_at":"2026-08-13T16:18:26.296485Z","submitted_at":"2023-10-23T07:50:10Z","title":"SPRING-INX: A Multilingual Indian Language Speech Corpus by SPRING Lab, IIT Madras","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14654","snapshot_observed_at":"2026-08-14T04:43:53.845643Z","title":"Spring-inx: A multilingual indian language speech corpus by spring lab, iit madras","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.845643Z"},"links":{"cited_paper":"/paper/2310.14654","citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:47faffcab9195feb53c7a02016df9d6979b408d3360895d381ed5a0c8cb04601","observation_id":"ceaf73ce-f6bd-4ccd-a570-bebf28cc4a0f","resolution":{"observed_at":"2026-08-14T04:43:53.845643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.851800Z","title":"SPICOR TTS_1.0 Corpus: A 97+ Hour Domain-Rich Indian English TTS Corpus","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.851800Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:88a18242ec1fe8868b21c2ffb1960470d2032ed177c40c824808b83770a09766","observation_id":"d94ea2db-5113-408a-bcdd-4b9b8e21a4ff","resolution":{"observed_at":"2026-08-14T04:43:53.851800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:43:53.856943Z","title":"SYSPIN_S1.0 Corpus: A TTS Corpus of 900+ Hours in Nine Indian Languages","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.856943Z"},"links":{"citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:79a9b90a0a8fd23b627f7ecf1b8352d86d910c049e13619bb18d373dbfae7e96","observation_id":"e0a9ad69-e7ed-445d-bcda-7edcb9190bc0","resolution":{"observed_at":"2026-08-14T04:43:53.856943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.13331","last_updated":"2022-07-27T07:24:34Z","snapshot_observed_at":"2026-08-13T14:55:51.661796Z","submitted_at":"2022-07-27T07:24:34Z","title":"Subword Dictionary Learning and Segmentation Techniques for Automatic Speech Recognition in Tamil and Kannada","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.13331","snapshot_observed_at":"2026-08-14T04:43:53.861829Z","title":"Subword dictionary learning and segmentation techniques for automatic speech recognition in tamil and kannada, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.861829Z"},"links":{"cited_paper":"/paper/2207.13331","citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:c0c19c49f244a70a2b24c5eb747994d3426c30f4b589985d63ea9e5607754060","observation_id":"b3c22647-07ff-4d93-a1db-887425d9fc41","resolution":{"observed_at":"2026-08-14T04:43:53.861829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.13333","last_updated":"2022-07-27T07:29:27Z","snapshot_observed_at":"2026-08-13T14:55:51.819100Z","submitted_at":"2022-07-27T07:29:27Z","title":"Knowledge-driven Subword Grammar Modeling for Automatic Speech Recognition in Tamil and Kannada","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.13333","snapshot_observed_at":"2026-08-14T04:43:53.867082Z","title":"Knowledge-driven subword grammar modeling for automatic speech recognition in tamil and kannada, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:43:53.867082Z"},"links":{"cited_paper":"/paper/2207.13333","citing_paper":"/paper/2608.08235"},"observation_digest":"sha256:43f659a2dae3b00c2b7b3089019c8d0c382a17072d71c5087ecf65ec2f417c43","observation_id":"c72ee02a-eab0-4eba-8e18-434a630d29fd","resolution":{"observed_at":"2026-08-14T04:43:53.867082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.08235","last_updated":"2026-08-12T18:37:29Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-15T09:13:43.867196Z","submitted_at":"2026-08-08T17:04:00Z","title":"SraVaani 1.0: Scaling Inclusive Speech Recognition for Indic Languages"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2608.08235."}