{"as_of":"2026-08-05T13:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2b6a423952e33ecc1776a0d7fb80fdaaa7169eb11c75733cc6961452d8865583","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T12:15:06.470439Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T12:15:06.470439Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.10371","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2607.10371","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:8867e8da7c25091e392af9a03e63f1a94b19f97fcb9e621cc6be8b23a43ab469","observation_id":"d61fe4a4-4b4e-4b8e-9573-294d1c6508aa","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.10371/citation-record","integrity":"/paper/2607.10371/integrity","json":"/paper/2607.10371/citation-record.json","paper":"/paper/2607.10371"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:d27795589f717c3534a1ffafb221d8edc377f649833361d2b9f7b99fca2a8703","observation_id":"9be9d37e-c2b2-496b-81c1-f7e3cc7bf605","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.10371","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2607.10371","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:8867e8da7c25091e392af9a03e63f1a94b19f97fcb9e621cc6be8b23a43ab469","observation_id":"d61fe4a4-4b4e-4b8e-9573-294d1c6508aa","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"uncertain","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:0d0724437a82d3671fb658b041d6dbaf99482df446227ece177ba8bf9f6dbf93","observation_id":"5cd6ce53-190e-4ccc-a6cd-bed3e1b3137c","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"centre”→“center","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:b93934eacc6ac3c868265957946cc160d0f90b139e2df6efa10596f437c0a96e","observation_id":"f8182e16-7996-4c9c-9663-55647349575c","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"We introduce GigaAM Multilingual, a Conformer en- coder pre-trained on 2M hours of audio using a cluster-aware sampling strategy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:b7c7d03d401231c7637fb53a3b5a964d2e92ab297bd8d52b39890aa406e43c9d","observation_id":"68989239-52ea-42ba-b079-b0a565ca4acb","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"The authors reviewed and revised all AI-assisted edits and take full responsibility for the content, claims, experimental results, and conclusions of this paper","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:928e4f765789c299575fe6c1805f2eb809b47bff8b46b817d9832eee60ab8b3f","observation_id":"1afdf5cb-9991-412a-83e9-99fe27c50f8b","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:08df3cc4a6267a13738d4e972b407faa92e34d151e1ee45ef03adaea61ffa9ae","observation_id":"5d1b874d-bd42-4891-81c7-aa4c9a011260","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-04T01:36:29.191456Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Google USM: Scaling automatic speech recognition beyond 100 languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:f81ed1c216c352fc8053b7dc9bcce68b9502d7d64e242fb051bf2e16962e39d4","observation_id":"e9f7d5bc-f704-408a-9c4b-c39d313442b4","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:4873f8b7d99112d1a32780305b3f0da71301f5b76949d254d494fe69029fcfab","observation_id":"889a9b6f-3264-4c13-ac05-2f75b5b1d8ab","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Available: http://jmlr.org/papers/v25/23-1318","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:e972f037a090315d8f22955088931d8c1dc3f9c98668d08bfc4ad12286ae6fe8","observation_id":"b88651f0-baf6-4736-b08d-fe2dc494bc10","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Omnilingual asr: Open-source multilingual speech recognition for 1600+ languages,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:776d64e5b76718fa77c16232e4d15acd13f4f04f5e24fa34a2c2741dd6639471","observation_id":"888eefd7-41d3-4092-a820-6d68ff553484","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"The ML-SUPERB 2.0 Challenge: Towards In- clusive ASR Benchmarking for All Language Varieties,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:e26c8bfacbf61cd3db73762147cd03ceba2bb54b3f381b249c81b111bef40545","observation_id":"1063d487-f647-42fd-9899-0b710060bb36","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"mHuBERT-147: A Compact Multilingual HuBERT Model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:b31b0e59113b437f3549cd55d857cf7e711fb817eeb0310245642867bab5cb36","observation_id":"346eb9d2-f306-4604-9366-a4fd5ced41d0","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"GigaAM: Efficient Self-Supervised Learner for Speech Recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:64f4f97a190cef19f5c0a022e0caf66da636afa6f343c177c4d293c51b07c0c7","observation_id":"0c9bc925-6089-4613-90d9-2ced99f0764e","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representa- tions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:4f1abfb992aa2f79956e70f4be9639e6d1dbbb54ecca207017ba23284757eced","observation_id":"34496957-8b35-4807-9578-d6f79ca9287a","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Hubert: Self-supervised speech rep- resentation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:62676c975c304ff0e92f6c28583e37505a507bfa5ca5ca83f91e1502eb7b3f04","observation_id":"4c637a33-271f-48e6-bfa7-e31bb043c42b","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09296","last_updated":"2021-12-16T18:29:22Z","snapshot_observed_at":"2026-07-06T12:09:37.468149Z","submitted_at":"2021-11-17T18:49:42Z","title":"XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09296","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"XLS-R: Self-supervised cross- lingual speech representation learning at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2111.09296","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:5dff9f9dcf8c492a0ef9d1a02bb3cd8f3164d07534d9b546aab3907fa60bd10a","observation_id":"2d8c6bc4-790e-437b-acb7-3688e45872b3","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"GigaSpeech 2: An evolving, large-scale and multi-domain ASR corpus for low-resource languages with automated crawling, transcription and refinement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:30a3ccf0f4c2a51e1805911d54082864730ce6ad74b4095e12678877d99a3f7f","observation_id":"67efeacc-0be1-4266-8a16-15e6c5f47caa","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"On the Effects of Heterogeneous Data Sources on Speech-to- Text Foundation Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:d136a831e2cbc5262dcc8d2eea5b55d6bba9af05b406f97c3f04318ec7f93d98","observation_id":"c6575b29-54ca-4468-96a9-a882eb09dde0","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"OWSM v4: Improving Open Whisper-Style Speech Models via Data Scaling and Cleaning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:662972846b8866018aab15c670d620e842326be5cc56a555055464c1ae3df283","observation_id":"b09525f2-549f-496e-8752-6c9580852165","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Ro- former: Enhanced transformer with rotary position embedding,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:cd22ea7bacc4af9558585f582ffd1242cd70b4c75983dbca3959a618692d6dc2","observation_id":"bc2daae0-f67f-4eb5-9aed-a9985ca80e7e","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Finding community structure in very large networks,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:fc4d9dc61310e6c86253f82d784a8f151e0a2a390ace9a935ce0742e391621a4","observation_id":"8fa418c3-29f3-4a73-a864-eeccd7af4679","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:c836f360e974ae37f75aef224190ea104a96cdd0506d29961bf5167e807691ec","observation_id":"0e9c1fba-5541-4e89-a9c0-543aff5147e9","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Common voice: A massively-multilingual speech corpus,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:2e3a1abbc1ee78af0ca415a74e8ebb5778e0057bf456ef35ac0a644555f68a19","observation_id":"5641afb8-f818-4fc8-ac56-ea726b3a388f","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Fleurs: Few-shot learning evaluation of universal representations of speech,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:79cb27453e632da8024c33ad96f7dd42fe40601553d3b97489aeafbc30eaf650","observation_id":"d9292ca4-343d-46a7-9d4c-7149002eb500","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Golos: Russian Dataset for Speech Research,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:e055ec7e6dc27195ad05ba87d597c5d46eee705d125f27ef4343482ca14bf83b","observation_id":"e97a3d55-b635-4827-a5ed-7973f10d4e18","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"A toolbox for construction and analysis of speech datasets,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:ed904f19fbbe478bfd34d49cb3549abb2e85d35406896a15a11f0ca2cf40bb78","observation_id":"0dca92fc-fd7f-452a-a148-d9a23c5c3d20","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Europarl-ASR: A large corpus of parliamentary debates for streaming ASR benchmarking and speech data filtering/verbatimization,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:4ec4514483db627d79ab85764c20fcbb1691f7a6f2d60f6363ce059790ddc8dc","observation_id":"7043f081-2cf7-4da0-af61-9cddcb73ed96","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Lib- riSpeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:f55494bd39efa7434be5f8467940bba915fde8adf23fe221a3557164b8cea275","observation_id":"9d7eb27f-23ce-4919-bc23-14c4fda3651b","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"The people’s speech: A large-scale diverse english speech recognition dataset for commercial usage,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:b7fd952b587e7d108dd2a23af40413060e7e1976e53a75568f21e3731409a6bf","observation_id":"f1cd8cd8-6c3f-4a88-85c0-b4ff4b72b921","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"SLURP: A spoken language understanding resource package,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:a73c02195e46ad464ba8906a31a0b6b72019c17f9a3d12445aa30cce4c47d07c","observation_id":"1248d36d-41ff-47a5-baaa-205d264bc859","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"SPGISpeech: 5,000 hours of transcribed fi- nancial audio for fully formatted end-to-end speech recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:93bb383b3db9f8731ab8c16399657d0bc320d6ece6c0bb382f5898ac0c48b08a","observation_id":"285afe87-ccd4-4be5-ba80-e478440347a5","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"TED-LIUM 3: Twice as much data and corpus repar- tition for experiments on speaker adaptation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:d92765a360c234995d788fae30ca59f130bd53ae739c130b28b7719ac7259902","observation_id":"efae1ac8-bfef-487e-9fde-ddb3d536b042","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"CSTR VCTK cor- pus: English multi-speaker corpus for CSTR voice cloning toolkit (version 0.92),","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:af01a7bde74b663fa1cf6456c9ae1df852c2135384d11e7ad21980664128ec82","observation_id":"51135a93-3e68-41a3-ac17-aaaf169f4cc1","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"V oxForge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:944947d5845f204ec99e3dc2d2c593580fad49c5a13d7341456bd67b9fbee1e2","observation_id":"2cb01b85-f87d-4802-99a4-38e8eac8fc49","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Usc: An open-source uzbek speech corpus and initial speech recognition experiments,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:d7a7e0a5dfe14c2d39b0a290e153623b21403a741d37b0a17f7d921cb5172e40","observation_id":"f156286b-746c-4e75-90fc-1772479d654e","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"KSC2: An Industrial-Scale Open-Source Kazakh Speech Corpus,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:2b813ac0285b1bbb5717aac08685725b17f658e942023245619e15885611009e","observation_id":"491029b0-7cac-4011-a1e9-cc64563818fe","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"KazakhTTS: An Open-Source Kazakh Text-to-Speech Synthesis Dataset,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:f69dfbbadf781af8bf713edaa6c32f0a32ac5d1cc4a8a84be9425a478d3fc604","observation_id":"755b17cc-63ed-49dc-b0f4-5dc5bf79a60b","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Yodas: Youtube-oriented dataset for audio and speech,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:307748ebd02b2cdb69008ae2242251b00096bfff2e48838a16148be3ad24b819","observation_id":"1a2010f5-4b60-4382-9b52-31d2a5200cd6","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"A post-processing system to yield reduced word er- ror rates: Recognizer output voting error reduction (rover),","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:b2d30b0722a15474043fbe10e7e62362f3c70b0a3e2ff1c4e04365ba23dd260f","observation_id":"2dc52c86-6be4-44c5-8455-e73ae6d1b752","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"mT5: A massively multilingual pre-trained text-to-text transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:7fb789e72501438d0319afc0e95af4744ef6fd724f1303b6cfbb8cb7e543b6e1","observation_id":"f574848a-27f2-4444-8825-a33e467a0a54","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05187","last_updated":"2023-12-08T17:18:42Z","snapshot_observed_at":"2026-07-06T16:58:55.520897Z","submitted_at":"2023-12-08T17:18:42Z","title":"Seamless: Multilingual Expressive and Streaming Speech Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05187","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Seamless: Multilingual expressive and streaming speech translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2312.05187","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:de7785ce5c5a8e9a35f7bdd34e3ab351ee2e370ac7e4afccfd9faea6c0dd565c","observation_id":"d9c7ef2d-ae9c-4011-a625-d203dc28a578","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-04T03:39:29.749054Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2607.10371."}