{"as_of":"2026-07-24T22:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b410b504944f872a9b3e56dcbfb421c1438e5064979a5cb680804f106862b1e8","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T10:17:15.726726Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-24T06:31:00.690269+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T10:17:15.726726Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-16T10:17:43.812845Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"cited_work":{"arxiv_id":"2601.20896","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.20896","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","venue":"cs.SD","work_id":"59a317a3-1d5c-4643-a956-ed287926a5cb","year":2026},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"cited_paper":"/paper/2601.20896","citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:e86ba82d9492513de72a0b6a1c86471e00d09e79aa77eb69d08d54b468e629cb","observation_id":"2ecd42d5-b945-4a81-a1a5-93ed26280da3","resolution":{"observed_at":"2026-05-16T10:17:43.815322Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"cited_work":{"arxiv_id":"2601.20896","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.20896","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","venue":"cs.SD","work_id":"59a317a3-1d5c-4643-a956-ed287926a5cb","year":2026},"citing_paper":{"arxiv_id":"2604.22631","last_updated":"2026-04-24T15:03:39Z","snapshot_observed_at":"2026-07-06T23:09:01.221922Z","submitted_at":"2026-04-24T15:03:39Z","title":"Identifying and typifying demographic unfairness in phoneme-level embeddings of self-supervised speech recognition models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T11:43:47.693392Z"},"links":{"cited_paper":"/paper/2601.20896","citing_paper":"/paper/2604.22631"},"observation_digest":"sha256:5cd707cc7f6ba59e3851cf86d84c44d1c00a484c14fcd5360861e9d17b3223e0","observation_id":"2b7fc040-a4e5-4f6f-b50d-1700828db6d5","resolution":{"observed_at":"2026-05-11T19:31:09.929396Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2601.20896/citation-record","integrity":"/paper/2601.20896/integrity","json":"/paper/2601.20896/citation-record.json","paper":"/paper/2601.20896"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"39b144b9-2525-4e0d-9289-dbef0d648e1c","year":null},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:4f3a00647d620a0814b4f45b370e935c8706ec507f62eaef58cd5affd394d4ef","observation_id":"8dd1f4eb-ff4b-4e8a-9c44-27699075cf2b","resolution":{"observed_at":"2026-05-16T10:17:44.858980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"cited_work":{"arxiv_id":"2601.20896","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.20896","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","venue":"cs.SD","work_id":"59a317a3-1d5c-4643-a956-ed287926a5cb","year":2026},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"cited_paper":"/paper/2601.20896","citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:e86ba82d9492513de72a0b6a1c86471e00d09e79aa77eb69d08d54b468e629cb","observation_id":"2ecd42d5-b945-4a81-a1a5-93ed26280da3","resolution":{"observed_at":"2026-05-16T10:17:43.815322Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b515762f-7913-4d32-91d8-67713e4fc1a2","year":2048},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:05616fcf7c8f4cce60f1440db24fb7328e9234d55e9a30ac36778b673753b882","observation_id":"59b4bed5-22f0-4029-90df-6fdcba6b9643","resolution":{"observed_at":"2026-05-16T10:17:44.851295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Overall, diversity-based sampling methods did not yield significant improvements over the either baseline","venue":null,"work_id":"4eb613f7-4d26-4896-a595-ba9bb3eee33a","year":null},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:4e405abf9a471f1b533e7afe7fad176eb5c2cba66d920dc1912c88dace75588d","observation_id":"7fa37eab-eb8c-4f4c-bd66-2c7e0043fecd","resolution":{"observed_at":"2026-05-16T10:17:44.854081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In contrast, selecting subsets of longer utterances consistently leads to lower WER, despite these subsets being most out-of-distribution relative to the fine-tuning data","venue":null,"work_id":"bdd7d617-1ba7-4037-9a68-5197067a07be","year":null},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:7bf1d108d7f88eef71d1543c732a262a960f59715f85ef76df33d14bb634a563","observation_id":"cb7b2272-0f4a-4878-a417-c1c7bf424a46","resolution":{"observed_at":"2026-05-16T10:17:44.861737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-supervised speech representation learning: A review","venue":null,"work_id":"89ff274c-a40b-4043-913f-7a842f54b05c","year":2022},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:3fe4afbb3c4732b58df0d532999883db9e28c21bba33e4b40073c091d39ece21","observation_id":"6f124903-2124-4815-b654-12dd078e9fa9","resolution":{"observed_at":"2026-05-16T10:17:44.864013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech rep- resentations","venue":null,"work_id":"67a3ad1b-40e9-40c5-81c0-1cca8b02305c","year":2020},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:9fa14cd7c01cc184d2edc2bc90cce8c52f0460dbb5dd73cf79885f612e1a51d6","observation_id":"034ede8d-2b78-41b5-94d1-3dec20fc43eb","resolution":{"observed_at":"2026-05-16T10:17:44.866460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An analysis of linear complexity attention substitutes with best-rq","venue":null,"work_id":"7445a252-4ba2-4ab7-a344-74567adcbef8","year":2024},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:3a160fcc22352907a1c22e1c472a676f41c445c2cbe1caa0878db3c713d5e1b2","observation_id":"1be6b491-bd44-4a34-8ff6-57f0a6be1b88","resolution":{"observed_at":"2026-05-16T10:17:44.839269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient self- supervised learning with contextualized target representations for vision, speech and language","venue":null,"work_id":"7b6123f0-a800-4855-8964-b19861abac04","year":2023},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:c426913c3698d3ec66a2cbaa6a00ddf345a792a74780096910ceb65046f326a7","observation_id":"6a5507cf-2025-455c-a365-538d836cb8bd","resolution":{"observed_at":"2026-05-16T10:17:44.841728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reducing barriers to self-supervised learning: Hubert pre-training with academic compute","venue":null,"work_id":"acfeef7d-bbdd-4ca4-8650-fde39519fee5","year":2023},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:2f5143b5f381fe0e0d7d49fa0e057d74296bbe334b845b7e87612e59fe820763","observation_id":"36728b3d-6414-4758-bbb2-51a71583861c","resolution":{"observed_at":"2026-05-16T10:17:44.844246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self- supervised learning with random-projection quantizer for speech recognition","venue":null,"work_id":"d7c6da3b-8935-4619-971d-b586e522fe3f","year":2022},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:5538091af31359a446faeeba525753c8c478fb2c05e6aa31f8453339db0dc34b","observation_id":"b62627ae-d07a-497b-b75b-73ab810d44e3","resolution":{"observed_at":"2026-05-16T10:17:44.831812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","venue":null,"work_id":"2e062d92-2696-4f72-9706-87bf19ad6c9d","year":2025},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:6d510b605a7a6dc509c01277866b2c68ee3a88be5b57945ded769fbaded646e7","observation_id":"a132405f-3758-4806-ba5f-47ad5002eb97","resolution":{"observed_at":"2026-05-16T10:17:44.826751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-07-06T14:57:43.345085Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":"2303.01037","doi":"10.48550/arxiv.2303.01037","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Haghani, P., Riesa, J., Perng, G., Soltau, H., Strohman, T., Ramabhadran, B., Sainath, T","venue":null,"work_id":"83cf7cd1-c22e-4664-b983-8e943ea096fb","year":2023},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:e1df4580de63eab59ca1600541e928877c3345009dc4ddba5a99d51cb0887b5c","observation_id":"d90a938c-6437-4c1b-a526-e633096ec97a","resolution":{"observed_at":"2026-05-16T10:17:43.819953Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards robust speech representation learning for thousands of languages","venue":null,"work_id":"b4c88d08-6a73-4df2-bc17-54e4bfa2a70a","year":2024},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:c27faf7bac9076e0a0aa07f6a9e263d6ef52d6c4f1047344871ae908b9f8ecd9","observation_id":"30cd90f5-566e-4505-b608-52d7a26cdb5b","resolution":{"observed_at":"2026-05-16T10:17:44.829390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":"69326761-e3be-4899-ab26-138eecf30083","year":2023},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:8239169939f6a680566ea3847f22863d55e57426bc3d0cf7e2d89df1c1c2dc21","observation_id":"bb6a0c6d-dc06-4f59-abbc-30006d3c9a6c","resolution":{"observed_at":"2026-05-16T10:17:44.834276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DiceHuBERT: Distilling HuBERT with a Self-Supervised Learning Objective","venue":null,"work_id":"5dc001ed-ff6f-41d2-8e51-71dc67c8854d","year":2025},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:11ce3c8a88ffab6b61e68b8d7e67c6a45e0f64185ed630682270b9ba7e080e91","observation_id":"7492fb47-cb9f-4e65-8bfc-bf4e3f4dc26f","resolution":{"observed_at":"2026-05-16T10:17:44.836825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards automatic assessment of self- supervised speech models using rank","venue":null,"work_id":"ca683fc6-84fe-4988-931d-ce260a9c5149","year":2025},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:076484e0286b849ca1daf35983f25233f8824c0555bcd2d57a8e3d05663e3831","observation_id":"fdad770d-cf9b-4ac2-bbe2-7fe2a15c9ba7","resolution":{"observed_at":"2026-05-16T10:17:44.846624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Active learning methods for low resource end-to-end speech recognition","venue":null,"work_id":"cc288a3a-bc3a-4128-835c-fc9231ca4de9","year":2019},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:c8c131997ff2f931be25258954ad3fcbb3539dca1a0ed41aa114cb26050afdd3","observation_id":"500e606f-fc2b-4b35-8325-e91136ae9664","resolution":{"observed_at":"2026-05-16T10:17:44.818856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unsupervised Data Selection via Discrete Speech Representation for ASR","venue":null,"work_id":"800c41f0-c9e8-456b-978d-cabe10d5f3a2","year":2022},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:e408c24827a41381253804aeaaf1a8cfe1c92d77cf9e7bba7b87a83d8466b7dd","observation_id":"04b2d758-95b7-45a8-b244-d15d62d81fba","resolution":{"observed_at":"2026-05-16T10:17:44.808787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"More speaking or more speakers?","venue":null,"work_id":"47d99b19-c405-4d58-b172-a4ead72d6931","year":2023},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:55bedaecec5f46d373754f80eb055308dd587aa080fd52d4514d2f14d37b9ffe","observation_id":"4a2ac93c-3555-4897-a6e4-64ce729ceefd","resolution":{"observed_at":"2026-05-16T10:17:44.816238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Loqua- cious Set: 25,000 Hours of Transcribed and Diverse English Speech Recognition Data for Research and Commercial Use","venue":null,"work_id":"b4ac6356-83cd-46f8-902b-20920f03eb12","year":2025},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:7bfa7fec3f28a577c354bd1b1fe8088e8704c2eb4b6dcab7579a1f1268978416","observation_id":"473584dc-71bd-490e-a3f2-1ce318dd311f","resolution":{"observed_at":"2026-05-16T10:17:44.849134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wespeaker: A research and production oriented speaker embedding learning toolkit","venue":null,"work_id":"9c39e89a-cbb4-4fde-863f-9c4e47d84d7d","year":2023},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:b55ac2fa01264e2baeae9aae1d1adae643358074962fd65f1dbc688de9a8f42b","observation_id":"1f5a4e05-1ee3-416b-b6ed-0c375b82a48e","resolution":{"observed_at":"2026-05-16T10:17:44.805834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"pyannote.audio 2.1 speaker diarization pipeline: principle, benchmark, and recipe","venue":null,"work_id":"075c4d1e-dbb3-42ee-9614-f92b5d4c89b2","year":2023},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:2dfb2a22d1ffaed75f797a1ca9713ca0bb29d5c75470cb1de4d2fb3e310e9f4a","observation_id":"95466d8a-6a56-4bc7-958d-a9df6d68f7c2","resolution":{"observed_at":"2026-05-16T10:17:44.821732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sense models: an open source solution for multilingual and multimodal semantic-based tasks","venue":null,"work_id":"e23d0aae-af4a-4a47-bbbc-4fb5de14d474","year":2025},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:c8834953bb61e1c2f05d4591654249c955dbdce38b62c93384a7229870cd3221","observation_id":"0fcea6a5-18d7-4fd9-aabb-eee5abc71e08","resolution":{"observed_at":"2026-05-16T10:17:44.814010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":"68a833ef-d9f6-44df-8107-b6becfc92b4e","year":2024},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:9e735a544c79b4dff072e60fa76ded97c85186ce54b6bf4b616515ad9aec31d9","observation_id":"85bef381-aa8d-44fb-a9ee-29f0b1f343ce","resolution":{"observed_at":"2026-05-16T10:17:44.811451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open implementation and study of best-rq for speech processing","venue":null,"work_id":"9d1f1b64-b3b8-4d32-978f-4f85c3954a51","year":2024},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:186466158c76edfd4e9e831ff85c794e99c688688df00445c63043f9c44413f5","observation_id":"2fbbae7a-86e3-44b0-9df5-a25b23675d03","resolution":{"observed_at":"2026-05-16T10:17:44.824214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04624","last_updated":"2021-06-08T18:22:56Z","snapshot_observed_at":"2026-07-06T11:17:18.147074Z","submitted_at":"2021-06-08T18:22:56Z","title":"SpeechBrain: A General-Purpose Speech Toolkit","version":1},"cited_work":{"arxiv_id":"2106.04624","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.04624","snapshot_observed_at":"2026-07-07T20:34:09.733636Z","title":"SpeechBrain: A general- purpose speech toolkit","venue":"eess.AS","work_id":"21b4460f-26ae-410a-a409-f69a6b2005da","year":2021},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"cited_paper":"/paper/2106.04624","citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:357a106cf174dc3fec069ffc8cdef7edfc4157fc8aff64917db315d0bd60d721","observation_id":"efe285bf-bfab-4787-a307-57fb14c1594f","resolution":{"observed_at":"2026-05-16T10:17:43.810929Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.05481","last_updated":"2021-12-29T10:38:00Z","snapshot_observed_at":"2026-07-06T10:22:25.341862Z","submitted_at":"2020-12-10T06:54:54Z","title":"Unified Streaming and Non-streaming Two-pass End-to-end Model for Speech Recognition","version":2},"cited_work":{"arxiv_id":"2012.05481","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.05481","snapshot_observed_at":"2026-07-05T13:21:06.219289Z","title":"Unified streaming and non-streaming two-pass end-to-end model for speech recognition","venue":"cs.SD","work_id":"b44c0f62-d70b-4a53-a835-ffd9e526c438","year":2020},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"cited_paper":"/paper/2012.05481","citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:60de4ad87817eecfb7b3cc034f0e54a5d173abea7a9c66f7f1521038fa4bce7b","observation_id":"c15b48dd-76b3-4ddd-be3e-19c2916165fc","resolution":{"observed_at":"2026-05-16T10:17:43.805945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamic chunk convolution for unified streaming and non- streaming conformer asr","venue":null,"work_id":"c380120b-e0bd-4ecc-a27d-6b7ceea31fca","year":2023},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:d229c47e671c4c59cab9f57cb3ea91fd97414a050aab10d27becfbfbf490e312","observation_id":"43cae7dc-0ecc-48e5-9261-171322402e78","resolution":{"observed_at":"2026-05-16T10:17:44.803014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In-domain ssl pre-training and streaming asr","venue":null,"work_id":"db2e5017-1ac4-4d74-97d1-4c89b86b4953","year":2025},"citing_paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:15.726726Z"},"links":{"citing_paper":"/paper/2601.20896"},"observation_digest":"sha256:8d01d4a5670cc649f780d29aa50af1639942c9ffe9716fd38a260d2033e8ac98","observation_id":"2e9732f7-7360-4271-89c5-6ccdddab4694","resolution":{"observed_at":"2026-05-16T10:17:44.856493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2601.20896","last_updated":"2026-04-23T07:03:51Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T08:56:11Z","title":"A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":3,"verified_fuzzy":26},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"thesis":"As of 24 July 2026, this Paper Citation Record lists 30 of 30 outbound references and 2 inbound Pith citation observations for arXiv:2601.20896."}