{"as_of":"2026-08-16T13:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2d9e77f194cca32aef7a0d90aabc6755d34a1f4cf5c3b5fad79631dd5b4e01a9","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:09:20.903912Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:09:20.730196Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T21:09:21.166119Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"cited_work":{"arxiv_id":"2501.05966","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.05966","snapshot_observed_at":"2026-08-10T21:09:21.166119Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","venue":"cs.SD","work_id":"34ecab43-94dd-4b1d-87f9-6f8d0ecd4691","year":2025},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.730196Z"},"links":{"cited_paper":"/paper/2501.05966","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:6f15904f194233f93762f6d4fb624bb97b76678f2bb28b36b945616992472298","observation_id":"a22d3847-3b3a-4c98-a15d-59994b323445","resolution":{"observed_at":"2026-08-10T21:09:21.172743Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.05966/citation-record","integrity":"/paper/2501.05966/integrity","json":"/paper/2501.05966/citation-record.json","paper":"/paper/2501.05966"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.644493Z","title":null,"venue":null,"work_id":"fc956191-1cf0-4e96-9c3f-49037a25ceb9","year":null},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.723882Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:4c50e1dd3cf4ebbcc224161ad9b49411c49cc1d849ede47e5c74344a3e7929de","observation_id":"32286f49-282d-48e3-a03f-b3810ed3841d","resolution":{"observed_at":"2026-08-10T21:09:21.651865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"cited_work":{"arxiv_id":"2501.05966","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.05966","snapshot_observed_at":"2026-08-10T21:09:21.166119Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","venue":"cs.SD","work_id":"34ecab43-94dd-4b1d-87f9-6f8d0ecd4691","year":2025},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.730196Z"},"links":{"cited_paper":"/paper/2501.05966","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:6f15904f194233f93762f6d4fb624bb97b76678f2bb28b36b945616992472298","observation_id":"a22d3847-3b3a-4c98-a15d-59994b323445","resolution":{"observed_at":"2026-08-10T21:09:21.172743Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.623550Z","title":null,"venue":null,"work_id":"db1ceaa6-26ed-4663-a2e6-f4a71a69a72b","year":null},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.736257Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:c41e4bdc7a957a9a1be814b5bc841828a906ef9094287aff7609319d1841fbdc","observation_id":"db8b6727-8912-4a2d-ba60-c9647c3d8619","resolution":{"observed_at":"2026-08-10T21:09:21.631107Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.600220Z","title":"Then we present results for each task","venue":null,"work_id":"83db87e7-954c-4bff-8865-23e9f77248a5","year":null},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.741418Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:7d2559df9bcf3348e81ed553a8f01fbda14dfeaea4ab85211f0e9ad68fc0c203","observation_id":"4d939346-0b3e-4066-ad00-2735ce5ccbc6","resolution":{"observed_at":"2026-08-10T21:09:21.609069Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.571595Z","title":"To illustrate the potential compute savings, suppose one pre- trains the 30 models from this work to 400k steps","venue":null,"work_id":"534a0814-9689-4ee8-a9b8-0d9573d230aa","year":null},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.746895Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:98aedc389a1480b6bff5b33150126fa4f929bd03d667f78b88a252d4ad55b540","observation_id":"8fc46881-5183-4432-83cb-a857a01425e2","resolution":{"observed_at":"2026-08-10T21:09:21.580035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.551124Z","title":null,"venue":null,"work_id":"5e0d3b2d-345b-4f50-91ed-34314225a290","year":null},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.751536Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:3257b9aac9d7399e3fdfe3ed833ad993f34b9d9ebfbe88c53f4475bc595d73db","observation_id":"a2ff2a40-a06b-4209-a4df-3d5ad3fc21e7","resolution":{"observed_at":"2026-08-10T21:09:21.557600Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.756514Z","title":"Self-supervised speech representation learning: A review,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.756514Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:c530e5239f1173df8b6f2462138788e766ec14670c05a6f8c38cbb588935c363","observation_id":"2c08ea3c-222d-421d-94ef-c31fafdb35b0","resolution":{"observed_at":"2026-08-10T21:09:20.756514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.761781Z","title":"Superb: Speech pro- cessing universal performance benchmark,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.761781Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:5e8a599dddf4b34e0c94b87e69b6538471186319178b6f6595f975ed59713d3e","observation_id":"28ac3184-9ec2-4fff-a480-f654dbee603c","resolution":{"observed_at":"2026-08-10T21:09:20.761781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.511720Z","title":"Reducing barriers to self-supervised learning: Hubert pre- training with academic compute,","venue":null,"work_id":"5fb601b3-d212-4f2e-af1e-9b6d877fabdb","year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.766785Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:aa10389b01673a8a47c98ec4892b8c8652dd91569adec70830cb2571c7b494c4","observation_id":"80298ea6-7411-462e-83b4-37bdb49f3d00","resolution":{"observed_at":"2026-08-10T21:09:21.517900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.771671Z","title":"Xls-r: Self-supervised cross-lingual speech representation learning at scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.771671Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:f0cfbaa2ce328da9346269f53140a84aa823d7da72bf3c775861e8931ec4a218","observation_id":"ca310b70-fed9-4213-a42f-20079f828961","resolution":{"observed_at":"2026-08-10T21:09:20.771671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-13T12:33:46.085209Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-10T21:09:20.777083Z","title":"Google usm: Scaling auto- matic speech recognition beyond 100 languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.777083Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:4b647602b929f2b7f10dea9d07f949e012087701a16eee5a0e6f1bdac2fc49d1","observation_id":"67ad8de9-c5a0-4ce1-bf90-a4e8da9ec1b3","resolution":{"observed_at":"2026-08-10T21:09:20.777083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.478395Z","title":"Efficient self- supervised learning with contextualized target representations for vision, speech and language,","venue":null,"work_id":"4057e1ac-de9a-4e7b-81e2-c4161f8f0af1","year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.783177Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:f29e3445d470b50f4ba94ecb08e2317ffd9bccfef668b63253d797bc2ca6642e","observation_id":"33e6f3e0-c1f4-4548-8922-ac86a2d1bead","resolution":{"observed_at":"2026-08-10T21:09:21.486228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.457043Z","title":"On the (in)efficiency of acoustic feature extrac- tors for self-supervised speech representation learning,","venue":null,"work_id":"7adcd351-b241-427b-9372-99b4769aa4c6","year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.788355Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:f0b8f84997a751efa47bc9600b920f2678653006b1cf7bf6809bdd4b55c96fae","observation_id":"9f51d3de-c7bd-4d43-b1e5-e3872f636eaf","resolution":{"observed_at":"2026-08-10T21:09:21.463361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.440203Z","title":"An analysis of linear complexity attention substitues with best- rq,","venue":null,"work_id":"736f6e35-d148-4fbd-8ea1-4f6f145ec9b2","year":2024},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.793021Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:e6ab45403effeb3e566ba730d90a0e6f951e8d21cc744d1fcb8577a9a3def3a3","observation_id":"3fb41a4a-a8e6-4ea6-9911-810faf2fd781","resolution":{"observed_at":"2026-08-10T21:09:21.445319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.423392Z","title":"Speech self-supervised representation benchmarking: Are we doing it right?","venue":null,"work_id":"a13c20c5-bb2c-4af1-80a3-37a39328af1d","year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.797247Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:f26ed26c6d4ef68ad9ed559d12048060dd22c30c90626c2379aef6eafc242f55","observation_id":"04250c51-1828-4e39-b571-261aca2529df","resolution":{"observed_at":"2026-08-10T21:09:21.428907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.406626Z","title":"RankMe: Assessing the downstream performance of pretrained self-supervised representations by their rank,","venue":null,"work_id":"d8565eed-7718-417f-8b08-821dc3aee5f9","year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.802014Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:e967c52ac8a8d9414dcce5887b0d85fc7f04b34166951aecc9fa9515d1d010b3","observation_id":"b71cdaf1-47dc-486e-8693-6c6505545a14","resolution":{"observed_at":"2026-08-10T21:09:21.412228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.387306Z","title":"The effective rank: A measure of ef- fective dimensionality,","venue":null,"work_id":"e1851791-b943-49ec-a7cf-b96f3e6ed21d","year":2007},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.807732Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:b7dac88577f568275432d3386db5378fb7cbb018fdc01e97beebbf58f2be01b0","observation_id":"a6879337-1188-4bbc-ae60-7f5eeb157563","resolution":{"observed_at":"2026-08-10T21:09:21.393814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10787","last_updated":"2025-01-17T21:34:34Z","snapshot_observed_at":"2026-08-16T13:18:00.125356Z","submitted_at":"2024-09-16T23:49:41Z","title":"Towards Automatic Assessment of Self-Supervised Speech Models using Rank","version":2},"cited_work":{"arxiv_id":"2409.10787","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.10787","snapshot_observed_at":"2026-08-10T21:09:21.121699Z","title":"Towards Automatic Assessment of Self-Supervised Speech Models using Rank","venue":"eess.AS","work_id":"d2ab7fa9-153f-440b-ab64-a1940d0ee8a9","year":2024},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.812965Z"},"links":{"cited_paper":"/paper/2409.10787","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:f7014793ba9bcb193fc716260d902b12c751d0c3a023330802570145ce4b643e","observation_id":"821ee8b3-1945-452c-b7d1-cb3c8f22dbe9","resolution":{"observed_at":"2026-08-10T21:09:21.128818Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.366365Z","title":"Self- supervised learning with random-projection quantizer for speech recognition,","venue":null,"work_id":"f2071128-f98b-4960-a311-57237cf88771","year":2022},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.818025Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:de412b46bf0eeee379d9176beda886829ea429e2b7671efa45cbbcb8d91700f4","observation_id":"344e8bd8-6df3-4293-b53a-66792838a844","resolution":{"observed_at":"2026-08-10T21:09:21.372396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04296","last_updated":"2024-09-04T10:23:04Z","snapshot_observed_at":"2026-08-13T17:22:59.498302Z","submitted_at":"2024-05-07T13:11:37Z","title":"Open Implementation and Study of BEST-RQ for Speech Processing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04296","snapshot_observed_at":"2026-08-10T21:09:20.823632Z","title":"Open implementation and study of best-rq for speech processing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.823632Z"},"links":{"cited_paper":"/paper/2405.04296","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:55fd70b4cf35a2a01711376aacbb43f19dd0070466d1385e5126341aa68d6a6e","observation_id":"0f7a008d-387b-46a6-ad99-53b572ff021c","resolution":{"observed_at":"2026-08-10T21:09:20.823632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04624","last_updated":"2021-06-08T18:22:56Z","snapshot_observed_at":"2026-08-14T05:20:02.331354Z","submitted_at":"2021-06-08T18:22:56Z","title":"SpeechBrain: A General-Purpose Speech Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04624","snapshot_observed_at":"2026-08-10T21:09:20.829529Z","title":"SpeechBrain: A general-purpose speech toolkit,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.829529Z"},"links":{"cited_paper":"/paper/2106.04624","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:6749a34112b967b7348e422582b7ed0e852a781b13542be3ea966add790fdfde","observation_id":"0e9fc001-30f6-40fe-96a2-ffabb2c1099e","resolution":{"observed_at":"2026-08-10T21:09:20.829529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.835077Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.835077Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:53c6e197a0820e08aa9b82fa0d092c443326baa47aeeb6bc076630c4dfbe1053","observation_id":"ad974c70-fd40-4adc-af6c-fa180d2779ac","resolution":{"observed_at":"2026-08-10T21:09:20.835077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.338457Z","title":"Some methods for classification and analysis of multivariate observations,","venue":null,"work_id":"a26cf4ef-73c3-4584-84ec-f53f64d7e81d","year":1967},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.840683Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:954b6b82e9222fd0f4889b55154fd2ce9573873a0d19d86e7d89d2ada5201ace","observation_id":"677c3ae5-9377-4f3d-a3a0-e1055fef8932","resolution":{"observed_at":"2026-08-10T21:09:21.344254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.846033Z","title":"Least squares quantization in pcm,","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.846033Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:d660ac74137ad675d8e59f527d9e45ca753d453a5da5a7dd296ee9b255bbf28c","observation_id":"b93951bf-8e11-4309-918e-506c84e21d6d","resolution":{"observed_at":"2026-08-10T21:09:20.846033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.851998Z","title":"Web-scale k-means clustering,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.851998Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:302ad8861af4580eaf8e5e0972b3a611c5b7737b9ac4b9b5e700caf39fe12c7d","observation_id":"4d53263b-3386-4d14-8a98-639130bab03b","resolution":{"observed_at":"2026-08-10T21:09:20.851998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.857645Z","title":"Scikit-learn: Machine learning in Python,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.857645Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:01c929db2524ff5bb21d98b86b2d1ffd02719ca7ad32c4f96453be21441ec8ce","observation_id":"0d2ac95c-85fa-4420-bf58-5ad1862cc4fa","resolution":{"observed_at":"2026-08-10T21:09:20.857645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.295020Z","title":"k-means++: the advantages of careful seeding,","venue":null,"work_id":"e169f4ab-da0b-4113-a94e-53a085abc45b","year":2007},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.862462Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:a6f3b4625fe2bb89cde2a391512b16945b44bc8f1832ad5a2ddd1be246be2e8a","observation_id":"7ed4d604-4f12-4b0f-8697-8d70416e408f","resolution":{"observed_at":"2026-08-10T21:09:21.301633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.275118Z","title":"A cluster separation measure,","venue":null,"work_id":"92db738d-4652-4757-ae42-751290b18bb6","year":1979},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.866485Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:a69fe5a8ca1a3179c530704588ece7d44c1afb140b963528ff896881de4ebf30","observation_id":"266beb86-e799-468e-a268-1b31ff43e703","resolution":{"observed_at":"2026-08-10T21:09:21.280390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.871079Z","title":"Lib- rispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.871079Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:d0a0930fe79132245d9df9255591b293e98bc63919639708345f2aa294b4c9b6","observation_id":"e850321f-9d73-47b0-a393-3a00109527c6","resolution":{"observed_at":"2026-08-10T21:09:20.871079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.875401Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.875401Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:eba324c82daa345c329e8dee1df66cb439fd6594e3f68c5badc99f238f62defe","observation_id":"d77feaaa-6092-496e-a623-2f9ee6ccd3f1","resolution":{"observed_at":"2026-08-10T21:09:20.875401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.880574Z","title":"Hubert: Self-supervised speech represen- tation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.880574Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:e9df68c1d680746c82efb04d25440fe91a115ee69d74261c85075e603b0a06ef","observation_id":"46ea029b-be06-42bc-820e-2afa5cf92340","resolution":{"observed_at":"2026-08-10T21:09:20.880574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.219836Z","title":"ContextNet: Improving Convolutional Neural Networks for Automatic Speech Recognition with Global Context,","venue":null,"work_id":"e634aa01-d8d2-41c7-8c16-543ad1e11ad5","year":2020},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.886242Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:dde7a09e4b4168c21ae5d8f2699fd7771501e81b6cee6a460ab8bca155c8b111","observation_id":"ecd7c788-93f4-4b3a-bf14-d7a8899c9801","resolution":{"observed_at":"2026-08-10T21:09:21.225818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.892598Z","title":"V oxceleb: A large- scale speaker identification dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.892598Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:ed6f768e1d732b3ddb3cb002de253731accdd72d5598499594d6775bd3e6b325","observation_id":"4d0a56d3-1e37-4a0a-a1e2-1e9ce84d3ea9","resolution":{"observed_at":"2026-08-10T21:09:20.892598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.898139Z","title":"Ecapa-tdnn: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.898139Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:58cdb5459a8565c7dffa9a751803e1b6fda78db434420688d6cb23cdcf3ad27c","observation_id":"774dac3f-dd1e-4e4d-a6f1-93d15a889119","resolution":{"observed_at":"2026-08-10T21:09:20.898139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.903912Z","title":"Layer-wise analysis of a self-supervised speech representation model,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.903912Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:5ddca98fc85f75158744f885c6a9f56850613ef3dd4ac79ea2ffdb1f252d4eea","observation_id":"746c7500-0a02-4cd4-89ce-e63db7ae8908","resolution":{"observed_at":"2026-08-10T21:09:20.903912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-15T18:19:47.752227Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2501.05966."}