{"as_of":"2026-08-07T11:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b2fad867e7826de7ff15751905afa669696cb853012618fbcafb2afbf795ad2a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:48:39.174752Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":116,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2401.09512","last_updated":"2026-05-18T13:28:38Z","snapshot_observed_at":"2026-07-06T17:17:03.447619Z","submitted_at":"2024-01-17T15:09:02Z","title":"MLAAD: The Multi-Language Audio Anti-Spoofing Dataset","version":10},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-24T04:34:59.205522Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2401.09512"},"observation_digest":"sha256:90ecfca2e6c0a10854dc220717c2c40f58ee82face80a73409b34cb092a0e531","observation_id":"e3d61ba3-faed-4c9c-a3ef-41e280caaed2","resolution":{"observed_at":"2026-05-24T04:36:00.889425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-06T23:48:39.174752Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15981","last_updated":"2025-06-28T05:47:16Z","snapshot_observed_at":"2026-08-06T23:42:06.328792Z","submitted_at":"2025-06-19T02:56:49Z","title":"Double Entendre: Robust Audio-Based AI-Generated Lyrics Detection via Multi-View Fusion","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:48:39.174752Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2506.15981"},"observation_digest":"sha256:54494524e1bb6e38e867b694e771d261a49f773b904b094272f65d99d9c4a0e6","observation_id":"307f9388-67b8-41fa-9068-7d207fb2a396","resolution":{"observed_at":"2026-08-06T23:48:39.174752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-06T18:14:08.841029Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08768","last_updated":"2025-07-11T17:27:11Z","snapshot_observed_at":"2026-08-06T18:06:58.265245Z","submitted_at":"2025-07-11T17:27:11Z","title":"On Barriers to Archival Audio Processing","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T18:14:08.841029Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2507.08768"},"observation_digest":"sha256:fc0069183ab65f482d21b3666c9bf00a1e8b998ef22f337b53546907eb7c5a54","observation_id":"5fab6ba7-56d8-410e-b917-55ded70f0929","resolution":{"observed_at":"2026-08-06T18:14:08.841029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-06T19:56:20.540912Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08832","last_updated":"2025-07-06T06:18:41Z","snapshot_observed_at":"2026-08-06T19:49:54.521474Z","submitted_at":"2025-07-06T06:18:41Z","title":"A Hybrid Machine Learning Framework for Optimizing Crop Selection via Agronomic and Economic Forecasting","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:56:20.540912Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2507.08832"},"observation_digest":"sha256:0e6d2ca2a8bcacd6ef3d2078c46809b85d27ee0d08272a639a1d81faf9af29b1","observation_id":"ab8d4adc-37bd-45eb-920c-f7370d130374","resolution":{"observed_at":"2026-08-06T19:56:20.540912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2512.20481","last_updated":"2026-04-15T12:23:46Z","snapshot_observed_at":"2026-08-03T04:20:46.583285Z","submitted_at":"2025-12-23T16:16:42Z","title":"Coherence in the brain unfolds across separable temporal regimes","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T20:11:29.476625Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2512.20481"},"observation_digest":"sha256:3b813b4d14965abc59de7ee93ebe7b0bae928cfe4fe34f2838654fb3413ea68d","observation_id":"c7afc37d-fa66-4172-ae08-6e15342c902e","resolution":{"observed_at":"2026-05-16T20:13:22.862525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2604.02374","last_updated":"2026-04-27T15:09:03Z","snapshot_observed_at":"2026-07-06T22:51:44.663367Z","submitted_at":"2026-03-31T20:35:26Z","title":"Evaluating Generalization and Robustness in Russian Anti-Spoofing: The RuASD Initiative","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T02:27:05.776290Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2604.02374"},"observation_digest":"sha256:551831b28894a4760ffe5519ed3076f662d304f78ebb7df5d7efece4307eab44","observation_id":"ddd22543-ba0a-49e6-a203-fe708de2b2d7","resolution":{"observed_at":"2026-05-11T22:46:12.487399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2604.04598","last_updated":"2026-04-06T11:23:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-06T11:23:42Z","title":"Benchmarking Multilingual Speech Models on Pashto: Zero-Shot ASR, Script Failure, and Cross-Domain Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T19:44:30.762851Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2604.04598"},"observation_digest":"sha256:dcd2ef9a1d89d392cc0740c1a441872f95d5a4af3d36fbb82908eb8358d45354","observation_id":"60d89d46-3473-489f-b9c7-f81ed640d2c2","resolution":{"observed_at":"2026-05-10T22:35:48.754248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2604.10123","last_updated":"2026-04-11T09:38:35Z","snapshot_observed_at":"2026-07-06T22:58:47.599383Z","submitted_at":"2026-04-11T09:38:35Z","title":"Training-Free Cross-Lingual Dysarthria Severity Assessment via Phonological Subspace Analysis in Self-Supervised Speech Representations","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:39.890339Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2604.10123"},"observation_digest":"sha256:098b8fdf61cc456100d81bc8f1a4b03fed51ef6eb485f76e66d6444f4f15ddff","observation_id":"5a19eb96-1e3a-4e65-864c-e643fa3a51a4","resolution":{"observed_at":"2026-05-11T09:05:58.892265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2604.10736","last_updated":"2026-04-16T21:22:01Z","snapshot_observed_at":"2026-07-06T22:59:18.756089Z","submitted_at":"2026-04-12T17:17:54Z","title":"BlasBench: An Open Benchmark for Irish Speech Recognition","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-10T15:53:54.092426Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2604.10736"},"observation_digest":"sha256:7670563b518d53d5803150ce6e0103d5e124d8c96e2656b1448166eb243630c3","observation_id":"5e08dc38-63c2-469d-8de7-cc5d58a180b1","resolution":{"observed_at":"2026-05-11T09:41:01.558355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2604.18932","last_updated":"2026-04-21T00:13:30Z","snapshot_observed_at":"2026-07-06T23:05:39.724237Z","submitted_at":"2026-04-21T00:13:30Z","title":"Tadabur: A Large-Scale Quran Audio Dataset","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T02:16:09.216191Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2604.18932"},"observation_digest":"sha256:58f28418d9d4c995e41fdb151d254209b8feef37b55b82f8005147b4b425deef","observation_id":"d41f838d-44b4-43e7-a11a-56f15e06e0f4","resolution":{"observed_at":"2026-05-11T13:11:03.683889Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2605.01381","last_updated":"2026-05-02T11:08:10Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T11:08:10Z","title":"A framework for analyzing concept representations in neural models","version":1},"reference_index":189,"source":"arxiv_source","source_observed_at":"2026-05-09T14:49:22.776209Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2605.01381"},"observation_digest":"sha256:3e42914e0cd6505b648ccd3e344475e8150a81e66c8ac9dae40cf045858288d0","observation_id":"1d0a1619-11f1-432b-8a93-44166d0ee087","resolution":{"observed_at":"2026-05-09T22:18:59.078659Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2606.09317","last_updated":"2026-06-08T10:27:33Z","snapshot_observed_at":"2026-08-02T04:43:02.914931Z","submitted_at":"2026-06-08T10:27:33Z","title":"A Comparative Study of Pre-trained Speech Encoders and Training Objectives for Large-Scale Indic Spoken Language Identification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T15:12:45.261874Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2606.09317"},"observation_digest":"sha256:3ac61653d3103c999534db025274a26eb00a67fa08a3a8a9f37ca5dffabe187d","observation_id":"f7355c90-ca9c-4bb5-971f-fb6fc32b7c38","resolution":{"observed_at":"2026-07-03T03:37:35.361386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2606.11542","last_updated":"2026-06-10T01:07:32Z","snapshot_observed_at":"2026-08-04T09:55:13.088817Z","submitted_at":"2026-06-10T01:07:32Z","title":"Pretrained self-supervised speech models can recognize unseen consonants","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T10:14:47.932613Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2606.11542"},"observation_digest":"sha256:6dc8da9b4b17a0d3f76f7b2b3b2901826d353d77cb320ff3fe4f4176c2aae8aa","observation_id":"41a4aab9-8e7e-4b78-90f1-602b7d0e7f87","resolution":{"observed_at":"2026-07-03T10:07:56.073107Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2606.26618","last_updated":"2026-06-25T05:27:18Z","snapshot_observed_at":"2026-08-06T19:12:00.066557Z","submitted_at":"2026-06-25T05:27:18Z","title":"Closing the Quality Gap in Low-Resource Text-to-Speech: LoRA Fine-Tuning of VoxCPM2 for Khmer and Korean","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T05:24:03.268025Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2606.26618"},"observation_digest":"sha256:58b8b06a33ffa3757e0c97fe84f307b483f1eae2ef6685f339eda1485337f7f0","observation_id":"c7c44471-50e5-4550-bed9-a73c4eed6376","resolution":{"observed_at":"2026-07-04T13:19:50.277522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-07-12T00:48:21.716770Z","title":"Scaling speech tech- nology to 1,000+ languages,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03670","last_updated":"2026-07-04T02:50:05Z","snapshot_observed_at":"2026-08-07T11:27:04.089670Z","submitted_at":"2026-07-04T02:50:05Z","title":"CHILDES-Aligned: A Curated Children's Speech Dataset via Multi-Model Timestamp Ensembling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T00:48:21.716770Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2607.03670"},"observation_digest":"sha256:5c073b99bb5f350cbd496d921154552b80bc68deb68b99560c2e00403b3d036d","observation_id":"10db3fde-f1e0-4ce7-a1ea-aa0756afa508","resolution":{"observed_at":"2026-07-12T00:48:21.716770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-07-11T18:11:36.626189Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04515","last_updated":"2026-07-05T21:37:15Z","snapshot_observed_at":"2026-08-07T10:46:12.581579Z","submitted_at":"2026-07-05T21:37:15Z","title":"Towards Digital Preservation of Efik: TTS for a Low-Resource African Language","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T18:11:36.626189Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2607.04515"},"observation_digest":"sha256:0f788825083c0b3163e63ba21b8914d28562f91906242cc16f5b7f615515163f","observation_id":"ba5de31c-da83-4527-8f35-47a42e0f611b","resolution":{"observed_at":"2026-07-11T18:11:36.626189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-01T07:10:39.841258Z","title":"Pratap, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21540","last_updated":"2026-07-24T18:05:20Z","snapshot_observed_at":"2026-08-07T09:16:01.540251Z","submitted_at":"2026-07-23T17:25:08Z","title":"DONDO: Open w2v-BERT Speech-Recognition Base Models for African Languages","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T07:10:39.841258Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2607.21540"},"observation_digest":"sha256:da7f90ed01aa3be4c6b4e9c5de59b0f35a26bfd337662c90762a404c3d252cf2","observation_id":"69f96c9a-58e0-4b13-9b50-9cae96658e6c","resolution":{"observed_at":"2026-08-01T07:10:39.841258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.13516/citation-record","integrity":"/paper/2305.13516/integrity","json":"/paper/2305.13516/citation-record.json","paper":"/paper/2305.13516"},"outbound":[],"paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2305.13516."}