{"as_of":"2026-08-08T13:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:41c96a3438131f44500ca1a109bbb5ad7d062110ffdd58f9e51ffcf7057280cd","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:03:33.486691Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.16490/citation-record","integrity":"/paper/2505.16490/integrity","json":"/paper/2505.16490/citation-record.json","paper":"/paper/2505.16490"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1907.10902","last_updated":"2019-07-25T08:55:22Z","snapshot_observed_at":"2026-08-03T10:00:13.416332Z","submitted_at":"2019-07-25T08:55:22Z","title":"Optuna: A Next-generation Hyperparameter Optimization Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10902","snapshot_observed_at":"2026-08-07T15:03:27.263703Z","title":"Optuna: A Next-generation Hyperparameter Optimization Framework, July 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.263703Z"},"links":{"cited_paper":"/paper/1907.10902","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:851ee93e17b63822051b82ff91c4766b2f401a7cd5a43350c8112fa20bb5edbc","observation_id":"ff06e62c-2d41-4854-af30-fdc95e5b0ed0","resolution":{"observed_at":"2026-08-07T15:03:27.263703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.950312Z","title":"Common V oice: A Massively-Multilingual Speech Corpus","venue":null,"work_id":"be501f73-4354-494b-a8b6-1cbd59a24c40","year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.404870Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:b3474bc870c3398a05baa4a6c56e84a2e529d46c4ac12f7e73d1f828cbb30384","observation_id":"e36f2734-ddd6-46dc-aae0-f52c8839671b","resolution":{"observed_at":"2026-08-07T15:03:43.000008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:27.536001Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations.Advances in neural information processing systems, 33:12449–12460, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.536001Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:47977c722e7b4aec73bb3780dfb068e9101b3b1899cddaea7e40e832d0b544e9","observation_id":"eedb6521-c831-40ae-a34c-2d47c736e457","resolution":{"observed_at":"2026-08-07T15:03:27.536001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02522","last_updated":"2024-03-04T22:26:25Z","snapshot_observed_at":"2026-07-06T17:39:32.800594Z","submitted_at":"2024-03-04T22:26:25Z","title":"HeAR -- Health Acoustic Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02522","snapshot_observed_at":"2026-08-07T15:03:27.720392Z","title":"Hear– health acoustic representations.arXiv preprint arXiv:2403.02522, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.720392Z"},"links":{"cited_paper":"/paper/2403.02522","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:daf56e416158d56fa7e92b5298b63ad18847128673e5df0f2bff582e4e7f1c09","observation_id":"cca498df-9210-42f1-98e1-0e094cb27da9","resolution":{"observed_at":"2026-08-07T15:03:27.720392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01255","last_updated":"2019-11-04T14:46:31Z","snapshot_observed_at":"2026-08-08T01:40:47.328408Z","submitted_at":"2019-11-04T14:46:31Z","title":"pyannote.audio: neural building blocks for speaker diarization","version":1},"cited_work":{"arxiv_id":"1911.01255","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.01255","snapshot_observed_at":"2026-08-07T15:03:36.957770Z","title":"pyannote.audio: neural building blocks for speaker diarization","venue":"eess.AS","work_id":"ea2f386e-4c41-4bdb-abb5-c946a63cbd67","year":2019},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.798093Z"},"links":{"cited_paper":"/paper/1911.01255","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:1a61353a904db66098b939f162fab5bab9ad0a11a0b86dc600d03f77f95887ee","observation_id":"acc8e611-e5ec-468f-9b19-9c33159df94c","resolution":{"observed_at":"2026-08-07T15:03:37.077690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:27.899330Z","title":"Iemocap: Interactive emotional dyadic motion capture database.Language resources and evaluation, 42:335–359, 2008","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.899330Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:f5dd42c51612b32d90dbe8735428510d36ffadb99077635b99afa38f4ebbe97a","observation_id":"85cdbb6b-455f-4f87-a3fb-3b7a53b94332","resolution":{"observed_at":"2026-08-07T15:03:27.899330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06909","last_updated":"2021-06-13T04:09:16Z","snapshot_observed_at":"2026-08-07T15:49:16.814852Z","submitted_at":"2021-06-13T04:09:16Z","title":"GigaSpeech: An Evolving, Multi-domain ASR Corpus with 10,000 Hours of Transcribed Audio","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06909","snapshot_observed_at":"2026-08-07T15:03:28.008270Z","title":"Gigaspeech: An evolving, multi-domain asr corpus with 10,000 hours of transcribed audio.arXiv preprint arXiv:2106.06909, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.008270Z"},"links":{"cited_paper":"/paper/2106.06909","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:3629a33c1f794f641ac0b2c4165f27b49f9384ffb25ea27d2ef92ebec885f4d2","observation_id":"ddd816b8-bd3f-4403-b5fd-9e9f06e09840","resolution":{"observed_at":"2026-08-07T15:03:28.008270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:28.125804Z","title":"Wavlm: Large-scale self-supervised pre- training for full stack speech processing.IEEE Journal of Selected Topics in Signal Processing, 16(6):1505–1518, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.125804Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:2931545ffd81504c0e1ab96466afafe08468c6a4839494a9279c01fceb13c3cc","observation_id":"ad7a64fc-7092-4154-a0e8-c795546c04fa","resolution":{"observed_at":"2026-08-07T15:03:28.125804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.645929Z","title":"Unsupervised cross-lingual representation learning for speech recognition.Interspeech 2021, 2021","venue":null,"work_id":"4057671c-bc45-49fb-a88d-7fbb7bc892c3","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.218606Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:61bf3dba8763cc9459a055cc0624bbb90d192ad3edab0fb7eaa42f74f07dfb78","observation_id":"1ad40fbc-0e66-46fb-a4bd-565ae42db68d","resolution":{"observed_at":"2026-08-07T15:03:42.734448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.428364Z","title":null,"venue":null,"work_id":"a0cdcba3-1da6-46e2-9173-2f31833c563f","year":1980},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.327393Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:6a3808ec665379a94a35950488a1a0ab9ed8a35de527585dd802292dae65887f","observation_id":"f6229e4e-8e64-4885-8a3b-dac33023672b","resolution":{"observed_at":"2026-08-07T15:03:42.516575Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.188633Z","title":"Number 2","venue":null,"work_id":"36f145af-8719-4286-81c4-4ce5ef2f3c34","year":1971},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.429204Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:a5e34b44f9ddb860c87f2ef40e1acb05cb43c65ff8183b8824ab7d2a31c5d55f","observation_id":"84cc7782-4f9c-4c5f-aff7-ab59bbf84f85","resolution":{"observed_at":"2026-08-07T15:03:42.311452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17505","last_updated":"2024-08-08T20:22:10Z","snapshot_observed_at":"2026-08-04T14:41:34.733369Z","submitted_at":"2024-07-07T08:09:28Z","title":"Survey on biomarkers in human vocalizations","version":2},"cited_work":{"arxiv_id":"2407.17505","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.17505","snapshot_observed_at":"2026-08-07T15:03:36.666114Z","title":"Survey on biomarkers in human vocalizations","venue":"q-bio.NC","work_id":"3fca4d74-7c49-43c4-b1d3-ca4fdd2f0c31","year":2024},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.506004Z"},"links":{"cited_paper":"/paper/2407.17505","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:bc87987b7928e34431ed9558c5d851d68b46f8cc5a3a28bc338537fc38840a9b","observation_id":"9d928774-7e8d-4760-9eb0-c03751c53f34","resolution":{"observed_at":"2026-08-07T15:03:36.762505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5120/18744-9997","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:34.977813Z","title":"Feature Extraction Techniques in Speech Processing: A Survey.International Journal of Computer Applications, 107(5):1–8, December 2014","venue":null,"work_id":"bd82f5cd-51f7-49c2-aabb-9e721eb3ff3a","year":2014},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.600956Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:c00205d7e392262a6eee5480c185d75966b6784e99950b5923e66b416db736f0","observation_id":"13dc959f-5a94-44da-ac89-625e4f1034e5","resolution":{"observed_at":"2026-08-07T15:03:35.118750Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:28.678612Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units.IEEE/ACM transactions on audio, speech, and language processing, 29:3451–3460, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.678612Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:54bd36105517e0554a8a86a44ff73464c84ce4038d725221ec5dbd0543c3bf55","observation_id":"15122494-ad71-4bc1-9667-d21cd6002174","resolution":{"observed_at":"2026-08-07T15:03:28.678612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.995422Z","title":"Copdvd: Automated classification of chronic obstructive pulmonary disease on a new collected and evaluated voice dataset.Artificial Intelligence in Medicine, 156: 102953, 2024","venue":null,"work_id":"e2cfdc0a-8552-40be-b245-3ee95c87d584","year":2024},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.787258Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:f24f82091b8002137dc793055e9b658091fd13b4d00a05675b40182bce191f42","observation_id":"4aef01c8-e52d-43b8-9180-8ecf34caac6f","resolution":{"observed_at":"2026-08-07T15:03:42.077006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.667908Z","title":"Speaker identification through artificial intelligence techniques: A comprehensive review and research challenges.Expert Systems with Applications, 171:114591, 2021","venue":null,"work_id":"e29ffdf8-ae8b-4a3d-8eb1-be3c957b66ab","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.869172Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:096ae163a52c23d01d1b072c79c816a57f9a9dcbec214b5ed2e3d264ed297d51","observation_id":"4de8adca-81d7-4231-915c-3ef0f30dfb22","resolution":{"observed_at":"2026-08-07T15:03:41.865994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.378576Z","title":"Libri-light: A benchmark for asr with limited or no supervision","venue":null,"work_id":"1b6ff2b3-ee10-468a-8890-5366b823f1cb","year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.966837Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:11d38d5c90b634e69ac835b6a6816141dded7818e99ef724c3065b20c2333e06","observation_id":"d6b65295-2015-4b55-b11a-634f327bea28","resolution":{"observed_at":"2026-08-07T15:03:41.500821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.052480Z","title":"LightGBM: A Highly Efficient Gradient Boosting Deci- sion Tree","venue":null,"work_id":"07379e1f-0fe8-4bed-9ede-8a923733000a","year":2017},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.068136Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:a7210b72450c34288664f32836fea51aadb201f620f1603db30e84e2ea1ca342","observation_id":"bedf83d8-b333-4295-b0d6-958285224776","resolution":{"observed_at":"2026-08-07T15:03:41.214286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:40.680443Z","title":null,"venue":null,"work_id":"2ce4aabb-9990-49a9-bd34-a301a03e9fa1","year":2024},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.137119Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:c11e4dd2148a0d7312aa8774280f54a859fd98fbbd8db15179adfa7e696c39e3","observation_id":"3edac2e6-4bbc-4e26-b268-ee284abea056","resolution":{"observed_at":"2026-08-07T15:03:40.904101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41591-024-03481-x","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:34.753173Z","title":"Phenome-wide associations of sleep characteristics in the Human Phenotype Project.Nature Medicine, 31(3):1026–1037, March 2025","venue":null,"work_id":"7fd5c02c-1dcb-4105-8876-0bcebb95edfd","year":2025},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.230899Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:18d03cebd90a28c82bff5aebaa2a3a1478e22646dc66de2b9554ccd82a7f7738","observation_id":"e2a360df-2512-4ede-994c-69dd37b7ed05","resolution":{"observed_at":"2026-08-07T15:03:34.826996Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/s21144785","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:34.523466Z","title":"Gender and Age Estimation Methods Based on Speech Using Deep Neural Networks.Sensors (Basel, Switzerland), 21(14):4785, July 2021","venue":null,"work_id":"53763e36-5305-4783-99d8-08be682d51c8","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.379756Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:1bba356ca18e8f6d033c03594974c4fce9c50f229e01590eefd0114064d1dcd9","observation_id":"a3350918-3795-4a6f-b938-bc174330829b","resolution":{"observed_at":"2026-08-07T15:03:34.624355Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:29.438754Z","title":"Covid-19 artificial intelligence diagnosis using only cough recordings.IEEE Open Journal of Engineering in Medicine and Biology, 1: 275–281, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.438754Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:266bae02cac1ce1ec2beaea229fb9a68e5cbf196bba851e5a51f37906eff9aab","observation_id":"10b29842-00e5-46b6-a90a-0aef7bbb76c9","resolution":{"observed_at":"2026-08-07T15:03:29.438754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:40.302935Z","title":"Survey of deep representation learning for speech emotion recognition.IEEE Transactions on Affective Computing, 14(2):1634–1654, 2021","venue":null,"work_id":"077014af-8f2b-4459-bd9b-a06398099e62","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.527326Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:95a00d13d54bb122ed6475c39100f7abc64091af434a9e9dd06dbd46ec29fe8a","observation_id":"a2af128e-e813-45b5-a583-1d35bfb1b175","resolution":{"observed_at":"2026-08-07T15:03:40.427037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:29.655615Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.655615Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:6eff676950e3d5cbecbfbd5c7bfb4315ad89844ee6d1287d556bef4490327373","observation_id":"1317ee78-1777-461d-898e-bd2e4c2f5986","resolution":{"observed_at":"2026-08-07T15:03:29.655615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:29.769328Z","title":"Detecting Cognitive Decline Using Speech Only: The ADReSSo Challenge","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.769328Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:d6aecf3d587104e8e83d46964106254eb73f61f3b2360f12e42a3de626bbf26b","observation_id":"6c3abdff-68dd-4480-8f59-8c33bf113fa2","resolution":{"observed_at":"2026-08-07T15:03:29.769328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08720","last_updated":"2023-07-17T04:19:30Z","snapshot_observed_at":"2026-08-07T10:18:11.188867Z","submitted_at":"2023-07-17T04:19:30Z","title":"ivrit.ai: A Comprehensive Dataset of Hebrew Speech for AI Research and Development","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08720","snapshot_observed_at":"2026-08-07T15:03:29.870629Z","title":"ivrit.ai: A Comprehensive Dataset of Hebrew Speech for AI Research and Development, July 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.870629Z"},"links":{"cited_paper":"/paper/2307.08720","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:da49c2d071e1ad7c0e7332da233bfcfed6e855284395ec25afc1e3c7dcca4a96","observation_id":"029fd8f7-27a9-43fd-b5fc-f58c97f9947c","resolution":{"observed_at":"2026-08-07T15:03:29.870629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"records/1500694","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:36.190224Z","title":null,"venue":null,"work_id":"5dab97f4-0408-4e30-8c74-528d62952916","year":2025},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.955537Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:7570b5a6bdc75e99db122c646cefeb60634370df6c980605bad82ae02415f184","observation_id":"b0b36358-20a2-4d38-97f6-51c5d0bb7826","resolution":{"observed_at":"2026-08-07T15:03:36.320031Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.974404Z","title":"Automatic speaker verification systems and spoof detection techniques: review and analysis.International Journal of Speech Technology, 25(1):105–134, 2022","venue":null,"work_id":"e4c91e5b-f0c9-4826-b25e-ccf77d2c9220","year":2022},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.049159Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:a61f4d3c399eef3a9575f8e8aa557c4a6e428bea486abd0cd1e91e4422898fb6","observation_id":"4ca6ad5c-944e-4aee-a7b8-b76b25396db3","resolution":{"observed_at":"2026-08-07T15:03:40.139457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.685264Z","title":"Study of the performance of automatic speech recognition systems in speakers with parkinson’s disease","venue":null,"work_id":"c7c0b23b-0e68-4abc-81ff-90122ca9fc7c","year":2019},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.162076Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:16137fd2a4e4f83a8ad7488206bf1cee3d921c419a684830974a9dad08508b5d","observation_id":"8d725437-679f-4160-8817-7af1d1a51947","resolution":{"observed_at":"2026-08-07T15:03:39.813561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.355343Z","title":null,"venue":null,"work_id":"0a4305b8-3ead-4cc5-8ded-47a2a28bc10c","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.263507Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:b6c4e872b8d39ecfb26c28daea0d8c8b0fb40a38fc049c2e3f1b9e975ccc36df","observation_id":"03cf80d6-b99b-425d-84b0-ead00d5eebcc","resolution":{"observed_at":"2026-08-07T15:03:39.517906Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:30.396776Z","title":"V oxceleb: Large-scale speaker verification in the wild.Computer Speech & Language, 60:101027, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.396776Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:1349e3b70b988e82260d981646512f87f1d72abee49b3af88f16337c1496ad9a","observation_id":"2e3e7bfc-47bd-460b-bf78-de746daf150a","resolution":{"observed_at":"2026-08-07T15:03:30.396776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.980166Z","title":"The coughvid crowdsourcing dataset, a corpus for the study of large-scale cough analysis algorithms.Scientific Data, 8(1):156, 2021","venue":null,"work_id":"400cc809-1589-478e-bbb2-f08cc2571afa","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.465018Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:bbff4c171145bc67b551e63917bf510a01862779c818c327c3a7e83af199f324","observation_id":"c450ccf1-ad85-495f-a9e4-f8e95f5bf4fa","resolution":{"observed_at":"2026-08-07T15:03:39.198345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:30.576014Z","title":"Librispeech: an asr corpus based on public domain audio books","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.576014Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:f1c21d2bbbf129e4b5d712648fd862a06ef4f5e13334da60d5f1b484d6be2be1","observation_id":"70c65c79-405b-4780-a3f8-ae747b68c282","resolution":{"observed_at":"2026-08-07T15:03:30.576014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.726124Z","title":"A german database of patterns of pathological vocal fold vibration.Phonus, 3:143–153, 1997","venue":null,"work_id":"a7561d96-1fac-4256-a267-8b2ebf761f52","year":1997},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.690670Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:643512fadfc64d265c2b6ffd29d9e4c9bda24171aadb29f17c983c7230a76bf0","observation_id":"f328333c-2850-43ba-8a74-83aafec05188","resolution":{"observed_at":"2026-08-07T15:03:38.812874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04624","last_updated":"2021-06-08T18:22:56Z","snapshot_observed_at":"2026-08-04T07:20:14.379561Z","submitted_at":"2021-06-08T18:22:56Z","title":"SpeechBrain: A General-Purpose Speech Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04624","snapshot_observed_at":"2026-08-07T15:03:30.859532Z","title":"SpeechBrain: A General-Purpose Speech Toolkit, June 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.859532Z"},"links":{"cited_paper":"/paper/2106.04624","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:f7bc593854df75ef3ca81f643710b9c4485b2d5671fc19d0f87e9eb9c56f684c","observation_id":"27c91a71-7075-4c38-9c84-3c05a8d17e38","resolution":{"observed_at":"2026-08-07T15:03:30.859532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.01477","last_updated":"2021-04-05T17:23:19Z","snapshot_observed_at":"2026-07-30T11:21:19.100824Z","submitted_at":"2020-12-02T19:33:44Z","title":"The Third DIHARD Diarization Challenge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.01477","snapshot_observed_at":"2026-08-07T15:03:31.066762Z","title":"The Third DIHARD Diarization Challenge, April 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.066762Z"},"links":{"cited_paper":"/paper/2012.01477","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:985392884193fa8981a86470a09478a8bc986017078013240f99f6c93d6ce9fa","observation_id":"857ee834-e217-4ca8-a5f2-bdf163b4d894","resolution":{"observed_at":"2026-08-07T15:03:31.066762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.452158Z","title":"Evaluation of speech and pause alterations in patients with acute and chronic heart failure.Journal of the American Heart Association, 11(21):e027023, 2022","venue":null,"work_id":"0315373a-a38b-4668-8b73-9264e18878b9","year":2022},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.183485Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:41ccffb784113d6d8724a9010ca323647db3aad82e90ff9195bd9534a01fdf10","observation_id":"99d99941-6e59-42b0-a5ff-cd87545fd0b9","resolution":{"observed_at":"2026-08-07T15:03:38.618424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.10548","last_updated":"2020-08-11T06:45:40Z","snapshot_observed_at":"2026-08-06T19:15:27.339369Z","submitted_at":"2020-05-21T10:04:52Z","title":"Coswara -- A Database of Breathing, Cough, and Voice Sounds for COVID-19 Diagnosis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.10548","snapshot_observed_at":"2026-08-07T15:03:31.354500Z","title":"Coswara–a database of breathing, cough, and voice sounds for covid-19 diagnosis.arXiv preprint arXiv:2005.10548, 2020","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.354500Z"},"links":{"cited_paper":"/paper/2005.10548","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:6341b8b65374d182ded0692096d72a732710c1db9b1d2fc4c79c91845be6b86f","observation_id":"91dad948-b8da-48bc-baf6-be3feaa7cbc6","resolution":{"observed_at":"2026-08-07T15:03:31.354500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10654-021-00753-5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:34.127054Z","title":"10 K: a large-scale prospective longitudinal study in Israel.European Journal of Epidemiology, 36(11):1187–1194, November 2021","venue":null,"work_id":"55cb0338-6c00-4691-9977-56287f897fa0","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.521588Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:51bc07cf3bd5e5ab8dda9d05523b78c33e1a2ccd673df93e719bef28aec19f3c","observation_id":"a974cb2f-d8e8-461d-8d9a-ce06875b02fc","resolution":{"observed_at":"2026-08-07T15:03:34.339156Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:31.678096Z","title":"X-Vectors: Robust DNN Embeddings for Speaker Recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.678096Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:4cb354a1fd8eabe9358ad9a238cb972c35b0aa6abe67baf9770951f21b325cf7","observation_id":"e5e4bf8e-0455-4785-8340-2ca860bf1ce4","resolution":{"observed_at":"2026-08-07T15:03:31.678096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.138147Z","title":"Comparison of speech tasks and recording devices for voice based automatic classification of healthy subjects and patients with amyotrophic lateral sclerosis","venue":null,"work_id":"26df8db3-c484-4c21-8d31-4bda98fb1872","year":2019},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.910944Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:6e9347c10a7948edeac266dbe17b8cb3046b1e401d2dd43b13fd1ccdc651a3c5","observation_id":"ef0aee27-88a2-4cae-968f-36fc5e49f657","resolution":{"observed_at":"2026-08-07T15:03:38.278926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:32.068328Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:32.068328Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:6bf613ebf3fcb34be8efe695d4fd567da685b44973d54e0d725fbdaf958f3728","observation_id":"1ad11b27-5004-4f2f-9974-1f63f11f2770","resolution":{"observed_at":"2026-08-07T15:03:32.068328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.11946","last_updated":"2020-09-11T05:08:01Z","snapshot_observed_at":"2026-08-06T22:36:56.473526Z","submitted_at":"2019-05-28T17:05:32Z","title":"EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.11946","snapshot_observed_at":"2026-08-07T15:03:32.217169Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:32.217169Z"},"links":{"cited_paper":"/paper/1905.11946","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:24ac47773f42c5917e2cde74ed18b914a7a7b74b723dc329cf06f5151095b8d7","observation_id":"b4a36263-7da7-4af6-b59b-538369d5a5eb","resolution":{"observed_at":"2026-08-07T15:03:32.217169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.847304Z","title":"Early dementia detection using multiple spontaneous speech prompts: The process challenge","venue":null,"work_id":"dfa17876-9808-4805-9ef9-13939d9ccadc","year":2025},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:32.416589Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:05bf12cdd07fd7b9ceb4d600587ef30c30cca9d5fb7a6f3ba1e31a34c6a6a100","observation_id":"667e7095-a84a-45a1-b203-9a12749bc16f","resolution":{"observed_at":"2026-08-07T15:03:37.955031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-023-49352-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:33.755443Z","title":"Ray Dorsey, and Adam V ogel","venue":null,"work_id":"d7221a05-1178-432b-8e15-9c7ee9322852","year":2023},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:32.619548Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:c608ff925d917c5f733c45a55c42b22d315c5035bdf141d8deec2751c0612aea","observation_id":"5497cff9-ca9c-4d59-be1a-35501d56a60b","resolution":{"observed_at":"2026-08-07T15:03:33.930434Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00390","last_updated":"2021-07-27T04:04:57Z","snapshot_observed_at":"2026-08-05T19:58:56.227907Z","submitted_at":"2021-01-02T07:24:21Z","title":"VoxPopuli: A Large-Scale Multilingual Speech Corpus for Representation Learning, Semi-Supervised Learning and Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00390","snapshot_observed_at":"2026-08-07T15:03:32.780424Z","title":"V oxpopuli: A large-scale multilingual speech corpus for representation learning, semi-supervised learning and interpretation.arXiv preprint arXiv:2101.00390, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:32.780424Z"},"links":{"cited_paper":"/paper/2101.00390","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:efe4c4b32bba1081fca74d16b0fb2059064e8909ab13906b777d5ed3e3990397","observation_id":"3cfacb16-af02-45e6-9163-d43e839a6056","resolution":{"observed_at":"2026-08-07T15:03:32.780424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12991","last_updated":"2023-10-20T11:31:26Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T15:47:36Z","title":"Speech Emotion Diarization: Which Emotion Appears When?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12991","snapshot_observed_at":"2026-08-07T15:03:33.019374Z","title":"Speech Emotion Diarization: Which Emotion Appears When?, October 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:33.019374Z"},"links":{"cited_paper":"/paper/2306.12991","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:5bad0ed5d2e2e52b03f6b0ecc30959140b214b9319f5d41af1f4d96a9e6b48f0","observation_id":"0a14560d-c012-4180-9396-14040a0f2328","resolution":{"observed_at":"2026-08-07T15:03:33.019374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.554332Z","title":"A comprehensive review of speech emotion recognition systems","venue":null,"work_id":"b2852509-3f17-4cda-924d-aa9c4fbe6b62","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:33.162888Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:7b27e1880965f45f29e4f6ca5910b72b0dd8e36f82d6d4d0c5d7b73e9407c9a6","observation_id":"01bd70cb-f87b-4d36-9553-746c99c0a10f","resolution":{"observed_at":"2026-08-07T15:03:37.657161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.276554Z","title":"Quantifying talk: developing reliable measures of verbal productivity.Behavior research methods, 43:168–178, 2011","venue":null,"work_id":"4ab543f6-e997-48c2-99d2-fd5dcf23f91a","year":2011},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:33.250296Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:ba6fa4d4f15ed5b9af69e5dc8ff514af703984bcd1395391ca0c5becd93150dd","observation_id":"26ae48ae-a54d-4374-8d4c-091405627585","resolution":{"observed_at":"2026-08-07T15:03:37.401094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:33.395624Z","title":"Superb: Speech processing universal performance benchmark.Interspeech 2021, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:33.395624Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:e5a7f2d8c53a5046b6e8f2b4f3ae2149aa040edc3e579f25d90a8c75439bd870","observation_id":"398c6fa1-ceae-4ef8-a034-6e8df484fb9a","resolution":{"observed_at":"2026-08-07T15:03:33.395624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09385","last_updated":"2024-05-29T21:24:40Z","snapshot_observed_at":"2026-08-01T22:03:47.928941Z","submitted_at":"2024-04-15T00:03:16Z","title":"A Large-Scale Evaluation of Speech Foundation Models","version":2},"cited_work":{"arxiv_id":"2404.09385","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09385","snapshot_observed_at":"2026-08-07T15:03:35.362005Z","title":"A Large-Scale Evaluation of Speech Foundation Models","venue":"eess.AS","work_id":"6b60ec82-1102-44f4-9da1-c4dd149ea40d","year":2024},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:33.486691Z"},"links":{"cited_paper":"/paper/2404.09385","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:aef090e3181a5fc01279edac1c81b7bafb9d3dab8d34e71ec0c75655739541c1","observation_id":"f346085e-7d80-4562-b430-ce6fb7ade033","resolution":{"observed_at":"2026-08-07T15:03:35.459437Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":9,"verified_fuzzy":17},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2505.16490."}