{"as_of":"2026-08-08T09:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0422c59ad64ab390a3f6acb4220db672bd9c31c963b54b59985f4b54fbb702a4","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:03:16.743139Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:03:13.849812Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:03:17.108098Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"cited_work":{"arxiv_id":"2506.00733","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00733","snapshot_observed_at":"2026-08-07T12:03:17.108098Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","venue":"eess.AS","work_id":"2b71e840-8796-4ad4-a75c-61c51c43452a","year":2025},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:13.849812Z"},"links":{"cited_paper":"/paper/2506.00733","citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:0727cf9cd2f4f9392bf0d42be9d158a31f2470a35c4c169fe0a9d9a7b1868a33","observation_id":"d96acdc6-39aa-4d61-832f-0d789259381c","resolution":{"observed_at":"2026-08-07T12:03:17.171722Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00733/citation-record","integrity":"/paper/2506.00733/integrity","json":"/paper/2506.00733/citation-record.json","paper":"/paper/2506.00733"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"cited_work":{"arxiv_id":"2506.00733","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00733","snapshot_observed_at":"2026-08-07T12:03:17.108098Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","venue":"eess.AS","work_id":"2b71e840-8796-4ad4-a75c-61c51c43452a","year":2025},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:13.849812Z"},"links":{"cited_paper":"/paper/2506.00733","citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:0727cf9cd2f4f9392bf0d42be9d158a31f2470a35c4c169fe0a9d9a7b1868a33","observation_id":"d96acdc6-39aa-4d61-832f-0d789259381c","resolution":{"observed_at":"2026-08-07T12:03:17.171722Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:25.037017Z","title":"same speaker","venue":null,"work_id":"2dffd468-8850-4357-913d-755f028dcbaf","year":null},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:13.942841Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:3fb4af895290ca87cfaca2e77b1dfadbf106bea799b43c769da873487995212e","observation_id":"88e51144-4fb0-4c0e-9073-d850caf06769","resolution":{"observed_at":"2026-08-07T12:03:25.188941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:24.676526Z","title":"same speaker","venue":null,"work_id":"da0cc49c-e454-43a0-9775-277f35895f5e","year":null},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.020287Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:98beca1bee183a92ecd29d31ed59cc99ebbe19756fbc1558772bf8dc9919edb6","observation_id":"d168a6de-5857-4991-a782-1a6ad762ca47","resolution":{"observed_at":"2026-08-07T12:03:24.839143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:24.334253Z","title":"To quantify heterogeneity, we used cosine similarity calculated from the ResNet-293 model pre-trained on the mul- tilingual V oxBlink2 dataset (Figure 1)","venue":null,"work_id":"4c4233f2-cf84-438e-bc59-56b767f6f1a3","year":null},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.093492Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:80c7e46d50850310ac0de73e276393e551da9d07905f6f7c09f2e8df47a1fb5f","observation_id":"9eb6b3cd-3499-431c-8141-4568e9cfa764","resolution":{"observed_at":"2026-08-07T12:03:24.500064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:23.900784Z","title":"Our results indicate that a threshold of 0.354 effectively reduces speaker heterogeneity while minimizing data loss","venue":null,"work_id":"00554917-68a4-48b2-8231-12d65951d210","year":null},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.170973Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:e53a09f139201b746c32ee5f0f1dee9c92acb34a00b6198252d0acf37af9b99b","observation_id":"a7c1f109-c137-462a-b0c0-784415aadb78","resolution":{"observed_at":"2026-08-07T12:03:24.098603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:23.616998Z","title":null,"venue":null,"work_id":"89afc1e2-cabe-4c93-806a-e28328a80167","year":null},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.292411Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:4b7a8eb16d0ac516a5713c9889e52beb8eea5ecd5aef061e67ffa5f28f436b11","observation_id":"249fe12f-b596-4e42-b31c-f39df4dcdcb7","resolution":{"observed_at":"2026-08-07T12:03:23.743155Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:23.277104Z","title":"Common V oice: A massively-multilingual speech corpus,","venue":null,"work_id":"a5b9d248-6861-4d3f-ab7d-464b703cdb9b","year":2020},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.356816Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:6183c5d41b1e6069a6f9e5cdb9d1a9719a70fcc55af80f2076ecb4c5b1a34b62","observation_id":"f2a43edd-b01d-4a6f-af0b-f4e4b296fdc7","resolution":{"observed_at":"2026-08-07T12:03:23.388238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:22.951524Z","title":"V oxCommunis: A corpus for cross- linguistic phonetic analysis,","venue":null,"work_id":"4d5727ee-d314-4b32-a0a5-9ea2fafb77a3","year":2022},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.409159Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:50c09156b9a2d0850c1d206d6d8d62bc694874559910a3bf4c3090ad5b9b3294","observation_id":"fe95b7f8-057b-4e78-9d1c-c2739aebc945","resolution":{"observed_at":"2026-08-07T12:03:23.123133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:22.699163Z","title":"MLS: A large-scale multilingual dataset for speech research,","venue":null,"work_id":"0e25cd07-fb8a-495d-85e0-9eb364421dae","year":2020},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.512668Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:dbf4fb2ad9e293552ef57fd3089c0f823d1d46ab035883afb01857bc7e7aa398","observation_id":"ed7a0175-e266-4315-acdb-8d08d609ec53","resolution":{"observed_at":"2026-08-07T12:03:22.799493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:22.413393Z","title":"VoxPopuli: A large- scale multilingual speech corpus for representation learning, semi-supervised learning and interpretation,","venue":null,"work_id":"9307727f-cad2-44c9-9387-d5246dcf4eb0","year":2021},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.607194Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:05fadccafaa7beba8f848c23784885762b47f5701be722951afbd7db57f44fc2","observation_id":"102b38ad-1ab7-4752-8997-fce9acee58ca","resolution":{"observed_at":"2026-08-07T12:03:22.551343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:22.000657Z","title":"V oxlingua107: A dataset for spoken lan- guage recognition,","venue":null,"work_id":"84620cff-577f-49f4-aba4-fbf3fbfe296c","year":2021},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.688626Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:477f6dd21ffb54df03ff47aeab2cfff44434101bee569ad007be498a6a2a40ee","observation_id":"e6874e70-7c12-48f1-9f9a-287cea45f02d","resolution":{"observed_at":"2026-08-07T12:03:22.231543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:14.777755Z","title":"Yodas: Youtube-oriented dataset for audio and speech,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.777755Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:b797232432095735a906e407af083add25aa39ce83f6e996769e510e376e75a5","observation_id":"2fbae231-8043-48bb-aece-c23e78456f02","resolution":{"observed_at":"2026-08-07T12:03:14.777755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:21.568617Z","title":"The UCLA phonetics lab archive,","venue":null,"work_id":"cf8549a8-1095-441a-a532-5a270fc2ad34","year":null},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.866866Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:2e49b9697316feb25df9a856ba4bcd8a419677359b29841bdd0432e0a4fdb13e","observation_id":"e6db15fa-b26a-448a-a2fd-57b46cde6d6b","resolution":{"observed_at":"2026-08-07T12:03:21.800591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:19.434378Z","title":"Becoming a high-resource language in speech: The Catalan case in the Com- mon V oice corpus,","venue":null,"work_id":"e3c21bd1-4fbd-492b-9cef-7d90c4d44904","year":2024},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:15.569415Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:df33b345d90786646308fcaffcdc6d4b0d1cc420c81d57943bcf9758d4359493","observation_id":"1ebf7fee-13bd-45a1-aa40-8fc34a24e0bb","resolution":{"observed_at":"2026-08-07T12:03:19.529655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:21.060884Z","title":"CMU Wilderness Multilingual Speech Dataset,","venue":null,"work_id":"895002a3-fa6b-4720-8aab-d38188c6196b","year":2019},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:15.077740Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:955e3e19a013a5f47f72a175a9baa2f16296cea70ae7542e35144e11f2dfedc4","observation_id":"eeca1e6e-d08a-4447-a22e-155d447c0ef7","resolution":{"observed_at":"2026-08-07T12:03:21.164828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:20.861372Z","title":"FLEURS: Few-shot learning evaluation of universal representations of speech,","venue":null,"work_id":"23a91238-6408-406c-957e-88690b854f3e","year":2022},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:15.158152Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:9f4e484a01233075e5fe54b14d2ec8ab325783c27ea29ac2248b9ed287a0e17a","observation_id":"f49a5d82-ec07-4df2-b9fb-752b80c71f9c","resolution":{"observed_at":"2026-08-07T12:03:20.934095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:20.384214Z","title":"Phonetic segmentation of the UCLA Phonetics Lab Archive,","venue":null,"work_id":"f3fddfc8-b988-42d0-a786-6a53cae4ac72","year":2024},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:15.238787Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:dc80e4b48f7ac044068642e88c053c1754a0fb2c3c15a7787c571b0e3bc9058f","observation_id":"b401fcc7-3c21-432a-b358-1284b5e456f1","resolution":{"observed_at":"2026-08-07T12:03:20.624907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:20.022583Z","title":"CommonBench: A larger scale speaker verification benchmark,","venue":null,"work_id":"c7ef5f8a-e271-474e-82b9-2c44541c6fe6","year":2024},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:15.263026Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:3b2fa55a94e26959a89b9c0a311d9706b00ef9b89d22db73977d64469ea28e34","observation_id":"80a623aa-a479-41c0-80d9-4c59760313cc","resolution":{"observed_at":"2026-08-07T12:03:20.180756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.14053","last_updated":"2022-06-29T15:34:23Z","snapshot_observed_at":"2026-07-06T13:25:31.486715Z","submitted_at":"2022-06-28T14:52:08Z","title":"Bengali Common Voice Speech Dataset for Automatic Speech Recognition","version":2},"cited_work":{"arxiv_id":"2206.14053","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.14053","snapshot_observed_at":"2026-08-07T12:03:16.939204Z","title":"Bengali Common Voice Speech Dataset for Automatic Speech Recognition","venue":"cs.CL","work_id":"ff4753c5-a679-4f0c-892e-1ec828887c3b","year":2022},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:15.337898Z"},"links":{"cited_paper":"/paper/2206.14053","citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:9f6402dfc46b8d60055a4e21c2ccd7138f5b9b78b1a25dfc6594f2b8dd4414d0","observation_id":"8d55fed3-a0ef-4679-a7b5-7ef050536533","resolution":{"observed_at":"2026-08-07T12:03:17.017065Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:19.696281Z","title":"Findings of the VarDial Evaluation Campaign 2022,","venue":null,"work_id":"fa07b944-c765-448d-946b-4f3f255fcfc2","year":2022},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:15.451853Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:1c0141e4f50c05a57ce1b363fd2c1d403fe2df4dc77dce3a726b6ec22f1b799b","observation_id":"8a9d9600-34a8-41bb-a8f3-9aa61540439a","resolution":{"observed_at":"2026-08-07T12:03:19.865493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:18.127675Z","title":"PyThaiNLP: Thai natural language processing in Python,","venue":null,"work_id":"dc0e3da8-0c87-418d-8efc-a28a62d1997b","year":2024},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:16.418277Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:0114d276107c2209a9f9f2e9e16d658d230b36e4f4631ad315550632301cd3ea","observation_id":"3b4fc2ce-fc2e-4a7d-a135-876c0d638b37","resolution":{"observed_at":"2026-08-07T12:03:18.227097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:19.190101Z","title":"V oxblink2: A 100k+ speaker recognition corpus and the open- set speaker-identification benchmark,","venue":null,"work_id":"d29bdd11-923e-46a0-8efe-a49ee77b0950","year":2024},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:15.738987Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:8aba1d8589935e3928bed591d14e635cdf82aedf9cbd657b5fdb7178539a14b3","observation_id":"c942c4cf-38e7-4310-9020-41b7bae2575c","resolution":{"observed_at":"2026-08-07T12:03:19.271316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:18.955642Z","title":"Zhang, E","venue":null,"work_id":"e946abf9-140c-4d5f-8a16-431f0f86bf5b","year":null},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:15.910901Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:d9b5ef4c21fcf6cee3cc48ddd09858cb0c0fb0ad3bf62e543d95a5168270c5b9","observation_id":"762b399a-a522-4b7e-8ef1-2197aee16d04","resolution":{"observed_at":"2026-08-07T12:03:19.021830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:16.060161Z","title":"V oxceleb: Large-scale speaker verification in the wild,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:16.060161Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:8c333f1216368811469657cb256b09e3cf2d69e4fa5627df482cb4eb4c33c061","observation_id":"75f99662-09d0-4afd-bb1b-c856110979dc","resolution":{"observed_at":"2026-08-07T12:03:16.060161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:18.643798Z","title":"Analysis of deep generative model impact on feature extraction and dimension reduction for short ut- terance text-independent speaker verification,","venue":null,"work_id":"40e79d05-577a-4073-9960-682a7d381121","year":2024},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:16.134761Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:4d9f3ad533fb9e89fad2c7b76d5559362b83b816f902bd7247cbbe80b1a6a1d6","observation_id":"fe3f1b48-4711-4de3-99e8-24d913cbb77f","resolution":{"observed_at":"2026-08-07T12:03:18.776073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:18.336186Z","title":"PyCantonese: Cantonese linguistics and NLP in python,","venue":null,"work_id":"e4f397d1-c948-4dbc-af97-7b6098fcc61c","year":2022},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:16.270798Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:698cc2d108e4c341aa3c6e12f1731cff2e30b663c5707f6bc36ed2fd30cc01ea","observation_id":"29d78567-08d4-4b55-a016-3cfcad5f4077","resolution":{"observed_at":"2026-08-07T12:03:18.466187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.11455","last_updated":"2022-05-28T06:55:14Z","snapshot_observed_at":"2026-07-06T08:03:11.300895Z","submitted_at":"2019-06-27T06:40:42Z","title":"PKUSEG: A Toolkit for Multi-Domain Chinese Word Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.11455","snapshot_observed_at":"2026-08-07T12:03:16.349538Z","title":"Pkuseg: A toolkit for multi-domain chinese word segmentation","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:16.349538Z"},"links":{"cited_paper":"/paper/1906.11455","citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:3f3f2e41076aa9ea4920cc5c6f530101730533bbabefe3eb5f9a660f57a241d1","observation_id":"b0e846a2-d3f3-40b3-aaba-1a0788db143d","resolution":{"observed_at":"2026-08-07T12:03:16.349538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:17.767939Z","title":"fugashi, a tool for tokenizing Japanese in python,","venue":null,"work_id":"718d138b-356e-4665-af8d-7d00eb0adcac","year":2020},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:16.484713Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:7b807373c0e81dd17f0d0892027786390bfc301bf1a4b2a00578d63547a66825","observation_id":"4232a897-3443-458c-8de2-b1313d62753f","resolution":{"observed_at":"2026-08-07T12:03:18.049459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:17.627384Z","title":"Introducing mul- tilingual phonetic information to speaker embedding for speaker verification,","venue":null,"work_id":"19df2155-938e-4e8a-819c-c0c9a378f204","year":2024},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:16.568408Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:37eabe1617a1cd51656949856cb9b64db2bb376503192f6b639bfcc2cf44e56c","observation_id":"ccbe578b-3176-4489-890d-4289ddd99046","resolution":{"observed_at":"2026-08-07T12:03:17.673593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:17.505711Z","title":"Speak- erStew: Scaling to many languages with a triaged multilingual text-dependent and text-independent speaker verification system,","venue":null,"work_id":"e366e1bc-dc1d-442a-b9b2-ee1ebb596b43","year":2021},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:16.635224Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:d80688b61204e3399b26f0ef0912f64fbeefedfd3ce2dd1f5ece2e6e889b1beb","observation_id":"f516ec25-f3c9-4ed9-9c61-25e1f2b2bcbe","resolution":{"observed_at":"2026-08-07T12:03:17.555359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:17.376889Z","title":"Language dependence in multi- lingual speaker verification,","venue":null,"work_id":"4e08a482-2b23-445b-979f-668f4ab9c235","year":2005},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:16.693941Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:ddb06679f0fc0ec1f5f82864ad4ae7109669833b02db9d6ca95e6cbc370c31be","observation_id":"fb9cef74-ec07-4ccb-b67c-ca4c077fd75d","resolution":{"observed_at":"2026-08-07T12:03:17.424535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:17.250603Z","title":"Speaker recognition across languages,","venue":null,"work_id":"f6c637c3-ad14-4911-a8f6-ed87d93e3d6d","year":2017},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:16.743139Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:d9f68371f9f10ea58ad6920f677ca6a1ac51aa563250304499855df5d6651209","observation_id":"65def1ed-1a2c-4e3a-9310-09253aaaffff","resolution":{"observed_at":"2026-08-07T12:03:17.299718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:03:21.298760Z","title":"Available: http://archive.phonetics.ucla.edu","venue":null,"work_id":"b98f7806-442e-452b-b2cc-a1752adec507","year":null},"citing_paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-07T12:03:14.982576Z"},"links":{"citing_paper":"/paper/2506.00733"},"observation_digest":"sha256:2b7a73c069019e85fdf9fcfd645e1ec5b02ecd52433f33a0e03b70537e5be84a","observation_id":"88dcfac0-5229-41dc-a96c-fb5efc3f1eda","resolution":{"observed_at":"2026-08-07T12:03:21.415776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00733","last_updated":"2025-05-31T22:39:48Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T11:56:53.099037Z","submitted_at":"2025-05-31T22:39:48Z","title":"Quantifying and Reducing Speaker Heterogeneity within the Common Voice Corpus for Phonetic Analysis"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":2,"verified_fuzzy":27},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2506.00733."}