{"as_of":"2026-08-07T10:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9731950d2c597378b391525a6b9879e372ff7854c91bad1b168da356f56a78bd","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:46:26.554154Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:46:26.469041Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T20:46:26.630275Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"cited_work":{"arxiv_id":"2507.01805","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.01805","snapshot_observed_at":"2026-08-06T20:46:26.630275Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","venue":"cs.SD","work_id":"553b100a-309f-41a2-9091-55c0b8b6b0e1","year":2025},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.469041Z"},"links":{"cited_paper":"/paper/2507.01805","citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:25cfff7bef00f3e87ed8955ff49822f4e361bc9788f6ec8fe6fe47e9bd447eec","observation_id":"55aa937a-afbc-4ae0-a41a-52d39b608187","resolution":{"observed_at":"2026-08-06T20:46:26.632834Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.01805/citation-record","integrity":"/paper/2507.01805/integrity","json":"/paper/2507.01805/citation-record.json","paper":"/paper/2507.01805"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.843504Z","title":"They are widely used in virtual voice assistants such as Siri, Gemini and Alexa, as well as in accessibility applications designed to as- sist visually impaired individuals","venue":null,"work_id":"7cd60c2c-3858-4a1e-bc34-56c65016634d","year":null},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.465650Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:2ccdf570bc2a882553740a5849227fd22632246833e424d37b64505e5e3b2746","observation_id":"eaf3fae0-fd58-4f5e-8672-d0c86c79a543","resolution":{"observed_at":"2026-08-06T20:46:26.846350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"cited_work":{"arxiv_id":"2507.01805","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.01805","snapshot_observed_at":"2026-08-06T20:46:26.630275Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","venue":"cs.SD","work_id":"553b100a-309f-41a2-9091-55c0b8b6b0e1","year":2025},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.469041Z"},"links":{"cited_paper":"/paper/2507.01805","citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:25cfff7bef00f3e87ed8955ff49822f4e361bc9788f6ec8fe6fe47e9bd447eec","observation_id":"55aa937a-afbc-4ae0-a41a-52d39b608187","resolution":{"observed_at":"2026-08-06T20:46:26.632834Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.833700Z","title":"Fine-tuning NISQA Based on the subjective test responses, we fine-tuned NISQA v1.02 for Spanish TTS naturalness assessment","venue":null,"work_id":"638cddd0-2436-45da-ac3d-b62e08da08a4","year":null},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.471982Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:70035425ac5f060ab09dec2bd7ee9604a9c2c531e640f0d7339ac17c26487de1","observation_id":"28554811-a64c-4f42-960d-84fdfc4e394d","resolution":{"observed_at":"2026-08-06T20:46:26.837073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.825138Z","title":"Dataset meta-analysis A total of 4,326 audio samples were rated in the subjective sur- vey, amounting to 226 minutes of speech data","venue":null,"work_id":"f0a22d3c-6cb2-427e-aa18-d286599c2629","year":null},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.474845Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:3b6dcbf066e815a12cd9c4d6db214757339b980a8bcb1c801be4392ea068b4ea","observation_id":"7f8eff99-7720-4abe-b157-fea55e3bbb54","resolution":{"observed_at":"2026-08-06T20:46:26.828194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.816722Z","title":"Gender and voice number are indicated, and VTLP and GL suffixes specify if the samples were generated through data augmentation","venue":null,"work_id":"d1b3c8bd-a6f7-44c8-8d4c-7cb784f7289b","year":null},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.477671Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:363e513e1b30d11b1ebe3ed14fc2f9796e15fb249fbf26d000529b2a92bf8400","observation_id":"9f71f772-c024-4d41-aad0-04e538198d5b","resolution":{"observed_at":"2026-08-06T20:46:26.819700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.809225Z","title":"The collected dataset consists of 4,326 audio samples from 52 different speakers (12 different TTS systems and 6 human voices)","venue":null,"work_id":"3f323d4a-77f4-44af-9d29-cd5111ee4f33","year":null},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.480434Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:23179d0d15b8c5299832655685fc3dc5a81e381de5ff6632e840d079e729dc6a","observation_id":"0980fb11-efa6-4446-a89f-929671763a82","resolution":{"observed_at":"2026-08-06T20:46:26.811885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.801910Z","title":"P.800.1, 2016","venue":null,"work_id":"f5b8c076-1a14-46c0-900c-6f4cfa4dc30f","year":2016},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.483070Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:c8c112c6ccda5cc9817895aeb0904a4a68f9d77d645e001e0481721564532c4b","observation_id":"c8b2ce31-1586-45d9-88d8-8b3354eb7c91","resolution":{"observed_at":"2026-08-06T20:46:26.804436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.795023Z","title":"Analysis of the survey of voice synthesis technology,","venue":null,"work_id":"e60ea69a-8c8b-46e0-ac9a-7354ed675676","year":2023},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.485691Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:95530e3ba8ca47e474f7a52875c7e06b3f05240e056c1e113a0c8e6ae1b4226e","observation_id":"360eb0b3-9876-4ead-bc94-3d019d8250d2","resolution":{"observed_at":"2026-08-06T20:46:26.797272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.788026Z","title":"Perceptual eval- uation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":"f9d87cc0-85b8-49c8-8071-4c158c5abaec","year":2001},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.488093Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:cbf8499e15fe049602b0ed6f7ad7878d86043d821ce627dcb028574eace67495","observation_id":"68034dee-cd5a-495d-8fc8-b4129aca2721","resolution":{"observed_at":"2026-08-06T20:46:26.790569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.778346Z","title":"Perceptual objective listening quality assessment (polqa), the third generation itu-t standard for end-to- end speech quality measurement part i-temporal alignment,","venue":null,"work_id":"7241d1ee-d9e2-403b-8f89-7ac6bdc4a5cd","year":2013},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.491103Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:a0ee4e347017ca4f71463aad68e0f29da51b73d2ac272dddc77cc8417c4b0ca9","observation_id":"6b4ac57a-55d1-4541-a5da-64a697d0859c","resolution":{"observed_at":"2026-08-06T20:46:26.780845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.771572Z","title":"Deep learning based assessment of syn- thetic speech naturalness,","venue":null,"work_id":"15f4710a-937d-45a4-be13-a7d322e36197","year":2020},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.494143Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:ae0cc0f64f73260b4508f23bc83517cf684fe4c4002e8f26404b0ea7e5227688","observation_id":"b77a3865-be6c-4714-aa16-ab894d2205bf","resolution":{"observed_at":"2026-08-06T20:46:26.773897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08125","last_updated":"2021-10-18T17:00:52Z","snapshot_observed_at":"2026-07-06T11:48:27.995805Z","submitted_at":"2021-09-16T17:27:12Z","title":"NORESQA: A Framework for Speech Quality Assessment using Non-Matching References","version":2},"cited_work":{"arxiv_id":"2109.08125","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.08125","snapshot_observed_at":"2026-08-06T20:46:26.618938Z","title":"NORESQA: A Framework for Speech Quality Assessment using Non-Matching References","venue":"eess.AS","work_id":"b27263b5-47f5-474a-9d00-8cc54f4e921a","year":2021},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.497069Z"},"links":{"cited_paper":"/paper/2109.08125","citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:a567b543a98aad785c4027c3b3cb26b9cb6173914210b51813ecc89392299510","observation_id":"7161ff00-3626-4a15-bece-eeac51e5cfcc","resolution":{"observed_at":"2026-08-06T20:46:26.621694Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.764437Z","title":"Amazon Polly – Text to Speech in 47 V oices and 24 Languages,","venue":null,"work_id":"dbae710d-1a5c-4580-bc92-65cbfe3b596e","year":2025},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.500584Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:1d7fd12273b192712f5625d5344216473c3fc9e03f2fc58f98bcf605015bdc77","observation_id":"7ec41ad2-ea8d-48e4-808b-36521ac81324","resolution":{"observed_at":"2026-08-06T20:46:26.767064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.705917Z","title":"Dctts: Discrete diffusion model with contrastive learning for text-to-speech generation,","venue":null,"work_id":"30e7061c-71f4-4494-8a9c-1bb36c5149b8","year":2024},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.521711Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:abfa38ce427db5e7e2be44568f5cf0967be52c298295d5f1c67c56a0a2655a95","observation_id":"c8e9c4f2-68a8-4638-a7d7-6a05054e3c0b","resolution":{"observed_at":"2026-08-06T20:46:26.708384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.750141Z","title":"Microsoft Azure Speech Services,","venue":null,"work_id":"95b539f9-2a90-47da-99a5-fb2110d11c5f","year":2025},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.506618Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:a9e84fffc36c3cddf53a30b2a57e958e41de9b1b3297dc195f32b1c519dd5893","observation_id":"d5f6b3ad-8236-4a1e-9ce8-812fe4865a5b","resolution":{"observed_at":"2026-08-06T20:46:26.752585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.742756Z","title":"[Online]","venue":null,"work_id":"512d744e-24b5-476c-8998-bd34579af088","year":2025},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.509315Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:67308fdf377aa2d7e1165a4de1cc71fc1216e2ced2288c73c7018dc46efd8109","observation_id":"50b5ff0c-c46e-476d-9dbd-06e38fc0bca8","resolution":{"observed_at":"2026-08-06T20:46:26.745168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.757141Z","title":"Available: https://aws.amazon.com/blogs/aws/ polly-text-to-speech-in-47-voices-and-24-languages/","venue":null,"work_id":"75e030f9-a2a2-426a-b306-8b4be3f4ff05","year":null},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.503380Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:156b0c480166e2e0b523f5b3797168bb91cdfebd229d425b183a08608be91a68","observation_id":"970a5756-2a5a-4e7d-8f90-aabf30123a1e","resolution":{"observed_at":"2026-08-06T20:46:26.759535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.735615Z","title":"Servicio de Conversi ´on de Texto a Habla Hispanoamericano,","venue":null,"work_id":"1c91ff26-273c-43a0-bc30-82054884ca89","year":2025},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.512002Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:7326d4e15e1e30e49c33864856c70a275760bf660f8d3b2a64d33da0b5138dcd","observation_id":"3e797dc3-d2dc-4611-92d0-4df22c7c7ee8","resolution":{"observed_at":"2026-08-06T20:46:26.738140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.728072Z","title":"Texto a V oz de Loquendo Online,","venue":null,"work_id":"0c7851fd-43c0-44d8-a437-e5279739a765","year":2025},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.514667Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:653452a7c7a25a21e93b8dad45c604a0eae594dfbf7062770071dce9f0e57b2f","observation_id":"ff92029a-732d-460d-bf2c-e372f5c62d8e","resolution":{"observed_at":"2026-08-06T20:46:26.730513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.720523Z","title":"text-to-speech 1.6.1,","venue":null,"work_id":"f14e24fe-f9b9-4f0f-9fee-4136ba405072","year":2025},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.516947Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:ff5299a0818eb9270da49e954cdfab5043710c685d5dd4288970fe4c237e8cb7","observation_id":"e56075f3-20d6-4292-8a08-0dbfba4ec028","resolution":{"observed_at":"2026-08-06T20:46:26.722987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.713594Z","title":"Fastpitch: Parallel text-to-speech with pitch predic- tion,","venue":null,"work_id":"6e9051ef-55fe-446c-b3af-8eab07acf87e","year":2021},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.519301Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:8c92f017511605242c2efaa19fb2f9649aeec4627289591147b2996d5fe0e0f1","observation_id":"3c271dc5-ad83-459b-a644-90220ba37996","resolution":{"observed_at":"2026-08-06T20:46:26.715935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.698807Z","title":"Speech synthesis method based on tacotron2,","venue":null,"work_id":"79031bf1-4f9f-487f-80f6-b55288de447d","year":2021},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.523956Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:3cd612ddd2fb3e20835db11f9705d3265b7623d92b780c29b64bbb9f7351a320","observation_id":"45224ca0-a6ec-4d6a-9758-d870666a0705","resolution":{"observed_at":"2026-08-06T20:46:26.701161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.691480Z","title":"Crowdsourcing Latin American Spanish for Low-Resource Text- to-Speech,","venue":null,"work_id":"1b5ed420-05d7-447f-81fa-d72199e3b94f","year":2020},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.526187Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:f0de4cc864677201f3ce73975f17493bc4a87a3adb40b3aff29b9c8a860565e2","observation_id":"30c8c589-a65f-473b-801a-316d00bbb9f8","resolution":{"observed_at":"2026-08-06T20:46:26.693844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.683850Z","title":"Single-channel waveforms augmentations for speech recognition models","venue":null,"work_id":"b8f86fc3-08ef-4e15-ac8f-f2825d4dbf4e","year":2025},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.528431Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:f9e1ee1a300aed9de19d1580b1050788c4eae547369f6c3e6d6f96f341e18873","observation_id":"8a83aee2-5329-4f5c-8a08-41074b7b700b","resolution":{"observed_at":"2026-08-06T20:46:26.686644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.676451Z","title":"V ocal tract length perturbation (vtlp) improves speech recognition,","venue":null,"work_id":"6aa7eda6-a015-443a-8b79-6b6d9c593474","year":2013},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.530740Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:f677faaeba8d4db2532521b0cdce352ec224efc41c5b37b6258e40502e965415","observation_id":"8ae56bb5-e8de-4fd0-b216-cffd3025f470","resolution":{"observed_at":"2026-08-06T20:46:26.679076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.668686Z","title":"P.807, 2016","venue":null,"work_id":"efb273f7-cfeb-4517-b970-aba06403582c","year":2016},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.533601Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:245ca9725a2cb07d0589226a7f4df28dd45fef7239b3c911b39d4ea09c10be8b","observation_id":"11d34f26-192d-4110-bce0-a419b404d03a","resolution":{"observed_at":"2026-08-06T20:46:26.671349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.660423Z","title":"Nisqa: A deep cnn-self-attention model for multidimensional speech quality pre- diction with crowdsourced datasets,","venue":null,"work_id":"d118351f-f813-4e5a-ac30-55b633796d14","year":2021},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.536028Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:93619655169ae831ad2a54775f65e6ab079f48b61ace39649e8a1abbb964bcc3","observation_id":"3d2e571a-1258-4127-95b2-ae9d9ced1e38","resolution":{"observed_at":"2026-08-06T20:46:26.663202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.652765Z","title":"Bias-aware loss for training image and speech quality prediction models from multiple datasets,","venue":null,"work_id":"2bfd6955-8ef0-4be0-a6ec-42332ed3fc25","year":2021},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.538523Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:beb57adb063f4a885916d5cbf0551880af8047e0fe6146d14931f16222ac2b3c","observation_id":"330548e2-9a60-4da2-bdc2-6921cbb741e6","resolution":{"observed_at":"2026-08-06T20:46:26.655538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05862","last_updated":"2019-09-11T08:19:49Z","snapshot_observed_at":"2026-08-06T05:33:37.746688Z","submitted_at":"2019-04-11T17:29:30Z","title":"wav2vec: Unsupervised Pre-training for Speech Recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05862","snapshot_observed_at":"2026-08-06T20:46:26.540877Z","title":"wav2vec: Unsupervised pre-training for speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.540877Z"},"links":{"cited_paper":"/paper/1904.05862","citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:9dee49644e01e7f499dc74284cc4c0dbef34808c5344ce4de0dbaa90c0fa4190","observation_id":"0d44c9b3-5ea3-4053-be17-e2763b175e0f","resolution":{"observed_at":"2026-08-06T20:46:26.540877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02735","last_updated":"2022-10-03T20:50:54Z","snapshot_observed_at":"2026-07-06T12:05:22.076764Z","submitted_at":"2021-11-04T10:39:06Z","title":"A Fine-tuned Wav2vec 2.0/HuBERT Benchmark For Speech Emotion Recognition, Speaker Verification and Spoken Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02735","snapshot_observed_at":"2026-08-06T20:46:26.543744Z","title":"A fine-tuned wav2vec 2.0/hubert benchmark for speech emotion recogni- tion, speaker verification and spoken language understanding,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.543744Z"},"links":{"cited_paper":"/paper/2111.02735","citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:158f198ab57014ad812daeacbc9ae25d47d68c2a8c6c6e5da5e5b5d20ea89998","observation_id":"899ee35a-95c7-4794-ad69-431a93b98030","resolution":{"observed_at":"2026-08-06T20:46:26.543744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09212","last_updated":"2020-11-18T11:10:29Z","snapshot_observed_at":"2026-07-06T10:15:40.974466Z","submitted_at":"2020-11-18T11:10:29Z","title":"On the use of Self-supervised Pre-trained Acoustic and Linguistic Features for Continuous Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2011.09212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.09212","snapshot_observed_at":"2026-08-06T20:46:26.592502Z","title":"On the use of Self-supervised Pre-trained Acoustic and Linguistic Features for Continuous Speech Emotion Recognition","venue":"cs.CL","work_id":"0ecc233c-6952-4364-b6bd-c4dcc2ffe830","year":2020},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.546488Z"},"links":{"cited_paper":"/paper/2011.09212","citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:7f9292de51ca8ce5f004cb34a712203f1548f83241bcff6cf8ef038bef485bf2","observation_id":"39fc0a7e-a060-417f-846a-ba618365f2c8","resolution":{"observed_at":"2026-08-06T20:46:26.595360Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.645333Z","title":"Emotion recognition from speech using wav2vec 2.0 embeddings,","venue":null,"work_id":"2217c191-5589-4a0e-a2f5-b3915b1ccb94","year":2021},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.549312Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:7fefe2b81ab241322c254ee603d7e6425aec561c8a87efed2594bc0bfd9d05f7","observation_id":"68b44e2b-21b0-4762-ad0b-00bb23dfe26e","resolution":{"observed_at":"2026-08-06T20:46:26.647912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.05585","last_updated":"2020-11-11T06:18:31Z","snapshot_observed_at":"2026-07-06T10:13:32.281474Z","submitted_at":"2020-11-11T06:18:31Z","title":"Recognizing More Emotions with Less Data Using Self-supervised Transfer Learning","version":1},"cited_work":{"arxiv_id":"2011.05585","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.05585","snapshot_observed_at":"2026-08-06T20:46:26.578960Z","title":"Recognizing More Emotions with Less Data Using Self-supervised Transfer Learning","venue":"cs.LG","work_id":"4506fa3b-4258-437f-9626-f1232c7d3e4c","year":2020},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.551609Z"},"links":{"cited_paper":"/paper/2011.05585","citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:56f6bfd3e3883158b6ca255c034483c35c2a995c1fb5185563be87e92f087072","observation_id":"3952cc81-d884-4fa7-afeb-d972d6667d03","resolution":{"observed_at":"2026-08-06T20:46:26.583707Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:46:26.638047Z","title":"Goodfellow, Y","venue":null,"work_id":"0cd9f9f4-e0ce-4b03-be3f-9c1526a0395b","year":2016},"citing_paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:46:26.554154Z"},"links":{"citing_paper":"/paper/2507.01805"},"observation_digest":"sha256:8704ee7bf94d7804bdfbe65e360835d7ef287000b647fb1886fe366da35b59d6","observation_id":"e64f6a00-4fb2-4c15-bdff-f49e8277a9dc","resolution":{"observed_at":"2026-08-06T20:46:26.640396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.01805","last_updated":"2025-07-02T15:24:47Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T20:40:04.050505Z","submitted_at":"2025-07-02T15:24:47Z","title":"A Dataset for Automatic Assessment of TTS Quality in Spanish"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":3,"verified_fuzzy":28},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2507.01805."}