{"as_of":"2026-08-08T12:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:71e269752be108ce0d352902967247156214239ea1bd8b19509808b7a162c541","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:00:28.634322Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:00:25.595644Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T14:00:28.778797Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"cited_work":{"arxiv_id":"2505.20506","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20506","snapshot_observed_at":"2026-08-07T14:00:28.778797Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","venue":"cs.CL","work_id":"c987edc2-f9b6-440a-b974-2d0799dd9ba1","year":2025},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.595644Z"},"links":{"cited_paper":"/paper/2505.20506","citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:8ffce67785dcbcb2d50d857eab5ff35a50b957e35788ce5d85961efc20a5ef59","observation_id":"b3b01c96-e5a6-431e-a440-48ac43f529a0","resolution":{"observed_at":"2026-08-07T14:00:28.939908Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20506/citation-record","integrity":"/paper/2505.20506/integrity","json":"/paper/2505.20506/citation-record.json","paper":"/paper/2505.20506"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:33.179880Z","title":null,"venue":null,"work_id":"c27327ee-3c46-4fd4-8f67-a02b5b9a59b5","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.491796Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:d540d2df4a6046b593c70139404c55fe13b8fbe2490643771fe3373b1c095d61","observation_id":"d9f8115b-88fa-4f4b-9ba0-7b5d2b52230e","resolution":{"observed_at":"2026-08-07T14:00:33.316583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"cited_work":{"arxiv_id":"2505.20506","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20506","snapshot_observed_at":"2026-08-07T14:00:28.778797Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","venue":"cs.CL","work_id":"c987edc2-f9b6-440a-b974-2d0799dd9ba1","year":2025},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.595644Z"},"links":{"cited_paper":"/paper/2505.20506","citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:8ffce67785dcbcb2d50d857eab5ff35a50b957e35788ce5d85961efc20a5ef59","observation_id":"b3b01c96-e5a6-431e-a440-48ac43f529a0","resolution":{"observed_at":"2026-08-07T14:00:28.939908Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.947204Z","title":"In this section, we describe each part of ArV oice and provide justifica- tion for design decisions where applicable","venue":null,"work_id":"d719299c-b67f-4fe6-8a38-b6d25fb4b090","year":2020},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.719894Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:d9b1d06d3dabc1e97ea679296e892dee6ad4d64a57bd29cffc151980eb2187ab","observation_id":"dfb1b0c9-46c1-48b4-8a93-5b50995bb039","resolution":{"observed_at":"2026-08-07T14:00:33.048002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.762382Z","title":null,"venue":null,"work_id":"14fb0bf8-2e78-452a-83d8-0439a222ef52","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.864240Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:298f71cb6fe88e3ac8ff4a23d9d19c2bfd279b38e55349d115813c673138a094","observation_id":"53e56dec-cefd-45d0-a40e-a8f05d00d8b3","resolution":{"observed_at":"2026-08-07T14:00:32.857585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.471533Z","title":"The dataset consists of 11 voices in total, 7 of which are human voices, and 4 are syn- thetic with parallel text","venue":null,"work_id":"2b23670a-dd2a-417d-b68b-c95dc62911d8","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.057794Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:dc3f805fd70452bc6a5658828994f6a2d0b7b27ae8acfb79c0dc9aa42a73544c","observation_id":"504024d5-b896-4714-bf34-0f8b1f7a0a16","resolution":{"observed_at":"2026-08-07T14:00:32.522013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.248128Z","title":"This work was partially funded by a Google research award (11/2023)","venue":null,"work_id":"1375d9bc-e4e9-4b5d-bd47-c08afe288a59","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.148273Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:730378933d9b6f3c60198493eb652f9afbf154277aeb5e5cf47bd04bb427b09f","observation_id":"027b4f30-a22f-4281-9271-061b715c7bcc","resolution":{"observed_at":"2026-08-07T14:00:32.321259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.327269Z","title":"Cmu wilderness multilingual speech dataset,","venue":null,"work_id":"e41b9e64-cabc-485f-aa2d-2a8531140964","year":2019},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.742493Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:691b756553249d730a55f7606b688984db40e5933ec9b836b050a9d4a99020e8","observation_id":"ab7b15dd-9064-48a4-b593-a83a87fad8c9","resolution":{"observed_at":"2026-08-07T14:00:31.404796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:26.224154Z","title":"Speech recognition challenge in the wild: Arabic mgb-3,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.224154Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:640d95327579f8e02eb344b78b158523577d4715ba64a559757d3406a30982a7","observation_id":"86a121d7-422a-40da-86a4-9c12d8eed7b6","resolution":{"observed_at":"2026-08-07T14:00:26.224154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.042798Z","title":"QASR: QCRI aljazeera speech resource a large scale annotated Arabic speech corpus,","venue":null,"work_id":"278d3cfd-8b2c-49ad-b90d-c5c4d9cb5e61","year":2021},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.295851Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:0cb9e5280d4b2fa3a653e8d35903f103195a82044c330524dfa4535ebd94e2ff","observation_id":"5ee82de3-d52f-495f-a59d-c9f82452c7e5","resolution":{"observed_at":"2026-08-07T14:00:32.148453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.837795Z","title":"Masc: Massive arabic speech corpus,","venue":null,"work_id":"b7bb273c-0bfb-4929-ad58-0f4832d6b0ab","year":2022},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.415432Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:f92f9d89a075dfe1ad0a3f8ee80a6fc6f858b08cb12615af15ddbc80ab4b6f89","observation_id":"e69c566f-2255-4adc-82e5-6b2a1379ae4b","resolution":{"observed_at":"2026-08-07T14:00:31.972932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.657701Z","title":"Diacritic recognition perfor- mance in arabic asr,","venue":null,"work_id":"e2881ad1-8f30-46b8-956b-cb3047b955bf","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.475402Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:232ced07ac81af5a567c90aa5bec01515f8972b9968a89cff736545208719af1","observation_id":"053ef7d6-8f61-4a79-bc8f-df7c3f39f83b","resolution":{"observed_at":"2026-08-07T14:00:31.748774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.499388Z","title":"Automatic restora- tion of diacritics for speech data sets,","venue":null,"work_id":"cb6da5da-ab4e-4e62-93f3-c9e86d46d480","year":2024},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.595759Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:47a9fffb45d7316c116e2050322776274b0caac7e4ad5dc48047e96cb9ee01d2","observation_id":"9112c2e5-c618-47fe-ad9a-eb3823aa28cf","resolution":{"observed_at":"2026-08-07T14:00:31.573106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.488896Z","title":"Clartts: An open-source classical arabic text-to-speech corpus,","venue":null,"work_id":"9edb43c4-f465-486c-91b5-3a95aa95bedd","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.674924Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:a9bdfa783f5247fe4914351432e10f83bf211b197913cf00c5f27c0ad9a9b6a3","observation_id":"dd85b093-b194-469c-afc5-51f7b77b07cf","resolution":{"observed_at":"2026-08-07T14:00:31.492215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:29.917331Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":"a44baa13-4e17-4695-a4b7-2ecab4c6d39d","year":2022},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.682750Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:8f8299cdb41b0b3e51a5ead40b761fece45da6bab5f4ca6f07de860f315e5787","observation_id":"53a911d2-71d0-4978-a8aa-4c5e4be5be7b","resolution":{"observed_at":"2026-08-07T14:00:30.089431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.172852Z","title":"ArzEn: A speech corpus for code-switched Egyptian Arabic-English,","venue":null,"work_id":"6085e779-4248-4c6e-b712-3ec4855c1355","year":2020},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.831943Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:a3b47d6a048e68d0d47202ee32b124f7e5a2c12238fbbbb488dfa792c482d4ef","observation_id":"9ef20df5-6677-456b-8174-27a1f6c87197","resolution":{"observed_at":"2026-08-07T14:00:31.239238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.983875Z","title":"V oxblink: A large scale speaker verification dataset on camera,","venue":null,"work_id":"12217cb8-2646-44d7-bef5-2140d4c7b2ab","year":2024},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.916277Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:03277ae53afe1460e2ed170ac3cddb03213f3721d66ca39da5cd4be7e35c04dd","observation_id":"1e8c6ac5-a457-4e26-8358-c331085d93d5","resolution":{"observed_at":"2026-08-07T14:00:31.089268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.848552Z","title":"Modern standard arabic phonetics for speech synthesis,","venue":null,"work_id":"04a7d3c7-24e6-4a69-980d-de2c8e9d70fb","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.019303Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:6c21bece5f8b5f7fbe6f70157109718df34e65274f9e8bfb532f018e15a79d85","observation_id":"65af7c26-2278-48fa-9ce9-047a8ad23143","resolution":{"observed_at":"2026-08-07T14:00:30.900960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01156","last_updated":"2024-11-09T05:58:10Z","snapshot_observed_at":"2026-07-06T19:43:59.326124Z","submitted_at":"2024-11-02T07:04:02Z","title":"Fish-Speech: Leveraging Large Language Models for Advanced Multilingual Text-to-Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01156","snapshot_observed_at":"2026-08-07T14:00:28.199944Z","title":"Fish-Speech: Leveraging large language models for advanced multilingual Text-to-Speech synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:28.199944Z"},"links":{"cited_paper":"/paper/2411.01156","citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:ee1f7ebcc74e9fdd8ec6b9cd369db4cd3b27c632e7660ac4034d6b59cf0c7705","observation_id":"f620d47a-d187-42f4-93e0-6e13081bcf3c","resolution":{"observed_at":"2026-08-07T14:00:28.199944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.529621Z","title":"Tashkeela: Novel corpus of arabic vo- calized texts, data for auto-diacritization systems,","venue":null,"work_id":"a2dbc3a3-c0b9-454d-ae8b-607e5558fcbc","year":2017},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.241330Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:f38731382e66ba48a8e1544cfff648c972912d2bb2da4ac3ba1e25f4ceb272f4","observation_id":"ffc5d9f1-5ed1-4090-880c-fae2b0018c2f","resolution":{"observed_at":"2026-08-07T14:00:30.602628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.614084Z","title":"We also fine-tuned KNN-VC [21], a non-parallel VC model that converts source into target speech by replacing each frame (a) VITS (w","venue":null,"work_id":"0c19a383-5a17-44cb-8a2a-268ad66dcb4d","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.989216Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:19f122280f3e5722f78b49ad2c112e638dcc9461dd0cc6bd1a174cc08e815848","observation_id":"4f860300-c013-4d5e-93cc-f81f59662c3d","resolution":{"observed_at":"2026-08-07T14:00:32.690016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.362279Z","title":"Comparison of topic identification methods for arabic language,","venue":null,"work_id":"7376b31f-257e-481b-a317-71dd14fbf180","year":2005},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.415410Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:bf4b367a2a242db250f72d147dd952b19ed7991f4a16899c4e7fc7923ede5aad","observation_id":"ba7c7e28-106d-4fb4-a4b0-37b977092f62","resolution":{"observed_at":"2026-08-07T14:00:30.443055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.241028Z","title":"STTATTS: Unified speech-to-text and text-to-speech model,","venue":null,"work_id":"3c6811ad-1853-4859-bae5-b9924a4009df","year":2024},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.583427Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:5277549557bd92b1a98f82e7bb7d2fcec49084e6e7598534917d3c1ce132447c","observation_id":"595761de-0765-4661-924a-299b8c43c8dc","resolution":{"observed_at":"2026-08-07T14:00:30.288429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:29.602721Z","title":"ArTST: Arabic text and speech transformer,","venue":null,"work_id":"304443bb-1c2a-45ff-9dd2-e92a5ada38c0","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.836847Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:05907ffccd4fa80a6e57b489e1c22db498ea7d53b9fffdb17d9118769e4c3d1f","observation_id":"25212192-0b16-4a2a-86c8-024f93293fcf","resolution":{"observed_at":"2026-08-07T14:00:29.737572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:29.377205Z","title":"Fast conformer with linearly scalable attention for efficient speech recognition,","venue":null,"work_id":"4ee05967-4715-44a1-9295-d012a1582cd4","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.957211Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:e06d28a383c3ba26b9e4e53d6927f3f8d19d9c5ebcb281390df270659f55a89a","observation_id":"15679c2d-fd08-41d1-87b3-e00a189b3c50","resolution":{"observed_at":"2026-08-07T14:00:29.484852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:28.076071Z","title":"Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:28.076071Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:33cd7582d4320958ccf071b1374bb15731f3ecdf610a0be48ff91bc1665f4cff","observation_id":"68242d48-3888-4ae0-a34e-f2e53dc222d1","resolution":{"observed_at":"2026-08-07T14:00:28.076071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07598","last_updated":"2023-09-15T10:47:52Z","snapshot_observed_at":"2026-07-06T16:18:25.480941Z","submitted_at":"2023-09-14T10:59:29Z","title":"AAS-VC: On the Generalization Ability of Automatic Alignment Search based Non-autoregressive Sequence-to-sequence Voice Conversion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07598","snapshot_observed_at":"2026-08-07T14:00:28.372172Z","title":"Aas-vc: On the generalization ability of automatic alignment search based non- autoregressive sequence-to-sequence voice conversion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:28.372172Z"},"links":{"cited_paper":"/paper/2309.07598","citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:ee7e14ce45c1bd1c1e7262460b651f945eaab49fdd2f30b0f936cc31366e6481","observation_id":"ca834ef0-2608-411c-8690-a878ddb3dd7e","resolution":{"observed_at":"2026-08-07T14:00:28.372172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:29.152764Z","title":"Parallel wavegan: A fast waveform generation model based on generative adversarial net- works with multi-resolution spectrogram,","venue":null,"work_id":"557bb0f4-8651-4096-af2c-a811675386ad","year":2020},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:28.521972Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:b4d6c4eb95a8bdcc98028da42432f5ebd1f4568211be1a7998e5fd22a5026d09","observation_id":"6b959bc7-994d-4b22-8339-aeb77a222c66","resolution":{"observed_at":"2026-08-07T14:00:29.248170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:29.019978Z","title":"V oice conversion with just nearest neighbors,","venue":null,"work_id":"e5211009-8cd4-4d88-9448-6ebfc8406791","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:28.634322Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:c478a57179229141f074e32586ee818e71e0e8844cbabe3761834ff6260ef628","observation_id":"cf97cd27-ac38-4b85-983d-b3806904a469","resolution":{"observed_at":"2026-08-07T14:00:29.075673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.681169Z","title":"Available: https://eprints.soton.ac.uk/409695/","venue":null,"work_id":"9d48fb32-bfbd-4af2-95c5-c3b5db05748c","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.112518Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:d43ee2cb72640442a53cad46388a2e8376e2e17941722dbfccb43ceae6b387e1","observation_id":"a26d98ca-5205-48f0-99ea-61164e471c45","resolution":{"observed_at":"2026-08-07T14:00:30.781759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T13:50:55.898012Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 1 inbound Pith citation observation for arXiv:2505.20506."}