{"as_of":"2026-08-23T08:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0455c417fb6417133ee0c16ece76d7f077b755be8dc18fae01cacf1b4161d692","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T05:13:31.600156Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T05:13:28.722551Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.22304","snapshot_observed_at":"2026-08-01T05:13:28.722551Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:28.722551Z"},"links":{"cited_paper":"/paper/2607.22304","citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:959045eb1984c0b1327988ac8b203de3898c11a603e01a9d4d0b32f9859138cd","observation_id":"f63349c3-e76c-4389-8628-b47dc73b4656","resolution":{"observed_at":"2026-08-01T05:13:28.722551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.22304/citation-record","integrity":"/paper/2607.22304/integrity","json":"/paper/2607.22304/citation-record.json","paper":"/paper/2607.22304"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:28.534045Z","title":"Existing efforts focus on emotion recogni- tion [7, 8, 9, 10], but these efforts target a single task and none adopts a voice cloning approach","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:28.534045Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:8357996b39ed0ddccff5347116774ecc6818e9e9082b5a40a87b4a776afe9c13","observation_id":"959896ce-9d76-4ed3-9518-e5eab7b5dfa4","resolution":{"observed_at":"2026-08-01T05:13:28.534045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.22304","snapshot_observed_at":"2026-08-01T05:13:28.722551Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:28.722551Z"},"links":{"cited_paper":"/paper/2607.22304","citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:959045eb1984c0b1327988ac8b203de3898c11a603e01a9d4d0b32f9859138cd","observation_id":"f63349c3-e76c-4389-8628-b47dc73b4656","resolution":{"observed_at":"2026-08-01T05:13:28.722551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:28.912334Z","title":"RQ1: Paralinguistic Preservation Table 3 and Figure 1 report AUC scores for the public and clinical datasets respectively","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:28.912334Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:f248c3ef1e820ce768c3d616da8af879890d1465cf52c30062d6a886032481d8","observation_id":"58caa454-0b1b-4f52-8862-f648c5985847","resolution":{"observed_at":"2026-08-01T05:13:28.912334Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:28.976234Z","title":"Our results show that, despite this, mod- ern cloning models retain most of the relevant signal","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:28.976234Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:309d03f5609b0578eb123789a916f3d3f879373e388c3570703d25560d5b756e","observation_id":"8376f74c-6f41-492c-8d15-5cd76d4768f2","resolution":{"observed_at":"2026-08-01T05:13:28.976234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:29.046207Z","title":"All experimental results and scientific conclusions are solely the authors’","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:29.046207Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:6a0b1f1c85bc9af4ef33b02dd25d04b3d072c9a64d02885cb9f1a857a63720d7","observation_id":"f3b9225a-1a20-4dcc-bac0-e8bf10e0c7e8","resolution":{"observed_at":"2026-08-01T05:13:29.046207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:29.123056Z","title":"Spoken language cor- pora augmentation with domain-specific voice-cloned speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:29.123056Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:2725f338757b5b1bd489d0c5a2a807bd0eeaa8e20bacbf389b8aafbfb26e6fd7","observation_id":"4cd39bca-2084-4031-b901-7170253452d0","resolution":{"observed_at":"2026-08-01T05:13:29.123056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:29.214409Z","title":"You do not need more data: Improving end- to-end speech recognition by text-to-speech data augmentation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:29.214409Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:d9cb3e3a32aeedf8f79f00de85b4be736710f92ecab6743dbf7fc08937c71be0","observation_id":"abce71d0-26ca-409c-8276-92102e76e87b","resolution":{"observed_at":"2026-08-01T05:13:29.214409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:29.302064Z","title":"Making more of little data: Improving low-resource automatic speech recognition using data augmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:29.302064Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:9d44e0a04c878aed05000d167b4e21785147fef95cf1eee80e12078ecff6e397","observation_id":"1dd943bf-941b-405b-ad9a-04ebc1e69b05","resolution":{"observed_at":"2026-08-01T05:13:29.302064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:29.394111Z","title":"An exhaustive evaluation of tts- and vc-based data augmentation for asr,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:29.394111Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:80e8d28751c236ff3af54a6615c56e71c74e9ee2dc03f278c1385b2f48f3e8df","observation_id":"06cfcbcd-d685-45de-af6a-90acfd3b13be","resolution":{"observed_at":"2026-08-01T05:13:29.394111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:29.497386Z","title":"A multimodal bayesian network for symptom-level depression and anxiety prediction from voice and speech data,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:29.497386Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:658430ff9a8205ac46ccfdd4227fe7b47a487b0a0a357f68420dc1ccedacd51c","observation_id":"9b2289d5-7c73-426f-8d34-fc25f9059e0c","resolution":{"observed_at":"2026-08-01T05:13:29.497386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:29.605505Z","title":"Speech analysis for health: Current state-of-the-art and the increasing impact of deep learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:29.605505Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:cbbdb1082f64ac587f927e4d8ce859063a318b020f9f78910a955217c220c1a4","observation_id":"bdcf2bdf-d466-4135-8d00-635223a035d3","resolution":{"observed_at":"2026-08-01T05:13:29.605505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:29.715208Z","title":"Generative emotional ai for speech emotion recognition: The case for synthetic emotional speech augmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:29.715208Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:bba61e1f1c0fd46d4043566525bcf2ef912315788f1099f4b322ffc313c8a30b","observation_id":"4f21c9b5-e09d-4911-b238-6d947a8e863a","resolution":{"observed_at":"2026-08-01T05:13:29.715208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:29.799795Z","title":"Towards improving speech emotion recognition using synthetic data augmentation from emotion conversion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:29.799795Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:003c6cee808b706c60a638e3ee65a8bba889b6f2a55e6e7fd3bb52e0ace2d0a2","observation_id":"38af0ffa-0f35-48de-92b3-a3a0d29ba5c3","resolution":{"observed_at":"2026-08-01T05:13:29.799795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:29.891704Z","title":"Data aug- mentation using GANs for speech emotion recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:29.891704Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:45e073424b01fe2b6c94c99543607604c53e3cc5e10376667b0a57eb85f174c7","observation_id":"6578d20d-0ad6-4e33-a9c7-1ddd569c10bf","resolution":{"observed_at":"2026-08-01T05:13:29.891704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11413","last_updated":"2023-05-19T03:51:09Z","snapshot_observed_at":"2026-08-21T22:57:26.481433Z","submitted_at":"2023-05-19T03:51:09Z","title":"A Preliminary Study on Augmenting Speech Emotion Recognition using a Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11413","snapshot_observed_at":"2026-08-01T05:13:29.995983Z","title":"A preliminary study on augmenting speech emotion recognition using a diffusion model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:29.995983Z"},"links":{"cited_paper":"/paper/2305.11413","citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:bb276c7642585b9f11495d4b9d87642d410e908a34153608b75d4f0e6fd22e08","observation_id":"e8e42cf9-ee08-4638-b761-ada8b5905070","resolution":{"observed_at":"2026-08-01T05:13:29.995983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.060335Z","title":"V oice cloning: Comprehensive sur- vey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.060335Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:8cf089aabdf8028a0302594bdea788503d97195dd36eb435d228dec56ddaced2","observation_id":"db6e4404-d517-44fc-a880-260b8a7a756d","resolution":{"observed_at":"2026-08-01T05:13:30.060335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.151365Z","title":"ClonEval: An open voice cloning benchmark,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.151365Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:183a3482bc4879311bee967b82bddbe6b00dc0362502c2b0e239ffd69ba94cf3","observation_id":"c4507867-150e-4dfc-83e3-b4191cb7b881","resolution":{"observed_at":"2026-08-01T05:13:30.151365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.214750Z","title":"The V oicePrivacy 2024 challenge evaluation plan,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.214750Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:3eb6e1861035216576f7db37268a7b02f2e5bff5778e7e865c9bc803d6db16ab","observation_id":"ec0fd2f0-e1e1-4ab0-810a-15a450d3c413","resolution":{"observed_at":"2026-08-01T05:13:30.214750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.287835Z","title":"A review of depression and suicide risk assessment using speech analysis,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.287835Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:6bcc93b95c8c60cb8235ca13b503c8118445cce46f27d6c3ed85635c1f65f801","observation_id":"b242847f-dbed-45bb-bbdd-cf76cd10873f","resolution":{"observed_at":"2026-08-01T05:13:30.287835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.378691Z","title":"Automated assess- ment of psychiatric disorders using speech: A systematic review,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.378691Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:3e06e043a532e2c7f5739646f62847a730a9bdbbebbe76120676a17a0c471054","observation_id":"4b2666c4-e1af-485b-ab34-ce097877481f","resolution":{"observed_at":"2026-08-01T05:13:30.378691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.496193Z","title":"Kintsugi voice biomarker technology,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.496193Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:29a70d5a4192cbc0c233a67311817ab2fe577bb16819fc763dc376b07937f1c7","observation_id":"8634de68-7a73-40bd-830f-a12ed91ccdcc","resolution":{"observed_at":"2026-08-01T05:13:30.496193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.586519Z","title":"V ocal biomarker platform,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.586519Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:542c774006bf36a26b26a9d7d600c5f32752500238e0270e0f36cb5309b46555","observation_id":"15344444-a95f-4dd8-b66b-58065ccae7dd","resolution":{"observed_at":"2026-08-01T05:13:30.586519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.669419Z","title":"The Distress Analysis Interview Corpus of human and computer interviews,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.669419Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:fcd770f2b66823a887d7c4c21ce74200dbdfafe6fc4dd91d01f6a4fee51f1e61","observation_id":"53e23352-262c-4c0c-b9ae-bb10b91cded0","resolution":{"observed_at":"2026-08-01T05:13:30.669419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.746662Z","title":"The Androids corpus: A new publicly available benchmark for speech based depression detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.746662Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:7c300430f5d32d7f64de761b027bf23716fc05d213a55d2f4c1ba996da77772a","observation_id":"26f27cd5-1f10-4541-a114-ccc2f11a5dda","resolution":{"observed_at":"2026-08-01T05:13:30.746662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.795842Z","title":"DEPAC: a corpus for depression and anxiety detection from speech,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.795842Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:bf4c6eeff8c5076c39ef8f6fdfdea0ce8a99da7e6fde7034205e8810732d3b7f","observation_id":"5118d113-2499-4aa2-9427-f576a44078ef","resolution":{"observed_at":"2026-08-01T05:13:30.795842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.861195Z","title":"IEMOCAP: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.861195Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:15e0d270a5fb5bd0e01d86094ff3411df385fe2a826f0b1dde5eb7a0d77cd63d","observation_id":"adc4d7c5-cf60-4a77-82ed-1d42e7ae3461","resolution":{"observed_at":"2026-08-01T05:13:30.861195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:30.927159Z","title":"MELD: A multimodal multi-party dataset for emo- tion recognition in conversations,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:30.927159Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:31f73aed0d413237519a1eab766f240239b5074aefc33932b33effe64c5cbb62","observation_id":"14b8924d-9556-4da0-8609-659d47eacfa5","resolution":{"observed_at":"2026-08-01T05:13:30.927159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:31.019392Z","title":"Towards multimodal sarcasm detection (an obviously perfect paper),","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:31.019392Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:16a9356d9599e35786e53816a030b32a40a425abfa00eff48515ad94cdd66880","observation_id":"1c0c15ec-e451-4d74-929b-e1bc35d59680","resolution":{"observed_at":"2026-08-01T05:13:31.019392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:31.105687Z","title":"CSTR VCTK cor- pus: English multi-speaker corpus for CSTR voice cloning toolkit (version 0.92),","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:31.105687Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:87d0e0851599fc432939f050b030c23d569d40b246ba3ce4ed98b4e54ccbf766","observation_id":"e0d941f2-fb87-4ead-b078-e43983a55c27","resolution":{"observed_at":"2026-08-01T05:13:31.105687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:31.188908Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:31.188908Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:cc2a605ab6eaa4ea079e1c56ed0e12ab26f5537d224747d2c15b83d19490c269","observation_id":"d4ed2a72-229b-4e4c-add4-524d68496784","resolution":{"observed_at":"2026-08-01T05:13:31.188908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T05:13:31.272045Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:31.272045Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:a150ae1d2796debccab113fe70ece2c80dd1a7a120a84a33bf6603264a007af6","observation_id":"3dfe6eb0-6094-4ecf-9d0b-906a9fe1fefe","resolution":{"observed_at":"2026-08-01T05:13:31.272045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:31.317785Z","title":"WavLM: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:31.317785Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:fb2f3f072ef0ea9887149c73a3f3544db88b8b3f49ac42a408742dc8b01a026c","observation_id":"305c54b0-c3a4-4dda-a25f-b08448f83275","resolution":{"observed_at":"2026-08-01T05:13:31.317785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:31.371777Z","title":"Paral- bench: A large-scale benchmark for computational paralinguistics over acoustic foundation models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:31.371777Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:0d1c6817e3c6e8a2503943217b139e228091ad03ffdc38b30745df899344c14d","observation_id":"62e4b729-40a8-4536-ae75-4c98f0d1e456","resolution":{"observed_at":"2026-08-01T05:13:31.371777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:31.469890Z","title":"Anxiety and depression as bidirectional risk factors for one another: A meta-analysis of lon- gitudinal studies,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:31.469890Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:344acbf3b406ef40c8e61ffd70f539665b4813ea95fd6f2fbfc107b2610d375d","observation_id":"861f2e65-5804-4819-b1af-076385b5bbaf","resolution":{"observed_at":"2026-08-01T05:13:31.469890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:13:31.600156Z","title":"Comor- bidity within mental disorders: a comprehensive analysis based on 145 990 survey respondents from 27 countries,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T05:13:31.600156Z"},"links":{"citing_paper":"/paper/2607.22304"},"observation_digest":"sha256:f481c7cd59b9d31b541281362f1a6ac924821503ce8bd5375ce4427ee0f4f45f","observation_id":"b3ebb449-845f-44a3-9346-806e6bf188ce","resolution":{"observed_at":"2026-08-01T05:13:31.600156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.22304","last_updated":"2026-07-24T13:46:00Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-01T05:13:28.046268Z","submitted_at":"2026-07-24T13:46:00Z","title":"Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2607.22304."}