{"as_of":"2026-08-09T21:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:541e32813c82a0c3b2dc146d6366ffd6d477c57a9f0f221e232b27c92aba13d1","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:23:12.222004Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:23:04.116674Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T13:23:12.457477Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"cited_work":{"arxiv_id":"2505.22054","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.22054","snapshot_observed_at":"2026-08-07T13:23:12.457477Z","title":"Voice Adaptation for Swiss German","venue":"cs.CL","work_id":"d643952e-61eb-483f-93de-6d545b2bbb9e","year":2025},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.116674Z"},"links":{"cited_paper":"/paper/2505.22054","citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:b6c75808dfa676d470f4af53f68b05d4629237549f505f246285c773b380e772","observation_id":"73889d1b-4869-4a5e-805c-de04eb51344b","resolution":{"observed_at":"2026-08-07T13:23:12.560265Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22054/citation-record","integrity":"/paper/2505.22054/integrity","json":"/paper/2505.22054/citation-record.json","paper":"/paper/2505.22054"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:16.804996Z","title":"It is now possible to clone a voice across languages with less than a minute of audio required [3, 4]","venue":null,"work_id":"0cd2bb8e-e16f-4248-bd08-a95875354ff6","year":null},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.038461Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:73274df82133c120f9fc1e2ee79b72281282865409fca467178dceb2a33f1b85","observation_id":"9360fa95-2080-4783-9ccf-5cf0dfdfd366","resolution":{"observed_at":"2026-08-07T13:23:16.935149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"cited_work":{"arxiv_id":"2505.22054","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.22054","snapshot_observed_at":"2026-08-07T13:23:12.457477Z","title":"Voice Adaptation for Swiss German","venue":"cs.CL","work_id":"d643952e-61eb-483f-93de-6d545b2bbb9e","year":2025},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.116674Z"},"links":{"cited_paper":"/paper/2505.22054","citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:b6c75808dfa676d470f4af53f68b05d4629237549f505f246285c773b380e772","observation_id":"73889d1b-4869-4a5e-805c-de04eb51344b","resolution":{"observed_at":"2026-08-07T13:23:12.560265Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:16.571150Z","title":"For our first model, we fine- tuned XTTS-v2 using the SRG and STT4SG-350 data mix","venue":null,"work_id":"d702c084-866d-419b-8247-6b7ca85fae32","year":null},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.252180Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:59a9e07946303564720b0e8695866ed575025fba92747663012af9ee9d70daaa","observation_id":"c3ddeacb-2b21-408f-8d4f-af3d3e24ce66","resolution":{"observed_at":"2026-08-07T13:23:16.674564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:16.331644Z","title":"The learning rate was changed to 6e-5 from the original 5e-5 due to internal tests and listening to the generated audio files","venue":null,"work_id":"7a4bf452-d1da-44f4-8998-4e5f5944c144","year":null},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.357760Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:c75dfbece6593470c0f341584979b25c60e8cafb43ec931b55a08d45c094f80e","observation_id":"8cef58c1-db32-4a48-b1e9-610963262ba3","resolution":{"observed_at":"2026-08-07T13:23:16.458662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:16.104237Z","title":"The training and test sets were pre- partitioned by the dataset authors to ensure speaker indepen- dence, such that no speaker or sample appears in both splits","venue":null,"work_id":"d3cc1575-11cd-44b8-872f-a8a2e381a574","year":null},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.486066Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:7a66b493a2dbd25d51a953173ceed2239fdc6ebf618f53ea40d85715f662f919","observation_id":"6f335fa5-5f71-4d6a-899f-8b6aa9af0001","resolution":{"observed_at":"2026-08-07T13:23:16.199244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:15.909603Z","title":"We showed that translating Standard German text to Swiss German dialect speech is feasible and yields satisfactory results","venue":null,"work_id":"7f2607b2-ed5a-45f9-9933-750f6d4f2c0d","year":null},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.666971Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:f426451e034826d04089b16ddfeaa7e97914a853b583005687c83517acf5a747","observation_id":"0d4607ae-b7db-4300-820e-fe1f53b6300b","resolution":{"observed_at":"2026-08-07T13:23:16.007737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-07T13:23:04.803829Z","title":"Neural codec language mod- els are zero-shot text to speech synthesizers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:04.803829Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:3f7c3f510d7c8e84166702975d2d91bc426469f5fe112f3943ffc14c7efdefef","observation_id":"07c2fa73-8827-4748-8982-68848deb21f1","resolution":{"observed_at":"2026-08-07T13:23:04.803829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05370","last_updated":"2024-06-17T04:39:08Z","snapshot_observed_at":"2026-08-08T07:23:06.245954Z","submitted_at":"2024-06-08T06:31:03Z","title":"VALL-E 2: Neural Codec Language Models are Human Parity Zero-Shot Text to Speech Synthesizers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05370","snapshot_observed_at":"2026-08-07T13:23:05.343214Z","title":"Vall-e 2: Neural codec language models are hu- man parity zero-shot text to speech synthesizers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:05.343214Z"},"links":{"cited_paper":"/paper/2406.05370","citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:0fe651aec2205d0c4b64e9b35ab20d7e83c81a8cd16bc25249f856abd4604d23","observation_id":"78f0abd3-8987-4043-b332-5830629f06d2","resolution":{"observed_at":"2026-08-07T13:23:05.343214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03926","last_updated":"2023-03-07T14:31:55Z","snapshot_observed_at":"2026-08-06T04:55:08.186019Z","submitted_at":"2023-03-07T14:31:55Z","title":"Speak Foreign Languages with Your Own Voice: Cross-Lingual Neural Codec Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03926","snapshot_observed_at":"2026-08-07T13:23:07.320866Z","title":"Speak foreign languages with your own voice: Cross-lingual neural codec language modeling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:07.320866Z"},"links":{"cited_paper":"/paper/2303.03926","citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:5c262c2d330a76d57d2cf209f8f9f07b020d6287cab617ac267ebaf1cc42a40d","observation_id":"f148466c-20d9-4340-a9ed-b9aedfd7a3f6","resolution":{"observed_at":"2026-08-07T13:23:07.320866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:15.651251Z","title":"XTTS: a Massively Multilingual Zero-Shot Text-to-Speech Model,","venue":null,"work_id":"e975a13f-5f8c-444a-a46e-95640c21d373","year":2024},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:07.455851Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:0717b27cc0b3e9aa2baa05d9bcced7072a42f1c3c1ebd449a416b3d9ddc5095f","observation_id":"c72a5b82-fef3-45bd-bdd5-26bfe6611af9","resolution":{"observed_at":"2026-08-07T13:23:15.733994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:15.374908Z","title":"Atten- tion is all you need,","venue":null,"work_id":"787b05d2-f232-4e46-ac3d-e55a618e3ad3","year":2017},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:07.623190Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:915bb3708decb9a737d85caf7654779154d215c5852b23e9acc06abd5f550556","observation_id":"b9c8fbaa-7db7-4946-8806-96a193e5e12e","resolution":{"observed_at":"2026-08-07T13:23:15.526781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:15.150876Z","title":"Libriheavy: A 50,000 hours asr corpus with punc- tuation casing and context,","venue":null,"work_id":"08a9ecec-93f9-42cf-a713-583146a6459f","year":2024},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:08.110373Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:97ca2f486cd448e43007bb29ae70add99b96aba1589ad96b89e71bb679933fd2","observation_id":"eee9640c-9dc1-4413-b0db-56dd9709b897","resolution":{"observed_at":"2026-08-07T13:23:15.233252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:10.048074Z","title":"Wenetspeech4tts: A 12,800-hour mandarin tts corpus for large speech generation model bench- mark,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.048074Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:e417de427809b6ee7d1beca0fa871155c047df544e13dc28dba7604a96e3df39","observation_id":"2ff7b0fe-c7bf-4b3f-a4ad-2c442e8cb43e","resolution":{"observed_at":"2026-08-07T13:23:10.048074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:14.992745Z","title":"Autoprep: An automatic preprocessing framework for in-the-wild speech data,","venue":null,"work_id":"65b17305-abb0-49c0-95c3-4733d23af4b9","year":2024},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.189848Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:f1e21d1cfc40b4e7a5c06e8c23cf49bbf71504c08637afd0920ea6ba822b57bb","observation_id":"4f9c09f7-e28a-4e74-951e-cec81e9bae97","resolution":{"observed_at":"2026-08-07T13:23:15.060135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:14.782642Z","title":"SDS-200: A Swiss German speech to Standard German text corpus,","venue":null,"work_id":"b5a34df0-5ab9-4236-9d89-99d4f6b5596d","year":2022},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.299302Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:7e15b9b56ace1ce808b44c7cecefa6a848d1004ccc683ffa0db645ba89527490","observation_id":"9610d4f2-2459-4f65-bc20-0db5b7d752f4","resolution":{"observed_at":"2026-08-07T13:23:14.853461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:14.566566Z","title":"STT4SG-350: A speech corpus for all Swiss German dialect regions,","venue":null,"work_id":"7e47c298-c095-4948-9960-92103e4038a4","year":2023},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.426587Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:8f2945d069e86f8d5cc255954f6797f401fe06f1c949e9f2d56ff6f13046944e","observation_id":"ccab4ab0-f4ef-4840-b927-e429cad7b4ef","resolution":{"observed_at":"2026-08-07T13:23:14.674152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15726","last_updated":"2025-04-22T12:09:39Z","snapshot_observed_at":"2026-07-06T20:10:46.746601Z","submitted_at":"2024-12-20T09:49:02Z","title":"Fine-tuning Whisper on Low-Resource Languages for Real-World Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15726","snapshot_observed_at":"2026-08-07T13:23:10.577473Z","title":"Fine-tuning whisper on low-resource languages for real- world applications,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.577473Z"},"links":{"cited_paper":"/paper/2412.15726","citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:a8d4609e874c8c9d8075f26ade79b2d0225120e158cb94777bd61ec8cc92f957","observation_id":"c96d4746-dcf6-4885-9db6-e185de5cc42b","resolution":{"observed_at":"2026-08-07T13:23:10.577473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.11401","last_updated":"2021-03-21T14:00:09Z","snapshot_observed_at":"2026-08-09T15:48:29.077951Z","submitted_at":"2021-03-21T14:00:09Z","title":"SwissDial: Parallel Multidialectal Corpus of Spoken Swiss German","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.11401","snapshot_observed_at":"2026-08-07T13:23:10.730467Z","title":"Swissdial: Parallel multidialectal corpus of spoken swiss german,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.730467Z"},"links":{"cited_paper":"/paper/2103.11401","citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:6c5b05b5d4e661d3c3d98d9efe72a6b67e33f9f48a6f30f7bc1657474f696316","observation_id":"d36cf610-c113-49cd-ae69-a0f96157642f","resolution":{"observed_at":"2026-08-07T13:23:10.730467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:14.286500Z","title":"Natural tts synthesis by condi- tioning wavenet on mel spectrogram predictions,","venue":null,"work_id":"cb207fd1-4332-496a-b599-f67da9856496","year":2018},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:10.900109Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:7a7bde7d8167efaed90761b20cc635f462029a8f9aad5a1dac0124de1279532c","observation_id":"07d8835e-427e-4c65-a01e-8b43d7627762","resolution":{"observed_at":"2026-08-07T13:23:14.426205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:13.955093Z","title":"pyannote.audio 2.1 speaker diarization pipeline: prin- ciple, benchmark, and recipe,","venue":null,"work_id":"8097290c-1c01-4f4f-958e-d836ccf89e44","year":2023},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.089755Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:6299a5ee41296e1127dec2461ead0fa7bdf1b4e3eeec0a4ae8069b3e6de63fc8","observation_id":"6c2527e8-c2fa-417a-b316-56e2321ca07d","resolution":{"observed_at":"2026-08-07T13:23:14.127369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:13.599460Z","title":"Powerset multi-class cross entropy loss for neural speaker diarization,","venue":null,"work_id":"011f74fe-391e-4544-aba9-87e827a30487","year":2023},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.230304Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:7437f0a7162c56fbb14a25ac105110e1026a799d98d6e397a01ac34a1a4fc30e","observation_id":"45c10899-69c6-4eb3-9ffc-da8cd68cb9ed","resolution":{"observed_at":"2026-08-07T13:23:13.763019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:13.300335Z","title":"ELAN (Version 6.8) [Computer software],","venue":null,"work_id":"946cc748-97ea-49be-926c-cd0fac4b2fc1","year":2024},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.428780Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:0a119e8bcadea3767ec677c512a6f72ecfaebfd6e835786858ba44c04142705b","observation_id":"383a0702-687b-4fad-a8b0-68d07dd8345f","resolution":{"observed_at":"2026-08-07T13:23:13.405616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:11.567094Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.567094Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:1429dbaa47579dc58688028a4e52cc0ea9aae697823f1cb27dd63fd043a5fbcb","observation_id":"3cacc949-1138-4e5d-bfb0-bf129a7e2be8","resolution":{"observed_at":"2026-08-07T13:23:11.567094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:12.992259Z","title":"Automatische erkennung schweizerdeutscher dialekte anhand von audiodaten via phonem- transkriptionen,","venue":null,"work_id":"7e3edc23-2417-4fda-9357-f06b42ee3f73","year":2024},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.681298Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:fdc26174c8ba26b50c00f434b29bfc011a5d722bcc53bb4a7fa1c4df4a609ce6","observation_id":"fa6ec5c3-4192-4638-a18f-9b3c9a5926cf","resolution":{"observed_at":"2026-08-07T13:23:13.150766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11680","last_updated":"2021-09-23T22:50:32Z","snapshot_observed_at":"2026-08-02T00:37:53.191869Z","submitted_at":"2021-09-23T22:50:32Z","title":"Simple and Effective Zero-shot Cross-lingual Phoneme Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11680","snapshot_observed_at":"2026-08-07T13:23:11.843471Z","title":"Simple and effective zero-shot cross-lingual phoneme recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.843471Z"},"links":{"cited_paper":"/paper/2109.11680","citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:a4ed4a4fbbdda2df8e8aacd6dc6a759a1149b42a3068e317fa2465f7524256f7","observation_id":"bd712c5f-effc-41a8-9975-fac9d42d2d4b","resolution":{"observed_at":"2026-08-07T13:23:11.843471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:11.955633Z","title":"Common voice: A massively-multilingual speech corpus,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:11.955633Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:ea4f16c4d0d5567e126616d008a90c214065ec9689ced7156790712264c2630b","observation_id":"2125b9b7-a794-4ec2-9470-b4b64e7caa41","resolution":{"observed_at":"2026-08-07T13:23:11.955633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:12.102534Z","title":"Ecapa2: A hybrid neural net- work architecture and training strategy for robust speaker embed- dings,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.102534Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:e9a2beda1891e31ac1a1dc113e8a1be1c1f2ec839e89785e4daf5c44cd162ca6","observation_id":"7b48d7f8-d108-4065-92a3-d65c95915eeb","resolution":{"observed_at":"2026-08-07T13:23:12.102534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:12.731580Z","title":"Dialect transfer for Swiss German speech translation,","venue":null,"work_id":"29adbd5a-4ea9-4eb6-ab79-64b16204f243","year":2023},"citing_paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:12.222004Z"},"links":{"citing_paper":"/paper/2505.22054"},"observation_digest":"sha256:a6259d37a145145f454248740e9983a31b162930a22bc5b5582713532e812be7","observation_id":"e8a41c36-d42a-4dff-8cf8-28f5895874fa","resolution":{"observed_at":"2026-08-07T13:23:12.860467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.22054","last_updated":"2025-05-28T07:24:40Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T19:05:09.930615Z","submitted_at":"2025-05-28T07:24:40Z","title":"Voice Adaptation for Swiss German"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 1 inbound Pith citation observation for arXiv:2505.22054."}