{"as_of":"2026-08-18T12:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f4301a2e3a1905caca90bf23b43a80db11649ff01995bb88ad13c294e7a87052","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:17:54.873072Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.05056/citation-record","integrity":"/paper/2505.05056/integrity","json":"/paper/2505.05056/citation-record.json","paper":"/paper/2505.05056"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.284293Z","title":"Wenet- speech: A 10000+ hours multi-domain mandarin corpus for speech recognition,","venue":null,"work_id":"5b6c0868-d241-4112-9940-4551b52dc857","year":2022},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.731469Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:6ee6be84013e6946da78ed99e14ad85b1d84f12985bb4871a2bba7b34b1cbfdb","observation_id":"f2bc0535-d1be-4d1a-b77b-d629698f9d6e","resolution":{"observed_at":"2026-08-15T23:17:55.288705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05361","last_updated":"2024-09-07T15:08:24Z","snapshot_observed_at":"2026-08-16T13:36:26.053658Z","submitted_at":"2024-07-07T13:24:54Z","title":"Emilia: An Extensive, Multilingual, and Diverse Speech Dataset for Large-Scale Speech Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05361","snapshot_observed_at":"2026-08-15T23:17:54.736082Z","title":"Emilia: An extensive, multilingual, and diverse speech dataset for large-scale speech generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.736082Z"},"links":{"cited_paper":"/paper/2407.05361","citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:6d48cc95430f65a983cca15b488c060aaa85370dbe453fe18f5a8cdd59db7f15","observation_id":"77a4ced1-7334-413d-b218-15832b16259b","resolution":{"observed_at":"2026-08-15T23:17:54.736082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.270907Z","title":"Common voice: A massively-multilingual speech corpus,","venue":null,"work_id":"697b3c8c-dcff-4f36-be31-f05e39ed543e","year":2020},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.740591Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:58972ad8e2c6a01dece51f9c456bf0cbaaf4cd0df4044a4be3197866365e5037","observation_id":"b42c57bd-82b5-480f-a914-2489ef6fd6eb","resolution":{"observed_at":"2026-08-15T23:17:55.275363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:54.744860Z","title":"Robust speech recognition via large- scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.744860Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:e98da42ed53319e7804e36e9d4800aa0d1a546a62b3f8cd339e9a47a982f7fd1","observation_id":"f8f103d4-e055-451c-82be-9733936bc31e","resolution":{"observed_at":"2026-08-15T23:17:54.744860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04675","last_updated":"2024-07-10T09:01:17Z","snapshot_observed_at":"2026-08-16T13:36:42.713695Z","submitted_at":"2024-07-05T17:38:03Z","title":"Seed-ASR: Understanding Diverse Speech and Contexts with LLM-based Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04675","snapshot_observed_at":"2026-08-15T23:17:54.749572Z","title":"Seed-asr: Understanding diverse speech and contexts with llm-based speech recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.749572Z"},"links":{"cited_paper":"/paper/2407.04675","citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:6643a01ad174ce4ccabdc125d7e34a8840e6d0bd46ba04d4a4c689691e4364d3","observation_id":"55023dc9-7f4e-4384-98e4-c7f3ea493964","resolution":{"observed_at":"2026-08-15T23:17:54.749572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.248416Z","title":"Moonshine: Speech recognition for live transcription and voice commands,","venue":null,"work_id":"8a59efa0-cc1d-4291-bcb4-19f345274dd1","year":2024},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.754270Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:0439d2eed8cc6f84410d3f9e5ccd42a4e75023eaa18127060431e82dfa3633f1","observation_id":"3d982d91-c326-445a-9352-0b50476c0277","resolution":{"observed_at":"2026-08-15T23:17:55.252681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00750","last_updated":"2024-10-20T14:25:49Z","snapshot_observed_at":"2026-08-16T13:22:17.818052Z","submitted_at":"2024-09-01T15:26:30Z","title":"MaskGCT: Zero-Shot Text-to-Speech with Masked Generative Codec Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00750","snapshot_observed_at":"2026-08-15T23:17:54.758777Z","title":"Maskgct: Zero-shot text-to-speech with masked generative codec transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.758777Z"},"links":{"cited_paper":"/paper/2409.00750","citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:759606fef13c6aa88012b7c1cab5f1546666026ba9881f5b7f30a03308444734","observation_id":"c26f3345-058c-47a6-927e-1fc6efdd23e9","resolution":{"observed_at":"2026-08-15T23:17:54.758777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-15T23:17:54.763554Z","title":"Neural codec language models are zero-shot text to speech synthesiz- ers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.763554Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:92a93784cee9c197284277913a721faa21b84d79aa83ca41580c607a2f72bbd9","observation_id":"48bc5af6-780d-4404-9472-37f1c386c58f","resolution":{"observed_at":"2026-08-15T23:17:54.763554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05407","last_updated":"2024-07-09T07:42:51Z","snapshot_observed_at":"2026-08-10T17:49:50.848957Z","submitted_at":"2024-07-07T15:16:19Z","title":"CosyVoice: A Scalable Multilingual Zero-shot Text-to-speech Synthesizer based on Supervised Semantic Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05407","snapshot_observed_at":"2026-08-15T23:17:54.768702Z","title":"Cosyvoice: A scalable multilingual zero-shot text-to-speech synthesizer based on supervised semantic tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.768702Z"},"links":{"cited_paper":"/paper/2407.05407","citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:228e229ec626439f17011536d4931d7c6b79272008e1a81069f43e5b115e9476","observation_id":"511157f3-7058-45ba-81eb-cc42ad099429","resolution":{"observed_at":"2026-08-15T23:17:54.768702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06885","last_updated":"2025-05-20T15:53:10Z","snapshot_observed_at":"2026-08-16T05:58:47.061997Z","submitted_at":"2024-10-09T13:46:34Z","title":"F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06885","snapshot_observed_at":"2026-08-15T23:17:54.775167Z","title":"F5-tts: A fairytaler that fakes fluent and faithful speech with flow matching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.775167Z"},"links":{"cited_paper":"/paper/2410.06885","citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:9e74ae173d49122b10135f73bd9f3d7e602d70a485110241ef0f7ee605ca7341","observation_id":"1970c52d-02db-4ad8-abf7-549d375330ab","resolution":{"observed_at":"2026-08-15T23:17:54.775167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.235321Z","title":"Cmu wilderness multilingual speech dataset,","venue":null,"work_id":"5b8a7a31-26fb-499d-8f50-3767580d5af0","year":2019},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.780086Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:aec31b8393dbc92a9f7518eaf9798f50c23a0ffab03523ab6fe701ea00f28944","observation_id":"bf6b5d5b-4d10-46c2-af9a-2efd7e394ffa","resolution":{"observed_at":"2026-08-15T23:17:55.240176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.220254Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":"fca82b84-af56-4470-a0f2-862f76a130ef","year":2024},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.786384Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:5bf65eec3f53e2c1131e66c74ff0ac7c4520e0271353c2fd61ee03de023cb8db","observation_id":"27164b1a-e5bd-423b-9acc-2107e568e4d9","resolution":{"observed_at":"2026-08-15T23:17:55.224591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.205900Z","title":"Experiments on speech synthesis for teochew, can taiwanese help?,","venue":null,"work_id":"b81846fb-16e0-46f7-b08d-b05e5624066f","year":2024},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.792634Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:ca2700ba8073061c2cb9551ad095af964a5e6c29fcd3ede7a211d7c2030f372b","observation_id":"26ebfd01-f80c-4bb7-a0d0-596ae32d5516","resolution":{"observed_at":"2026-08-15T23:17:55.210405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:54.797759Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.797759Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:0571a93d93169efe76d3ee33dcafad6e646f84980a8395c16def006c62c9e140","observation_id":"d57dc0b9-6310-4325-b80a-c679a42524c7","resolution":{"observed_at":"2026-08-15T23:17:54.797759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:54.802856Z","title":"Hubert: Self- supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.802856Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:d2eaeb35dec0dcbe52060bb1d2a69a83748d41d04944772f8aee4e759d4a7324","observation_id":"52eda01c-a102-4c54-829b-22cfc640800b","resolution":{"observed_at":"2026-08-15T23:17:54.802856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:54.807671Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.807671Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:8e437a43cdbc8b5ac230d2623d05b3b1c7df614f45a076ba7dd2e32fa488664e","observation_id":"66fbd766-3d6d-4ae5-86ca-c0cb870d2574","resolution":{"observed_at":"2026-08-15T23:17:54.807671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17020","last_updated":"2024-06-04T14:10:41Z","snapshot_observed_at":"2026-08-16T14:56:37.001061Z","submitted_at":"2023-09-29T07:09:23Z","title":"Low-Resource Self-Supervised Learning with SSL-Enhanced TTS","version":2},"cited_work":{"arxiv_id":"2309.17020","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.17020","snapshot_observed_at":"2026-08-15T23:17:54.938243Z","title":"Low-Resource Self-Supervised Learning with SSL-Enhanced TTS","venue":"eess.AS","work_id":"8f0fd076-6f78-45a8-bf49-f54d8356594c","year":2023},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.812211Z"},"links":{"cited_paper":"/paper/2309.17020","citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:3f422aaca413f77291c8a5818ebb48d4e6a882086439cb039a3c2938065aec72","observation_id":"7c668f53-36a3-4271-b271-ef9cfe4e33cd","resolution":{"observed_at":"2026-08-15T23:17:54.944368Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.163089Z","title":"Improving automatic speech recog- nition performance for low-resource languages with self-supervised models,","venue":null,"work_id":"99820c2f-0246-400e-b317-e2388a8879bc","year":2022},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.817181Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:03a16a48f2a371459a5b67f80580736023817e36f8e9b57d020a8ec6e966d585","observation_id":"110d9f52-3a06-4157-ae2e-23b637c2c8a4","resolution":{"observed_at":"2026-08-15T23:17:55.168230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.151118Z","title":"Lrspeech: Extremely low-resource speech synthesis and recognition,","venue":null,"work_id":"6fda4113-de22-47de-80bb-cfcf511a9540","year":2020},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.821292Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:1a261aa057d3a076344815bd99706e09453df412750b9de2aa8a7a5b7e023c3a","observation_id":"ba0c356c-d37c-4ecb-bb76-51d487b49d23","resolution":{"observed_at":"2026-08-15T23:17:55.155258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.139605Z","title":"Autoprep: An automatic preprocessing framework for in-the-wild speech data,","venue":null,"work_id":"8af60e80-07b8-497d-8549-6214ac7a870b","year":2024},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.825342Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:4de770160c63575e56d49003545cc15d20728ba023183baf6e028fa102c5ade1","observation_id":"1cddaec1-250d-406d-b315-89bd923b0947","resolution":{"observed_at":"2026-08-15T23:17:55.143430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.127278Z","title":"Cstr vctk corpus: English multi-speaker corpus for cstr voice cloning toolkit (version 0.92),","venue":null,"work_id":"95c01bf5-acb1-409e-8836-9b52fa9c0925","year":2019},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.830556Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:f9c7108336b1e1bf9e4c3b89c4d67318d8934aecf806518e23f1587f7d5f8cad","observation_id":"1d4721a1-6875-4810-84d8-762a6b8947fb","resolution":{"observed_at":"2026-08-15T23:17:55.131688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.112884Z","title":"AISHELL-3: A Multi-Speaker Mandarin TTS Corpus,","venue":null,"work_id":"5234b2ae-2e8a-4ef4-82e8-a48de3814997","year":2021},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.837119Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:f5acf5b87bf7ad190a38ba595cd544f9a20c29474ee096c92b2220089da60e01","observation_id":"f3b47410-c53d-45d6-b32e-434c150de927","resolution":{"observed_at":"2026-08-15T23:17:55.118196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.097547Z","title":"Libritts: A corpus derived from librispeech for text-to-speech,","venue":null,"work_id":"0dc5c536-a134-4dc9-99a9-c72070d05aaf","year":2019},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.841056Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:3b27cb6594c18dd2ee4f0bd6ddb801ce2972c43909141ef77b16ce85e0b7f085","observation_id":"49ff6398-293e-4466-ac2b-7f553dd9d45b","resolution":{"observed_at":"2026-08-15T23:17:55.101730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.080890Z","title":"Gigaspeech: An evolving, multi-domain asr corpus with 10,000 hours of transcribed audio,","venue":null,"work_id":"92e20551-7549-40ef-a643-cea0071dc71c","year":2021},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.845041Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:ecf0a9c0d906977c252468f08c673dc8c4438f43cd81f5cb344e98762cc9134c","observation_id":"fd6b2216-eb48-4b38-bab8-9ee0fa48e66e","resolution":{"observed_at":"2026-08-15T23:17:55.086136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05763","last_updated":"2024-06-19T04:52:56Z","snapshot_observed_at":"2026-08-16T13:44:47.492627Z","submitted_at":"2024-06-09T12:32:42Z","title":"WenetSpeech4TTS: A 12,800-hour Mandarin TTS Corpus for Large Speech Generation Model Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05763","snapshot_observed_at":"2026-08-15T23:17:54.850247Z","title":"Wenetspeech4tts: A 12,800-hour mandarin tts corpus for large speech generation model benchmark,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.850247Z"},"links":{"cited_paper":"/paper/2406.05763","citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:70b1c3d5836aa9101ecafa6ea791637f57d14184cf31d397128e1dc9f66f4336","observation_id":"9111284c-c78f-44d8-bf6f-df645d1d2a47","resolution":{"observed_at":"2026-08-15T23:17:54.850247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.068481Z","title":"Dnsmos p. 835: A non-intrusive perceptual objective speech quality metric to evaluate noise suppressors,","venue":null,"work_id":"4a6ac9b8-abea-45eb-9f1b-ba77ca144213","year":2022},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.854570Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:1caa51f08939e3230efedb747f9ecd8853e44e2ac9daf5f727808ee2792caf6d","observation_id":"3eff2833-6a50-46d9-8669-9fcd4c4bb481","resolution":{"observed_at":"2026-08-15T23:17:55.072356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.054412Z","title":"Natural tts synthesis by conditioning wavenet on mel spectrogram predictions,","venue":null,"work_id":"9fcddd80-810a-42f3-910a-faef4efd28de","year":2018},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.858921Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:6a6e87b83f12702f6b933104b10a71bd9008b916f6558a0441f1ef74519bbb9d","observation_id":"438585af-4b8b-4481-87d2-c974c242c67e","resolution":{"observed_at":"2026-08-15T23:17:55.059595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.042361Z","title":"Fastspeech 2: Fast and high-quality end-to-end text to speech,","venue":null,"work_id":"1180f0be-a9f3-400e-a9d0-9b6cee844cac","year":2020},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.863685Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:22d04d3c3a00455f858317ed2bcbe5d6635076d48cac8a59183163ad0c039349","observation_id":"2f6f1a83-2544-435e-bfe7-da3c7b64f16e","resolution":{"observed_at":"2026-08-15T23:17:55.046348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:17:55.030134Z","title":"Hifi-gan: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":"e007d360-1a97-4aad-86f8-ddbe1674aed5","year":2020},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.869295Z"},"links":{"citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:58c7f5fe8778f052ee4bd1d8d46679738b60f9039150a50d6871014157a0dcbb","observation_id":"22fb8816-16fc-4cc7-943a-19657ee0c397","resolution":{"observed_at":"2026-08-15T23:17:55.034255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.05171","last_updated":"2022-06-14T14:16:52Z","snapshot_observed_at":"2026-08-16T19:14:24.432687Z","submitted_at":"2020-10-11T05:36:54Z","title":"fairseq S2T: Fast Speech-to-Text Modeling with fairseq","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.05171","snapshot_observed_at":"2026-08-15T23:17:54.873072Z","title":"Fairseq s2t: Fast speech-to-text modeling with fairseq,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:17:54.873072Z"},"links":{"cited_paper":"/paper/2010.05171","citing_paper":"/paper/2505.05056"},"observation_digest":"sha256:85c3958c266e253f0e26e1a7ffc3b8b6f346f7847449e5f3be660608688e44a7","observation_id":"e14259d4-9735-4a60-ba17-4cd740434d22","resolution":{"observed_at":"2026-08-15T23:17:54.873072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.05056","last_updated":"2025-05-08T08:47:11Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T23:12:06.197588Z","submitted_at":"2025-05-08T08:47:11Z","title":"Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":17},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2505.05056."}