{"as_of":"2026-08-07T06:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:266e96957e7c191bd100bd6dacd7756d891e9f82672c4bb2d7975f87bc30f566","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:36:02.710119Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:37:10.571368Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-04T10:37:10.571368Z","title":"Wenetspeech-yue: A large-scale cantonese speech corpus with multi-dimensional annotation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.09344","last_updated":"2026-07-18T03:39:01Z","snapshot_observed_at":"2026-08-07T03:16:22.896156Z","submitted_at":"2025-10-10T12:56:19Z","title":"WildElder: A Chinese Elderly Speech Dataset from the Wild with Fine-Grained Manual Annotations","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T10:37:10.571368Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2510.09344"},"observation_digest":"sha256:97b3f8b6298b5b92d873eb3a1261aedac851b0640494aeac17ea5c6a02662f38","observation_id":"9ba67aae-634d-4fcb-81eb-ffed2b7eae79","resolution":{"observed_at":"2026-08-04T10:37:10.571368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":"2509.03959","doi":"10.48550/arxiv.2509.03959","metadata_source":"pith","pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech-yue: A large- scale cantonese speech corpus with multi-dimensional annota- tion","venue":"cs.SD","work_id":"6f8180cf-776c-4d58-877c-01e3584ecdc2","year":2025},"citing_paper":{"arxiv_id":"2604.00688","last_updated":"2026-04-21T12:14:57Z","snapshot_observed_at":"2026-07-06T22:51:26.754746Z","submitted_at":"2026-04-01T09:45:51Z","title":"OmniVoice: Towards Omnilingual Zero-Shot Text-to-Speech with Diffusion Language Models","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-13T23:00:18.720371Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2604.00688"},"observation_digest":"sha256:76b8688ff434385ee7735dccbc7891e424e2e8e89490e91f6cde0830637c2caa","observation_id":"c4af5a92-dd04-4cf6-ba07-2543dd795e3b","resolution":{"observed_at":"2026-05-13T23:03:24.701893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":"2509.03959","doi":"10.48550/arxiv.2509.03959","metadata_source":"pith","pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech-yue: A large- scale cantonese speech corpus with multi-dimensional annota- tion","venue":"cs.SD","work_id":"6f8180cf-776c-4d58-877c-01e3584ecdc2","year":2025},"citing_paper":{"arxiv_id":"2604.18105","last_updated":"2026-06-18T09:00:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-20T11:21:06Z","title":"NIM4-ASR: Towards Efficient, Robust, and Customizable Real-Time LLM-Based ASR","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T03:48:14.211240Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2604.18105"},"observation_digest":"sha256:3e790739cedcfaf2f0e84caf0fa89b1f248775b1a57d778db8f84f551c008b1a","observation_id":"a0ca6f0e-79c5-4fbc-8cae-a9e3e854ad0a","resolution":{"observed_at":"2026-05-11T12:21:05.867703Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":"2509.03959","doi":"10.48550/arxiv.2509.03959","metadata_source":"pith","pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech-yue: A large- scale cantonese speech corpus with multi-dimensional annota- tion","venue":"cs.SD","work_id":"6f8180cf-776c-4d58-877c-01e3584ecdc2","year":2025},"citing_paper":{"arxiv_id":"2604.18105","last_updated":"2026-06-18T09:00:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-20T11:21:06Z","title":"NIM4-ASR: Towards Efficient, Robust, and Customizable Real-Time LLM-Based ASR","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-05T13:15:50.794969Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2604.18105"},"observation_digest":"sha256:c9a5687330d34d693a8d9462d4042a619eaf45e0d733cc70a3901446aed5d2a8","observation_id":"4f8c7203-3f75-4e3c-b49e-f023ca52de37","resolution":{"observed_at":"2026-07-05T13:21:06.294936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":"2509.03959","doi":"10.48550/arxiv.2509.03959","metadata_source":"pith","pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech-yue: A large- scale cantonese speech corpus with multi-dimensional annota- tion","venue":"cs.SD","work_id":"6f8180cf-776c-4d58-877c-01e3584ecdc2","year":2025},"citing_paper":{"arxiv_id":"2605.17846","last_updated":"2026-05-18T04:40:31Z","snapshot_observed_at":"2026-08-01T14:30:51.690088Z","submitted_at":"2026-05-18T04:40:31Z","title":"UrduSpeech: A 156-Hour Urdu Speech Corpus with 12-Dimension Paralinguistic Annotations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T01:15:49.570743Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2605.17846"},"observation_digest":"sha256:97847d664064be568e85c39defe3ccfe548aa1f909e10949b29b0b9d22552528","observation_id":"45edd031-52a6-4378-a1fe-338c0fd8fbe2","resolution":{"observed_at":"2026-05-20T01:17:54.801533Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":"2509.03959","doi":"10.48550/arxiv.2509.03959","metadata_source":"pith","pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech-yue: A large- scale cantonese speech corpus with multi-dimensional annota- tion","venue":"cs.SD","work_id":"6f8180cf-776c-4d58-877c-01e3584ecdc2","year":2025},"citing_paper":{"arxiv_id":"2606.01016","last_updated":"2026-05-31T05:13:32Z","snapshot_observed_at":"2026-07-06T23:41:39.172310Z","submitted_at":"2026-05-31T05:13:32Z","title":"PolySpeech-100: A Large-Scale Benchmark for Speech Understanding Across 100+ Languages and Dialects","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T17:44:07.669223Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2606.01016"},"observation_digest":"sha256:def50835fd23abe553f5cbf71d59c143ec7ce48a83dd314ba5034b9ca890f869","observation_id":"79616013-f493-4f5f-8c54-0a3465b9ad56","resolution":{"observed_at":"2026-06-28T17:52:27.075003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.03959/citation-record","integrity":"/paper/2509.03959/integrity","json":"/paper/2509.03959/citation-record.json","paper":"/paper/2509.03959"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.04051","last_updated":"2024-07-11T02:08:35Z","snapshot_observed_at":"2026-08-06T00:42:36.144034Z","submitted_at":"2024-07-04T16:49:02Z","title":"FunAudioLLM: Voice Understanding and Generation Foundation Models for Natural Interaction Between Humans and LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04051","snapshot_observed_at":"2026-08-05T10:36:00.053975Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.053975Z"},"links":{"cited_paper":"/paper/2407.04051","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:8c92c77f6776452a7955d81a81b6a61f49f0364edb3dc1e7189b0f2ae5e5cba1","observation_id":"e64faf6a-3260-42bb-800f-092f37e7ab77","resolution":{"observed_at":"2026-08-05T10:36:00.053975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.208112Z","title":"Ardila, M","venue":null,"work_id":"faa068c6-827c-4a8d-9400-bd47bcae4faa","year":2020},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.123173Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:6e775e581b7e5c44956a1b0d8057252016f8a18e518f9730bb27b0e8c872e438","observation_id":"1f779da0-1efd-4e96-bbfc-0ffa72527da9","resolution":{"observed_at":"2026-08-05T10:36:04.211255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.199315Z","title":null,"venue":null,"work_id":"4073cdca-afe4-4f06-bb09-2e929dcc9865","year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.185963Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:a5ca82173e418be43dfe483a4f7740ee12352e89c8042887b39350fa2ce52128","observation_id":"170f9447-cd11-4ef4-afe6-8fd50e522312","resolution":{"observed_at":"2026-08-05T10:36:04.202194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.190452Z","title":null,"venue":null,"work_id":"6150194c-20a9-4c97-ab3a-db1bc2daa974","year":1983},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.262770Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:252adbc76e9f4ed9ac1dfedbbecf4c7ff3f58b45e1d02ad2307eef75ec3cbcd7","observation_id":"1a5a6eca-7097-409a-8264-cb8e5e17e743","resolution":{"observed_at":"2026-08-05T10:36:04.193370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-981-96-1045-7_15","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:02.810767Z","title":null,"venue":null,"work_id":"11825c48-249e-46b8-b941-3aea6f713972","year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.366707Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:044177bf1d7c6384913eb601ab026e78b3649ce9183da1d48f54c09b286a2c85","observation_id":"9a645bff-d2ff-48bd-9b3c-87c9061ffe21","resolution":{"observed_at":"2026-08-05T10:36:02.848327Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10117","last_updated":"2024-12-25T11:54:03Z","snapshot_observed_at":"2026-08-07T06:02:40.568271Z","submitted_at":"2024-12-13T12:59:39Z","title":"CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10117","snapshot_observed_at":"2026-08-05T10:36:00.479568Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.479568Z"},"links":{"cited_paper":"/paper/2412.10117","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:6d3004e22471e199722d688f3cdc7dd4787fb6384b694807965d316b07edc652","observation_id":"3fc3dacd-8d87-4848-bc83-2afd20cc14ff","resolution":{"observed_at":"2026-08-05T10:36:00.479568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14648","last_updated":"2025-05-20T17:36:41Z","snapshot_observed_at":"2026-08-02T18:05:39.690459Z","submitted_at":"2025-05-20T17:36:41Z","title":"Vox-Profile: A Speech Foundation Model Benchmark for Characterizing Diverse Speaker and Speech Traits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14648","snapshot_observed_at":"2026-08-05T10:36:00.618723Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.618723Z"},"links":{"cited_paper":"/paper/2505.14648","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:cf18f777360354f1e7b593b4e5d3eebf83966530bed433eb11b56767ecf219ed","observation_id":"de84995d-ecf2-4d19-883a-001534d188fc","resolution":{"observed_at":"2026-08-05T10:36:00.618723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.179360Z","title":null,"venue":null,"work_id":"4f825602-c8a5-41cc-8212-c6a841c9f0bc","year":1997},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.731596Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:bc372f2851b9997dac62bb8c05f4dd4667e329593c8c329830d4465207c88b98","observation_id":"29b95a84-a35a-4d78-8bd8-7082ae4d43d9","resolution":{"observed_at":"2026-08-05T10:36:04.182743Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.170292Z","title":null,"venue":null,"work_id":"be1c3239-a999-45de-9a58-70cd66cf5a83","year":2063},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.846894Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:40e1595e168172cabfb39a1dbe617648e6a6a788d7155f67ea897c796683ca6c","observation_id":"1af7e0cc-f4c3-48e8-a17f-01819514fb2d","resolution":{"observed_at":"2026-08-05T10:36:04.173308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:00.973650Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.973650Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:f4e2694b87bc9df1bb3e33e5e284a4638611f271f66bbc91c9de8608686238e8","observation_id":"361ce81d-08ef-4472-b836-c6a8498e0a07","resolution":{"observed_at":"2026-08-05T10:36:00.973650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11946","last_updated":"2025-02-18T07:29:10Z","snapshot_observed_at":"2026-08-01T18:52:39.594289Z","submitted_at":"2025-02-17T15:58:56Z","title":"Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11946","snapshot_observed_at":"2026-08-05T10:36:01.031769Z","title":"Huang, B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.031769Z"},"links":{"cited_paper":"/paper/2502.11946","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:5402cc6d94106ea25639d0e36092cb707ed829bde57e5a2d3a8a8705d8f6d37f","observation_id":"4014b2da-1dc8-4d32-9b6b-a15ffbe387d4","resolution":{"observed_at":"2026-08-05T10:36:01.031769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18425","last_updated":"2025-04-25T15:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-25T15:31:46Z","title":"Kimi-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18425","snapshot_observed_at":"2026-08-05T10:36:01.100658Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.100658Z"},"links":{"cited_paper":"/paper/2504.18425","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:5cfe4b7549a94ab7ebe5e7ceb2734ca898f3b0db4b0d75d733cf796646ba2785","observation_id":"149f51c7-bb9c-4bfe-8304-e24fd130cfcd","resolution":{"observed_at":"2026-08-05T10:36:01.100658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.161051Z","title":"Lavechin, M","venue":null,"work_id":"19ff214b-6883-4e39-9927-42a35e0c6e95","year":2023},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.156803Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:ecc5b8af720a0443bc7b4c75ac6a81ebce1037092e989fccd17f8548353adfee","observation_id":"dfa10953-3f1b-4e3b-8b3f-e9c30bfd6e5f","resolution":{"observed_at":"2026-08-05T10:36:04.163801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22069","last_updated":"2025-05-28T07:51:21Z","snapshot_observed_at":"2026-07-06T21:31:59.333003Z","submitted_at":"2025-05-28T07:51:21Z","title":"Delayed-KD: Delayed Knowledge Distillation based CTC for Low-Latency Streaming ASR","version":1},"cited_work":{"arxiv_id":"2505.22069","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.22069","snapshot_observed_at":"2026-08-05T10:36:03.025168Z","title":"Delayed-KD: Delayed Knowledge Distillation based CTC for Low-Latency Streaming ASR","venue":"cs.SD","work_id":"8fb6df9e-850c-498b-956a-fc01cea5a46d","year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.258766Z"},"links":{"cited_paper":"/paper/2505.22069","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:e53c370aef525acead2d804a19791408e6c00a326cbfcc75ed825ff937c37714","observation_id":"0ebebc46-3bd5-4496-af2c-9b869013a41e","resolution":{"observed_at":"2026-08-05T10:36:03.088081Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.151556Z","title":null,"venue":null,"work_id":"9b559a51-70cc-49bb-a6af-13c06456a0fa","year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.354703Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:baa66b560389e302390fb3ad847b3f96758c2b3d42f2ef630d88039ca9330276","observation_id":"0495cfab-1ef1-4a3b-93ff-506719c2b846","resolution":{"observed_at":"2026-08-05T10:36:04.154539Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20212","last_updated":"2025-03-26T04:14:03Z","snapshot_observed_at":"2026-07-06T20:58:46.814850Z","submitted_at":"2025-03-26T04:14:03Z","title":"Dolphin: A Large-Scale Automatic Speech Recognition Model for Eastern Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20212","snapshot_observed_at":"2026-08-05T10:36:01.410147Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.410147Z"},"links":{"cited_paper":"/paper/2503.20212","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:b9974d468ffc6c89f6000bdd8599f00192e8c02153df6ef0aea60fa80e0a2a6d","observation_id":"c0172191-7c34-4129-b20a-b21761b78136","resolution":{"observed_at":"2026-08-05T10:36:01.410147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.142224Z","title":"Panayotov, G","venue":null,"work_id":"367b1e51-65a0-4a67-b6ea-3f416111e7ac","year":2015},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.497537Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:f037ddaf1c66ffe9d1decd4d2a678b1961361cd4f91074ee36e8939f07275e11","observation_id":"6bc0e45a-c203-4f08-a5e4-04ebcf8eae7d","resolution":{"observed_at":"2026-08-05T10:36:04.145236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.131735Z","title":"Radford, J","venue":null,"work_id":"35b6c285-3446-4971-8f12-64147e5720ac","year":2023},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.611753Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:279f9400857113fdd90ab64bd3db6d8bd46c77e91bc3f3cb2e25d09b66df678c","observation_id":"c604c326-316d-47da-9d7e-040ede9a5f35","resolution":{"observed_at":"2026-08-05T10:36:04.135310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.094772Z","title":null,"venue":null,"work_id":"1f723bd8-2d52-4b85-92e5-28810a494753","year":2022},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.663015Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:070994943a163ad842d03fc2762e0a0d2dd6c1d8cc3e3b19fff2fe5897e270ba","observation_id":"07516982-94f2-44aa-99cf-1a4d03d8025f","resolution":{"observed_at":"2026-08-05T10:36:04.124077Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22063","last_updated":"2025-05-28T07:39:25Z","snapshot_observed_at":"2026-08-02T01:39:18.965075Z","submitted_at":"2025-05-28T07:39:25Z","title":"Weakly Supervised Data Refinement and Flexible Sequence Compression for Efficient Thai LLM-based ASR","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22063","snapshot_observed_at":"2026-08-05T10:36:01.741876Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.741876Z"},"links":{"cited_paper":"/paper/2505.22063","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:d025851dfd9947b2582c7989760c316aa0f015218680626625825fc7b6fed483","observation_id":"d99f7832-8f17-493a-bcf7-a19de8ebd20f","resolution":{"observed_at":"2026-08-05T10:36:01.741876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-02T20:06:32.256011Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-05T10:36:01.815189Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.815189Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:1a4f923e804d4ae0aefec7582f5480d0c1a470f778313cb7bd936b96ac4f2dc8","observation_id":"896d6676-1b94-453e-be33-5b385a527b2b","resolution":{"observed_at":"2026-08-05T10:36:01.815189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:03.900651Z","title":null,"venue":null,"work_id":"ebd582d1-6c34-4dd6-b6c1-914b49808723","year":2023},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.920238Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:aa5b31be61001c67972688ff5d7e350a5745bc1d889d2449cb5be7e016f01c13","observation_id":"f5f6ee85-81fc-4cd6-abf0-df7e26e3bc27","resolution":{"observed_at":"2026-08-05T10:36:04.030952Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.05642","last_updated":"2021-12-30T00:30:30Z","snapshot_observed_at":"2026-08-04T06:59:25.324887Z","submitted_at":"2021-06-10T10:25:15Z","title":"U2++: Unified Two-pass Bidirectional End-to-end Model for Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.05642","snapshot_observed_at":"2026-08-05T10:36:02.013721Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.013721Z"},"links":{"cited_paper":"/paper/2106.05642","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:ab224d79cf3973c0c52a4a58bcedd019b1659b72a76b8a0531bd9956e20cd45c","observation_id":"53db4fbf-e2ae-44f6-96af-3f70de58c309","resolution":{"observed_at":"2026-08-05T10:36:02.013721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:03.743894Z","title":"Xiang, H","venue":null,"work_id":"97af828c-147a-48c1-81ab-36eb87b0ba04","year":2022},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.113083Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:e73a3fe041b7a2793549e238755e2bf2e6b6c9875c6ceda6eb8ab591a43bdbb2","observation_id":"d74e26d0-69bb-486b-8b0c-2935a05508b2","resolution":{"observed_at":"2026-08-05T10:36:03.850230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20215","last_updated":"2025-03-26T04:17:55Z","snapshot_observed_at":"2026-08-06T08:46:20.194739Z","submitted_at":"2025-03-26T04:17:55Z","title":"Qwen2.5-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20215","snapshot_observed_at":"2026-08-05T10:36:02.202465Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.202465Z"},"links":{"cited_paper":"/paper/2503.20215","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:5c7084775cd29e21517295d7b620c905cd90c153c269f83071aaedec3e94bac3","observation_id":"9ba16420-d636-4b39-af6f-fe1451789d68","resolution":{"observed_at":"2026-08-05T10:36:02.202465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-05T01:17:13.454546Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T10:36:02.306865Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.306865Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:29532cb4c57760ce0328a606c0ce1da6b1ffb8ab844fa881419dc4bd42234886","observation_id":"7e8d036a-9b51-4646-ae0e-bb34e373869d","resolution":{"observed_at":"2026-08-05T10:36:02.306865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T10:36:02.388883Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.388883Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:7f73a5c242fdb4cab45ef3cff45171551fec1dd46bc4c0b4884618944e8c7e57","observation_id":"285a3276-4fba-461e-afef-30598e42de9c","resolution":{"observed_at":"2026-08-05T10:36:02.388883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11546","last_updated":"2025-05-27T04:49:35Z","snapshot_observed_at":"2026-08-04T06:10:50.996064Z","submitted_at":"2024-06-17T13:44:20Z","title":"GigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11546","snapshot_observed_at":"2026-08-05T10:36:02.509065Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.509065Z"},"links":{"cited_paper":"/paper/2406.11546","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:c92c86d002011ae446ca78f457948939e974378be2116e443bd0668f71d1d610","observation_id":"b87d2bc6-feb6-4b21-9d63-c5949de440e4","resolution":{"observed_at":"2026-08-05T10:36:02.509065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:03.579646Z","title":null,"venue":null,"work_id":"cd77bbd0-b995-4b92-a1f5-0a00ae2d43f0","year":2022},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.610950Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:6af37f505efa6ad48de245660b8d2231f77e85874f742bfea0ab6e2ee3e05e61","observation_id":"1c0dc945-e583-4d84-92f6-3c6bae4f499f","resolution":{"observed_at":"2026-08-05T10:36:03.686096Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:03.361751Z","title":"Zhang, H","venue":null,"work_id":"8e258be8-ff6a-417f-a610-5dbe6171812d","year":2022},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.710119Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:891a00a9b43ac00304834ce7eadc57543f823cda9a8b7e3fa3e0cf71cceb9385","observation_id":"e25d1e8a-b3f3-41b8-b115-2916657694d6","resolution":{"observed_at":"2026-08-05T10:36:03.497785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":2,"verified_fuzzy":6},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 6 inbound Pith citation observations for arXiv:2509.03959."}