{"as_of":"2026-08-20T07:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0ea485cffefcf072601fb67f894721e944aa556c38f7481a1f2a9244146ea48e","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T00:03:20.091355Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T00:03:20.091355Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T16:59:58.650761Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"cited_work":{"arxiv_id":"2606.24714","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.24714","snapshot_observed_at":"2026-07-04T16:59:58.650761Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","venue":"cs.CL","work_id":"c24cc9ed-f455-4830-9796-d20613d30f8d","year":2026},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"cited_paper":"/paper/2606.24714","citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:1754bf3ddf0968c8a3a0f0a6f5a7fd25f7db2c55081f4f3be54c86c548e62e16","observation_id":"99cb0955-3f5c-471d-844e-c14ee2dd276c","resolution":{"observed_at":"2026-07-04T16:59:58.652340Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.24714/citation-record","integrity":"/paper/2606.24714/integrity","json":"/paper/2606.24714/citation-record.json","paper":"/paper/2606.24714"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":null,"venue":null,"work_id":null,"year":2028},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:46c9342073d4cbfd9b3789fe34a36f8f234396d75a8b59abb0e37809e59ff089","observation_id":"0a438115-ed65-4330-8512-0b17ebcd80a7","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"cited_work":{"arxiv_id":"2606.24714","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.24714","snapshot_observed_at":"2026-07-04T16:59:58.650761Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","venue":"cs.CL","work_id":"c24cc9ed-f455-4830-9796-d20613d30f8d","year":2026},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"cited_paper":"/paper/2606.24714","citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:1754bf3ddf0968c8a3a0f0a6f5a7fd25f7db2c55081f4f3be54c86c548e62e16","observation_id":"99cb0955-3f5c-471d-844e-c14ee2dd276c","resolution":{"observed_at":"2026-07-04T16:59:58.652340Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"Three-ASR Protocol The v0.1 public leaderboard uses three heterogeneous ASR routes: MiMo API ASR, SenseVoiceSmall, and Paraformer-zh","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:9abbc4aed6f1dfbb01be676ff33e2cdf58d3478afba1404f4428135ccb6cfb93","observation_id":"f46fe41f-f029-49cc-865b-05e4d0f4686c","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"Each system generates one audio file per public test record, using one fixed voice and provider- level default normalization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:bc87efb6f6b668cff718c6fdabb73dd69b172948af5f7e4fb31f9e9fb97d5ce5","observation_id":"359eb6e6-ec3c-46c3-b62b-4f3b9d65e772","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"The release includes data, schema, scoring code, fixed ASR transcripts, leaderboard files, the dashboard, audit, and checksums","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:b31502c7646a4fa022b653ba7389c2876d08e5320bc19aaa72a89215457588c9","observation_id":"73896c9b-868e-454c-bd2c-a32981471ed3","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"ASR text can hide pronunciation errors, especially same- character tones, and unknown rates vary by category","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:9b2b10e7c852e153a1a5f2fb2dfc431a6799a7e5105acbb778f10909b86f012c","observation_id":"f0eccebd-bfc8-4ce3-9042-fb408ca6fd78","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:66be3d6493ec63e10ead5b4620ebd909691819a479c95e84986fde9ef3d8adef","observation_id":"4bf76724-125d-4d72-ae0e-902a22cfd8b3","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"No human-subject audio, personal speech data, or pri- vate user data is released","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:0b9e4a2fbceaad75ccbd7221308b595fea1e4dd52ca63a26511f6bd52c02daa9","observation_id":"42bf3908-eed7-43f4-a47a-b15060deeea3","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"ITU-T Recom- mendation P .800: Methods for subjective determination of transmission quality,","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:4cb820238cdd429e241b9e14365c3beec7544a45293b1a149d9b07a2754c62eb","observation_id":"4a20bf64-f6b9-4243-81fe-67e55f044e5b","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"MOSNet: Deep learning based objective assessment for voice conver- sion,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:3549459e30b94c6cf7bd9cff94432ecf60a12720c01c1b23e86da63836fbff4b","observation_id":"4d3d56f3-8afe-4dca-8578-05832720e0e0","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:cc03ac0149592a2bb49abd0e2a816d4a2c01338052ccc8ea0994f92b91a50d6e","observation_id":"331bad20-9dbf-42cf-8d97-f70df929418f","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"Normalization of non-standard words,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:7eef5cbf5a764c173d13ef09244a35b25a4b4794327afd50e0540a65401a7b40","observation_id":"69784e4a-8113-4dca-b473-470bffdda974","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"The Kestrel TTS text nor- malization system,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:94d05928e0d3719cb100b4ff3d1c0a93e7db494cab361d12133ac06c0fd5befb","observation_id":"4079672e-2f52-4dec-a71f-f3db1ff59388","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.00068","last_updated":"2017-01-24T19:51:12Z","snapshot_observed_at":"2026-08-14T21:32:34.418760Z","submitted_at":"2016-10-31T22:42:02Z","title":"RNN Approaches to Text Normalization: A Challenge","version":2},"cited_work":{"arxiv_id":"1611.00068","doi":null,"metadata_source":"pith","pith_arxiv_id":"1611.00068","snapshot_observed_at":"2026-07-04T16:59:58.647155Z","title":"RNN Approaches to Text Normalization: A Challenge","venue":"cs.CL","work_id":"498d8a5a-a311-4da7-9298-b4675401bf2a","year":2016},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"cited_paper":"/paper/1611.00068","citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:b85129432f5ef94df55e3ff5e5f2537ea04488cdbe0c10c93d9dc7ade97a0487","observation_id":"4d614d3f-f88b-42c4-92cc-007a26952b66","resolution":{"observed_at":"2026-07-04T16:59:58.649101Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"A three-stage text normalization strategy for Mandarin text-to- speech systems,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:0564c7f36ed3f4e96206e6fda16f5a169c4fcf7ab74b53359f457b8df2c64e1d","observation_id":"5d23a704-a89f-4ddf-b628-d3a7415e2b2f","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"An end-to-end Chinese text normalization model based on rule-guided flat-lattice trans- former,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:60cd2226133474f0cb312604f523f5a89c3c0abf73cdfa81b2cc1ce9caf2860c","observation_id":"7c80aaad-d980-49cb-8851-dadf3a0101e7","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"g2pM: A neural grapheme- to-phoneme conversion package for Mandarin Chinese based on a new open benchmark dataset,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:aa40fae0e59126e46764ca70e541425d16a0dd9590843e20fd329e62855c9f66","observation_id":"af69f936-bf03-4304-a8e3-501f15c91616","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"CVTE-Poly: A new bench- mark for Chinese polyphone disambiguation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:ec164c737fab7d2f3ef6d904451f02c1560a5db44b7f38557597389a8d83cfaf","observation_id":"26233f28-bbb8-4f7e-8e9d-2ce44e898c0e","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"SenseVoice: Multilingual speech understanding model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:f5653696f4169726399ba191c65035d97580e7a890e2d93876498f12a0c2fda8","observation_id":"eeadcb20-ad82-45c2-a816-9fafd4c0bb25","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T00:03:20.091355Z","title":"FunASR: A fundamental end-to- end speech recognition toolkit,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T00:03:20.091355Z"},"links":{"citing_paper":"/paper/2606.24714"},"observation_digest":"sha256:6585720776c33b75f33d133cdc3b8fc1be4d1418375ca3e7969ab9fcd4c56491","observation_id":"d8f6e29a-c217-4962-a0f2-af31192b9b06","resolution":{"observed_at":"2026-06-26T00:03:20.091355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.24714","last_updated":"2026-06-23T15:34:58Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T16:49:32.959249Z","submitted_at":"2026-06-23T15:34:58Z","title":"CN-NewsTTS Bench: a target-level automatic benchmark for raw-input Chinese news TTS pronunciation"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 1 inbound Pith citation observation for arXiv:2606.24714."}