{"as_of":"2026-08-09T05:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dbab7fa27c9b203e1a46fafc121aad06cc8d3076534d09a760c8bf07a4856a64","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:40:56.904244Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:40:54.228445Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T10:40:57.090496Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"cited_work":{"arxiv_id":"2506.04711","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04711","snapshot_observed_at":"2026-08-07T10:40:57.090496Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","venue":"cs.SD","work_id":"97867da1-e5dd-4b61-9fd7-64b80b4eb679","year":2025},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.228445Z"},"links":{"cited_paper":"/paper/2506.04711","citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:217bbd12921c958ba747b5c2837a1b71746237b90b4744aededa273078652b0e","observation_id":"44f88352-e306-4159-8cb3-6ec920acf1ef","resolution":{"observed_at":"2026-08-07T10:40:57.136403Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04711/citation-record","integrity":"/paper/2506.04711/integrity","json":"/paper/2506.04711/citation-record.json","paper":"/paper/2506.04711"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"cited_work":{"arxiv_id":"2506.04711","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.04711","snapshot_observed_at":"2026-08-07T10:40:57.090496Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","venue":"cs.SD","work_id":"97867da1-e5dd-4b61-9fd7-64b80b4eb679","year":2025},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.228445Z"},"links":{"cited_paper":"/paper/2506.04711","citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:217bbd12921c958ba747b5c2837a1b71746237b90b4744aededa273078652b0e","observation_id":"44f88352-e306-4159-8cb3-6ec920acf1ef","resolution":{"observed_at":"2026-08-07T10:40:57.136403Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:41:02.208465Z","title":"These prior works share a similar motivation with ours that phoneme-based supervision is advantageous for multilingual acoustic representation learning","venue":null,"work_id":"78ef1b59-d6d9-4674-9579-2eff0c2d2584","year":null},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.268232Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:e3cc3b47d1bbc6b161dfb5519cc3b8c426228769ea73583f00b79339f6be89ef","observation_id":"a573a24d-fe68-4560-a6b7-481b018f1608","resolution":{"observed_at":"2026-08-07T10:41:02.272363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:41:02.088048Z","title":"Whistle Subword FT","venue":null,"work_id":"e8e1385f-aec9-43cb-9ac7-4935c0d2457c","year":null},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.322423Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:6286c65469fafdc05d4e1a147104c52c55f722fa6e0dfd0187601f9d813cb6b9","observation_id":"0aa21601-ec94-4d04-b686-4cdeb58a11a5","resolution":{"observed_at":"2026-08-07T10:41:02.130411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:41:01.945340Z","title":"Dataset Experiments are conducted on the CommonV oice (CV) dataset [22], version 11.0 (released September 2022)","venue":null,"work_id":"6d8aed9f-b5fb-414e-b22a-8743fd4ec9ac","year":2022},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.415843Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:cdd69b9484a11a0c75032a2b90bff52f40de41df7dd1070e935e8259b70da5ad","observation_id":"fe4eae7e-b119-4f76-8dc1-2c2d98b73e36","resolution":{"observed_at":"2026-08-07T10:41:02.012520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:41:01.406290Z","title":"Results The main results are shown in Table 1","venue":null,"work_id":"44298264-f7ef-4f58-8659-5144c902c2a0","year":null},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.686658Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:fbdbfe3083f3954b82fa72a68ad7c44f29d9b9c20abe46ba22ff2d7b98f1c0f4","observation_id":"518bab98-30ee-46a9-9244-1dad95e70a8d","resolution":{"observed_at":"2026-08-07T10:41:01.497256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:41:01.630140Z","title":"Ablation results are shown in Table 3 and 4","venue":null,"work_id":"c5d80508-9df7-4746-8d2e-36e0289f383a","year":null},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.570948Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:7a16dd405f725f6bf52f37bb2345a91cf89b75c84c2a65484b7fca6f08de1df1","observation_id":"322c6be4-fd5f-4d17-9a81-7d54a565a629","resolution":{"observed_at":"2026-08-07T10:41:01.743809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:59.159925Z","title":"Whistle: Data-efficient multilingual and crosslingual speech recognition via weakly phonetic supervision,","venue":null,"work_id":"d0fa93b4-029f-4221-a9f9-b745c7796fa0","year":2025},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:55.331541Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:093089a82993445417205e7a916e3ef5f8dedb58aa7b79c9825435fe6ac48c89","observation_id":"07e99b7b-eb8c-428f-a58f-129ba069d822","resolution":{"observed_at":"2026-08-07T10:40:59.265206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:41:01.132837Z","title":null,"venue":null,"work_id":"fc43de3d-4d64-44c2-aad9-82f9cd890fee","year":null},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.753560Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:e07385f75314c9032365ad2a428b7243ce9fda3aa72215c9e00ccf0ac16288b0","observation_id":"28cf0097-5025-447d-b81f-10bc25741f0c","resolution":{"observed_at":"2026-08-07T10:41:01.251666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:41:00.841143Z","title":null,"venue":null,"work_id":"8910dd6c-82fb-42d5-9dc0-200c26744870","year":null},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.836071Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:83e55dcf6438811f0c93c47cae7d7d3a128bff543766c3d458aa880a764c9825","observation_id":"b6887d5c-f241-413d-8536-cd34708fa227","resolution":{"observed_at":"2026-08-07T10:41:00.955115Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:41:00.593296Z","title":"Univer- sal phone recognition with a multilingual allophone system,","venue":null,"work_id":"4d5d26dd-7da8-4732-87bc-e7a4250c27ad","year":2020},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.909145Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:29cda89079c3a6029cc698d5dbcded438bf842cf2f170aa41826db063c6eccd5","observation_id":"9f1fb3d9-9cbd-4cd2-b548-a98475417433","resolution":{"observed_at":"2026-08-07T10:41:00.716263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:41:00.361057Z","title":"Multilingual and crosslin- gual speech recognition using phonological-vector based phone embeddings,","venue":null,"work_id":"1c9b571b-ef1f-42a4-9dd7-473df056e15f","year":2021},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.975905Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:22090c64065fd7834ca22b7e4168bc765647d7c737613bfde7d0a08ef5305215","observation_id":"344a6636-2a92-4cee-946c-53848d45b45e","resolution":{"observed_at":"2026-08-07T10:41:00.474530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:41:00.030092Z","title":"Massively multilingual asr on 70 lan- guages: Tokenization, architecture, and generalization capabili- ties,","venue":null,"work_id":"4daa59cb-7d05-4acd-b59e-b14dfab9ca73","year":2023},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:55.034182Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:7f515900b9d23e9dd9e374d118057e18a9feabd6c925f1bd9bb3917c8c0f7f43","observation_id":"b2f38fe5-0536-447f-beda-7aaf45fbc399","resolution":{"observed_at":"2026-08-07T10:41:00.190375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:59.778579Z","title":"Simple and effective zero-shot cross-lingual phoneme recognition,","venue":null,"work_id":"4a9c16e0-b182-4e3e-abe0-0c02529e02cf","year":2022},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:55.097062Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:bbf9c1bd6a6104523dbc01a77d5ed446e440f4739f29978c3fadd79b517af9c0","observation_id":"2a843bc8-f315-4b02-aa5d-91abca8935d3","resolution":{"observed_at":"2026-08-07T10:40:59.923779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:59.535242Z","title":"Investigation into phone-based subword units for multilingual end-to-end speech recognition,","venue":null,"work_id":"609575b9-75d7-4002-8b36-450f7282cdca","year":2023},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:55.168363Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:c645dbd8228837f6dea71fe17ffcc09df76241e749b98232b05e1a3cc8e6c4a8","observation_id":"131258a3-cf27-483e-97c4-f4050961da28","resolution":{"observed_at":"2026-08-07T10:40:59.646050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:59.370474Z","title":"Allophant: Cross- lingual phoneme recognition with articulatory attributes,","venue":null,"work_id":"21ca4a8f-624f-4189-b679-d03c5701e969","year":2023},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:55.230679Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:e28fa3536bbc81ddacd041beb85db373006f37328e661e3bc70490651e10c57e","observation_id":"7d28df0a-ff17-4e0c-a7cc-617f5734b36e","resolution":{"observed_at":"2026-08-07T10:40:59.458072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04172","last_updated":"2023-09-29T07:32:03Z","snapshot_observed_at":"2026-07-06T15:51:50.675471Z","submitted_at":"2023-07-09T13:38:25Z","title":"Can Generative Large Language Models Perform ASR Error Correction?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04172","snapshot_observed_at":"2026-08-07T10:40:56.185495Z","title":"Can gener- ative large language models perform asr error correction?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.185495Z"},"links":{"cited_paper":"/paper/2307.04172","citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:997fad93b7a229b26a20b163cc0db9f960c89c9de320016278e82bccb9ca4ad1","observation_id":"637e4b82-b995-47f0-a165-7a9c85592023","resolution":{"observed_at":"2026-08-07T10:40:56.185495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:58.992938Z","title":"Low-resourced speech recognition for iu mien language via weakly-supervised phoneme-based multilingual pretraining,","venue":null,"work_id":"8d00448b-36ee-4fd0-ab49-d68a025baef1","year":2024},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:55.424494Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:a4f6054eb4d05b34b75cbdb641f21940e55e24d29be5c731f05f0f6cac54cde3","observation_id":"4f4f9b58-f4d6-4d19-87f3-eea40ecb7af5","resolution":{"observed_at":"2026-08-07T10:40:59.067545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:58.732380Z","title":"Speech recognition with weighted finite-state transducers,","venue":null,"work_id":"43348cce-b794-4736-a110-fd977ea812c5","year":2008},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:55.551029Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:792fc2ade7d39a2021743874f24701cd4acce80a21327cc78187ca9ffba8de62","observation_id":"fa43ec14-2342-4fd8-bb0e-a11a855bc363","resolution":{"observed_at":"2026-08-07T10:40:58.845811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:58.486994Z","title":"mt5: A massively multilingual pre-trained text-to-text transformer,","venue":null,"work_id":"89944888-c3cd-493d-8ef7-eaace08e8920","year":2021},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:55.644325Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:ed0b382403b179d4a494962ae8911911a0843d15f4e81eae641f03f5f50f56d0","observation_id":"0a116e0b-7395-438a-824c-3c6da9a57a0b","resolution":{"observed_at":"2026-08-07T10:40:58.602631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:41:01.821029Z","title":"Whistle Phoneme FT","venue":null,"work_id":"08796b77-0fe2-4e58-9080-caaa09c98ff6","year":null},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:54.479681Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:af000de599ce11416b568082337caff556b704aa9eb68af9b41b44c94dbe09e8","observation_id":"da6f7d64-eb3f-4b0a-a473-4d008a6af523","resolution":{"observed_at":"2026-08-07T10:41:01.876652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T10:40:55.710918Z","title":"GPT-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:55.710918Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:476b7a2cb67ee5d2083826afc963077a31e6ffb04b4e4ab09b08b8e875cf2cc3","observation_id":"ed7ab7be-32c6-4773-811c-e9790c4531f7","resolution":{"observed_at":"2026-08-07T10:40:55.710918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T10:40:55.809107Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:55.809107Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:e563a2cd2c541308fd3a42ddecd886459ae8247117dcae8646d01294967fa935","observation_id":"32a86eec-6efb-4a82-9142-89bacfc4179e","resolution":{"observed_at":"2026-08-07T10:40:55.809107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:58.277078Z","title":"TranUSR: Phoneme-to-word transcoder based unified speech representa- tion learning for cross-lingual speech recognition,","venue":null,"work_id":"0dad2075-8b34-435d-8f53-74d0c5276131","year":2023},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:55.940261Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:d2bdce0511c6d63361cbac6ad68e10edafceace54b9bfd50f46a50c8a6c98e3c","observation_id":"bb6c0b56-467c-40e5-97dc-ba5c8c034525","resolution":{"observed_at":"2026-08-07T10:40:58.374557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:58.085174Z","title":"Optimizing two-pass cross- lingual transfer learning: Phoneme recognition and phoneme to grapheme translation,","venue":null,"work_id":"dfffb0e5-cd7a-4080-9844-5b8d6829c560","year":2023},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.012216Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:2a17c9d463759df80449d8fb39ff0286805598f33edfe99d1e15c93f89e32bbb","observation_id":"8437556f-04a6-4b7a-951a-8cd73dc22870","resolution":{"observed_at":"2026-08-07T10:40:58.176816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:56.106491Z","title":"Emergent abilities of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.106491Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:d75841b0ba43fddb3a16b7376b88f79b6e93bf239e03aaea71baeff5481e4646","observation_id":"22609ee5-e927-45e6-bb4f-2b427894727c","resolution":{"observed_at":"2026-08-07T10:40:56.106491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:56.251245Z","title":"On decoder-only architecture for speech- to-text and large language model integration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.251245Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:3260a1141cb9104b4a14f2152efbcb9976c87803362d3442a79a5bb062bde08a","observation_id":"3d5d098c-19cd-4031-98bf-185fb044a788","resolution":{"observed_at":"2026-08-07T10:40:56.251245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T10:40:56.315803Z","title":"Qwen-audio: Advancing universal audio understand- ing via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.315803Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:7e65b9ef0433df2a47e64574de7554f6dca84694245fd814a8e507c54eb3958c","observation_id":"68a369d3-bafa-4f07-92a9-a10bc310ae4c","resolution":{"observed_at":"2026-08-07T10:40:56.315803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-06T09:11:01.697195Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-07T10:40:56.371803Z","title":"An embarrassingly simple approach for llm with strong asr capacity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.371803Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:47032ba4a69161c325ec96d5bbfec4cd35ad9e4ee4c965f94223d25c2cc05f85","observation_id":"6aa07d3c-ad30-467c-93df-e220f0b0dbb3","resolution":{"observed_at":"2026-08-07T10:40:56.371803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:56.453254Z","title":"Con- nectionist temporal classification: labelling unsegmented se- quence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.453254Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:e471a6b7d2f51b40c4d851699fd507b90314987717609bedd86834d92193638c","observation_id":"018f2ebd-3399-4337-ab62-73768ed782ea","resolution":{"observed_at":"2026-08-07T10:40:56.453254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:57.911290Z","title":"Retrieval- augmented generation for knowledge-intensive nlp tasks,","venue":null,"work_id":"9db76b4f-c421-44e7-9577-12a42c1f4f44","year":2020},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.536745Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:6c728d18f684bbe1b2e6fbaae311cc295cbd53c9d48d9112b0e44029a2739a4c","observation_id":"6ee8624f-cbc4-4fc5-9f1a-1ec1ff593aa4","resolution":{"observed_at":"2026-08-07T10:40:57.956952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:56.592956Z","title":"Common voice: A massively-multilingual speech corpus,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.592956Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:c532fd03bc5aff61e22b2f40bd87f511b5ba51f3d61908e6740f15cff1a12718","observation_id":"c9987079-8909-430f-92d3-d4717c05477e","resolution":{"observed_at":"2026-08-07T10:40:56.592956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:57.760126Z","title":"CAT: A CTC-CRF based ASR toolkit bridging the hybrid and the end-to-end approaches towards data efficiency and low latency,","venue":null,"work_id":"31d1e1c6-cca0-4dee-89cb-c8de658ac4ef","year":2020},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.664362Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:c8a7b9200cb3af1063f25c0b833ca164eef769a1fab5d6b745ab5c469af06154","observation_id":"877caa9b-0464-4cac-8f78-601d21f01196","resolution":{"observed_at":"2026-08-07T10:40:57.799600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:57.628007Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":"5a772d4e-1663-4bf0-bfcb-933a1d3be5e8","year":2020},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.736229Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:bde0be754741fa38fb13734c2bdcdc66b6db0a27cb8d5f1b45a0d4e424716184","observation_id":"e0974414-ba7e-4acc-9b51-fac04ce13836","resolution":{"observed_at":"2026-08-07T10:40:57.680435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:57.456595Z","title":"Grapheme-to-phoneme transduction for cross-language ASR,","venue":null,"work_id":"fc339ede-43dd-4afc-8b66-1568665ae7c1","year":2020},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.803754Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:fd20a38c288fed04463f51c898ea3f46043f54b4685f3a21c545c2be5acfc0c0","observation_id":"639b3a70-0520-4b8d-a7a7-7c68816bb3a5","resolution":{"observed_at":"2026-08-07T10:40:57.541032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:57.340620Z","title":"Attention is all you need,","venue":null,"work_id":"1ac3ed5a-ab51-40ef-9645-6d310db5329e","year":2017},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.850834Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:8ddc3ca2fe836ed0fc0eacfdf342309cf70feee88b4db4d631edfa81d8591fec","observation_id":"e294896e-caa4-4936-9d41-c45f99ac750b","resolution":{"observed_at":"2026-08-07T10:40:57.399654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:40:57.210819Z","title":"Some statistical issues in the comparison of speech recognition algorithms,","venue":null,"work_id":"ec26d876-37a1-4109-a376-c1d0a1406723","year":1989},"citing_paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:40:56.904244Z"},"links":{"citing_paper":"/paper/2506.04711"},"observation_digest":"sha256:fe0b42079458dfe956ad2180a3be411df0e3e522b9d522bc05b8c9f60d7358e6","observation_id":"2edd59ce-ffb7-42ea-8bc8-02964cfa0135","resolution":{"observed_at":"2026-08-07T10:40:57.254522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.04711","last_updated":"2025-06-05T07:35:55Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-09T05:32:26.120156Z","submitted_at":"2025-06-05T07:35:55Z","title":"LLM-based phoneme-to-grapheme for phoneme-based speech recognition"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2506.04711."}