{"as_of":"2026-07-31T20:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8f97612d6eb3ee6bb48580e801866ff44373ee593a379b96c5b7e35291020db7","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T18:09:22.207379Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-31T06:34:12.847434+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.06054/citation-record","integrity":"/paper/2607.06054/integrity","json":"/paper/2607.06054/citation-record.json","paper":"/paper/2607.06054"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.811208Z","title":"Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech,","venue":null,"work_id":"bfb15528-680d-4769-8af5-3425b2fc06c8","year":2021},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:7a98bea329a13d880804b09a6e3eb525eb4cf8e429389941743dca644e985f9e","observation_id":"ea39cef1-c124-444d-ae96-bf6d446adb3d","resolution":{"observed_at":"2026-07-08T18:15:21.812754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02430","last_updated":"2024-06-04T15:48:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T15:48:29Z","title":"Seed-TTS: A Family of High-Quality Versatile Speech Generation Models","version":1},"cited_work":{"arxiv_id":"2406.02430","doi":"10.48550/arxiv.2406.02430","metadata_source":"pith","pith_arxiv_id":"2406.02430","snapshot_observed_at":"2026-07-10T10:37:01.591529Z","title":"Seed-TTS: A Family of High-Quality Versatile Speech Generation Models","venue":"eess.AS","work_id":"6e88ee95-1133-4302-a142-cdf8f9456a8d","year":2024},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2406.02430","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:cf4140e2dff668035c47e5d94345bd44b45674a04e3753540f4cfbd12948f0c3","observation_id":"0627bc6e-6b43-49e5-8862-89b87b2d5768","resolution":{"observed_at":"2026-07-08T18:15:21.411426Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06885","last_updated":"2025-05-20T15:53:10Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T13:46:34Z","title":"F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching","version":3},"cited_work":{"arxiv_id":"2410.06885","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.06885","snapshot_observed_at":"2026-07-08T18:15:21.415875Z","title":"F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching","venue":"eess.AS","work_id":"2a9a61a0-5461-4302-8659-788b84ecca31","year":2024},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2410.06885","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:5f1cc327a29bf1b1a20f159cb84b2c263cbd43e48c96be662f469964cecfbce6","observation_id":"b412697a-b251-4b4a-b94f-6f3556a123e7","resolution":{"observed_at":"2026-07-08T18:15:21.418131Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.24650","doi":"10.48550/arxiv.2509.24650","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"V oxcpm: Tokenizer-free tts for context-aware speech generation and true-to-life voice cloning","venue":null,"work_id":"191e619c-8028-43ca-952e-2aa85335d419","year":2025},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:2c89a67a5313d7501d3534bb5e9177cb6403bfe515747cfd36c1fc23917edcdc","observation_id":"d91f1d7c-f71b-4933-a491-b1a8acb141e7","resolution":{"observed_at":"2026-07-08T18:15:21.414730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.809536Z","title":"Neural machine translation of rare words with subword units,","venue":null,"work_id":"35290caf-eb0a-46a0-9876-e643a295cda8","year":2016},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:8deb4b8a74129684a19e5880427541cec5b33697af322bee303f40b17e4b639d","observation_id":"4c1970c9-3e0b-4d4c-a020-45df1c894965","resolution":{"observed_at":"2026-07-08T18:15:21.811016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.807715Z","title":"How good is your tokenizer? on the monolingual performance of multilingual language models,","venue":null,"work_id":"2f040b2d-7158-4759-ab30-56f80aba31a1","year":2021},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:6d769739150fcdac984773a7ec553a0ec89ea8fd5e4c71b9c26dfa3219620a62","observation_id":"7538783f-7645-4b28-aa03-4cb797798729","resolution":{"observed_at":"2026-07-08T18:15:21.809133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.806149Z","title":"TAIDE-14-tasks,","venue":null,"work_id":"0539b05a-f28f-4c64-9a36-8356a3a4595a","year":2023},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:8c221601c5d15668ffacef387bdd7c9d334cc9541eabb8f3b160c8368fd98af9","observation_id":"1440e7c6-79ac-455e-aca8-1b12e7b7fc7e","resolution":{"observed_at":"2026-07-08T18:15:21.807521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.804115Z","title":"Subword regularization: Improving neural network translation models with multiple subword candidates,","venue":null,"work_id":"5a8225c4-33c0-4f68-85a5-99137e7a988f","year":2018},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:c40c24193a85f976c3b4dbd3c0a29205d0407342046a5e6b3a8781f66ab49510","observation_id":"5f02f3dd-7ab0-49d8-bc59-503a2115b820","resolution":{"observed_at":"2026-07-08T18:15:21.805639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.802386Z","title":"SentencePiece: A simple and language independent subword tokenizer and detokenizer for neural text processing,","venue":null,"work_id":"3a162b88-2cb4-49da-b5b8-46b1117dec7b","year":2018},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:31c23f725c816f025a0537dd76fbf4c86889d82ad0d7538e1808f7c896f25565","observation_id":"47a616a0-07b8-4601-bc17-eceb86de30be","resolution":{"observed_at":"2026-07-08T18:15:21.803922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.800349Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":"f058b95c-e9c0-4084-a245-d7606e4e5a42","year":2019},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:4118e4061ef70ef0b1d68c93c7f00b7cfb95bec02310c49b6476824944049d6b","observation_id":"69dc57fc-17b1-472d-acdd-45d4b33b2e1a","resolution":{"observed_at":"2026-07-08T18:15:21.802149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:e07507c6d3a4eedb5c671a016126f7a0e305301b7433a6211d14b598dd07afa8","observation_id":"2cdf9f82-fe6b-4f96-aabf-ff02d1741d94","resolution":{"observed_at":"2026-07-08T18:15:21.408170Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:eca8bce5d9eed7583752d162073a7fb6aae3f35d12a7fe5f861d01fa71513636","observation_id":"7d1d33ce-b132-46c3-a717-5bd5d241cf15","resolution":{"observed_at":"2026-07-08T18:15:21.420625Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":"2503.19786","doi":"10.1007/978-3-540-48085-3_36","metadata_source":"pith","pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Gemma 3 Technical Report","venue":"cs.CL","work_id":"f93e08bf-9e96-409b-8ac6-b8385fd17fd7","year":2025},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:2b178076e664422f19c3306806b54e0de3ced51b1bf25ef837b31726dd3ec1e6","observation_id":"dfcf7a62-00a4-4f76-b8b8-e3f1d791c255","resolution":{"observed_at":"2026-07-08T18:15:21.405036Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.797926Z","title":"Language model tokenizers introduce unfairness between languages,","venue":null,"work_id":"a3716ef6-6285-4001-9e53-4119c0627a7b","year":2023},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:c94168cd4c246dfe47f031148b8571e5761e379dfc36cec989edd6f7dc264293","observation_id":"2cb84713-9bfe-408b-aa21-f21b4dcd27b1","resolution":{"observed_at":"2026-07-08T18:15:21.799385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.796129Z","title":"Do all languages cost the same? tokenization in the era of commercial language models,","venue":null,"work_id":"c5642c3d-f716-4921-9b69-b1805445ad24","year":2023},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:b3d0d17b6ba2ef424aca05820fe242eef63bf5a4da5f35b2828e4dc08ab20872","observation_id":"da46738a-c53f-4d58-895d-03b5cb3b24ac","resolution":{"observed_at":"2026-07-08T18:15:21.797728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.794443Z","title":"Tokenization and the noiseless channel,","venue":null,"work_id":"469447b5-bd13-40c8-a566-109fb45217e7","year":2023},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:c721cfa7a6b4e44ffce1574e4a930da54ca92c1d1de0cf63930ca7adad64ae7c","observation_id":"3b210c8d-18a7-4b76-b9f5-247523a5f271","resolution":{"observed_at":"2026-07-08T18:15:21.795843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.792633Z","title":"ByT5: Towards a token-free future with pre-trained byte-to-byte models,","venue":null,"work_id":"741cf615-641c-4127-85ff-92dbaed6749d","year":2022},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:7783d9ef42da6fe69fcef96e7a0d691f23d42579db17541d9581375eceff4f57","observation_id":"fa479ae6-6507-4e3a-b99f-df5a05da8949","resolution":{"observed_at":"2026-07-08T18:15:21.794079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.790971Z","title":"CANINE: Pre- training an efficient tokenization-free encoder for language representation,","venue":null,"work_id":"2b55d722-7c27-423f-a083-33060882b325","year":2022},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:a6ce57182d81a24d38d8de90d21b62bd41dfd9768a3bac3ec2f66f66918b7a54","observation_id":"683accf1-75f2-479e-a31f-9ea262f90d1f","resolution":{"observed_at":"2026-07-08T18:15:21.792454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.789144Z","title":"Natural TTS synthesis by conditioning WaveNet on mel spectrogram predictions,","venue":null,"work_id":"a9239a42-0b97-40f5-9665-21b1b193ccc7","year":2018},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:8caef52d12cfb6374e398dd2f17b149d0acab411e94d4f17be85171c8e3d50b0","observation_id":"f7a07615-782c-46cf-9705-ed68883be3d2","resolution":{"observed_at":"2026-07-08T18:15:21.790629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04558","last_updated":"2022-08-08T01:53:05Z","snapshot_observed_at":"2026-07-06T09:26:58.251758Z","submitted_at":"2020-06-08T13:05:40Z","title":"FastSpeech 2: Fast and High-Quality End-to-End Text to Speech","version":8},"cited_work":{"arxiv_id":"2006.04558","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.04558","snapshot_observed_at":"2026-07-08T18:15:21.399873Z","title":"Fastspeech 2: Fast and high-quality end-to-end text to speech","venue":"eess.AS","work_id":"415023d2-900f-4bda-a774-38e2d95b7a8f","year":2020},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2006.04558","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:0e5edfb78914282927ab4935e4ab26b2c4c0ddfaf6b8a281178861c2e78a82b1","observation_id":"6fa43e09-9a85-4bbf-9982-bcb5baabf37d","resolution":{"observed_at":"2026-07-08T18:15:21.402116Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-07-06T14:37:43.837878Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":"2301.02111","doi":"10.48550/arxiv.2301.02111","metadata_source":"pith","pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","venue":"cs.CL","work_id":"de8fb688-dd63-4942-92f6-66d98d5b6db2","year":2023},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:a5061e2a3dc79d0a0f07459651b3d433c0d8d5b7202bc6ce8b1a4dee4d884e33","observation_id":"de215d58-4d20-431c-b6a0-5abd1419cfa9","resolution":{"observed_at":"2026-07-08T18:15:21.448138Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.06928","last_updated":"2026-06-05T05:43:15Z","snapshot_observed_at":"2026-07-06T23:46:37.903443Z","submitted_at":"2026-06-05T05:43:15Z","title":"VoxCPM2 Technical Report","version":1},"cited_work":{"arxiv_id":"2606.06928","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.06928","snapshot_observed_at":"2026-07-08T19:05:30.488863Z","title":"VoxCPM2 Technical Report","venue":"cs.SD","work_id":"6a05fc21-8b42-49e8-95a9-c5b1c39acc54","year":2026},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2606.06928","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:dfa04b8d55597b41689ad18f3aa6a80e8e74b5ec78b148c95b0c79a6a6af717b","observation_id":"211628dd-e43b-4b96-b8ea-8145568cbe2c","resolution":{"observed_at":"2026-07-08T18:15:21.444610Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04904","last_updated":"2024-06-07T12:56:11Z","snapshot_observed_at":"2026-07-06T18:27:07.473039Z","submitted_at":"2024-06-07T12:56:11Z","title":"XTTS: a Massively Multilingual Zero-Shot Text-to-Speech Model","version":1},"cited_work":{"arxiv_id":"2406.04904","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.04904","snapshot_observed_at":"2026-07-08T18:15:21.439861Z","title":"Xtts: a massively mul- tilingual zero-shot text-to-speech model","venue":"eess.AS","work_id":"0fdda5f3-0b91-4735-8335-b150db16d2b8","year":2024},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2406.04904","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:9a2f4fc44539d99359bcd095e820aa649c4358ef8b87c70c5e2aa8dc45065620","observation_id":"e7758f09-b868-4f3e-a232-1f9dd80f55e6","resolution":{"observed_at":"2026-07-08T18:15:21.442023Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.821890Z","title":"End-to-end code- switching TTS with cross-lingual language model,","venue":null,"work_id":"6133a050-6ec2-49ce-a995-69eb80af3572","year":2020},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:c6c3a322bcbd3f7be0409f2fcd122b6079497c5c2c17b7ec0e33ea7355a81534","observation_id":"f8d9d8f1-7139-430b-af31-c6725f1fad10","resolution":{"observed_at":"2026-07-08T18:15:21.823325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T19:05:30.553754Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":"f7b4a5de-702f-4ca6-a5ca-c112c26601ba","year":2020},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:237aa515aac13c8a4bd967f78da8d44cf79f789d2f0b8f5d1b7e425bfab459fe","observation_id":"fca8eed3-3b5b-49cc-b35d-de97e0fc9390","resolution":{"observed_at":"2026-07-08T18:15:21.821704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T19:05:30.533789Z","title":"HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":"dedda09f-9d4b-4324-b72c-d54d3d52b02f","year":2021},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:b320feeb0d01a85b5bde59c7942914610fc11891a33069b3b93233063c0a1d8b","observation_id":"979ee19d-444e-42b1-86d6-a281b7ac3e86","resolution":{"observed_at":"2026-07-08T18:15:21.819958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17487","last_updated":"2023-11-29T09:48:34Z","snapshot_observed_at":"2026-07-06T16:54:18.139849Z","submitted_at":"2023-11-29T09:48:34Z","title":"Taiwan LLM: Bridging the Linguistic Divide with a Culturally Aligned Language Model","version":1},"cited_work":{"arxiv_id":"2311.17487","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.17487","snapshot_observed_at":"2026-07-08T18:15:21.436878Z","title":"Lin and Y .-N","venue":"cs.CL","work_id":"03561c57-3cea-48a1-8f06-7975a81ae39e","year":2023},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2311.17487","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:e99c2e3fe4f9d6695c606948ec3892e9a3e97ad377c22f77f0717a220663f942","observation_id":"9c87759f-c7a2-407e-9837-2d744114017e","resolution":{"observed_at":"2026-07-08T18:15:21.438746Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20180","last_updated":"2024-03-29T13:56:21Z","snapshot_observed_at":"2026-07-06T17:53:02.801211Z","submitted_at":"2024-03-29T13:56:21Z","title":"Measuring Taiwanese Mandarin Language Understanding","version":1},"cited_work":{"arxiv_id":"2403.20180","doi":"10.48550/arxiv.2403.20180","metadata_source":"pith","pith_arxiv_id":"2403.20180","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Measuring Taiwanese Mandarin Language Understanding","venue":"cs.CL","work_id":"16ac7175-2597-43cb-b544-6caf923980a2","year":2024},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2403.20180","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:28702e258b4c25b858e9c5512883cc0cb97797e7f90d1386a868058e20e1db34","observation_id":"a16b8910-8d6b-4820-8a3b-83ab76d55271","resolution":{"observed_at":"2026-07-08T18:15:21.435702Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11130","last_updated":"2025-06-16T15:47:41Z","snapshot_observed_at":"2026-07-06T21:41:19.199391Z","submitted_at":"2025-06-10T17:30:32Z","title":"A Self-Refining Framework for Enhancing ASR Using TTS-Synthesized Data","version":2},"cited_work":{"arxiv_id":"2506.11130","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.11130","snapshot_observed_at":"2026-07-10T07:56:57.825825Z","title":"A self-refining frame- work for enhancing asr using tts-synthesized data","venue":"cs.CL","work_id":"73a675bd-873c-4c68-ae94-7772f8941f1b","year":2025},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2506.11130","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:9428d60d0586098bf9abd13316fd2e5dfeb94932e632ad8ab700cad0bae9b255","observation_id":"40bfac51-d6fb-42a3-9f54-3faa9e183317","resolution":{"observed_at":"2026-07-08T18:15:21.432691Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.816862Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":"7c99f9b9-6487-44d3-b695-972760295530","year":2023},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:db2704568be64e0717bf2e2520edc76098b326ea508c72e76b344db81f2d8730","observation_id":"ef006d06-41bf-4e44-924d-55f054600b60","resolution":{"observed_at":"2026-07-08T18:15:21.818325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.814920Z","title":"TAIDE: Trustworthy AI dialogue engine,","venue":null,"work_id":"ee7b31fd-6192-4e3b-91b3-a910ac90f211","year":2024},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:ccbd356c85cd2717695a2bfdbc1da639e2390b98f108c5ceb9a64d82bd13c4ab","observation_id":"2a8c4b16-c5d3-482c-90a1-5aaa4ca3198d","resolution":{"observed_at":"2026-07-08T18:15:21.816380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":"2404.06395","doi":"10.48550/arxiv.2404.06395","metadata_source":"pith","pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-07-11T03:07:51.226857Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","venue":"cs.CL","work_id":"f20a4304-bd39-414a-923b-d18322e29258","year":2024},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:cc7551dd30cd708762b7b3e9b7b47b74f9f0e5fbd3322b32a0540151135682a4","observation_id":"08e8e8ea-648a-49cc-8ec2-721d88f5541e","resolution":{"observed_at":"2026-07-08T18:15:21.429411Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":"2312.00752","doi":"10.48550/arxiv.2312.00752","metadata_source":"pith","pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-07-10T20:07:33.480124Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","venue":"cs.LG","work_id":"4ee75248-1199-492c-a52f-6661e0f4adff","year":2023},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:e99a65e43993cfd23ea9a375c156840f5cf53f3d9ceadcdad5233800adeeda86","observation_id":"4631df5b-9a73-4345-aef7-d27a01329265","resolution":{"observed_at":"2026-07-08T18:15:21.426548Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:15:21.813117Z","title":"GQA: Training generalized multi-query transformer models from multi-head checkpoints,","venue":null,"work_id":"18dbe23b-5f89-49b5-8926-c03a6689ca27","year":2023},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:20ccdd9b58f6d9dc5fbcf561f951f97ec7653d256cda7213e3cf04ebdba237d3","observation_id":"fe9107d5-cc52-41bc-9000-ac771acf71a7","resolution":{"observed_at":"2026-07-08T18:15:21.814709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":"2104.09864","doi":"10.48550/arxiv.2104.09864","metadata_source":"pith","pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-07-11T01:27:45.562618Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","venue":"cs.CL","work_id":"4e5eee26-cd04-4c7a-988f-3e6d1a1f0eb9","year":2021},"citing_paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-08T18:09:22.207379Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2607.06054"},"observation_digest":"sha256:565d33c7dda9607c3efa79cbe3bd515ed95546d4d6d594dc40f060f11719a6f0","observation_id":"2f3e2db9-eab4-4975-b266-fb4c20b91f94","resolution":{"observed_at":"2026-07-08T18:15:21.423524Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:47.452101+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:47.452101+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.06054","last_updated":"2026-07-07T09:31:19Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-07-10T23:17:32.665960Z","submitted_at":"2026-07-07T09:31:19Z","title":"BlueMagpie-TTS: A Token-Efficient Tokenizer, Language Model, and TTS for Taiwanese-Accent Code-Switching Speech"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":14,"verified_fuzzy":19},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"thesis":"As of 31 July 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2607.06054."}