{"as_of":"2026-08-16T12:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2cadb97410da1d8be35fb5792e1d5c2164c0949de899254001a2cf655a62dd7c","coverage":[{"denominator":115,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:22:09.052312Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00722/citation-record","integrity":"/paper/2608.00722/integrity","json":"/paper/2608.00722/citation-record.json","paper":"/paper/2608.00722"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.593120Z","title":"Artificial Intelligence Review , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.593120Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:4e48d31e2d8a03285b0099db3c948a7258d43230fb4ee7459541111d684b10a7","observation_id":"96c25c93-0935-4287-8bb1-13392b3fb748","resolution":{"observed_at":"2026-08-15T15:22:08.593120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.598502Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.598502Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:c0ae0d16b3dacea068e5c9427506c001ccb1253c7b3614563b339743434a5dbe","observation_id":"a4769f07-181f-4d9d-814c-503a928d7cdd","resolution":{"observed_at":"2026-08-15T15:22:08.598502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T15:22:08.603674Z","title":"arXiv preprint arXiv:2307.09288 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.603674Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:0f2fa53ef56afb2fd2db33d2534cb1f4add47473407662bd01c912c26f408e6b","observation_id":"1fb4e9e7-38ee-4dd8-96bd-914b43d7fcaf","resolution":{"observed_at":"2026-08-15T15:22:08.603674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.608838Z","title":"Proceedings of the 24th international conference on Machine learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.608838Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:01789dfe120beddb687292e7264cf63db006cc89c6de70d5a22050c925d1c1a5","observation_id":"0b9206fa-382a-42db-aec6-2eccceea6441","resolution":{"observed_at":"2026-08-15T15:22:08.608838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.613326Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.613326Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:e3dc3708f13b7b0b02b4dde0da64438679c5c8eecb7cfa3e686c9cdb7380196a","observation_id":"7a1cad27-a561-47bd-8e11-0364361b6745","resolution":{"observed_at":"2026-08-15T15:22:08.613326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.617950Z","title":"Multimedia Tools and Applications , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.617950Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:275eda492c05ba8a7002cee4d250eef4892883e182abd8d1e27050dc6701160e","observation_id":"573f3fa4-7dc1-44f8-8309-7ae2b8498325","resolution":{"observed_at":"2026-08-15T15:22:08.617950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.622444Z","title":"Interspeech 2017 , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.622444Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:f86e3c8115cbc17136d0973e4ca588e493b2c773f1cd666026bd9a1f607f8db3","observation_id":"6b30f84a-b2fa-4b68-b11a-6cbbbf301c4e","resolution":{"observed_at":"2026-08-15T15:22:08.622444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.627305Z","title":"Proceedings of the 61st annual meeting of the association for computational linguistics (volume 1: Long papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.627305Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:5b53a33aabfb865a8da9d2b2577b9381ce0ab239967321f7666f91d0011d2a3c","observation_id":"8ab5308e-911e-443d-b5a7-4489e4ff4ba1","resolution":{"observed_at":"2026-08-15T15:22:08.627305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.632274Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.632274Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:9479a6648381846afa238c2c53f432291afcbccaa5ac9e90d8b9b9baa6c2158c","observation_id":"ea31336d-852f-491e-8e0e-6c630ec09358","resolution":{"observed_at":"2026-08-15T15:22:08.632274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T15:22:08.637032Z","title":"arXiv preprint arXiv:2303.08774 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.637032Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:761a51e75159348393ed5f9a395d137ba07f4dbc4b44c6827853bddb3eb27d5a","observation_id":"3258e424-20ff-48d6-b5c1-ffd183820cd3","resolution":{"observed_at":"2026-08-15T15:22:08.637032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.641728Z","title":"ICASSP 2026-2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.641728Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:22cf893ede4ab522b743dca9b691674641a875887bbeb0e788c9c5bc60a54acf","observation_id":"0cb40b1a-d35a-4929-9a1f-12c7721cce52","resolution":{"observed_at":"2026-08-15T15:22:08.641728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-15T15:22:08.646840Z","title":"arXiv preprint arXiv:2402.03300 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.646840Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:71eba6a770d97bd41a2e6f23123191c4a87ee0a64e3be437cdd401cdc8648536","observation_id":"4f049032-5582-4bb4-8e12-a25bc2c7cc07","resolution":{"observed_at":"2026-08-15T15:22:08.646840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.652031Z","title":"Proceedings of the 2016 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.652031Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:8b53c2118db8d3104be1afc7e2d523d4884748e949be1f160cb893c3e0dc125b","observation_id":"cdb09ae8-3677-40b2-8fa4-357434364c33","resolution":{"observed_at":"2026-08-15T15:22:08.652031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-08-13T12:20:57.788212Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-15T15:22:08.656595Z","title":"arXiv preprint arXiv:2308.01825 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.656595Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:b29caee92e8f670f0de4b75b593d8d6677c1ed000087d8f57a0846487f77605e","observation_id":"08a24126-1b6d-4fcc-83da-1aaba1d702cb","resolution":{"observed_at":"2026-08-15T15:22:08.656595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.661041Z","title":"Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.661041Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:d72c63897cc9e87baead7daef99db470e1edc13efc40c80a4ccee164681942eb","observation_id":"d7e4e2c9-76d6-46d2-b9d0-022980244772","resolution":{"observed_at":"2026-08-15T15:22:08.661041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15621","last_updated":"2026-01-22T03:51:43Z","snapshot_observed_at":"2026-08-13T01:33:42.158497Z","submitted_at":"2026-01-22T03:51:43Z","title":"Qwen3-TTS Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.15621","snapshot_observed_at":"2026-08-15T15:22:08.666295Z","title":"arXiv preprint arXiv:2601.15621 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.666295Z"},"links":{"cited_paper":"/paper/2601.15621","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:e3b221845b17d012fadc199ce6076bf7df05ae330fd7fba05a75a740c4f9bef1","observation_id":"55b126e3-1057-472f-9327-dc18714cbe2a","resolution":{"observed_at":"2026-08-15T15:22:08.666295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.671536Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.671536Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:cb4969867cfb84c4df3800355395a91936bda6daa9a979f2fd7ce37c8defe386","observation_id":"37a9df08-bfa3-4103-bf10-0a91961aefc2","resolution":{"observed_at":"2026-08-15T15:22:08.671536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.676101Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.676101Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:d296ce0882366caa4379b616a70bdbda22b9ff0bd7d5885067895ecf76b7d3b5","observation_id":"c1b49ba2-233b-4bc9-90c7-f9c596ebbd26","resolution":{"observed_at":"2026-08-15T15:22:08.676101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.680480Z","title":"Proceedings of the 56th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.680480Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:aa0daeb9b3512f9694961f847df34322149b1908c11629c05d38b8f1771b7d38","observation_id":"5bd1ebd4-50e6-4399-900f-6871ed18bf02","resolution":{"observed_at":"2026-08-15T15:22:08.680480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-15T15:22:08.684784Z","title":"arXiv preprint arXiv:2505.09388 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.684784Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:5c3430f2c6138398c97e74c1fdbfae9ec12a4f0171b251581e016fc9a198a2d4","observation_id":"4f27d307-3cef-4c1d-9f4a-ad177ebd9750","resolution":{"observed_at":"2026-08-15T15:22:08.684784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.689426Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.689426Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:fbc3e0d5b78d65f8ac8e70a89a89ee102ab1031f84fab78ad284837d43e8d4dd","observation_id":"5dfbe297-59b6-4367-b7e0-094d5786f176","resolution":{"observed_at":"2026-08-15T15:22:08.689426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17310","last_updated":"2024-06-25T06:46:47Z","snapshot_observed_at":"2026-08-12T23:35:32.668854Z","submitted_at":"2024-06-25T06:46:47Z","title":"High Fidelity Text-to-Speech Via Discrete Tokens Using Token Transducer and Group Masked Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17310","snapshot_observed_at":"2026-08-15T15:22:08.693595Z","title":"arXiv preprint arXiv:2406.17310 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.693595Z"},"links":{"cited_paper":"/paper/2406.17310","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:33a93e5ec711b7fca4a40f7440ed5f5107c6abbcf6e368ce10e3ffeb14df0488","observation_id":"67b1731f-a36f-44e5-b06b-52b068e79b51","resolution":{"observed_at":"2026-08-15T15:22:08.693595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.698271Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.698271Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:e635077b29c55a0f3bdce64abb5ec05f5b918646d869638b444a76cedf091763","observation_id":"08d448b4-9d1e-4fc9-b65f-c79f78d5df37","resolution":{"observed_at":"2026-08-15T15:22:08.698271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.702735Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.702735Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:17e666c9efca14383f0d24958450d2eb4497c9ef10c22fe1d40635e8d16f456a","observation_id":"ff203cb4-55ad-407a-9ad6-0e6f878a3a04","resolution":{"observed_at":"2026-08-15T15:22:08.702735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.707293Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.707293Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:2e7031e5b6067f9fc939a64b35b7b349d771310d92fe07cb93e3c74b4b7d2da1","observation_id":"88573b4e-1efd-4fba-8338-e8cf60ba6b15","resolution":{"observed_at":"2026-08-15T15:22:08.707293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.711626Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.711626Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:876b6c87cec1ebe3c66affec2badd8b8cb8be36a6ddddf48c58babeef13401fd","observation_id":"d974dd6a-c64d-401c-9b7b-40e67be97671","resolution":{"observed_at":"2026-08-15T15:22:08.711626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.715930Z","title":"Speech Synthesis Based on Hidden Markov Models , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.715930Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:a005ef9c96aa81bedffa3925746aeae7ca77d0bb9ea443e44c349dfd686c88e1","observation_id":"adbd089f-7de3-4fbb-a1b6-d188d392e699","resolution":{"observed_at":"2026-08-15T15:22:08.715930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.720072Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.720072Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:4a4f555338a8c221b443d4890605d954fcecf2434bb29f2e0c69644590699c8b","observation_id":"69b1f918-9510-4053-b1f7-4d14e1206a3b","resolution":{"observed_at":"2026-08-15T15:22:08.720072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.724088Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.724088Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:2d472133ddcb2b4fb2b7878819457b2a0d339b28bba05a3547209d4ce2ff9db7","observation_id":"4c587501-9229-4dad-a2c6-662a228a3e95","resolution":{"observed_at":"2026-08-15T15:22:08.724088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.728482Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.728482Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:0fe5199b434d93bb9c16c8a642e6e481c0b1ae9f01395b832c375b5d2dd5de80","observation_id":"096b45c7-40e3-4c05-b8fd-e1f34d050dfc","resolution":{"observed_at":"2026-08-15T15:22:08.728482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.732804Z","title":"Transactions of the Association for Computational Linguistics , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.732804Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:d227eea0431abbae76043e403281e82f396107d4a9393286c65abb21c6e174f8","observation_id":"d1a9f2c3-eb13-461d-a775-916199464d8a","resolution":{"observed_at":"2026-08-15T15:22:08.732804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.737239Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.737239Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:4c76a20417d671e98bf7e603af117bca68d9af823c7120a522e8980b81f369c2","observation_id":"f3038592-c6cc-4885-bbcd-cea0beed366a","resolution":{"observed_at":"2026-08-15T15:22:08.737239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.742617Z","title":"arXiv preprint arXiv:2512.14291 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.742617Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:5dc7c952796cd8efaee619c6f4d5ae8c579728d15ba7462866829826480b0ec0","observation_id":"35f04908-9d0e-4296-85bc-711b50a06482","resolution":{"observed_at":"2026-08-15T15:22:08.742617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.746836Z","title":"Audio Imagination: NeurIPS 2024 Workshop AI-Driven Speech, Music, and Sound Generation , year=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.746836Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:90936d226c01766f3f1fef9799026ee329c653d4661272bf79f5531fa8015c24","observation_id":"93f052c8-9305-48b1-9b94-aba60bf33eba","resolution":{"observed_at":"2026-08-15T15:22:08.746836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05407","last_updated":"2024-07-09T07:42:51Z","snapshot_observed_at":"2026-08-10T17:49:50.848957Z","submitted_at":"2024-07-07T15:16:19Z","title":"CosyVoice: A Scalable Multilingual Zero-shot Text-to-speech Synthesizer based on Supervised Semantic Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05407","snapshot_observed_at":"2026-08-15T15:22:08.751335Z","title":"arXiv preprint arXiv:2407.05407 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.751335Z"},"links":{"cited_paper":"/paper/2407.05407","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:95df272943f1e05267319313f748b0ebc01903f0eec22bdd772a55558fa2f0f3","observation_id":"1f52e095-5868-472e-ac70-b98508fdba43","resolution":{"observed_at":"2026-08-15T15:22:08.751335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10117","last_updated":"2024-12-25T11:54:03Z","snapshot_observed_at":"2026-08-16T06:25:22.037199Z","submitted_at":"2024-12-13T12:59:39Z","title":"CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10117","snapshot_observed_at":"2026-08-15T15:22:08.755808Z","title":"arXiv preprint arXiv:2412.10117 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.755808Z"},"links":{"cited_paper":"/paper/2412.10117","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:199e33f9922d0e5cbb3a0b13621aeeae949747ab748e0cbc3f9eacf6b9ef5dad","observation_id":"655b6065-4a78-4c56-b351-f1fb7e18a523","resolution":{"observed_at":"2026-08-15T15:22:08.755808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17589","last_updated":"2025-05-27T07:48:34Z","snapshot_observed_at":"2026-08-16T06:12:24.457686Z","submitted_at":"2025-05-23T07:55:21Z","title":"CosyVoice 3: Towards In-the-wild Speech Generation via Scaling-up and Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17589","snapshot_observed_at":"2026-08-15T15:22:08.760546Z","title":"arXiv preprint arXiv:2505.17589 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.760546Z"},"links":{"cited_paper":"/paper/2505.17589","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:f66b9e0d347ac3da10457747f99b14b02bd156352583de94178c89e155600d9a","observation_id":"dc63ced5-fad2-4222-893b-a99fb2972f51","resolution":{"observed_at":"2026-08-15T15:22:08.760546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.765106Z","title":"Interspeech 2019 , year=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.765106Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:78f93900262235ae99f75ddbfde8043fab3a9a659cd5059fd1a64fe0d8dbac06","observation_id":"8d655747-cde0-4023-bf5b-bdde4ddd1d0e","resolution":{"observed_at":"2026-08-15T15:22:08.765106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.769544Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.769544Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:4d361e2265b6f156ae80f8ea1c621b4e4d5bf5c90c0e548e947f0e98d8caa2de","observation_id":"95df2a2c-4303-401a-8564-7560e6e3e3bb","resolution":{"observed_at":"2026-08-15T15:22:08.769544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.773872Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.773872Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:d7a4426543c2523049586ae0f6325fa68070ec05f2cab3dae3ada969aa4049e2","observation_id":"6536ba29-3bbe-4c3f-a0be-0aa7e3bb30d2","resolution":{"observed_at":"2026-08-15T15:22:08.773872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.778426Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.778426Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:1ac5c7e7d603e1df5964883d789aed475e7ec0481d47fed537fcbed89b6e8c86","observation_id":"cce7205e-b1db-455a-bdaa-cae6ae9d7a03","resolution":{"observed_at":"2026-08-15T15:22:08.778426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.782619Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.782619Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:09de18e3bb87b988969358b8f958f3ca1fe8b9e0fcf1b59f053b71a078f9278a","observation_id":"a675be1e-0de1-4c88-b621-8c9d2b04c423","resolution":{"observed_at":"2026-08-15T15:22:08.782619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.786944Z","title":"Interspeech 2022 , year=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.786944Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:4a0db37073375b3026f11acda433c8a42befdd9d689ca503b8285e7d32c30427","observation_id":"59750af2-21f3-4759-81d2-f36bed2c05b2","resolution":{"observed_at":"2026-08-15T15:22:08.786944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02430","last_updated":"2024-06-04T15:48:29Z","snapshot_observed_at":"2026-08-15T11:55:32.600679Z","submitted_at":"2024-06-04T15:48:29Z","title":"Seed-TTS: A Family of High-Quality Versatile Speech Generation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02430","snapshot_observed_at":"2026-08-15T15:22:08.791366Z","title":"arXiv preprint arXiv:2406.02430 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.791366Z"},"links":{"cited_paper":"/paper/2406.02430","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:25f42a2b60ce6b9934ab4d3a7d9f7940e5450655e90a359f482f107863c9431a","observation_id":"9fdee9f3-3feb-40e3-8c0f-df981b8a669c","resolution":{"observed_at":"2026-08-15T15:22:08.791366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.796066Z","title":"ACM computing surveys , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.796066Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:9d9748f1630c42134752238fcd411f56b6e387b59c3a7a08817bafac0642e212","observation_id":"b7715130-5a0b-43a6-af6a-acab3982d5bf","resolution":{"observed_at":"2026-08-15T15:22:08.796066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-15T15:22:08.800153Z","title":"arXiv preprint arXiv:1606.06565 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.800153Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:a7a71a4588817d1656c31dbff2be85de195e0c702e0d595d1d49b5e65d0e2866","observation_id":"c5f9ff73-a78d-4d95-a43f-77265d56085d","resolution":{"observed_at":"2026-08-15T15:22:08.800153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.804451Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.804451Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:4205f630db5a0b0d917fdc378aefa6ec3751bf3abbf9bc58a5ede8b7164d5473","observation_id":"b2436c54-67a1-4442-bba5-fdc4f7225004","resolution":{"observed_at":"2026-08-15T15:22:08.804451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.808673Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.808673Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:b020bbca32861d40b494325a87280e9853a5e0ed732420217bcd35a21f43951c","observation_id":"ff71c7cd-75ff-491d-b05d-55a754ec0cc2","resolution":{"observed_at":"2026-08-15T15:22:08.808673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.414164Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages=","venue":null,"work_id":"089146df-95b3-4f99-9c80-395c7fd3cba4","year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.813004Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:48ea47845a8de66c7136e605bd9690abe16442d4a8e7093f2b51bc896f0f1a43","observation_id":"26a265a6-38f3-45ce-9027-29c8c763f651","resolution":{"observed_at":"2026-08-15T15:22:10.419099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.399452Z","title":"ICASSP 2025-2025 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":"fc3a45fd-339c-4c52-8598-1af4bd50b5f2","year":2025},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.817181Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:93fd19964fe0ea505cdf474d4eb4eeeb9c553594536a8ea23cbc3c16c44cebf8","observation_id":"fad183d2-6f09-41d7-a621-133cce1d6ec0","resolution":{"observed_at":"2026-08-15T15:22:10.404253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04128","last_updated":"2025-02-22T11:32:13Z","snapshot_observed_at":"2026-08-08T23:22:17.610458Z","submitted_at":"2025-02-06T15:04:00Z","title":"Llasa: Scaling Train-Time and Inference-Time Compute for Llama-based Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04128","snapshot_observed_at":"2026-08-15T15:22:08.821225Z","title":"arXiv preprint arXiv:2502.04128 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.821225Z"},"links":{"cited_paper":"/paper/2502.04128","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:ce15d80cada2b7741258f830c835fa78261d06a52c2b53c50adb412715109249","observation_id":"e4146e82-9d55-4410-b814-a33636db4ca9","resolution":{"observed_at":"2026-08-15T15:22:08.821225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.825648Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.825648Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:cd35add6c0e6e8b4b2faab59b125714395a6eb9ddd4d311e74cd53a78a1952b4","observation_id":"1d806cf2-d0fa-4276-b160-5c153e9434e3","resolution":{"observed_at":"2026-08-15T15:22:08.825648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.830178Z","title":"IEEE/ACM transactions on audio, speech, and language processing , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.830178Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:94d3036c8f73b7db1fc57fe540bc0aa07a16a2be007223c5a3cf3b06a4fc028b","observation_id":"af70592b-3875-46b2-a5ab-55efe35c1dda","resolution":{"observed_at":"2026-08-15T15:22:08.830178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.366329Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"650f1d69-f203-43a6-b2fa-f435f5ebe1e9","year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.834542Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:2067f2395053098938f0c08f725be1becd6d5c425d1aa909a8517445ea042520","observation_id":"b497e2ed-a72a-4de1-8037-a621efc65d5e","resolution":{"observed_at":"2026-08-15T15:22:10.370913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.839093Z","title":"arXiv preprint arXiv:2412.16846 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.839093Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:01f1d70c5bb37012b27cebf84dbf581374f010999809614be5482f490e4b8207","observation_id":"9c52a2f4-e4d2-45b3-a2eb-042c74504c51","resolution":{"observed_at":"2026-08-15T15:22:08.839093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-15T15:22:08.843412Z","title":"arXiv preprint arXiv:2212.08073 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.843412Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:2198701084e1e66397ec1068601f8e7dbca7292ef10892354bdb9aa77f1a2b26","observation_id":"1e07556c-af04-4360-83ed-20a93a984a9e","resolution":{"observed_at":"2026-08-15T15:22:08.843412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.848295Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.848295Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:88c17ea34239efea6c9983cc8b5aa2cf33c6d45d347dbe8b122560dc0fc8aaa6","observation_id":"53091b2f-5c6e-4c17-b069-5414af31d4b9","resolution":{"observed_at":"2026-08-15T15:22:08.848295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10571","last_updated":"2024-06-06T12:02:37Z","snapshot_observed_at":"2026-08-14T16:32:16.325631Z","submitted_at":"2024-02-16T10:55:38Z","title":"Direct Preference Optimization with an Offset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10571","snapshot_observed_at":"2026-08-15T15:22:08.852671Z","title":"arXiv preprint arXiv:2402.10571 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.852671Z"},"links":{"cited_paper":"/paper/2402.10571","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:0c3692c144e3ac01b874779b74d2b526c6f849b1fba51db823644f6b2ceadee6","observation_id":"2e0c5f04-a617-4e51-9f0c-fadd2af7a9f7","resolution":{"observed_at":"2026-08-15T15:22:08.852671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.343372Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":"6d8853ee-e325-4360-96fe-7700ed4fafeb","year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.857857Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:29d4bf0076501255f2509641db58391f90297fd081f18dbcca2743361ea3d29a","observation_id":"0a719694-b2e6-401d-b0a7-99f58a0cb255","resolution":{"observed_at":"2026-08-15T15:22:10.347553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.862249Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.862249Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:4994715d47c406be671c718e74c26202277824c806a8f4ad09a0dc44e4916369","observation_id":"e64045ce-e213-463a-b97f-98950d8583d1","resolution":{"observed_at":"2026-08-15T15:22:08.862249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.866888Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.866888Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:b4c402a3d8cc1dbe23f90369479b3f0e1d77a5add55c3f67fc99c3af6a8b45c4","observation_id":"a2ec9418-9542-4f06-bcaf-d9dad8a594b2","resolution":{"observed_at":"2026-08-15T15:22:08.866888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.311132Z","title":"The Journal of Machine Learning Research , volume=","venue":null,"work_id":"ba444076-b391-4655-bac3-22d73647867a","year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.871520Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:f1c6f938d5adec4ea908b7e7f48b0ed59cba5c37b6dc23310bf1eb1ebda832ca","observation_id":"f92c3ec9-1031-4f4e-9bac-8b322cedfc33","resolution":{"observed_at":"2026-08-15T15:22:10.315803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00633","last_updated":"2024-12-26T02:30:48Z","snapshot_observed_at":"2026-08-14T01:49:06.147794Z","submitted_at":"2024-06-02T06:36:46Z","title":"Improving GFlowNets for Text-to-Image Diffusion Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00633","snapshot_observed_at":"2026-08-15T15:22:08.876529Z","title":"arXiv preprint arXiv:2406.00633 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.876529Z"},"links":{"cited_paper":"/paper/2406.00633","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:3f961472b579095fc5f9b8171428130b60c523116d8cc684f068ffc3706b504e","observation_id":"907b17f2-3dfb-4165-b8bc-9a95129c11c1","resolution":{"observed_at":"2026-08-15T15:22:08.876529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05746","last_updated":"2024-09-09T16:01:58Z","snapshot_observed_at":"2026-08-15T08:16:41.560281Z","submitted_at":"2024-09-09T16:01:58Z","title":"LLMs Will Always Hallucinate, and We Need to Live With This","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05746","snapshot_observed_at":"2026-08-15T15:22:08.881801Z","title":"arXiv preprint arXiv:2409.05746 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.881801Z"},"links":{"cited_paper":"/paper/2409.05746","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:d31c69b6946495a11447f4dec0bea56d7424340dd569ce5c3b2314235e525b31","observation_id":"3e4a8d0c-ec28-4f4d-a9c8-78cde6904666","resolution":{"observed_at":"2026-08-15T15:22:08.881801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00654","last_updated":"2024-06-02T07:54:33Z","snapshot_observed_at":"2026-08-15T15:55:05.388047Z","submitted_at":"2024-06-02T07:54:33Z","title":"Enhancing Zero-shot Text-to-Speech Synthesis with Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00654","snapshot_observed_at":"2026-08-15T15:22:08.887075Z","title":"arXiv preprint arXiv:2406.00654 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.887075Z"},"links":{"cited_paper":"/paper/2406.00654","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:c0267f7505d0e4be9d318fe6c997f0137b6ba8c2434aeaaf292b0a431fa2f204","observation_id":"5be57cd2-3f8e-4892-9279-83a1cbd963a2","resolution":{"observed_at":"2026-08-15T15:22:08.887075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15326","last_updated":"2024-10-20T07:55:44Z","snapshot_observed_at":"2026-08-12T22:19:16.895000Z","submitted_at":"2024-10-20T07:55:44Z","title":"A Survey of Uncertainty Estimation in LLMs: Theory Meets Practice","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15326","snapshot_observed_at":"2026-08-15T15:22:08.891895Z","title":"arXiv preprint arXiv:2410.15326 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.891895Z"},"links":{"cited_paper":"/paper/2410.15326","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:d155410ecd042c22ae3789d7caaa0694a6d5cfc8db7ad90384fec532d0859ca1","observation_id":"ff9986ff-e8a3-4642-a443-5819fdd862bf","resolution":{"observed_at":"2026-08-15T15:22:08.891895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00290","last_updated":"2025-05-09T05:37:54Z","snapshot_observed_at":"2026-08-15T14:59:44.371099Z","submitted_at":"2025-02-01T03:18:02Z","title":"Estimating LLM Uncertainty with Evidence","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00290","snapshot_observed_at":"2026-08-15T15:22:08.897865Z","title":"arXiv preprint arXiv:2502.00290 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.897865Z"},"links":{"cited_paper":"/paper/2502.00290","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:ecaa8b03e1ecbbfe6a6bb06a83a99e909891b0b46fb2fe42cacb967d7e64f4f5","observation_id":"7b4105b9-7bfe-4cfa-b49f-90ab8a71e95e","resolution":{"observed_at":"2026-08-15T15:22:08.897865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.902663Z","title":"ACM Computing Surveys , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.902663Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:dbe0c44dfcf2e309eb3b60f45ad70d1624f319a7c72b2d74873fd32f47676e02","observation_id":"6d6bdb2c-edcc-4ab7-bc61-4d724af5cbbf","resolution":{"observed_at":"2026-08-15T15:22:08.902663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.907380Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.907380Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:776f548bacdf1fbd9b0eb4bd27022b9d7f233fb0f94a3a8e69e34017e18ee4a0","observation_id":"abf32a65-c727-43d9-b400-b26cae721694","resolution":{"observed_at":"2026-08-15T15:22:08.907380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.911589Z","title":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.911589Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:015c49e37d5255c42b60ec71dd9f2570e9a3760060881e0aec984f842e0d2ca3","observation_id":"aaf88695-8b7e-4259-9e8c-3d2e564a2d08","resolution":{"observed_at":"2026-08-15T15:22:08.911589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.915895Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.915895Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:5f8cc3d9fc8be62c35921e12ef0de11d8e960e5b4677370f54b28ac0063feebd","observation_id":"e935c48d-4338-41ae-bd76-3fb459629b56","resolution":{"observed_at":"2026-08-15T15:22:08.915895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06426","last_updated":"2025-02-22T02:15:58Z","snapshot_observed_at":"2026-08-14T09:21:27.874880Z","submitted_at":"2024-07-08T22:15:01Z","title":"DebUnc: Improving Large Language Model Agent Communication With Uncertainty Metrics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06426","snapshot_observed_at":"2026-08-15T15:22:08.921241Z","title":"arXiv preprint arXiv:2407.06426 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.921241Z"},"links":{"cited_paper":"/paper/2407.06426","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:2d109af7c8f0fbde262d23acdfe36702b179cc6096bd211d3e9a6a87defa5175","observation_id":"e93644c8-cd06-4edd-947a-1aa184389c6f","resolution":{"observed_at":"2026-08-15T15:22:08.921241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03926","last_updated":"2023-03-07T14:31:55Z","snapshot_observed_at":"2026-08-13T12:29:52.281350Z","submitted_at":"2023-03-07T14:31:55Z","title":"Speak Foreign Languages with Your Own Voice: Cross-Lingual Neural Codec Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03926","snapshot_observed_at":"2026-08-15T15:22:08.927344Z","title":"arXiv preprint arXiv:2303.03926 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.927344Z"},"links":{"cited_paper":"/paper/2303.03926","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:a149d9140d8e18253f17894831bfd9684b966652b5313260c0704d57bad35bb7","observation_id":"180d0c53-36c2-49e5-b623-0785683c1ba6","resolution":{"observed_at":"2026-08-15T15:22:08.927344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05370","last_updated":"2024-06-17T04:39:08Z","snapshot_observed_at":"2026-08-15T19:06:12.976129Z","submitted_at":"2024-06-08T06:31:03Z","title":"VALL-E 2: Neural Codec Language Models are Human Parity Zero-Shot Text to Speech Synthesizers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05370","snapshot_observed_at":"2026-08-15T15:22:08.931992Z","title":"arXiv preprint arXiv:2406.05370 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.931992Z"},"links":{"cited_paper":"/paper/2406.05370","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:07ae0ea6c087b3712687e3ea2489a81e5edc84c365ca76712020708e441600af","observation_id":"792a0a51-4285-41ec-8413-bd356d10da38","resolution":{"observed_at":"2026-08-15T15:22:08.931992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04904","last_updated":"2024-06-07T12:56:11Z","snapshot_observed_at":"2026-08-12T23:47:54.413535Z","submitted_at":"2024-06-07T12:56:11Z","title":"XTTS: a Massively Multilingual Zero-Shot Text-to-Speech Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04904","snapshot_observed_at":"2026-08-15T15:22:08.936770Z","title":"arXiv preprint arXiv:2406.04904 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.936770Z"},"links":{"cited_paper":"/paper/2406.04904","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:04d85c16237db323cb3cccdb2288dc777f80a78301de4fa54e20103ca5c3c49f","observation_id":"a8ba440a-6caa-404a-8a3f-2ea1a06ce577","resolution":{"observed_at":"2026-08-15T15:22:08.936770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08093","last_updated":"2024-02-15T18:57:26Z","snapshot_observed_at":"2026-08-13T04:20:12.197716Z","submitted_at":"2024-02-12T22:21:30Z","title":"BASE TTS: Lessons from building a billion-parameter Text-to-Speech model on 100K hours of data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08093","snapshot_observed_at":"2026-08-15T15:22:08.941745Z","title":"arXiv preprint arXiv:2402.08093 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.941745Z"},"links":{"cited_paper":"/paper/2402.08093","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:1e1a2d46516ce36001b8362debdb464b69e0e3169ec0276415432f85df9e8c7b","observation_id":"0526aef3-a4a6-432c-bb8c-498318d83378","resolution":{"observed_at":"2026-08-15T15:22:08.941745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08237","last_updated":"2024-12-12T10:01:11Z","snapshot_observed_at":"2026-08-14T13:09:30.411662Z","submitted_at":"2024-12-11T09:38:50Z","title":"TouchTTS: An Embarrassingly Simple TTS Framework that Everyone Can Touch","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08237","snapshot_observed_at":"2026-08-15T15:22:08.946434Z","title":"arXiv preprint arXiv:2412.08237 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.946434Z"},"links":{"cited_paper":"/paper/2412.08237","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:a39a36a2014855cdd22e6417c5c01b91a9da710b5728ebcaa13bbbf33be8d16d","observation_id":"849841b5-c2c5-445e-be47-e9310f0da1e6","resolution":{"observed_at":"2026-08-15T15:22:08.946434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18512","last_updated":"2026-04-03T15:54:23Z","snapshot_observed_at":"2026-08-15T04:45:12.011452Z","submitted_at":"2024-09-27T07:46:52Z","title":"Expressive Prompting: Improving Emotion Intensity and Speaker Consistency in Zero-Shot TTS","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18512","snapshot_observed_at":"2026-08-15T15:22:08.951109Z","title":"arXiv preprint arXiv:2409.18512 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.951109Z"},"links":{"cited_paper":"/paper/2409.18512","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:14d58841907c38ab48270823ce73824839fcb063f931a9d479a148709efa1ad6","observation_id":"f2e41925-17e0-4fff-b6b4-6f5e6a4d6e21","resolution":{"observed_at":"2026-08-15T15:22:08.951109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01710","last_updated":"2025-03-03T16:23:10Z","snapshot_observed_at":"2026-08-13T16:11:28.134657Z","submitted_at":"2025-03-03T16:23:10Z","title":"Spark-TTS: An Efficient LLM-Based Text-to-Speech Model with Single-Stream Decoupled Speech Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01710","snapshot_observed_at":"2026-08-15T15:22:08.955751Z","title":"arXiv preprint arXiv:2503.01710 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.955751Z"},"links":{"cited_paper":"/paper/2503.01710","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:3591690d31ab23c32b6a70b2916b0816274ad7564bc590a92b133f8863843e35","observation_id":"94e003f1-8bd2-432f-a719-819c7391d48c","resolution":{"observed_at":"2026-08-15T15:22:08.955751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.960695Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.960695Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:2abf201048337d32e1d3ab508d66e74cd332c5cef13aba6ef1ad82fabc96894e","observation_id":"7aff7277-fbf5-4534-8a18-5e39860d58e5","resolution":{"observed_at":"2026-08-15T15:22:08.960695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.965508Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.965508Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:e429cce00e6c529bea80b4ea0b6565054c745521fc6a553c944aed257cc54886","observation_id":"f3d22135-4edc-4c24-93cf-199ea45c7908","resolution":{"observed_at":"2026-08-15T15:22:08.965508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.970177Z","title":", author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.970177Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:d0e56ed13a954b5776d9476437de41e980b947b32af38b68b7bbd6ee59d32c2f","observation_id":"a588fcfe-8ace-48ec-aca9-860bae804223","resolution":{"observed_at":"2026-08-15T15:22:08.970177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.974499Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.974499Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:9d87efeda4d28fe6fa1b2da8fb92503f1bdf03fc40d631af8182eeff24fe3c38","observation_id":"50bbc2f5-5848-4d0a-8c65-0a67495c6155","resolution":{"observed_at":"2026-08-15T15:22:08.974499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:08.978997Z","title":"Uncertainty in Artificial Intelligence , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.978997Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:f24d34323ad89101286fff3b62fa8e199a78c8504689b09c8a21cae315f7912d","observation_id":"9cd54fe5-16b6-4f10-9583-6961841a3125","resolution":{"observed_at":"2026-08-15T15:22:08.978997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.213338Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"e9f5884a-1c63-4c2b-a6f6-fdec99ae5e1b","year":2022},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.983560Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:fd0ef43f6fde1db8a94484c592ea04cbfbc9f19c13300d8d64c91799942776c0","observation_id":"de60e897-9466-44f0-8de0-296708218692","resolution":{"observed_at":"2026-08-15T15:22:10.217698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.02606","last_updated":"2023-01-31T01:46:12Z","snapshot_observed_at":"2026-08-13T14:32:14.427552Z","submitted_at":"2022-09-06T15:52:51Z","title":"Unifying Generative Models with GFlowNets and Beyond","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.02606","snapshot_observed_at":"2026-08-15T15:22:08.987804Z","title":"arXiv preprint arXiv:2209.02606 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.987804Z"},"links":{"cited_paper":"/paper/2209.02606","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:4b524a284930ccc02467e2d2c00af6636c58bbcc319b67c9d56e349719900389","observation_id":"c4f5602c-d7ac-4cc8-bee4-6bcaf520d0ca","resolution":{"observed_at":"2026-08-15T15:22:08.987804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.198376Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"306469d3-5a31-48a4-a056-164f03ddbbaf","year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.992773Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:1c4ad49ff87d49feea38934907f1d863c2619a8b018d26fdf36f8ad9e128eb00","observation_id":"2a28a573-5c4d-455a-99ae-87ff3212c8a7","resolution":{"observed_at":"2026-08-15T15:22:10.202997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.183754Z","title":"International Conference on Artificial Intelligence and Statistics , pages=","venue":null,"work_id":"c962110d-edcf-4626-a06b-59259de9fcdf","year":2024},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:08.997729Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:61bba5bbe8587da164d2ff7d7bb58679de543d2a6848f677115b9240b7daed0e","observation_id":"7d7ded55-3a65-47c5-9072-a2bd4a2f6eb8","resolution":{"observed_at":"2026-08-15T15:22:10.188461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.169050Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"8ca8630a-dc40-408e-b799-fdc7a2275bfe","year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.002478Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:a2393611ef86f3a7ce7897dffcaae2534513fb2698440d63f74fac7fdd55fc2e","observation_id":"af206c72-a7d3-407c-a5fe-36ea4ce22ea0","resolution":{"observed_at":"2026-08-15T15:22:10.173687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.154259Z","title":"Transactions on Machine Learning Research , year=","venue":null,"work_id":"00607d51-64f1-47a7-a035-60684d917637","year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.006858Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:7377c1d476b061744dd412cb0f3cdc43f0112a2a149ef5d48535fff5bb2aaf57","observation_id":"62a19638-35c0-46a6-96bd-75340448228c","resolution":{"observed_at":"2026-08-15T15:22:10.158874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.138779Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":"693323f3-374a-4234-940a-b74646112cd4","year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.011497Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:9f828718a98fccf0a84a029ac7963aadb77a788a31304ff96a117f09cd567213","observation_id":"285a78a5-93d7-41ae-bfbd-8e55dfb4874c","resolution":{"observed_at":"2026-08-15T15:22:10.143771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:09.015943Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.015943Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:98628ebe16a394eb08e3f6dc820b48df14942b17e26898a74469bf84b7b80101","observation_id":"c63c3eca-eb15-40dd-b296-cf2a526b235a","resolution":{"observed_at":"2026-08-15T15:22:09.015943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.115108Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":"48206716-2424-4c67-ba8b-2100c6a77718","year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.020408Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:c94bbb5cd0757d39974f4e2ef8ec7a9ae3f785b0db6df1e1f64234577c673806","observation_id":"7fa42198-040f-40e9-b7f9-6c38da7e681a","resolution":{"observed_at":"2026-08-15T15:22:10.119489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.100757Z","title":"Digital Discovery , volume=","venue":null,"work_id":"275e6d51-9de5-4c40-b21a-f904e722d5a9","year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.024691Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:9e0911df7cd095e5598db96b175917d08905ad1b67b089956105ff07195dc16f","observation_id":"56a43bbd-691c-4dc9-a54b-52ed73c18735","resolution":{"observed_at":"2026-08-15T15:22:10.105890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.085956Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"ef6fe433-4467-49cf-b012-75befa138b9b","year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.029315Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:ce5afc5e74abd75da7efc980a7baa3beb533c0bc7684ee5456cd9bafab4e561b","observation_id":"07f90514-33eb-4b43-970f-b7f53047a414","resolution":{"observed_at":"2026-08-15T15:22:10.091424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.071639Z","title":"NeurIPS 2023 Generative AI and Biology (GenBio) Workshop , year=","venue":null,"work_id":"0e04e82c-2258-4dc1-88ec-765ba26e79dc","year":2023},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.034019Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:4e43b20005b54461cb53a2b4c56902c5e298fda8274d4c1ad8a5dbc2bd8d90b7","observation_id":"d6b11eee-de1a-4016-a870-554c9b63f933","resolution":{"observed_at":"2026-08-15T15:22:10.076176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.057145Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"1d992a97-25c4-4b9a-8eff-167d496b1d84","year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.038783Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:aaa0cc28b431a98632809c9228857e500a8e86ffb697d42a9624f6c24caf93c3","observation_id":"697a388d-358a-4cce-933b-467a8f8560ed","resolution":{"observed_at":"2026-08-15T15:22:10.061842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.042954Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":"4cd8fb27-6cba-4d42-8f18-52e989f8b780","year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.043214Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:6797a7ae6157a43701a047a708ba40c0d06c46738c0df1238c6ef10a9bcbb730","observation_id":"ef33de94-6b92-495c-a8e0-12298b468b77","resolution":{"observed_at":"2026-08-15T15:22:10.047654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07041","last_updated":"2025-02-28T05:33:02Z","snapshot_observed_at":"2026-08-13T00:57:28.576576Z","submitted_at":"2024-03-11T16:26:06Z","title":"Ant Colony Sampling with GFlowNets for Combinatorial Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07041","snapshot_observed_at":"2026-08-15T15:22:09.047496Z","title":"arXiv preprint arXiv:2403.07041 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.047496Z"},"links":{"cited_paper":"/paper/2403.07041","citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:223c974ef7f487c29f081e8efbc2f4e040c2d45e937244165d0110279a2d087f","observation_id":"2033c797-3448-4760-adb5-4da04b619131","resolution":{"observed_at":"2026-08-15T15:22:09.047496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:22:10.028666Z","title":"Proceedings of the 38th International Conference on Neural Information Processing Systems , pages=","venue":null,"work_id":"7b963db2-6432-4588-90e7-2fb6f04f1d1f","year":null},"citing_paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-15T15:22:09.052312Z"},"links":{"citing_paper":"/paper/2608.00722"},"observation_digest":"sha256:b4c03ba7123ed4b9817363edf057feee676e67b93e329b152c6d1edda3ffba96","observation_id":"7c52f6eb-7f67-46b1-b4b8-192010ee5d4f","resolution":{"observed_at":"2026-08-15T15:22:10.033459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.00722","last_updated":"2026-08-01T15:41:55Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-15T19:07:35.124687Z","submitted_at":"2026-08-01T15:41:55Z","title":"Experience-Calibrated Contrastive Decoding for Mitigating Hallucinations in LM-Based Text-to-Speech"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":82,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":115},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 100 of 115 outbound references and 0 inbound Pith citation observations for arXiv:2608.00722."}