{"as_of":"2026-08-07T19:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83d3c64dd7ac35b80d985a328fad99f3fab2a554bf5b4e01f0af1522e47fc49a","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T23:05:08.894347Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T23:05:08.894347Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T23:09:00.904043Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2606.17806","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.17806","snapshot_observed_at":"2026-07-03T23:09:00.904043Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","venue":"eess.AS","work_id":"ff8aa2d2-e8a3-4751-9b09-4084b733c3fd","year":2026},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2606.17806","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:1c51c53702a3c924fcfe5e047bfdbabbdc5ee67662785b41e98634c54a499e86","observation_id":"259dec7b-05ee-4cca-acb3-f4c8fcd9a10e","resolution":{"observed_at":"2026-07-03T23:09:00.905894Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.17806/citation-record","integrity":"/paper/2606.17806/integrity","json":"/paper/2606.17806/citation-record.json","paper":"/paper/2606.17806"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2606.17806","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.17806","snapshot_observed_at":"2026-07-03T23:09:00.904043Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","venue":"eess.AS","work_id":"ff8aa2d2-e8a3-4751-9b09-4084b733c3fd","year":2026},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2606.17806","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:1c51c53702a3c924fcfe5e047bfdbabbdc5ee67662785b41e98634c54a499e86","observation_id":"259dec7b-05ee-4cca-acb3-f4c8fcd9a10e","resolution":{"observed_at":"2026-07-03T23:09:00.905894Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:e931a974156387b4d1907a5950b0c33bee41456f60f3776b4b55f01318e989ba","observation_id":"4577b35a-f850-46ad-907d-c850c7f55ba4","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Datasets The clean speech corpus comprises publicly available data from the DNS5 LibriV ox subset [23], VCTK [24], EARS [25], and LibriSpeech [26]","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:1cda9ce2f19e30ce3618e0149ddcf480873f71c7087e917f32258c979760bee0","observation_id":"d2e8ad4e-7196-4f04-ac6c-09cebba5c73c","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Our work demonstrates that this approach offers a robust and well-structured alternative to conventional spectral- domain methods","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:387b1972922cbade7bd18177a572780eef985bd582f82d48f9a023d8a622e92c","observation_id":"fee8362f-f0db-42cf-ad74-8b6147cf5c2e","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"12274221) and the Yangtze River Delta Science and Technology Innovation Community Joint Re- search Project (Grant No","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:1a1b278c90b2d25fe6e55cc10aafc8acb0909c3e92f1c6c2530ea35a38a7da88","observation_id":"94c05127-af73-4338-90fd-5966e3daab26","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Generative AI was employed exclusively for minor language editing and polishing to enhance clarity and readabil- ity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:943b6cdeff9cf720952471f250a57fea34b4289779958952bf01de48aeab018d","observation_id":"12175251-4ca9-4688-bdfd-0d97930dfae2","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:226bec6c04a7cb2d2036a87a36e49b34329eeff717a1361a8d23eeaef486a940","observation_id":"87cb9647-ebe9-4f9f-9408-ee60b30dd00e","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24708","last_updated":"2026-04-05T03:27:11Z","snapshot_observed_at":"2026-08-04T09:40:49.585423Z","submitted_at":"2025-09-29T12:34:58Z","title":"SenSE: Semantic-Aware High-Fidelity Universal Speech Enhancement","version":2},"cited_work":{"arxiv_id":"2509.24708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.24708","snapshot_observed_at":"2026-07-03T23:09:00.910994Z","title":"SenSE: Semantic-Aware High-Fidelity Universal Speech Enhancement","venue":"eess.AS","work_id":"906bd2fc-1df7-4709-aa35-6d2447f914e6","year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2509.24708","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:e6eb21aaa7d3c37ceb15e817ce0dab5439faa5342596141683a1ee47ce48993f","observation_id":"3c600709-3401-47f8-9701-bf3527d31245","resolution":{"observed_at":"2026-07-03T23:09:00.912655Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Efficient Speech Enhancement via Embeddings from Pre-trained Generative Audioencoders,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:0ec1e18ff39b1c22f677f71b903299a1610d72471d5307e7f07769ed7984cc62","observation_id":"7eb99388-ec05-4c9d-95df-610863ce6813","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Speech enhancement and dereverberation with diffusion-based generative models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:167f0d7474b799ca90c0646dbf97885f7cdd56e714ffe1754ebbdc13c954cead","observation_id":"f01fc13e-b723-4da6-beca-2b215662cc96","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Storm: A diffusion-based stochastic regeneration model for speech en- hancement and dereverberation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:dd948d511dfd1acbbb21c3baa51f7fd7920d97cd4c203204fad9c977f4d0bf0f","observation_id":"cea15566-4cdb-4f05-b468-0a9c24e61bef","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Selm: Speech enhancement using discrete tokens and language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:95ce052290f3b8d91bf85db77fcb00a78077a23b4909ee4eb4da89379a1e6a66","observation_id":"62033308-71f4-40ab-9f61-695deda6b4d9","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Genhancer: High-Fidelity Speech Enhancement via Generative Modeling on Discrete Codec Tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:f0fc3f33143e03679bfab9229a27630f662f6af18dd6f6f78314497ab8977866","observation_id":"01307d61-731b-41f5-95c6-46fc3c0fde9f","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.13300","last_updated":"2025-11-17T12:24:35Z","snapshot_observed_at":"2026-08-07T19:12:34.696410Z","submitted_at":"2025-11-17T12:24:35Z","title":"PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2511.13300","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2511.13300","snapshot_observed_at":"2026-08-05T02:51:45.666161Z","title":"Pase: Leveraging the phonological prior of wavlm for low- hallucination generative speech enhancement,","venue":null,"work_id":"dd1edadb-ca0d-4737-be71-d1c02522eb9b","year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2511.13300","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:cc2520bd98f5e28416119efe91e96b151ef12b1a3ca9e5125e2dca255e05ff73","observation_id":"07ddf42f-fe45-4414-84ac-cb29c134cc43","resolution":{"observed_at":"2026-08-05T02:51:45.666161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.18355","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:09:00.924266Z","title":"Rethinking flow and diffusion bridge models for speech enhancement,","venue":null,"work_id":"1e1ec8dd-cecb-428b-83c7-3e83bf99fdf1","year":2026},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:7c823dca68fa638180b93768cb01238adef4f8caad39078f1815d47ab4541a89","observation_id":"c144dbde-166a-4ab4-8d2a-28d6f856d7f1","resolution":{"observed_at":"2026-07-03T23:09:00.925718Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Generative speech foundation model pretraining for high-quality speech extraction and restoration,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:c6b7a6eb2180da0349add476c9620a31d1812bcd0643049ec1296eec68ec0996","observation_id":"7eec4a31-d7a8-40c8-9616-eb3b31a9c6ad","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Empirical distributions of dft- domain speech coefficients based on estimated speech variances,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:602c3a23a7c45910c60c154aba00fd3480c409b3d5d355903a1584d181aa24cb","observation_id":"02de860e-0402-4405-a533-0feac0096a62","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Layer-wise analysis of a self-supervised speech representation model,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:cc56505c8d4e62e9fec01309e772e574a304d3c9ce299b6062665041e23ff511","observation_id":"3353b5e5-4275-45eb-af59-16ed113714b5","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Investigating self-supervised learning for speech enhancement and separation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:f247e50490013ba839312c837baa343ac20cd1c1bc7e2eebe698aa24f0d1fe62","observation_id":"0c174b1b-ca10-46a6-b346-ac8560c4b81a","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Boosting self-supervised embeddings for speech en- hancement,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:bdcbb5c3b6ec8ad05eb7be7f53d41d240878b2d2ab369a57f30d1d5e3b37fbe5","observation_id":"e6978272-4121-4c05-9de6-d4a092c51a06","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:ab93bd35ef2d477f7410fe747d3e995a5ec44bf05e7958ea89d136cf252816ca","observation_id":"9d5ff2ab-6bb9-4a1d-bf49-1ad74b033919","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Scalable diffusion models with transform- ers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:9eec9ea9a2422aa7568c161eae3e1dfa39db27ce107f5f974b1ea5105ce2ca0c","observation_id":"25b02c04-45a1-4815-9e66-d2409a610c3c","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"F5-tts: A fairytaler that fakes fluent and faithful speech with flow matching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:8beb69911c3cf2f5cd6014734d3274f60164470c80bf3536c387e3539850a4a0","observation_id":"af39c964-42e2-489c-9f58-45714be7c78a","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.13720","last_updated":"2026-01-07T05:36:57Z","snapshot_observed_at":"2026-07-06T22:36:08.495952Z","submitted_at":"2025-11-17T18:59:57Z","title":"Back to Basics: Let Denoising Generative Models Denoise","version":2},"cited_work":{"arxiv_id":"2511.13720","doi":"10.48550/arxiv.2511.13720","metadata_source":"pith","pith_arxiv_id":"2511.13720","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Back to Basics: Let Denoising Generative Models Denoise","venue":"cs.CV","work_id":"37973de8-a5e6-4d92-897b-a98fa9f7f2f3","year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2511.13720","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:3623536e1ec2cc4f79a983a9a35e583bbf0cb7e1af0d144804fa0c0b7229e2e9","observation_id":"ac060926-3e34-4452-aac7-60dfc31010b9","resolution":{"observed_at":"2026-07-03T23:09:00.923183Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Flow matching for generative modeling,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:119759854bac817a7d2380a056c5bc8b2d5b98b507d780532cedb4405a1ad302","observation_id":"d3198330-4fbd-4cc6-8afc-792e86e9788b","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Available: https://openreview.net/forum?id= PqvMRDCJT9t","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:81efc10cc870ba515426549418919f761f51f68bd6d8e1ecc22a3c3f2b9f338f","observation_id":"36c5eea7-1f1d-4987-b0d5-ea62cc4ac12c","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00814","last_updated":"2024-05-29T14:21:47Z","snapshot_observed_at":"2026-07-06T15:36:41.266003Z","submitted_at":"2023-06-01T15:40:32Z","title":"Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesis","version":3},"cited_work":{"arxiv_id":"2306.00814","doi":"10.48550/arxiv.2306.00814","metadata_source":"pith","pith_arxiv_id":"2306.00814","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vocos: Closing the gap between time-domain and fourier-based neural vocoders for high-quality audio synthesis","venue":"cs.SD","work_id":"dfb28242-44a0-4f86-bb57-65dd1aae8947","year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2306.00814","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:aa3db4e16954971cda5d88519fbfa6e1a4f6da531e0bda9663caf01e6a2f3a7d","observation_id":"8dec23c5-03d7-4633-a10e-3d92de0d2bad","resolution":{"observed_at":"2026-07-03T23:09:00.912005Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Wavtokenizer: an efficient acoustic discrete codec tokenizer for audio language modeling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:9562960e26bf9b1ffa2b11152f4a1f4ad8cb124036de7f40235157fa7010f5ac","observation_id":"6616a914-6e72-4476-83ef-58c4d914daa1","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:b1c87af03d75ea6773d35ca578d677ff34ddd065ab2f03ada54812d59eebc019","observation_id":"e0efc43b-7d92-46e0-b1b8-17b4d8ec5eb0","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Icassp 2023 deep noise suppression challenge,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:2e41bb5615df2a3adabce40807fa77dd3b95289bb70de105faab1d19f63c9451","observation_id":"1bee1b0e-b621-4dea-9eed-8eb204d79165","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"The voice bank corpus: De- sign, collection and data analysis of a large regional accent speech database,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:c3fc14e951bda1295a27df0e2e6a655b118eff903a59c70718d38abccd36ca88","observation_id":"97140995-448b-4c80-8f31-1a818b269d4f","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"EARS: An Anechoic Fullband Speech Dataset Benchmarked for Speech Enhancement and Dere- verberation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:9056845473fc9f63a9d09f2e9f37e24fffebb34372349076383b44e7169d1f77","observation_id":"60215fe5-8cf8-4a7f-8ca4-e17c5685df5c","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Lib- rispeech: An asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:4e05afbc5e4d0f10f8f96df0f9864f49cd3cb41bae61f11345bb7b404e5e62a0","observation_id":"1365b103-3fa2-4e4a-9fb2-87e87cdbf947","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"WHAM!: Extending speech separation to noisy environments,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:707ac15c8eaa38aaa04d9e21ed3b1f1f48efaa499c86391153016a447f854c89","observation_id":"e94d2750-f6e1-42eb-a439-896d90b0b30f","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"FSD50K: an open dataset of human-labeled sound events,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:03e1f500052875e2890031f83259525e92b8f00e6fe3c2bffa2b13f51969b0f7","observation_id":"03c0940a-7a67-4a5d-936b-b06a87de4340","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.01840","last_updated":"2017-09-05T18:38:33Z","snapshot_observed_at":"2026-07-06T05:21:33.309016Z","submitted_at":"2016-12-06T14:58:59Z","title":"FMA: A Dataset For Music Analysis","version":3},"cited_work":{"arxiv_id":"1612.01840","doi":null,"metadata_source":"pith","pith_arxiv_id":"1612.01840","snapshot_observed_at":"2026-07-04T14:39:57.208412Z","title":"FMA: A Dataset For Music Analysis","venue":"cs.SD","work_id":"ded6f28d-171f-48d7-861a-9d653fccecb4","year":2016},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/1612.01840","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:4b93795a261ec74dd63984b830197ec1531579ab1684d77047438165c5b36ce2","observation_id":"708dd38c-60df-4604-a8a5-a31ad1aea4b6","resolution":{"observed_at":"2026-07-03T23:09:00.928538Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"A study on data augmentation of reverberant speech for robust speech recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:62a0d4942af368f67911b594f5d06143cdb82803c065662ebb005e25ce9badbf","observation_id":"3a4bb543-e066-4e09-919a-49d1961f0b0d","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"The INTERSPEECH 2020 Deep Noise Suppression Challenge: Datasets, Subjective Testing Framework, and Challenge Results,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:0e347d2b395cf9d82fb34a3173b202520d72866f75d9b5d2430d0077ec0b5059","observation_id":"f6c75420-7f9f-4073-a33b-bfc8270a4773","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Dnsmos p.835: A non-intrusive perceptual objective speech quality metric to eval- uate noise suppressors,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:67c127def4136eafd970fb7938390c296478bf18825aa5afb28559a235c9a8b9","observation_id":"4b260545-f907-41a2-92dd-a34197d35d45","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"UTMOS: UTokyo-SaruLab System for V oice- MOS Challenge 2022,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:291d3ee0d2090a08b72ce6be356c726b2bab29a298e7a70c84434edd780456b6","observation_id":"98664676-f6b0-40f1-92d4-43e97790940a","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"SpeechBERTScore: Reference-Aware Automatic Evaluation of Speech Generation Leveraging NLP Evaluation Metrics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:28d905d913818f121d691978277f83c91551b6dd07dbcc901dda0bb06cf76fdc","observation_id":"0a46c703-fb82-428b-b55f-abfdfd608cbc","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"mHuBERT-147: A Compact Multilingual HuBERT Model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:f4ee7392d1c8a88ee0e7f87dfb08b21399a358c40433e9e78a0cbacf72b43b50","observation_id":"1b5b4ae7-cdaa-4fb6-a1a0-65a863a0e608","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Evaluation metrics for generative speech en- hancement methods: Issues and perspectives,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:d9162e062be717c1fed21a108af578952497f340801353dacbfe2c7310c2e61c","observation_id":"72b6552a-2d1a-4b93-ada8-3bc7a5fa41e2","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Simple and Effective Zero-shot Cross-lingual Phoneme Recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:04e488144bc2a607816c54d3ec248f36f10710a8aec8bd24b695d51d6cab4fcf","observation_id":"455794c6-15cf-43dc-bba3-412eafe3a319","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:4feb28a08af7b2ffba3f4b49a184785b5ad2c97e1e94d8516676cdebca386159","observation_id":"d82fda8b-0ae7-4aa4-8271-cf6581724098","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Tf-gridnet: Integrating full- and sub-band modeling for speech separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:dbd9e8899f789a38341115cf9734d7726164ff6d4900291e8555212f66dfb604","observation_id":"89fe1262-c2ac-41b2-9737-7d2a85f76c9e","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00493","last_updated":"2025-06-10T06:55:05Z","snapshot_observed_at":"2026-08-07T17:37:19.033023Z","submitted_at":"2025-03-01T13:44:50Z","title":"LLaSE-G1: Incentivizing Generalization Capability for LLaMA-based Speech Enhancement","version":4},"cited_work":{"arxiv_id":"2503.00493","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00493","snapshot_observed_at":"2026-07-03T23:09:00.924175Z","title":"Llase-g1: Incentivizing generalization capability for llama-based speech enhancement","venue":null,"work_id":"9dcf14bb-3729-4b73-8a1b-d355a5a24dbb","year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"cited_paper":"/paper/2503.00493","citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:5cf019ee181a029b83338cd564304ac0ca33f997e9fdd17aa1ff47137cb92e53","observation_id":"204a1e36-8fbc-47a4-a68c-7aa745e0c694","resolution":{"observed_at":"2026-07-03T23:09:00.925960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"Anyenhance: A unified generative model with prompt-guidance and self-critic for voice enhancement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:d53c9ece644c057fb56799a3ddbb87a2fa3e5fb11216bf92c35700b2aae3d98f","observation_id":"0aec4b56-5a05-40f4-bd10-1c3346a9d1ce","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T23:05:08.894347Z","title":"A convnet for the 2020s,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-26T23:05:08.894347Z"},"links":{"citing_paper":"/paper/2606.17806"},"observation_digest":"sha256:2ce72874e205bd8b583eae293e103fb945bf5f54d4602113f41a2bb373aac173","observation_id":"c83168b7-2e0f-46b6-aa60-d63c4f822ffb","resolution":{"observed_at":"2026-06-26T23:05:08.894347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.17806","last_updated":"2026-06-16T11:28:29Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-07-06T23:53:21.186284Z","submitted_at":"2026-06-16T11:28:29Z","title":"PhASE-Flow: Phonetic-Conditioned Acoustic Flow Matching in SSL Representation Domain for Speech Enhancement"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":40,"verified_exact":7,"verified_fuzzy":0},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 1 inbound Pith citation observation for arXiv:2606.17806."}