{"as_of":"2026-08-19T13:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:15b8fa7789ca24599cfb36d52c755ed7329dc53c6f7d4df1132488cb2b916f3d","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:14:08.481532Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:14:08.331915Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T20:14:08.599533Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"cited_work":{"arxiv_id":"2505.13843","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13843","snapshot_observed_at":"2026-08-15T20:14:08.599533Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","venue":"eess.AS","work_id":"a167ab2b-1b14-46b4-bea6-b81346cc70f4","year":2025},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.331915Z"},"links":{"cited_paper":"/paper/2505.13843","citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:b73b989b9b253ceb00800185fd70547294dc135660bdb8693104b8596d35220f","observation_id":"b1d24c08-6527-4049-82a8-f20c2adf5fa1","resolution":{"observed_at":"2026-08-15T20:14:08.605437Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.13843/citation-record","integrity":"/paper/2505.13843/integrity","json":"/paper/2505.13843/citation-record.json","paper":"/paper/2505.13843"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.912939Z","title":"SE has been widely applied in various fields, including hear- ing aids, text-to-speech (TTS) systems, and robust automatic speech recognition (ASR) [1, 2]","venue":null,"work_id":"15dfda5e-bbf0-4f73-85f5-2b75155fc321","year":null},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.327077Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:ea6f2f484f696350eba239e751f207b693f0e9a691419c0f4fe3f0825edc6f8c","observation_id":"fc2c3b9d-f8a9-4d0f-b579-842c05100cdf","resolution":{"observed_at":"2026-08-15T20:14:08.917354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"cited_work":{"arxiv_id":"2505.13843","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13843","snapshot_observed_at":"2026-08-15T20:14:08.599533Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","venue":"eess.AS","work_id":"a167ab2b-1b14-46b4-bea6-b81346cc70f4","year":2025},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.331915Z"},"links":{"cited_paper":"/paper/2505.13843","citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:b73b989b9b253ceb00800185fd70547294dc135660bdb8693104b8596d35220f","observation_id":"b1d24c08-6527-4049-82a8-f20c2adf5fa1","resolution":{"observed_at":"2026-08-15T20:14:08.605437Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.901323Z","title":"Specifically, we will first assess the enhanced speech quality in complex, far-field noisy environments","venue":null,"work_id":"d601f45d-8afa-447f-8120-1fe9fde8da48","year":2021},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.336982Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:18d3c0c8efcf1c46a1b6f9ae89a98fb3a30772bdf9e50cc18eec3bbd892e28ce","observation_id":"29792553-a04e-47d4-a3ad-8436496438fe","resolution":{"observed_at":"2026-08-15T20:14:08.905329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.890254Z","title":null,"venue":null,"work_id":"b1bc20be-c4a5-46a9-bc01-47a5d54285ce","year":null},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.341339Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:b7ae5049ed18eddf9df15b650dc40a6daeee4a0052ffa99a94a9f46557d74f18","observation_id":"cd936ee1-2127-40e3-ba63-dd669d4a74f3","resolution":{"observed_at":"2026-08-15T20:14:08.894125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.878694Z","title":"Human Listening and Live Caption- ing: Multi-Task Training for Speech Enhancement,","venue":null,"work_id":"661c9bd2-a3db-4764-af73-fba005874b03","year":2021},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.345856Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:71ec943c02980e8ba5cc218d8c77f62206d14daaf0bbb82a337b3ba0469e3e45","observation_id":"82c1fb51-05ba-494e-816a-9e9b07037133","resolution":{"observed_at":"2026-08-15T20:14:08.882899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.06685","last_updated":"2022-03-30T11:18:52Z","snapshot_observed_at":"2026-08-18T11:35:53.501654Z","submitted_at":"2022-01-18T01:12:01Z","title":"How Bad Are Artifacts?: Analyzing the Impact of Speech Enhancement Errors on ASR","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.06685","snapshot_observed_at":"2026-08-15T20:14:08.349708Z","title":"How bad are artifacts?: Analyzing the impact of speech enhancement errors on asr,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.349708Z"},"links":{"cited_paper":"/paper/2201.06685","citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:6f0bd4fe9b659d6dcdc1ca646486f4653546745daab4214b20343c0ddc3f0bb2","observation_id":"5421045d-be06-4295-9dbb-278e162070bd","resolution":{"observed_at":"2026-08-15T20:14:08.349708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.867614Z","title":"Supervised and unsupervised speech enhancement using nonnegative matrix factorization,","venue":null,"work_id":"0c92c2cb-8e1e-4be7-8617-829f9feaf4be","year":2013},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.353980Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:4184718f498d6071e2a4c8e3f0f549323b9bf3398f4e7b404abb75deb0381eae","observation_id":"ab244503-90e0-47d0-882e-8a0d7a26b4fa","resolution":{"observed_at":"2026-08-15T20:14:08.871583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.856351Z","title":"A novel NMF-HMM speech enhancement algo- rithm based on poisson mixture model,","venue":null,"work_id":"3533f81d-0205-4b92-9877-371da3c51b20","year":2021},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.357651Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:b4ab311514ce341368aa85868f242c2707a7b77547b011095460f4f7650f9954","observation_id":"5d186a92-fc50-4262-9034-1f6d04650f19","resolution":{"observed_at":"2026-08-15T20:14:08.860545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.844745Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":"2a7cb4c3-2185-4a51-b7a9-758d38a2cddb","year":2018},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.361585Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:bad8b74301aad34ecc1adccf8b86a929221b8869488c8f96eedd112cf8f74ff5","observation_id":"54f82b16-6ecf-4109-953f-cdbb42ca9a3a","resolution":{"observed_at":"2026-08-15T20:14:08.848443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.833227Z","title":"Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":"d6d40dd4-2066-4cf1-a594-9e9bf5496976","year":2019},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.365326Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:5d6db02ffa75ffbb6bff4b8420df465f0ba582acf805eed0ec089df6fa7ad155","observation_id":"0d3a12fe-7abc-40d7-a45e-fbf04a15ffd7","resolution":{"observed_at":"2026-08-15T20:14:08.837112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.821706Z","title":"A parallel-data-free speech enhancement method using multi-objective learning cycle-consistent generative adversarial network,","venue":null,"work_id":"27d30e72-4ddc-4aa6-ad8d-ae4d7c8e8cf0","year":2020},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.368812Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:b43e6a021e4155a6654ecd73833577449a63fada6752c458ce5d111850c04038","observation_id":"feb3fb99-6c41-4c64-a245-ba496ad22131","resolution":{"observed_at":"2026-08-15T20:14:08.825531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.809751Z","title":"DCCRN: Deep Complex Convolution Recurrent Network for Phase-Aware Speech Enhancement,","venue":null,"work_id":"fefbdf97-641b-47fc-a268-fd5ee06af67f","year":2020},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.373005Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:8bc8d79b673a04bf54f8dd0f502e1195432960d777b054e3bbd09e9dbb0a8420","observation_id":"bd21a903-e6d8-4fe7-840f-1c4518a218f8","resolution":{"observed_at":"2026-08-15T20:14:08.813955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.797479Z","title":"On the compensation between magnitude and phase in speech separation,","venue":null,"work_id":"5e3d7e45-d03b-4904-85f6-9d231231e825","year":2018},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.376886Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:68797c6dea53148be39fcb98d0d52b5ae8688b9899e54e355faabee1a022fa1e","observation_id":"21f862d2-43bb-4840-8168-6435e07f14b3","resolution":{"observed_at":"2026-08-15T20:14:08.801378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.784903Z","title":"FR- CRN: Boosting feature representation using frequency recurrence for monaural speech enhancement,","venue":null,"work_id":"10e56c47-604e-4f97-9d00-63e5eb7a2666","year":2022},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.380507Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:cde98cb22687aa2c830053c9108ab970184d947efe7377e6dc5d10c94c2f5afa","observation_id":"9e51017a-b0f5-49cd-bc9c-ffe4062d8ecb","resolution":{"observed_at":"2026-08-15T20:14:08.788794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.773523Z","title":"Mossformer2: Combining transformer and RNN-free recurrent network for enhanced time- domain monaural speech separation,","venue":null,"work_id":"b7a6a2b6-1145-4ee5-be6d-6d1aa3723d92","year":2024},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.384937Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:2fb7a46b09e13bd4862f69cfa09b9b5eba5abbf1fd1d369ba93f3dc43d7b77fd","observation_id":"afd39462-1151-48c9-aad7-3c2eaeef454f","resolution":{"observed_at":"2026-08-15T20:14:08.777603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.762275Z","title":"A two-stage deep representation learning-based speech enhancement method using variational autoencoder and adversar- ial training,","venue":null,"work_id":"9c75eec3-7694-46bd-86a2-2fbf6b1611b6","year":2024},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.388907Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:da0f1a8b47f490b3d217db23e9dd5bc975d7efa6c40117ecc9aea8e6cc5fafaa","observation_id":"10895ccb-0dbb-4447-9653-4f6d9c22ff0f","resolution":{"observed_at":"2026-08-15T20:14:08.766699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.751528Z","title":"A deep represen- tation learning-based speech enhancement method using complex convolution recurrent variational autoencoder,","venue":null,"work_id":"61435766-43e6-425e-8555-13eb1b272401","year":2024},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.392547Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:d272b51d6e63a794889b5864ec2f2f2508bc50f663fa5ee0ef9dd08368c18e37","observation_id":"5d5fe6fa-f365-4254-ae92-a6e58119c3c8","resolution":{"observed_at":"2026-08-15T20:14:08.755253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.396439Z","title":"Genhancer: High-fidelity speech enhancement via generative modeling on discrete codec tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.396439Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:98f8b7fab73d2766479a816784577a49bd596179e133d4045998ee0682d6c033","observation_id":"f4389f4d-73b4-4c9a-a460-3222e97d6c4e","resolution":{"observed_at":"2026-08-15T20:14:08.396439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.733919Z","title":"Diffusion models for audio restoration: A re- view [special issue on model-based and data-driven audio signal processing],","venue":null,"work_id":"e7cbf3b9-d0a3-4d6d-9ad4-8a31e2ce25b8","year":2025},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.401312Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:211b2931fa04ebacc7e906f9c26eed2ded3d36c0009e4428b87d3fd8f2076531","observation_id":"7b2e6823-acd1-4ab4-bc6a-94f805d1ca97","resolution":{"observed_at":"2026-08-15T20:14:08.737795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.722779Z","title":"Low-latency speech enhancement via speech token generation,","venue":null,"work_id":"47cfa39f-ccfa-4b9f-b285-49f24810c4c2","year":2024},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.406270Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:9f24c90a6b5cf30665970c9cc2beece236288147550d01e69fc5a7881d8dfd5a","observation_id":"78af46ca-9ec0-4efa-b5f2-bc89d7b0f750","resolution":{"observed_at":"2026-08-15T20:14:08.726836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.410686Z","title":"Naturalspeech 3: Zero-shot speech synthesis with factorized codec and diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.410686Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:58a4d4507ba7a13f367af69c28f57c24c3836c48024b3c22df124d4ab25bfa30","observation_id":"95fc8214-6cfb-4bc3-ab31-ff94fd2cc520","resolution":{"observed_at":"2026-08-15T20:14:08.410686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.704577Z","title":"Improved masked image generation with token-critic,","venue":null,"work_id":"6e2d9416-3f56-40e6-bcfe-51b590cfe444","year":2022},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.414648Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:d5240e6765bef3771f1d0557a8008930b5ed2ca7018eb368b2fbd7f46f3e43ca","observation_id":"dc8e0b77-5430-4837-afdd-42e94dd30044","resolution":{"observed_at":"2026-08-15T20:14:08.708247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.693181Z","title":"Unsupervised speech decomposition via triple information bot- tleneck,","venue":null,"work_id":"e59e7a2d-7d89-4356-a6ce-e2d744ad5b60","year":2020},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.418543Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:0b631e76363d9e02d73e0768ab6357c7feb73d12fec9128ddefb28e75a1a6282","observation_id":"20160373-8661-49bd-ae92-aca4aef1585a","resolution":{"observed_at":"2026-08-15T20:14:08.696919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.423010Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.423010Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:cfcce9ec2c51603f5b391af41286ba602f61b5cf4c5c0a7efe31435242b0e139","observation_id":"0542ba0a-5559-42aa-b7ab-9b9c3a1c6ee0","resolution":{"observed_at":"2026-08-15T20:14:08.423010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.426717Z","title":"Soundstream: An end-to-end neural audio codec,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.426717Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:c959e03f7a88d214714845a781446b27dc08d635a3ddb9d6fa4309bfba3e1102","observation_id":"66027937-db1c-4fb4-a981-4ce7c6e11744","resolution":{"observed_at":"2026-08-15T20:14:08.426717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.430463Z","title":"Neural discrete represen- tation learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.430463Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:4021a313365fea05f416e4460814f2c7f986b6f1c50e9f91314d15f989ad2908","observation_id":"acd12912-30fb-47d7-b78a-5172b6b8fa5e","resolution":{"observed_at":"2026-08-15T20:14:08.430463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09636","last_updated":"2023-05-16T17:41:25Z","snapshot_observed_at":"2026-08-19T12:40:58.936874Z","submitted_at":"2023-05-16T17:41:25Z","title":"SoundStorm: Efficient Parallel Audio Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09636","snapshot_observed_at":"2026-08-15T20:14:08.434273Z","title":"Soundstorm: Efficient parallel audio gen- eration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.434273Z"},"links":{"cited_paper":"/paper/2305.09636","citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:d98d591bd4ae85f71809b2d642736de4b401f863fb992e982f8a8008c8407716","observation_id":"af74726a-0247-4335-8e60-389c7ebbe594","resolution":{"observed_at":"2026-08-15T20:14:08.434273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14687","last_updated":"2024-05-20T04:23:45Z","snapshot_observed_at":"2026-08-14T03:13:28.801183Z","submitted_at":"2022-09-29T11:12:27Z","title":"Diffusion Posterior Sampling for General Noisy Inverse Problems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14687","snapshot_observed_at":"2026-08-15T20:14:08.438422Z","title":"Dif- fusion posterior sampling for general noisy inverse problems,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.438422Z"},"links":{"cited_paper":"/paper/2209.14687","citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:e2b0a4f7305d646e9571fdde9fdf66273f3cb59a9894517ed59f84e2d498c8cc","observation_id":"46bfc82f-0982-419c-aa7d-0adf87982b11","resolution":{"observed_at":"2026-08-15T20:14:08.438422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.661681Z","title":"Emilia: An extensive, multilingual, and diverse speech dataset for large-scale speech generation,","venue":null,"work_id":"d5a3a207-0b7e-4a3c-a3fd-0eaf6f26bf2a","year":2024},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.442427Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:473295686db84be6172aa44f7c94fd25b31f3f53ba035e858034af10495bc9ec","observation_id":"607ec96c-35f6-451f-a547-53f8a3c1fbb6","resolution":{"observed_at":"2026-08-15T20:14:08.666138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.650994Z","title":"Inter- speech 2021 deep noise suppression challenge,","venue":null,"work_id":"76152750-38ae-4fd9-81db-fb1d36dea6fd","year":2021},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.446266Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:99e002afce98c4bfad8de4ab9a8069153dc17ee7a8b440df820a3ec16e48bb1e","observation_id":"00bda098-7df6-4495-ae21-d38b5c689a8a","resolution":{"observed_at":"2026-08-15T20:14:08.654586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02430","last_updated":"2024-06-04T15:48:29Z","snapshot_observed_at":"2026-08-15T11:55:32.600679Z","submitted_at":"2024-06-04T15:48:29Z","title":"Seed-TTS: A Family of High-Quality Versatile Speech Generation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02430","snapshot_observed_at":"2026-08-15T20:14:08.450196Z","title":"Seed-TTS: A family of high-quality versatile speech generation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.450196Z"},"links":{"cited_paper":"/paper/2406.02430","citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:680e334cd17944ccb839efa9caf483df67cad3c214a885c448e105484fd0d36e","observation_id":"80a01a25-0a8f-46f3-810b-000f848be1b8","resolution":{"observed_at":"2026-08-15T20:14:08.450196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06670","last_updated":"2020-03-05T20:37:08Z","snapshot_observed_at":"2026-08-12T13:38:15.911519Z","submitted_at":"2019-12-13T19:22:44Z","title":"Common Voice: A Massively-Multilingual Speech Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06670","snapshot_observed_at":"2026-08-15T20:14:08.454288Z","title":"Common voice: A massively-multilingual speech corpus,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.454288Z"},"links":{"cited_paper":"/paper/1912.06670","citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:a0c33d606865486832d6136d39d739e451b6d1f95131cec83ccd9ec0f073863a","observation_id":"1970fe8d-0530-4597-bb21-325bdc9b9a5a","resolution":{"observed_at":"2026-08-15T20:14:08.454288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.639462Z","title":"Didispeech: A large scale Man- darin speech corpus,","venue":null,"work_id":"7a760914-260b-4e07-959c-c70363ece91b","year":2021},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.459241Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:898d97f669663fde981f7b73eff8d17112ff04b1280228bb61180d788fcd92e0","observation_id":"2099b4ad-265c-4e0f-8da7-cb152c4c11a1","resolution":{"observed_at":"2026-08-15T20:14:08.643652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.627989Z","title":"DNSMOS P.835: A non- intrusive perceptual objective speech quality metric to evaluate noise suppressors,","venue":null,"work_id":"ecb1aaec-851f-4c3a-bf63-65fc2cdc7409","year":2022},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.462766Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:c00ce22cb2f73a0d43bb4b49dbe78f91ac1a37aeb0d7c49479b9e4331685b2b9","observation_id":"7399eec7-859c-42a2-988b-936bb609adda","resolution":{"observed_at":"2026-08-15T20:14:08.631871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.466525Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.466525Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:325cce7bc26ff8af94ab97d9a70c1e1fdc06cc3cb3d247be340170c0e7b1a329","observation_id":"4f91b265-0368-4ea5-8121-8ef6cd16ff4f","resolution":{"observed_at":"2026-08-15T20:14:08.466525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11013","last_updated":"2023-05-18T14:45:09Z","snapshot_observed_at":"2026-08-18T07:30:25.553997Z","submitted_at":"2023-05-18T14:45:09Z","title":"FunASR: A Fundamental End-to-End Speech Recognition Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11013","snapshot_observed_at":"2026-08-15T20:14:08.470461Z","title":"Funasr: A fundamental end-to-end speech recognition toolkit,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.470461Z"},"links":{"cited_paper":"/paper/2305.11013","citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:d71b1f24bbb166dd4651d710f303ace5cf58891ca6684d29e345a5ade2854cfe","observation_id":"629376f1-90e3-4113-994c-f94bc4b53cd7","resolution":{"observed_at":"2026-08-15T20:14:08.470461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:14:08.474158Z","title":"Wavlm: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.474158Z"},"links":{"citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:c324a625fc883d25ad366111c0d5272277de4c8b72fffe460605deba5b2de4f0","observation_id":"db83a1b3-6aed-4b67-839d-f2414f92b52a","resolution":{"observed_at":"2026-08-15T20:14:08.474158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00750","last_updated":"2024-10-20T14:25:49Z","snapshot_observed_at":"2026-08-16T13:22:17.818052Z","submitted_at":"2024-09-01T15:26:30Z","title":"MaskGCT: Zero-Shot Text-to-Speech with Masked Generative Codec Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00750","snapshot_observed_at":"2026-08-15T20:14:08.477692Z","title":"Maskgct: Zero-shot text-to- speech with masked generative codec transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.477692Z"},"links":{"cited_paper":"/paper/2409.00750","citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:6debf57cb3c1b082fa0d4f47ab1b4c181dd3ada0a17ba94ad3fa11ca69ca15e3","observation_id":"323ba844-defb-424d-9b4d-76a2e892d01f","resolution":{"observed_at":"2026-08-15T20:14:08.477692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T20:14:08.481532Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:14:08.481532Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.13843"},"observation_digest":"sha256:56a3cf1dfcddedb62dead24f59c9380dd7e42f44f5b81cd9c41dac08ad12107d","observation_id":"46307196-e1ff-4be5-ac2f-8b87abd4be15","resolution":{"observed_at":"2026-08-15T20:14:08.481532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.13843","last_updated":"2025-05-20T02:38:29Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-19T08:31:10.535724Z","submitted_at":"2025-05-20T02:38:29Z","title":"A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 1 inbound Pith citation observation for arXiv:2505.13843."}