{"as_of":"2026-08-08T07:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:faa125ea8cbe1766db8e4b45ef1694439ad3075cbd8b56018a4fbeb7710164e0","coverage":[{"denominator":83,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":83,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:24:14.488006Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24576/citation-record","integrity":"/paper/2505.24576/integrity","json":"/paper/2505.24576/citation-record.json","paper":"/paper/2505.24576"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:05.320283Z","title":"Speech en- hancement and recognition using multi-task learning of long short-term memory recurrent neural networks,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.320283Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:95840a59edd2f75077831490be0db96bc81a4983916e118c6a59f871af35053e","observation_id":"716356ac-dce1-4229-a302-bf7d2a6b2a6f","resolution":{"observed_at":"2026-08-07T12:24:05.320283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:05.416221Z","title":"Design of matrix Wiener filter for noise reduction and speech enhancement in hearing aids,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.416221Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:e57a77f64adc157e8c96759fbc7052d43c934519e306a51142fe5361d550abbf","observation_id":"62598bbe-3409-4f44-bb53-30fcd5f25149","resolution":{"observed_at":"2026-08-07T12:24:05.416221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:05.533821Z","title":"Real-time speech enhancement using an efficient convolutional recurrent network for dual-microphone mobile phones in close-talk scenarios,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.533821Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:c2c2468b690bfe6e8579f179eb84e83d93976eeab1157473f3a5323f6f231aa9","observation_id":"2e66ba0d-f28c-45d0-aad0-653a66b329f6","resolution":{"observed_at":"2026-08-07T12:24:05.533821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:25.172274Z","title":"Towards efficient models for real-time deep noise suppression,","venue":null,"work_id":"63ae63d1-1dfd-4bed-b691-7549fdae8051","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.617113Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:2639972bf9f9c08d1bc5788b9a222f90a83742fe1dd7c23547a1bacd759a1894","observation_id":"46ba6a5f-de3c-424a-854e-4c268fbc1bd1","resolution":{"observed_at":"2026-08-07T12:24:25.245825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:25.041396Z","title":"Speech dereverberation with frequency domain autoregressive modeling,","venue":null,"work_id":"fd5146ac-6351-48e1-acb8-48cdcdd94f66","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.701661Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:691b4b442ec0ba91fc5fbb9e0ca773390f7b04fed21808da8fdc0e80456f89f5","observation_id":"249ed92b-9bd7-4a6c-9b54-edc34e93a742","resolution":{"observed_at":"2026-08-07T12:24:25.120141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.884911Z","title":"Towards robust speech super-resolution,","venue":null,"work_id":"c0b1e147-fd48-4dd6-9fb2-078569bea5ed","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.782624Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:230d55b54e4d57e253eceed9e8bf403dedc5c8073c404e905166e7de7df654ab","observation_id":"6993f4ea-a360-47bf-b4a9-1cb3581fe9e8","resolution":{"observed_at":"2026-08-07T12:24:24.960601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.782476Z","title":"Towards generalized speech en- hancement with generative adversarial networks,","venue":null,"work_id":"73a33416-bdba-477e-b95b-bdade200f29a","year":2019},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.847042Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:9bd6fd8d4f672439dc97d39274fbf631428fc0f77ecf4cbe5e3d5da49e00f121","observation_id":"dc98e143-e3e9-4587-a1e5-3193e1bbdd4a","resolution":{"observed_at":"2026-08-07T12:24:24.828371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.577594Z","title":"Cascaded time + time-frequency unet for speech enhancement: Jointly addressing clipping, codec distortions, and gaps,","venue":null,"work_id":"5865e943-8055-4a70-9b66-f88d3f326e4c","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:05.947781Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:0e424c46b9e9c2068df1a3654878b2bea04ec5ad69a4e6c8e52ac5507066ad6e","observation_id":"08e94d8c-a003-45ca-a6e6-37eba284a952","resolution":{"observed_at":"2026-08-07T12:24:24.698350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.03065","last_updated":"2022-09-16T10:27:27Z","snapshot_observed_at":"2026-07-06T13:18:09.946150Z","submitted_at":"2022-06-07T07:32:32Z","title":"Universal Speech Enhancement with Score-based Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.03065","snapshot_observed_at":"2026-08-07T12:24:06.031442Z","title":"Univer- sal speech enhancement with score-based diffusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.031442Z"},"links":{"cited_paper":"/paper/2206.03065","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:97fb2a25b837012abe00a06f897bd52b5383f6b76e5b29cc45a14e6002b57407","observation_id":"ff7ed7c1-d1f2-4b2a-bc02-fb077aceb2c2","resolution":{"observed_at":"2026-08-07T12:24:06.031442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.455837Z","title":"Universal score- based speech enhancement with high content preservation,","venue":null,"work_id":"20d5b6ae-260f-4bd0-97fb-d4993fbdaf14","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.167411Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:cfb4b131d0f168ec37740922fa58f56807985b1a64b19d889fbd941500f1443e","observation_id":"ef1052c3-dfb5-4117-85ec-480935b3bf63","resolution":{"observed_at":"2026-08-07T12:24:24.490341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.243350Z","title":"SDW-SWF: Speech distortion weighted single-channel Wiener filter for noise reduction,","venue":null,"work_id":"62de92bf-2e4b-4df7-80b7-77759c19a6a7","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.265926Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:c5238eb9b74822e7a76dcdb8090632bb80e795d66bd901c03f37b835d4a86e0a","observation_id":"f8ff8762-09a2-4b2a-b197-1957f6ccf1cd","resolution":{"observed_at":"2026-08-07T12:24:24.356752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:24.042777Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":"cfeac3ef-ea65-4127-909b-3d7944d824d0","year":2018},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.363099Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:6e753c95063a483ea783234bf5fffab537969f33b19e115fcca3ccf9af72d06f","observation_id":"eae5353b-a5ab-4de0-9778-92b00a7e98ff","resolution":{"observed_at":"2026-08-07T12:24:24.135690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:23.839799Z","title":"The unimportance of phase in speech enhance- ment,","venue":null,"work_id":"aac715cf-7c4e-4408-a205-12814b7d6302","year":1982},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.462253Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:8d90f7e560734a2344481e0fc5261bce13ecf11fa03f57199ca69615b494e6e0","observation_id":"7aa6e7a1-b29a-483b-bc55-07633f11ad57","resolution":{"observed_at":"2026-08-07T12:24:23.932866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:23.599422Z","title":"STFT phase reconstruction in voiced speech for an improved single-channel speech enhancement,","venue":null,"work_id":"2694d292-96b2-4dee-bdd2-41634423e77d","year":1931},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.533448Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:921f615a624fccf6a790d463ef1c86426030b460a92edb92f96c060e436f9a3d","observation_id":"d946e870-f974-453f-a175-ee110b30f3e3","resolution":{"observed_at":"2026-08-07T12:24:23.699382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:23.384138Z","title":"Complex ratio masking for monaural speech separation,","venue":null,"work_id":"3367cd29-16e9-4058-b347-fa8de94b4cb6","year":2016},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.642175Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:18bfe7a489771ebcc01f33adf66978ccfa853aa172a64d93f738870191538fe1","observation_id":"593aa040-7cf0-4663-b505-41e5633e148b","resolution":{"observed_at":"2026-08-07T12:24:23.480376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:23.152225Z","title":"Complex spectrogram enhancement by convolutional neural network with multi-metrics learn- ing,","venue":null,"work_id":"ed203a2a-8751-4d11-98bc-7bd5ae3fdcf5","year":2017},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.720459Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:990cb0c4f3653a7ba5e4bee69dd673fbe301df7a8adf7de46f1e10aa9d8a6255","observation_id":"d3c75c57-9514-4b70-96f6-be5719ff4de3","resolution":{"observed_at":"2026-08-07T12:24:23.282431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:22.922262Z","title":"On the compensation between magnitude and phase in speech separation,","venue":null,"work_id":"3ba028c3-c2f5-4454-9b1b-d47c7d1868c5","year":2018},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.799550Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:c29ee83211c1e3752297b6fdb135fab6c8ecae082710906bf6d6a5764a4494ed","observation_id":"9c80430d-9df9-479a-bc89-7b26e3261923","resolution":{"observed_at":"2026-08-07T12:24:23.035880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:22.707727Z","title":"CMGAN: Conformer-based metric-gan for monaural speech enhancement,","venue":null,"work_id":"ad9a8a3a-8999-4b38-aa9c-038f4d505e05","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.877982Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:05dc414aa06d9031a08d4ff244f75834decacf0405111c1c7d5e5dfb7bbcec4b","observation_id":"10f5013e-3d1b-4d2c-8017-df727aa974ec","resolution":{"observed_at":"2026-08-07T12:24:22.773303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:22.269963Z","title":"SEGAN: Speech enhancement generative adversarial network,","venue":null,"work_id":"d377c633-a462-4f61-a643-4d4c5ba65ad8","year":2017},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:06.964042Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:ec17ac6521aa6e8bd86c7b5baac2d64fb6b693efbb0fd16d252f21ef6fae8878","observation_id":"d05ca07b-b95c-481e-8424-84d7b2396224","resolution":{"observed_at":"2026-08-07T12:24:22.495067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:22.134816Z","title":"SE-Conformer: Time-domain speech enhancement using conformer,","venue":null,"work_id":"779577c5-b95e-4c9f-8338-f3f9eea00220","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.038338Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:f26212acb27f77362d5dccc1ba1f7b7e1c45e83b792e7407277060c7a7cc150d","observation_id":"a10c51fe-51fc-4b33-b83c-367c99f82d7f","resolution":{"observed_at":"2026-08-07T12:24:22.194680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.982879Z","title":"WSRGlow: A glow- based waveform generative model for audio super-resolution,","venue":null,"work_id":"b1643c7d-2f8b-431f-827b-23aac373a2d4","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.141993Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:024a02ffd5393ed59ef9c9422c600348fdb76594ff67d7a1d1c68092f715b445","observation_id":"5b35036e-2211-4302-a5a0-699487118354","resolution":{"observed_at":"2026-08-07T12:24:22.062519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.896816Z","title":"Auto-encoding variational Bayes,","venue":null,"work_id":"c7fc598f-f249-47cd-aaf5-cebf9380d342","year":2014},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.216191Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:4de555a76e072f9b329d514bcdb2811383239ecbcb65fa8fd861cbceb7b4b4bd","observation_id":"ffc1f071-626b-4856-93ad-07c3747f5b74","resolution":{"observed_at":"2026-08-07T12:24:21.929041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.824962Z","title":"Generative adversarial nets,","venue":null,"work_id":"9a658b23-afe3-4190-8d46-22d0dae217b0","year":2014},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.299353Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:359b3649ae06ed1a02b05e9449bbf8db104dbc82808f255d3b72c0231dbafc62","observation_id":"00af0251-0d56-4d00-9914-228b15820ea0","resolution":{"observed_at":"2026-08-07T12:24:21.854984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.724735Z","title":"Variational inference with normalizing flows,","venue":null,"work_id":"2f2d4bf2-7030-4d2e-bad0-50c8cb83fa0d","year":2015},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.389136Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:c22d8257ecda9dc8617e52ebbe00aa4f122270c08cfd7761a89c203f2f844989","observation_id":"167f40c3-a57c-456b-8d41-a557f860f1cf","resolution":{"observed_at":"2026-08-07T12:24:21.760844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.641129Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics,","venue":null,"work_id":"e3c5836f-eb30-41e3-8427-b5878a79506e","year":2015},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.501204Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:73b3f605e02f055f3fae13f63ebcebb3c92eea973c777928d95848cafd54b05e","observation_id":"46f82160-a371-4091-863b-1506a109d80b","resolution":{"observed_at":"2026-08-07T12:24:21.677254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.559366Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":"f6069857-5f6b-45bc-be55-02b2a8d8fdc5","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.597158Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:61ff0d4dc27257d71a2688ce8d3b69f593365c33505a6450b1d40fded5de00e4","observation_id":"c798cd8b-5231-4839-bc93-f51bdc40c5f2","resolution":{"observed_at":"2026-08-07T12:24:21.594820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.489104Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":"bc7fdd0f-7c0c-48f4-9965-a5cb53801114","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.690027Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:7a2256f64518cbaab182d4ad8c78eec684845a24ca55c9f1d1dad6da44c133f7","observation_id":"71421055-5139-4eb8-8b8c-1cc9ad662620","resolution":{"observed_at":"2026-08-07T12:24:21.509062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.387016Z","title":"Diffusion models beat GANs on image synthesis,","venue":null,"work_id":"f9f44e1d-95df-4c6f-b304-b2e0489e4736","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.784924Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:3aa0b0c2e0cd96a9046b4f2cf6a58ca0293537805f1838bd1609cdc765e12de3","observation_id":"7d48cf85-4982-4034-a6de-64381423c383","resolution":{"observed_at":"2026-08-07T12:24:21.431910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.316589Z","title":"Conditional diffusion probabilistic model for speech enhancement,","venue":null,"work_id":"785ef1f2-bbd3-429d-95ee-744432769963","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.891117Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:849fa688e09aeefc363f01e15b61121ed95c178ad1b7976035ca66f32f2300a3","observation_id":"db91a5cc-d604-492f-8c73-cbd2db6795c9","resolution":{"observed_at":"2026-08-07T12:24:21.347699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.250290Z","title":"Speech enhancement with score-based generative models in the complex STFT domain,","venue":null,"work_id":"db4f73a8-151b-49e1-baf3-24cc15d5d383","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:07.988798Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:e030a7509b5b288667408678b3c05a1af5421ac1b7d280240bad2afd6e117a5b","observation_id":"11eaf220-643a-4cd9-8a78-94731403a563","resolution":{"observed_at":"2026-08-07T12:24:21.276603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.188712Z","title":"Speech enhancement and dereverberation with diffusion-based genera- tive models,","venue":null,"work_id":"4aae3e14-3c5f-4267-b68b-0c3c1802d624","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:08.250031Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:f771e4cd77618333bdce7d9bf80daa9cf0076271b762fcbaddcdcca7ac364df4","observation_id":"48970a6e-8cc8-4e79-b7a9-2687dba3f732","resolution":{"observed_at":"2026-08-07T12:24:21.211424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.100597Z","title":"StoRM: A diffusion-based stochastic regeneration model for speech enhancement and dereverberation,","venue":null,"work_id":"020ec3dc-c9f9-4c15-8f9e-2a3a8ec74bce","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:08.642509Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:0979b8d7697e48cda93809854976de06fc2364b42c2a9c41db5c2d42f69a1d91","observation_id":"71787c70-8afe-460f-800b-cda0559d45e9","resolution":{"observed_at":"2026-08-07T12:24:21.130705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:08.846064Z","title":"Score-based generative modeling through stochastic differ- ential equations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:08.846064Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:f0634e5c7f71b5c8999e4496e99b0f6817abc2b1e7f085bc4817801b6bc53307","observation_id":"b46871ce-56d1-4769-8fca-cde1c2771ab0","resolution":{"observed_at":"2026-08-07T12:24:08.846064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:21.027625Z","title":"Estimation of non-normalized statistical models by score matching,","venue":null,"work_id":"3faa73d1-4ef1-4fc4-bf43-92ea6d23d839","year":2005},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:08.998766Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:84ab961b420b8a410437f2f509489f61031e5960e3fb8d3636c4fb7408c1fee8","observation_id":"20dd84bd-05e3-4102-bf29-3aeed8371020","resolution":{"observed_at":"2026-08-07T12:24:21.053168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.981519Z","title":"SRTNet: Time domain speech enhancement via stochastic refinement,","venue":null,"work_id":"28241c54-20cc-4d92-8462-aa02705824d2","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:09.148479Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:816c14ac8f057155fab48808b507a859032bf534d2707497ba4f48fce8c8204a","observation_id":"9a94dab9-1b71-4a64-90ba-17bd12eaaa78","resolution":{"observed_at":"2026-08-07T12:24:21.002799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.908550Z","title":"Reducing the prior mismatch of stochastic differential equations for diffusion-based speech enhancement,","venue":null,"work_id":"4fbe41a1-10d3-4580-8b77-bfb7a86aa734","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:09.302414Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:fa29ed943dcda0bfaf4e9aa8634e6c658fef77e11831812c4c259115e877d76e","observation_id":"f660b753-badb-427d-8b0a-a7efb613c0f5","resolution":{"observed_at":"2026-08-07T12:24:20.938463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.833465Z","title":"Schr ¨odinger bridge for generative speech enhancement,","venue":null,"work_id":"3ccfd8b6-9c24-4346-a45c-22a385113e09","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:09.476701Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:6a1265d863dc74653045eccb419ec45ca52dba6aa8a9082832ec036e784fe772","observation_id":"5229341e-bdb8-4529-82a0-d2b0b3c6eab3","resolution":{"observed_at":"2026-08-07T12:24:20.865167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10753","last_updated":"2025-01-18T21:15:41Z","snapshot_observed_at":"2026-07-06T19:16:23.103921Z","submitted_at":"2024-09-16T21:47:52Z","title":"Investigating Training Objectives for Generative Speech Enhancement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10753","snapshot_observed_at":"2026-08-07T12:24:09.764102Z","title":"Investigating train- ing objectives for generative speech enhancement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:09.764102Z"},"links":{"cited_paper":"/paper/2409.10753","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:0b4b59bcd6f4673b56638b2afee09de47d716f4dc719237095b455835d47c016","observation_id":"faf033a5-86e1-4153-8f2d-fc60cd1d494a","resolution":{"observed_at":"2026-08-07T12:24:09.764102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.771483Z","title":"Reverse-time diffusion equation models,","venue":null,"work_id":"55cd0232-4d9a-4efd-bb40-a0c5cba1805b","year":1982},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.157469Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:6f1d3ddd0fb9ec1b561fdd2132b7df4bcc0015cd06f390593c8d473ffde7b26a","observation_id":"83e33e75-accc-46a1-89c2-e7a64eb248ca","resolution":{"observed_at":"2026-08-07T12:24:20.798766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.704280Z","title":"A connection between score matching and denoising au- toencoders,","venue":null,"work_id":"1d14c62e-dd7f-4e44-a1e8-00c7c7b66783","year":2011},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.527907Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:cc49a39ce77dbbcd59f4fb972563d42322db2dc537848c3c96bbc204965b4803","observation_id":"956fb354-0aff-43b5-b3f3-ba83b30edce1","resolution":{"observed_at":"2026-08-07T12:24:20.740705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.650887Z","title":null,"venue":null,"work_id":"9d58b60b-584e-4e04-b053-02d2513448b1","year":1992},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.626032Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:f12b98a5c1e821f19cf31575f99bfc8144fc340d4f2a1d9f3133b03d279872f1","observation_id":"907f9ce7-840c-4be4-99fa-9390c305cf94","resolution":{"observed_at":"2026-08-07T12:24:20.669457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.595370Z","title":"Correlation functions and computer simulations,","venue":null,"work_id":"3480847d-3891-4eb2-b678-6fef7c9f2c07","year":1981},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.717840Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:ff2b9aa9a5473f3f7d48bc328d026ceeeef05161e6d6db146eb2ffb448fee0e8","observation_id":"3d171b47-8d30-460d-96d1-c6b3db313eb9","resolution":{"observed_at":"2026-08-07T12:24:20.616617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13285","last_updated":"2024-09-20T07:29:44Z","snapshot_observed_at":"2026-08-04T11:25:20.967287Z","submitted_at":"2024-09-20T07:29:44Z","title":"LiSenNet: Lightweight Sub-band and Dual-Path Modeling for Real-Time Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2409.13285","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.13285","snapshot_observed_at":"2026-08-07T12:24:14.635090Z","title":"LiSenNet: Lightweight Sub-band and Dual-Path Modeling for Real-Time Speech Enhancement","venue":"eess.AS","work_id":"c0f71079-76cc-4d71-b8a2-b58e6920486b","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.789466Z"},"links":{"cited_paper":"/paper/2409.13285","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:d8f5fe08bb0df9d4b42a5cb290685f5c4c46ab45cfafb3fb3214a5c352172e88","observation_id":"29b3686b-6a75-443f-878a-0554ea20c077","resolution":{"observed_at":"2026-08-07T12:24:14.702747Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.529319Z","title":"Perceptual linear predictive (PLP) analysis of speech.,","venue":null,"work_id":"fd90902d-4627-47de-81c0-8c5c73840300","year":1990},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:10.877893Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:f52cbe4fd916472f188d48359314edbefcbaa12acc209105b5c5a38f4ec5ad8d","observation_id":"4ce15b95-6eee-4900-b5af-8b1f9a07c9d8","resolution":{"observed_at":"2026-08-07T12:24:20.556666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.473611Z","title":"MetricGAN: Generative adversarial networks based black-box metric scores optimization for speech enhancement,","venue":null,"work_id":"a97f3623-07df-4b75-bb47-a07ae4f7636c","year":2019},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.028636Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:ea01227146ca6cb370232b29e85dd097e6be2027b7694d56b76367a71d2e8b4e","observation_id":"9ef14024-6dc1-4b19-ba24-8df8417dfbd0","resolution":{"observed_at":"2026-08-07T12:24:20.500655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.399286Z","title":"/spl beta/-order MMSE spectral amplitude estimation for speech enhancement,","venue":null,"work_id":"8a57f641-b12d-4b5f-8394-364804c42ecd","year":2005},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.156365Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:b57cdf28e810c8c05e970f40edbb8d74b27e8a0a31d765cb9cd68e2413b2351c","observation_id":"6fc95435-c716-4e45-937f-54de7ea01ea8","resolution":{"observed_at":"2026-08-07T12:24:20.439765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.276334Z","title":"A consolidated view of loss functions for supervised deep learning-based speech enhancement,","venue":null,"work_id":"8034fdb1-1ee3-4fa3-9b04-d3b99103d419","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.235104Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:49befe8482cc840e67657d404fd0cb3c812d0d7bf2e8bbc3c6654f9988400440","observation_id":"aa8e07d6-1105-454b-bf03-0e8530dfd518","resolution":{"observed_at":"2026-08-07T12:24:20.373489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:20.074696Z","title":"U-Net: Convolutional net- works for biomedical image segmentation,","venue":null,"work_id":"5ddde067-8ceb-4a69-b53f-af4a40c4386e","year":2015},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.299645Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:01fa13c865a7512b5ecf888db66c5946eaec967f654e06708641fa38361e2a9d","observation_id":"fc6c59d1-02ba-4d5c-9b71-26d1a5b27184","resolution":{"observed_at":"2026-08-07T12:24:20.180083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:19.852772Z","title":"Real-time single image and video super-resolution using an efficient sub-pixel convolutional neural network,","venue":null,"work_id":"47e5ffc2-160a-44c4-b4ed-860ce65cd5ef","year":2016},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.377386Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:a1b8b664c879fc6c7f2b96a506fdffb7d5db3cca6d9cda5d3b2b43089662a994","observation_id":"5884eabb-e41a-4eee-94eb-26be67a41819","resolution":{"observed_at":"2026-08-07T12:24:19.940339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:19.672286Z","title":"Fourier features let networks learn high frequency functions in low dimensional domains,","venue":null,"work_id":"a5abf17b-a744-48e2-bac3-d1c3d071ab50","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.454474Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:7193abecb00e89d614d0cabb8d1870850a8da93f68d44f9ef9cea5aabd7019f7","observation_id":"9b67962f-7487-486e-bc64-1fc99f63cbb7","resolution":{"observed_at":"2026-08-07T12:24:19.772693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:19.515886Z","title":"Dual-Path RNN: Efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"3bc702aa-72da-4def-8e51-7569eb8b5184","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.565997Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:b10d03a40b6cf24e9a22c6ec20431a8cd39752f5cc37ddf4a30035aa7b25289a","observation_id":"dc62274f-4101-4084-bb18-add4684c652d","resolution":{"observed_at":"2026-08-07T12:24:19.600207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:19.272649Z","title":"DPCRN: Dual-path convolution recurrent network for single channel speech enhancement,","venue":null,"work_id":"1f2050e1-c2eb-4719-9f68-04d63d6e0f08","year":2021},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.688487Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:c07b978ab1afaa2c0847e10fef9f1e6a6f81f867649fcb354997b94a737b3d39","observation_id":"699c61af-c1d2-4408-83c3-e82a52484c92","resolution":{"observed_at":"2026-08-07T12:24:19.396301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:19.095370Z","title":"DPT-FSNet: Dual-path trans- former based full-band and sub-band fusion network for speech enhance- ment,","venue":null,"work_id":"53aa89f2-f284-4699-b73b-6a9a83ec2eb9","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.871148Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:179dc126dddf6f6761fdefd18bff2187366c9d1715cb72223783381b4a823d56","observation_id":"014f1c48-a188-4599-88ba-942ac7ef487e","resolution":{"observed_at":"2026-08-07T12:24:19.158100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:18.946308Z","title":"Attention is all you need,","venue":null,"work_id":"941c09cb-6815-4013-b090-b028ba910d88","year":2017},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:11.998623Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:fcaa4e518c9623da17da5a3c998c3447ccaef1393e1e9ef11fbdfae86d76649d","observation_id":"1b205694-cfd3-4083-805a-cab046bcd506","resolution":{"observed_at":"2026-08-07T12:24:19.017463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:18.774341Z","title":"TransNeXt: Robust foveal visual perception for vision trans- formers,","venue":null,"work_id":"07d623d7-6389-4e8e-a55a-57c6bf99863f","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.110211Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:dd81a456c4e85e68e0b53057f41b0746723b4d4d53469d163ae4754a08969473","observation_id":"0e2d9f80-c5bc-468b-86d8-483a9d8eb9bd","resolution":{"observed_at":"2026-08-07T12:24:18.875059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:18.536668Z","title":"Xception: Deep learning with depthwise separable convo- lutions,","venue":null,"work_id":"6bd8a79b-a48c-4005-927c-5f2952b4a5a6","year":2017},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.199909Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:e889383b990e567035bbc12e7ccb7610efe3f94459089c016fbc14c832ca5978","observation_id":"a8fc7525-a10a-4722-ac59-ecb2d72e5d40","resolution":{"observed_at":"2026-08-07T12:24:18.651534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08681","last_updated":"2020-08-13T05:42:12Z","snapshot_observed_at":"2026-07-06T08:16:16.271286Z","submitted_at":"2019-08-23T06:22:06Z","title":"Mish: A Self Regularized Non-Monotonic Activation Function","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.08681","snapshot_observed_at":"2026-08-07T12:24:12.307546Z","title":"Mish: A self regularized non-monotonic neural activation function,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.307546Z"},"links":{"cited_paper":"/paper/1908.08681","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:deacb60e8bd02b54408d0730779e759ca55da710ab29d86e2374ce92756de791","observation_id":"4bcfc627-8130-47e1-9fa1-c0cc91ef5ad8","resolution":{"observed_at":"2026-08-07T12:24:12.307546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:18.341525Z","title":"A novel noise-aware deep learning model for underwater acoustic denoising,","venue":null,"work_id":"238af38b-9558-416d-8e5b-bdf6e613b6f1","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.339276Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:0f1b3ccbd2fe3fd66435bd806d10019437219acf04b382f016af6c5b0c42c426","observation_id":"f3c196c3-d4e3-432b-a0fd-520033d1df33","resolution":{"observed_at":"2026-08-07T12:24:18.407951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.04323","last_updated":"2020-09-09T14:26:56Z","snapshot_observed_at":"2026-07-06T09:54:12.429500Z","submitted_at":"2020-09-09T14:26:56Z","title":"VoiceFilter-Lite: Streaming Targeted Voice Separation for On-Device Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.04323","snapshot_observed_at":"2026-08-07T12:24:12.388358Z","title":"V oiceFilter-Lite: Streaming targeted voice separation for on-device speech recognition,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.388358Z"},"links":{"cited_paper":"/paper/2009.04323","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:0608506ef578c5c8268ffaac8369bceccae28c1f9af730f8a03111dc8653bb17","observation_id":"6fff9da2-e798-40a7-aa85-a5c5b7150cbc","resolution":{"observed_at":"2026-08-07T12:24:12.388358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12524","last_updated":"2022-05-30T03:13:08Z","snapshot_observed_at":"2026-07-06T13:13:40.650733Z","submitted_at":"2022-05-25T06:40:09Z","title":"Accelerating Diffusion Models via Early Stop of the Diffusion Process","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12524","snapshot_observed_at":"2026-08-07T12:24:12.445142Z","title":"Accelerating diffusion models via early stop of the diffusion process,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.445142Z"},"links":{"cited_paper":"/paper/2205.12524","citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:72eb2ab88e30cd88c22c2802ecd7f81251cc1d6f5840018d01112340527c1643","observation_id":"7f58bf50-c3ee-4a16-888e-e16d4cf7da2e","resolution":{"observed_at":"2026-08-07T12:24:12.445142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:18.142953Z","title":"Truncated diffu- sion probabilistic models and diffusion-based adversarial auto-encoders,","venue":null,"work_id":"e4453f35-a627-4e8d-aa48-4d4b6125098c","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.690369Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:dd06f6fbe893e7dc342c0898f0220dc6afd8e8487d6e310015899fa2d2fa4344","observation_id":"e4bcbe22-253e-44ba-ab4b-0995de6fa805","resolution":{"observed_at":"2026-08-07T12:24:18.237514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.951855Z","title":"ICASSP 2024 speech signal improvement challenge,","venue":null,"work_id":"3dea3402-c57e-4854-92c5-f6fc93707fb0","year":2024},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:12.968642Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:1a6a9fc651f02e9afb4575400f1fd54464923b6edf418bede296a58746215db8","observation_id":"9685b651-acc4-4dcc-91d6-3f6710e0f1f4","resolution":{"observed_at":"2026-08-07T12:24:18.049691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.755785Z","title":"CSR-I (WSJ0) Com- plete","venue":null,"work_id":"a8da14db-4d3b-428c-a1f8-5d42bbceecc2","year":null},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.052996Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:0293510c50f708c668a6f1bea9d56bf480e3d5f3b5004e721b34d4f517f4b569","observation_id":"214e8d44-2ce5-405a-87ef-bed6259fc1f8","resolution":{"observed_at":"2026-08-07T12:24:17.830129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.612873Z","title":"WHAM!: Extending speech separation to noisy environments,","venue":null,"work_id":"2e5d196c-53be-4066-a306-691bc69cc2ca","year":2019},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.137968Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:3771f0e2a8fb11180d0d5e317bda218bf51eee06b6630d21dde7a345735604a2","observation_id":"1b1ab0b4-88a6-456a-b213-59835214521f","resolution":{"observed_at":"2026-08-07T12:24:17.677720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.467415Z","title":"Investi- gating RNN-based speech enhancement methods for noise-robust Text- to-Speech,","venue":null,"work_id":"36dca06a-6f0d-4a2b-9be8-8dcafe7d4430","year":2016},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.228132Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:896ff5df03ba8cd0bbc98bc214ed3b11ca1765ce328ba9a7bbd82670d90c5c6f","observation_id":"3fdfe0fe-9990-4745-9c92-b48a2a556ed0","resolution":{"observed_at":"2026-08-07T12:24:17.537166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.308255Z","title":"The voice bank corpus: Design, collection and data analysis of a large regional accent speech database,","venue":null,"work_id":"80a1fed1-989e-43b1-9665-1b6b76a4b638","year":2013},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.272337Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:2c4d42ee863a2373717ef199cf28d9b4128c379eb419ffbb0eb90088bc93a33f","observation_id":"cfad495d-cf93-4b0d-a008-e4c45f86a98d","resolution":{"observed_at":"2026-08-07T12:24:17.365286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.243826Z","title":"The diverse environments multi- channel acoustic noise database: A database of multichannel environ- mental noise recordings,","venue":null,"work_id":"ff0dcf27-11ea-43a4-b91f-1bf51b3d69ae","year":2013},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.308745Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:b785bddfc0e9b2ce66a6e90a55efee51bff519ec27a755d46f73a9d648a6bf48","observation_id":"85c57405-355a-44fc-84bf-afb04d9b53f2","resolution":{"observed_at":"2026-08-07T12:24:17.274366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.176876Z","title":"“Colorless","venue":null,"work_id":"2664209b-9266-4a4b-a9f1-8e7100582b5a","year":1961},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.362251Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:d7f0af35fc3ac9e5cc45c9c20d0357d9519d6f7370a30f5b6cc082365587b0c7","observation_id":"2f699493-b539-465f-ba04-e1e10d1b99d8","resolution":{"observed_at":"2026-08-07T12:24:17.205350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:17.002437Z","title":"TIMIT Acoustic-Phonetic Continuous Speech Corpus","venue":null,"work_id":"21c60939-96f0-4cb5-869e-e2c312f0704f","year":null},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.424415Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:474506c0326ab50c083963dfc790d4a4f1257b934a3e06bf1d39e251ceafc8e4","observation_id":"ca7c1da7-ee8f-477e-9c90-056c0984ecf4","resolution":{"observed_at":"2026-08-07T12:24:17.118394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:16.817768Z","title":"Perceptual evaluation of speech quality (PESQ)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":"36a49087-98c7-4ceb-b02e-b1a9c1b28e98","year":2001},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.517150Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:32b0b2d4186005d8e6fa857bc7b9a613839fa8d98f4d02f08659dd4d32303120","observation_id":"b17a0026-1d1f-4b78-b888-d51a98d2f7b1","resolution":{"observed_at":"2026-08-07T12:24:16.930761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:16.651825Z","title":"An algorithm for predicting the intelligibility of speech masked by modulated noise maskers,","venue":null,"work_id":"7d34a6e8-ab91-4076-af02-ea442a95100c","year":2009},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.614758Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:3ef1dfae4b787e8697ae9fc0048b1d92ae2b81cbbd6920cb7324e9634179f2f7","observation_id":"67746058-b3ab-46ee-8d91-97fb9823d5b8","resolution":{"observed_at":"2026-08-07T12:24:16.721579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:16.438962Z","title":"Evaluation of objective quality measures for speech enhancement,","venue":null,"work_id":"c1dcc4cd-4c84-4a1f-ae00-e26aa40a3c4c","year":2008},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.684423Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:4bebe234c26f7c01cdb85f4db50112c0becce7f968f383e6d86bb5932ac8b567","observation_id":"bfae7291-8b47-43c6-803d-1dd0051d558c","resolution":{"observed_at":"2026-08-07T12:24:16.541821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:16.220248Z","title":"HIFI++: A unified framework for bandwidth extension and speech enhancement,","venue":null,"work_id":"7718e32b-35ee-4bc7-a30a-01f07deb2918","year":2023},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.743759Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:7e8c832ca83dbfbfe99421d443fc4f60f2d49f76f7e2f27600326ba1f28c2f18","observation_id":"9d41fafd-571d-4fd6-b1ce-9f53864a48ac","resolution":{"observed_at":"2026-08-07T12:24:16.295677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:16.065271Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":"e6744432-070d-4614-8362-ea9742fda264","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.834780Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:ff99ffcab75f32a0a54cb2cbaa3603cd7cf31f4392bf0d85e3543ae26d71c4c5","observation_id":"8b99624a-e29a-420c-ac13-b01c572b0b95","resolution":{"observed_at":"2026-08-07T12:24:16.133672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.839011Z","title":"ViSQOL v3: An open source production ready objective speech and audio metric,","venue":null,"work_id":"dec0c0b4-2d6e-44e8-bfe6-5977e3c4fc82","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.885993Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:6fb4abbb87fb874146a8878386ca95983bfa350f8c90dcc22c4a0cb8f94b017e","observation_id":"8b4dab04-5d7e-4dde-abbc-85bc8e318094","resolution":{"observed_at":"2026-08-07T12:24:15.935720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.690055Z","title":"Distance measures for speech processing,","venue":null,"work_id":"ae652d5b-195d-4854-b694-75b2dcff77ca","year":1976},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.954352Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:df595da922cf0fabdfca1f13a521eeb1dfdf6186a77ec670a1021d4dd2058421","observation_id":"cca8e975-4635-45fb-8805-c5757b6da95b","resolution":{"observed_at":"2026-08-07T12:24:15.727430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:13.997307Z","title":"Image quality assessment: from error visibility to structural similarity,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:13.997307Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:40ae43c964e93b1f460e3202e566e9e64f5ebeebbdb85d8999551f4cbab1df45","observation_id":"3b51a6d6-d1fa-45d4-88be-d5656de7cb81","resolution":{"observed_at":"2026-08-07T12:24:13.997307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.576370Z","title":"Squeezeformer: An efficient transformer for automatic speech recognition,","venue":null,"work_id":"dc07ecd8-2f63-40b8-a07e-f5646e5e8631","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.075055Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:1f544b679024c23b6004462400840a9a0ddc9c7d303af2340e08684c56e7eae6","observation_id":"86e5fe76-5af7-4bac-b698-621d09e1df40","resolution":{"observed_at":"2026-08-07T12:24:15.624026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.409802Z","title":"Improved techniques for training score-based generative models,","venue":null,"work_id":"ddcd51f5-ec95-4815-b928-c57d7c1c15a4","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.161575Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:f41ef70de2b0006a79f9cad49c9451e66b310bd27bd4b794b76962ca6ed6ab3a","observation_id":"cd9de103-4989-48f2-bd1e-c040a9d3ab15","resolution":{"observed_at":"2026-08-07T12:24:15.469187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.245831Z","title":"Conv-TasNet: Surpassing ideal time- frequency magnitude masking for speech separation,","venue":null,"work_id":"3d18137c-a52e-453f-a8bd-12f6a7502979","year":2019},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.254732Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:4d24221b3fa1367f0fe69b9a5913b62cf41dbcde241b8e01e54663a3c3c47727","observation_id":"5b3b72f5-47e2-4ad6-90fc-50fc2df172b2","resolution":{"observed_at":"2026-08-07T12:24:15.296725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:15.066427Z","title":"MANNER: Multi-view attention network for noise erasure,","venue":null,"work_id":"13a6a1e8-31d0-4795-bff6-0b0ec20c2c48","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.336919Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:6b716c4ca97f0e674b99ff7f42cf93c83b9fb5dd450cbc18467d3bc38368c7a0","observation_id":"edc07c6a-688a-4dba-a40b-3f3a9f5954f9","resolution":{"observed_at":"2026-08-07T12:24:15.149360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:14.936539Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":"79149670-2c7a-45bd-a25a-a38e50e49623","year":2020},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.419117Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:8290d8900fd220b03304ebd092f5332d02197b187c6adfd3a6be356e80fba3e8","observation_id":"766f0514-309f-4bb6-8a14-554d66a95834","resolution":{"observed_at":"2026-08-07T12:24:14.988568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:24:14.821103Z","title":"Neural vocoder is all you need for speech super-resolution,","venue":null,"work_id":"ff99ca02-8d6c-460a-b358-a1648f1b9ed0","year":2022},"citing_paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:14.488006Z"},"links":{"citing_paper":"/paper/2505.24576"},"observation_digest":"sha256:a2da98da8dbafef489d3e2a68009b19454853b0c131aae46d87948bfaba5bbf0","observation_id":"610748a8-191a-4b23-98d7-8dc2d555d103","resolution":{"observed_at":"2026-08-07T12:24:14.880228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.24576","last_updated":"2025-05-30T13:26:42Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T12:15:40.920539Z","submitted_at":"2025-05-30T13:26:42Z","title":"A Composite Predictive-Generative Approach to Monaural Universal Speech Enhancement"},"reference_resolution":{"displayed":83,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":71},"total_outbound_references":83},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 83 of 83 outbound references and 0 inbound Pith citation observations for arXiv:2505.24576."}