{"as_of":"2026-08-08T14:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:84b0211d428fa155c9b96d5182519ad3331b9d7b7fc0713e59a9a645c9b5f904","coverage":[{"denominator":135,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:59:25.569320Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:58:58.879900Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T09:31:04.427270Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"cited_work":{"arxiv_id":"2505.16911","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16911","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Active speech enhancement: Active speech denoising declipping and dereverberation","venue":null,"work_id":"e757880d-11ca-4e48-8833-4007f3d43abc","year":2025},"citing_paper":{"arxiv_id":"2604.10979","last_updated":"2026-04-13T04:37:46Z","snapshot_observed_at":"2026-08-03T08:41:49.983665Z","submitted_at":"2026-04-13T04:37:46Z","title":"Speech-preserving active noise control: a deep learning approach in reverberant environments","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T15:58:58.879900Z"},"links":{"cited_paper":"/paper/2505.16911","citing_paper":"/paper/2604.10979"},"observation_digest":"sha256:728ca174ceff791de5a750391571d5a2def9cc2c13cec09207b9731037bb348e","observation_id":"f128f3cc-50a3-48be-8202-b1845a584878","resolution":{"observed_at":"2026-05-11T09:31:04.430984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16911/citation-record","integrity":"/paper/2505.16911/integrity","json":"/paper/2505.16911/citation-record.json","paper":"/paper/2505.16911"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:13.537112Z","title":"Suppression of acoustic noise in speech using spectral subtraction","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:13.537112Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:a3eabae58064e6f9336353f9dd5fec58d20c611386394144d7bde4cd55dae20f","observation_id":"8a1588d3-692e-4d57-a0a9-679d1770282d","resolution":{"observed_at":"2026-08-07T14:59:13.537112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:13.671948Z","title":"All-pole modeling of degraded speech","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:13.671948Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:421e2c36cb30103a9b7b831f69046e2f9248c23ff8053137a19227ced78f82fc","observation_id":"29dbc812-51dd-4f5c-986e-6f6f6ea9871a","resolution":{"observed_at":"2026-08-07T14:59:13.671948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:13.795002Z","title":"Speech enhancement using a mini- mum mean-square error short-time spectral modulation magnitude estimator","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:13.795002Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:24345384de21fe93ca5309735f0b56628ad7a7504a8cd7646e15645c535118ca","observation_id":"9296278b-f54b-413e-ab64-70ef49acd8fa","resolution":{"observed_at":"2026-08-07T14:59:13.795002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.09452","last_updated":"2017-06-09T11:34:06Z","snapshot_observed_at":"2026-08-03T16:11:03.130454Z","submitted_at":"2017-03-28T08:39:06Z","title":"SEGAN: Speech Enhancement Generative Adversarial Network","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.09452","snapshot_observed_at":"2026-08-07T14:59:13.914356Z","title":"Segan: Speech enhancement generative adversarial network","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:13.914356Z"},"links":{"cited_paper":"/paper/1703.09452","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:af39366c582e72b788f3d52d811064c47510a689848236b2c4551cc421886046","observation_id":"6f101946-8013-49f0-b6fe-440f4469fab0","resolution":{"observed_at":"2026-08-07T14:59:13.914356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:14.061118Z","title":"A wavenet for speech denoising","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:14.061118Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:191fe405e915d1a2179354856764dba2542718fd2638420119c9e1480fba87d8","observation_id":"f89e203c-566f-4bc9-886a-29a7c4a3f4ff","resolution":{"observed_at":"2026-08-07T14:59:14.061118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:14.205206Z","title":"A new framework for supervised speech enhancement in the time domain","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:14.205206Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:a8924aa31fed390f4905fb03e2224f82a79ae31f668536b14c9953a627759757","observation_id":"cfc5e020-f134-455a-9490-c1837acc06bd","resolution":{"observed_at":"2026-08-07T14:59:14.205206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00264","last_updated":"2020-09-23T03:16:28Z","snapshot_observed_at":"2026-07-06T09:43:44.262748Z","submitted_at":"2020-08-01T13:42:29Z","title":"DCCRN: Deep Complex Convolution Recurrent Network for Phase-Aware Speech Enhancement","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00264","snapshot_observed_at":"2026-08-07T14:59:14.324830Z","title":"Dccrn: Deep complex convolution recurrent network for phase-aware speech enhancement","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:14.324830Z"},"links":{"cited_paper":"/paper/2008.00264","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:dd81a3b9e4da77d91fe7f0298e55220b6ce20e6b1b0612e59054666b643c2945","observation_id":"e586623a-43c2-46ba-9ecd-01e9b3112615","resolution":{"observed_at":"2026-08-07T14:59:14.324830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:14.471024Z","title":"Metricgan: Generative adversarial networks based black-box metric scores optimization for speech enhancement","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:14.471024Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:09fb9a8a9cc61c4ce5aee3e0e54209177888cd9c76ae216debbb0c8f8c5fe586","observation_id":"24584d64-e670-4734-a77e-8225c9b96528","resolution":{"observed_at":"2026-08-07T14:59:14.471024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:14.540000Z","title":"Metricgan+: An improved version of metricgan for speech enhancement","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:14.540000Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:b7641979fa5448a64fcf8fe3176a6a22c1136c9e61681929ae199593b4ca04a5","observation_id":"cff758a4-77ef-46fc-aea9-5e8c953680a0","resolution":{"observed_at":"2026-08-07T14:59:14.540000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:14.625481Z","title":"A multi-resolution approach to gan-based speech enhancement","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:14.625481Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:12dae29a7833aacdbb4301c8a1776698ddb5a56d5b0323eaf5c3e87198435d69","observation_id":"452ee900-3abb-4a85-a334-8f1e82926a07","resolution":{"observed_at":"2026-08-07T14:59:14.625481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:14.736643Z","title":"Metricgan-okd: multi-metric optimization of metricgan via online knowledge distillation for speech enhancement","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:14.736643Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:81f54de2cef26198ea81e3ec034ecb178ae82689a0ab27aa71715afa83013f06","observation_id":"35767552-b12a-4ee2-80f5-ce896924e7f5","resolution":{"observed_at":"2026-08-07T14:59:14.736643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:14.860570Z","title":"Gan-based speech enhance- ment for low snr using latent feature conditioning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:14.860570Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:b2661aa27ff0e894be7857069fc1ae6472d8260a0c24446a1d89b0380c4940f3","observation_id":"9b927b1a-fb9c-48b1-949b-7dd6111dfeab","resolution":{"observed_at":"2026-08-07T14:59:14.860570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:14.995217Z","title":"Tstnn: Two-stage transformer based neu- ral network for speech enhancement in the time domain","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:14.995217Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:e9b51ef649d9a758393b39e1a85d884691340df95c3e5ee93b8a93289296e83d","observation_id":"98ca6b4d-eace-43bb-9335-a7add2317aba","resolution":{"observed_at":"2026-08-07T14:59:14.995217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2022-10781","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:29.993062Z","title":"Efficient transformer-based speech en- hancement using long frames and stft magnitudes","venue":null,"work_id":"7ad26929-cf87-4a7a-a371-57d1c952a8da","year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:15.118699Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:ab10c456c949ae0d38bbc48be0000eac4f2565565b444fe30d986744676fb854","observation_id":"3a1286c6-5f26-4355-95a4-7d5f72171319","resolution":{"observed_at":"2026-08-07T14:59:30.063947Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.04346","last_updated":"2022-11-08T16:12:38Z","snapshot_observed_at":"2026-07-06T14:15:48.224901Z","submitted_at":"2022-11-08T16:12:38Z","title":"Cross-Attention is all you need: Real-Time Streaming Transformers for Personalised Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2211.04346","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.04346","snapshot_observed_at":"2026-08-07T14:59:31.932360Z","title":"Cross-Attention is all you need: Real-Time Streaming Transformers for Personalised Speech Enhancement","venue":"eess.AS","work_id":"847256dd-503f-4651-9786-452900dbea71","year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:15.256205Z"},"links":{"cited_paper":"/paper/2211.04346","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:3983009313b8ba24390342fef52ae7b9807e489f96c53be3f09c2b65f37b76f5","observation_id":"ef277e24-7c21-4de2-bc40-aa289b7259b2","resolution":{"observed_at":"2026-08-07T14:59:32.037256Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15149","last_updated":"2024-03-03T15:32:30Z","snapshot_observed_at":"2026-07-06T12:53:54.017866Z","submitted_at":"2022-03-28T23:53:34Z","title":"CMGAN: Conformer-based Metric GAN for Speech Enhancement","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15149","snapshot_observed_at":"2026-08-07T14:59:15.402693Z","title":"Cmgan: Conformer-based metric gan for speech enhancement","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:15.402693Z"},"links":{"cited_paper":"/paper/2203.15149","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:24b2f1659f619c23ee73e76a70487a56ed5de0b27c45ce18b8b696fdbeb7f4dc","observation_id":"baaab274-d50c-4bb7-8837-3e5574798d18","resolution":{"observed_at":"2026-08-07T14:59:15.402693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:15.516567Z","title":"Improved transformer-based dual-path network with amplitude and complex domain feature fusion for speech enhancement","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:15.516567Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:c364977250d1acff7adc84b676878c1c1c089342286139e4ae1cec15ba77be02","observation_id":"80716b5f-ace7-4253-a03d-02077447d730","resolution":{"observed_at":"2026-08-07T14:59:15.516567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2024-1831","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:29.795203Z","title":"An exploration of length generalization in transformer-based speech enhancement","venue":null,"work_id":"d7267f12-9d45-4eed-8a46-1cdc5439140b","year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:15.674684Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:a625578756c2ad8a857f69791611fc1b2dddac3e15204f7e43650b73e02c4d8a","observation_id":"0e47a91b-fe8c-4782-9553-9888e6f2c70c","resolution":{"observed_at":"2026-08-07T14:59:29.857422Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:15.805517Z","title":"Guimarães, Jiaqi Su, Rithesh Kumar, Tiago H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:15.805517Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:aef9fedc6ceef104849aadd551186828f5ce08699a9aa51412a33ebb330b2a60","observation_id":"dfeac455-2663-49e5-8f59-0fa8032a3108","resolution":{"observed_at":"2026-08-07T14:59:15.805517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:15.905066Z","title":"Conditional diffusion probabilistic model for speech enhancement","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:15.905066Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:37c64d990e9d3f36b9caf57ff361687f3885762f9d87a04762082bdf10a14fbe","observation_id":"654eaeba-34ba-4128-8198-fea2c0b3ab7a","resolution":{"observed_at":"2026-08-07T14:59:15.905066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17004","last_updated":"2022-07-07T16:12:45Z","snapshot_observed_at":"2026-08-05T09:14:41.106005Z","submitted_at":"2022-03-31T12:53:47Z","title":"Speech Enhancement with Score-Based Generative Models in the Complex STFT Domain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17004","snapshot_observed_at":"2026-08-07T14:59:16.033607Z","title":"Speech enhancement with score-based generative models in the complex stft domain","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:16.033607Z"},"links":{"cited_paper":"/paper/2203.17004","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:98cfd80e1c23e803031aaf1e9ef8f98d78e5095cffc663e8bf3b204935121542","observation_id":"0cf4b319-b7f9-4a4d-9aa4-b17496f9b8ad","resolution":{"observed_at":"2026-08-07T14:59:16.033607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:16.142470Z","title":"Speech enhancement and dereverberation with diffusion-based generative models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:16.142470Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:ec55bbe809dc9bbab2c21c630725d1f90336c77d1ffa78c9d63153ec70f07a94","observation_id":"5f3147ea-3c8e-476e-b574-bb902b4ccd03","resolution":{"observed_at":"2026-08-07T14:59:16.142470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:16.244841Z","title":"Storm: A diffusion- based stochastic regeneration model for speech enhancement and dereverberation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:16.244841Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:da9789d033baae11d44ad1650ec01902f2075990c1dba2d23d4226308fee1231","observation_id":"e5746723-b05c-4c5d-a691-5a4c4dc9af14","resolution":{"observed_at":"2026-08-07T14:59:16.244841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:16.337956Z","title":"Revisiting denoising diffusion probabilistic models for speech enhancement: Condition collapse, efficiency and refinement","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:16.337956Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:4e630ad6885cf6fa27b714dac5cca902a9bd0ec5d15091d671ae4f2216501d08","observation_id":"a0a5aac0-00c4-488c-bc2c-0d865a1d9320","resolution":{"observed_at":"2026-08-07T14:59:16.337956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:16.444037Z","title":"Diffusion-based speech en- hancement with a weighted generative-supervised learning loss","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:16.444037Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:9a1a271ef8c6655eaf1663fdf7c7f6462542fabe03a1ec82ac9b6bf3d3560bba","observation_id":"f51fab44-ff92-4b4c-b8a5-d1387c92a4ab","resolution":{"observed_at":"2026-08-07T14:59:16.444037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:16.547606Z","title":"Process of silencing sound oscillations","venue":null,"work_id":null,"year":1936},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:16.547606Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:1b2c7f55b5ef66cb96153b902bc33c73d0d3746882385a37f0dc1135f0785821","observation_id":"758df6a5-8db6-4f56-ad41-a7111d132189","resolution":{"observed_at":"2026-08-07T14:59:16.547606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:16.636984Z","title":"Active control of sound","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:16.636984Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:953a1b25ce5f6c3911bc0da820d478d3e4113d1d7ce58cd64cb9c2a8de906fc0","observation_id":"cdcf1d78-0c85-44a2-ad68-ac1c2a0165f2","resolution":{"observed_at":"2026-08-07T14:59:16.636984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:16.732325Z","title":"Active control of vibration","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:16.732325Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:fc74ae94d1fd02b40d4d06568ab97b4c41ccb00b72c2eef7218f5bb88fec4051","observation_id":"13e913fa-fe08-44ac-a7e9-2a6329fcbfab","resolution":{"observed_at":"2026-08-07T14:59:16.732325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:16.856454Z","title":"E & Fn Spon London, 1997","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:16.856454Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:2a348b6a85291ee18564c910fb4235790dcc8d024cc1cd49f3babaaebf669243","observation_id":"528594b2-f67f-43b5-86d9-a46320f0040a","resolution":{"observed_at":"2026-08-07T14:59:16.856454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:16.978125Z","title":"Active noise control: a tutorial review","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:16.978125Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:a377874f9af9883cff651a6fdbd85c29a3904e1654ca06c434b6b56c8e5dbea2","observation_id":"7c0f8d62-869e-4eaa-8b7f-93157f3c793b","resolution":{"observed_at":"2026-08-07T14:59:16.978125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:17.087155Z","title":"Deep anc: A deep learning approach to active noise control","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:17.087155Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:353ca169bbd65ce9f5d86f3779c5d62cb4be1fdf645ceba5ead419838fd235e8","observation_id":"df3d8cce-9f5b-4019-ae9f-0e525e4668b5","resolution":{"observed_at":"2026-08-07T14:59:17.087155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:17.255124Z","title":"Had-anc: A hybrid system comprising an adaptive filter and deep neural networks for active noise control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:17.255124Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:47f06b403a350b4a641b4318375064129908e2cc3336e8d0a5c142e0590194ed","observation_id":"adc605ed-a083-41ec-bf31-ff602dcb0a72","resolution":{"observed_at":"2026-08-07T14:59:17.255124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:17.388769Z","title":"Deep learning-based active noise control on construction sites","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:17.388769Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:1e23159e8678df3b39a98547bbb4e60cbbbff11ac988734129e3dcdadbc31b9a","observation_id":"309364b3-d8aa-4f24-bdb0-e69071a4bed4","resolution":{"observed_at":"2026-08-07T14:59:17.388769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:17.476350Z","title":"Dnoisenet: Deep learning-based feedback active noise control in various noisy environments","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:17.476350Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:9eb59bb2a0787473852d80d178bd2f40b56d411322d9396585b8c0dcffef3e20","observation_id":"e7a4218c-ddca-4700-b101-027e122a0308","resolution":{"observed_at":"2026-08-07T14:59:17.476350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:17.585251Z","title":"Enhancing active noise control through stacked autoencoders: Training strategies, comparative analysis, and evaluation with practical setup","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:17.585251Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:569da5cb5e6112e485fe55565d41eebcabfcb1bdb47a174b76daf9ed5ed14113","observation_id":"5417f20d-3c84-4c81-be18-357c21be8db2","resolution":{"observed_at":"2026-08-07T14:59:17.585251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:17.734586Z","title":"Generalized performance of neural network controllers for feedforward active control of nonlinear systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:17.734586Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:bd8b03431230119878ed9d1aeddfc668803531b876af50801793ee7a9a023a93","observation_id":"e657110c-273c-42a7-bbc2-dff44ca07e08","resolution":{"observed_at":"2026-08-07T14:59:17.734586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01185","last_updated":"2025-05-25T12:26:37Z","snapshot_observed_at":"2026-08-01T20:42:23.718250Z","submitted_at":"2025-02-03T09:22:26Z","title":"Deep Active Speech Cancellation with Mamba-Masking Network","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01185","snapshot_observed_at":"2026-08-07T14:59:17.842195Z","title":"Deep active speech cancellation with multi-band mamba network, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:17.842195Z"},"links":{"cited_paper":"/paper/2502.01185","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:fcc02e71b24e660edfc6779731a153bb141c90f1edffe8b6b127a79535d2b385","observation_id":"d42018e9-7c35-466b-a04f-f89fb90e1117","resolution":{"observed_at":"2026-08-07T14:59:17.842195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:17.957230Z","title":"Perceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:17.957230Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:eda6279bfdbc7e33dee344d14fc08aed767fc2b501a9a381b7aa01c6edd77e31","observation_id":"4beb1c66-8f85-4e0a-9e55-602983d63578","resolution":{"observed_at":"2026-08-07T14:59:17.957230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.12847","last_updated":"2020-09-06T14:32:59Z","snapshot_observed_at":"2026-07-06T09:31:50.012114Z","submitted_at":"2020-06-23T09:19:13Z","title":"Real Time Speech Enhancement in the Waveform Domain","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.12847","snapshot_observed_at":"2026-08-07T14:59:18.014140Z","title":"Real time speech enhancement in the waveform domain","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:18.014140Z"},"links":{"cited_paper":"/paper/2006.12847","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:394ca875349ac23d5c4ea5d7a19ceb7ca26f447873f2a006d1ec8620f175a080","observation_id":"d90274ff-a7df-4b0f-aac7-1182ac19fb99","resolution":{"observed_at":"2026-08-07T14:59:18.014140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:18.146819Z","title":"Conformer: Convolution- augmented transformer for speech recognition, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:18.146819Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:103c12e18ea205225c427bbe58cfc9558385c4b5b780a2ac9c310413cac2b4e5","observation_id":"b2e83979-13bf-4a50-9f5f-84aafd9764f1","resolution":{"observed_at":"2026-08-07T14:59:18.146819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:18.228418Z","title":"At- tention is all you need in speech separation, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:18.228418Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:e1658cdf3386c5414cab7af424e287fc0429ff747c9f88e5c7f9b8dbbf72bfbf","observation_id":"da23271e-bc2f-429c-84f4-2b55932d11e1","resolution":{"observed_at":"2026-08-07T14:59:18.228418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:18.324784Z","title":"Attentive recurrent network for low-latency active noise control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:18.324784Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:9e68ba048f2dfba678a7903312eb9312d98afc4e0d9d179ee1e30ee8025dbb9d","observation_id":"ed044bf8-2b21-4ec0-951c-0f6d83149250","resolution":{"observed_at":"2026-08-07T14:59:18.324784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:18.412467Z","title":"Selective fixed- filter active noise control based on convolutional neural network","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:18.412467Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:6191b3cfdd4279c72d5b51eca088a80f36a1cc7271a78b33b3b6b1e45c1b552c","observation_id":"8cbd02c2-4cac-4812-8f3a-fbaae9f4e38c","resolution":{"observed_at":"2026-08-07T14:59:18.412467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:18.495672Z","title":"A hybrid sfanc-fxnlms algorithm for active noise control based on deep learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:18.495672Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:def22d3bc1e1f49fc2d16b6172049ae438065dad775a1306058db831983a532b","observation_id":"758b893e-c37b-4911-b0dc-cde634a71a38","resolution":{"observed_at":"2026-08-07T14:59:18.495672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:18.620344Z","title":"An improved artificial bee colony algorithm for model-free active noise control: algorithm and implementation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:18.620344Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:6b5b5584cb33bad1638f360c160301e9c142fa06f461d290fcd9f0cd43de8714","observation_id":"39c65e5f-7756-4ddf-8fda-b10a7b5ec61b","resolution":{"observed_at":"2026-08-07T14:59:18.620344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:18.750062Z","title":"Genetic algorithm-based adaptive active noise control without secondary path identification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:18.750062Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:3eadfb8545c9c667f0886a5e8f25d36e3d73996fb28691c75f427c7f074323a8","observation_id":"1b98be14-7262-4f88-97c6-72b3d051634c","resolution":{"observed_at":"2026-08-07T14:59:18.750062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:18.918431Z","title":"Unsupervised learning based end-to-end delayless generative fixed-filter active noise control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:18.918431Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:f014212fed7f64f7a27abd759b5b8d328eb43ccf9dd22c5f61eea1f07cba0d7f","observation_id":"e1a35822-27f8-468a-873d-bbc2e4fcc962","resolution":{"observed_at":"2026-08-07T14:59:18.918431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:19.031104Z","title":"What is behind the meta-learning initialization of adaptive filter?—a naive method for accelerating convergence of adaptive multichannel active noise control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:19.031104Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:97090d9369f84abe94787ababb1043f76ad33ece8cb976a15b144e70a292a522","observation_id":"3a7d8338-dfde-4f22-bf57-1d1379cbd232","resolution":{"observed_at":"2026-08-07T14:59:19.031104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:19.125322Z","title":"Deep mcanc: A deep learning approach to multi-channel active noise control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:19.125322Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:192042888c616d636649ba6eeefe51fc7709a5b6ca33fd8fde79320a750005ef","observation_id":"ddbc70c1-a28a-4fd3-b1d9-1c41040d44a5","resolution":{"observed_at":"2026-08-07T14:59:19.125322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:19.200319Z","title":"Remote micro- phone technique for active noise control over distributed networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:19.200319Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:99e5469fa61affbb5a46b34a148caca5e45875242d7c2dc67f287d63510372c6","observation_id":"c06a93f4-06f2-4c84-a43c-810d53d68d0d","resolution":{"observed_at":"2026-08-07T14:59:19.200319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:19.286089Z","title":"Spatially selective active noise control systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:19.286089Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:781c9c1837f66337bb1279e3328b44219ff517ce9b214d417ba16e2007718cc3","observation_id":"8a16b5ee-c452-4ae0-a9ea-b11f3be137a7","resolution":{"observed_at":"2026-08-07T14:59:19.286089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:19.376499Z","title":"A time- domain multi-channel directional active noise control system","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:19.376499Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:aff0181bcbac7ffd5f63fb780ac4b7f606759e06ab39553696a4133df79695df","observation_id":"9075ee64-bb76-4a12-9afb-666acb655f7b","resolution":{"observed_at":"2026-08-07T14:59:19.376499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:19.456978Z","title":"Multichannel two-gradient direction filtered reference least mean square algorithm for output-constrained multichannel active noise control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:19.456978Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:f0ce46277030260612cb2f44a3ebda88d874d024684da0631a1b60545654cffe","observation_id":"f093b849-f59a-45a6-b7b1-6f9347402cd3","resolution":{"observed_at":"2026-08-07T14:59:19.456978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:19.514556Z","title":"Low-latency active noise control using attentive recurrent network","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:19.514556Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:87ce0c528b1f8bcd664d2fe8b4aef45e94602c3f47ec2430de92ca7668ab2f17","observation_id":"5551ca5b-68a1-497e-b75b-ef0d2ee11153","resolution":{"observed_at":"2026-08-07T14:59:19.514556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05841","last_updated":"2022-04-17T10:08:38Z","snapshot_observed_at":"2026-08-03T23:46:58.017549Z","submitted_at":"2022-04-12T14:37:39Z","title":"VoiceFixer: A Unified Framework for High-Fidelity Speech Restoration","version":2},"cited_work":{"arxiv_id":"2204.05841","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.05841","snapshot_observed_at":"2026-08-07T14:59:31.410362Z","title":"VoiceFixer: A Unified Framework for High-Fidelity Speech Restoration","venue":"eess.AS","work_id":"f43c3358-b616-4fc8-900f-27567224153a","year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:19.578819Z"},"links":{"cited_paper":"/paper/2204.05841","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:6cd6e245fe0a32f3084a267b1c7a4e1a73b9081b8fd8003c339e1724ab117cc8","observation_id":"499e56ba-28b1-4cb2-882a-4e87255d05ba","resolution":{"observed_at":"2026-08-07T14:59:31.541034Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:19.689551Z","title":"An investigation of incorporating mamba for speech enhance- ment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:19.689551Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:5fa2f0f03ab44131eae9ff6eb079f6a8516af96d5de3ab3a9e95b1e0f145e394","observation_id":"20c5091a-5ef5-4447-a591-ba03525b9cf3","resolution":{"observed_at":"2026-08-07T14:59:19.689551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:19.821411Z","title":"A short-time objective intelligibility measure for time-frequency weighted noisy speech","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:19.821411Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:0fb2b869eb47460b030f174bb6304b482f5373bdd14ef40c195bca6b44c4b03d","observation_id":"73f2289e-ad73-4304-8095-a4d9c12c08ba","resolution":{"observed_at":"2026-08-07T14:59:19.821411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:19.887984Z","title":"Evaluation of objective quality measures for speech enhancement","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:19.887984Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:1cb401c6f35a56b01313d495ce945be407c3c1dcfd52ac35c8be7e2eaced21bc","observation_id":"22f21a1d-81ca-4343-96c1-adb0ffc2e984","resolution":{"observed_at":"2026-08-07T14:59:19.887984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05034","last_updated":"2025-05-20T16:53:31Z","snapshot_observed_at":"2026-07-06T19:12:06.671181Z","submitted_at":"2024-09-08T09:20:04Z","title":"TF-Mamba: A Time-Frequency Network for Sound Source Localization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05034","snapshot_observed_at":"2026-08-07T14:59:20.041958Z","title":"Tf-mamba: A time-frequency network for sound source localization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:20.041958Z"},"links":{"cited_paper":"/paper/2409.05034","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:cbcce4f0a87425becf7508388b8256ce3210f11be8f1806086bb6caae12f5f07","observation_id":"d58d95b8-0014-487a-b4c0-88bda607c91a","resolution":{"observed_at":"2026-08-07T14:59:20.041958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-07T14:59:20.182393Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:20.182393Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:213c7eb71e57111a1b05ff0df75b64cd2ab2421904aa4abc808c791ef2e9ee9d","observation_id":"a7a9956f-0e46-48de-972c-3eb936d167aa","resolution":{"observed_at":"2026-08-07T14:59:20.182393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T14:59:20.281120Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:20.281120Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:27b3ac1fa028658a3e72c866e2afa297a1d9d7444a3524e9cb530ce387ccdc48","observation_id":"8358ae0f-6557-4f2b-ac3d-57aacdce49c3","resolution":{"observed_at":"2026-08-07T14:59:20.281120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19887","last_updated":"2024-07-03T14:30:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T23:55:06Z","title":"Jamba: A Hybrid Transformer-Mamba Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19887","snapshot_observed_at":"2026-08-07T14:59:20.340560Z","title":"Jamba: A hybrid transformer-mamba language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:20.340560Z"},"links":{"cited_paper":"/paper/2403.19887","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:b45b6b3c71fa0ed259c3f47b676ee4f3107a8111f9fd3db0b39f1adf652c6208","observation_id":"49ce5312-51f8-4f02-8605-41374852634a","resolution":{"observed_at":"2026-08-07T14:59:20.340560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13686","last_updated":"2023-05-23T04:48:51Z","snapshot_observed_at":"2026-08-07T19:21:40.251093Z","submitted_at":"2023-05-23T04:48:51Z","title":"MP-SENet: A Speech Enhancement Model with Parallel Denoising of Magnitude and Phase Spectra","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13686","snapshot_observed_at":"2026-08-07T14:59:20.418561Z","title":"Mp-senet: A speech enhancement model with parallel denoising of magnitude and phase spectra","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:20.418561Z"},"links":{"cited_paper":"/paper/2305.13686","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:74a9839873482b4292d381d285bcc4b2dc802423b66dcf3fcc69dea5601c5523","observation_id":"1f85c65f-aa22-4b2b-bb95-2cc626a77d83","resolution":{"observed_at":"2026-08-07T14:59:20.418561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:20.516822Z","title":"Investigating rnn-based speech enhancement methods for noise-robust text-to-speech","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:20.516822Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:613d6bd59bbc1d504c6c4049173dd197e37724078b6290edad3532ce106e7c4d","observation_id":"3646e3e6-e9e9-4fcf-a08f-42c46bdd73fb","resolution":{"observed_at":"2026-08-07T14:59:20.516822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:20.632013Z","title":"The voice bank corpus: Design, collection and data analysis of a large regional accent speech database","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:20.632013Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:8539f5c6306b72f5c7999c8b42c74fbf9c9f8739b6ef234f4913a700a38640b6","observation_id":"170be457-e4d5-4234-89eb-6ff9b3f573f0","resolution":{"observed_at":"2026-08-07T14:59:20.632013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:20.764072Z","title":"The diverse environments multi- channel acoustic noise database (demand): A database of multichannel environmental noise recordings","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:20.764072Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:6d952645f88a7837980ac2c8efb97e0732e94f9ac4df389a8092dd338e4ad17b","observation_id":"e256482a-c278-4c15-b433-810b456ba9a3","resolution":{"observed_at":"2026-08-07T14:59:20.764072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:20.931522Z","title":"Open- source conversational ai with speechbrain 1.0","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:20.931522Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:10225052c1f37d17dd625706755548a39181e72570ea053d8d7400134499a1f8","observation_id":"7a72bb87-ed95-45af-8761-931ed73b93fe","resolution":{"observed_at":"2026-08-07T14:59:20.931522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:21.027478Z","title":"Image method for efficiently simulating small-room acoustics","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:21.027478Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:88db9b3e26dd1d60ea31f74f3f9952c8754e28131ac0e929bd5955645513d031","observation_id":"0f246386-fd97-4b52-b3f2-63471e90f32d","resolution":{"observed_at":"2026-08-07T14:59:21.027478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:21.153362Z","title":"Room impulse response generator","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:21.153362Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:b22d847d84537b5cee294a08fbe25f2d7ff01c02a6c928e4470ba1cad041fd07","observation_id":"5c5ed1d6-e926-4f7d-9d9b-fc8ba94f36a1","resolution":{"observed_at":"2026-08-07T14:59:21.153362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T14:59:21.228087Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:21.228087Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:a22b88b7348743372a45d1a04d54ee6c0b878cd5e7157b438f2e856bbafac787","observation_id":"67ee6dea-9a23-4609-aec1-d587d8601651","resolution":{"observed_at":"2026-08-07T14:59:21.228087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:21.369787Z","title":"Nonlinear thf-fxlms algorithm for active noise control with loudspeaker nonlinearity","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:21.369787Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:757c0d19e6a2d825193ebe8c21d908e41132f45068cad8f7f2dd3216d5124f0c","observation_id":"fe26f107-7c7c-43f4-acc4-fface07b504f","resolution":{"observed_at":"2026-08-07T14:59:21.369787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:21.601020Z","title":"Scaling learning algorithms towards AI","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:21.601020Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:b90ef3067d9239ef5cbf7fc7674c6440c0d526a274fb396e4bc472c213928ed8","observation_id":"939ed2de-7651-4e04-a3d8-a50313b6c512","resolution":{"observed_at":"2026-08-07T14:59:21.601020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:21.737267Z","title":"Hinton, Simon Osindero, and Yee Whye Teh","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:21.737267Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:95d0650c0ae57bbbf1fd7e332aca7d8c0f84cb9f657ce242464d9296f293fc61","observation_id":"f3f87a0b-579b-4a81-a577-d1b70e142059","resolution":{"observed_at":"2026-08-07T14:59:21.737267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:21.905489Z","title":"Deep learning , volume 1","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:21.905489Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:f5311c1123a44048af7d6fabdb6d43230b6c0886200c1bb4ddab8a7cefb74c4c","observation_id":"dcaf3ef4-f4cf-4875-8c86-ce37479505e1","resolution":{"observed_at":"2026-08-07T14:59:21.905489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:22.047060Z","title":"Just relax: Convex programming methods for identifying sparse signals in noise","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:22.047060Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:033c82f7a0c445aa9c71228af6d0a42ee975214dbbd6229b2b92f4d006b5faf8","observation_id":"25122d2d-5f3c-409f-88dd-10dda82a4092","resolution":{"observed_at":"2026-08-07T14:59:22.047060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:22.257823Z","title":"Computationally efficient fixed-filter anc for speech based on long-term predic- tion for headphone applications","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:22.257823Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:bb35e70f7886f0e1209dea9cd9215e1615de68242281de102abff99ba71900ab","observation_id":"3d222bc9-6b8f-4d40-9d81-c79e3748689f","resolution":{"observed_at":"2026-08-07T14:59:22.257823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:22.505077Z","title":"Adaptive sparse linear prediction in fixed-filter anc headphone applications for multi-speaker speech reduction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:22.505077Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:853418f6ad4c274f627341ec9f4ed1a7d5fbfb83b43b2c1581821ad1796bfa47","observation_id":"b833238e-162f-4d45-9081-d257fdfc6f92","resolution":{"observed_at":"2026-08-07T14:59:22.505077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02063","last_updated":"2024-09-10T14:02:58Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:04:31Z","title":"SPMamba: State-space model is all you need in speech separation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02063","snapshot_observed_at":"2026-08-07T14:59:22.650800Z","title":"Spmamba: State-space model is all you need in speech separation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:22.650800Z"},"links":{"cited_paper":"/paper/2404.02063","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:642e2c844d539598db5a2eb339a80aba1cf69a061e30b69133e4d372a898dc9f","observation_id":"132855d6-1165-4f63-8963-1f9d292d60f5","resolution":{"observed_at":"2026-08-07T14:59:22.650800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12609","last_updated":"2025-04-27T05:17:15Z","snapshot_observed_at":"2026-07-06T18:17:12.404441Z","submitted_at":"2024-05-21T09:04:48Z","title":"Mamba in Speech: Towards an Alternative to Self-Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12609","snapshot_observed_at":"2026-08-07T14:59:22.839343Z","title":"Mamba in speech: Towards an alternative to self-attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:22.839343Z"},"links":{"cited_paper":"/paper/2405.12609","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:4e74d3f1621e3d0645e4e61dcd53960598521ee501bab6d766d62829bb5f795c","observation_id":"e616a51c-e7c0-401b-8c5a-9033a8ed3521","resolution":{"observed_at":"2026-08-07T14:59:22.839343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18257","last_updated":"2024-05-01T00:36:13Z","snapshot_observed_at":"2026-08-05T13:52:45.580279Z","submitted_at":"2024-03-27T05:00:08Z","title":"Dual-path Mamba: Short and Long-term Bidirectional Selective Structured State Space Models for Speech Separation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18257","snapshot_observed_at":"2026-08-07T14:59:23.021167Z","title":"Dual-path mamba: Short and long-term bidirectional selective structured state space models for speech separation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:23.021167Z"},"links":{"cited_paper":"/paper/2403.18257","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:51555837fd5b645d68a05904acf1e6e0049e6f11240dc1c7a2af3178088a57c9","observation_id":"bfa37d9c-7c14-4cf6-bb7f-45370ac3b627","resolution":{"observed_at":"2026-08-07T14:59:23.021167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09337","last_updated":"2024-03-14T12:31:10Z","snapshot_observed_at":"2026-08-04T15:08:00.857682Z","submitted_at":"2024-03-14T12:31:10Z","title":"Differential identities of matrix algebras","version":1},"cited_work":{"arxiv_id":"2403.09337","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.09337","snapshot_observed_at":"2026-08-07T14:59:30.907782Z","title":"Differential identities of matrix algebras","venue":"math.RA","work_id":"05200252-7a2c-4386-b10d-60a2ad9a9728","year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:23.188304Z"},"links":{"cited_paper":"/paper/2403.09337","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:f0ff32d186519aafb50d79e0c75d656af986458d84563897b4681d0e92b48eed","observation_id":"69378908-a02e-41ae-9ada-9982125448d5","resolution":{"observed_at":"2026-08-07T14:59:30.982585Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07675","last_updated":"2024-06-19T05:17:22Z","snapshot_observed_at":"2026-07-06T17:43:18.638545Z","submitted_at":"2024-03-12T14:11:29Z","title":"Multichannel Long-Term Streaming Neural Speech Enhancement for Static and Moving Speakers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07675","snapshot_observed_at":"2026-08-07T14:59:23.358559Z","title":"Multichannel long-term streaming neural speech enhance- ment for static and moving speakers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:23.358559Z"},"links":{"cited_paper":"/paper/2403.07675","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:72db619c9a1567f1ea00374f8d7914c7b8fd4d831719e9704c193622647500cb","observation_id":"8f37216c-4654-4a76-9a7a-3399c23b18ab","resolution":{"observed_at":"2026-08-07T14:59:23.358559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03344","last_updated":"2024-06-05T15:00:59Z","snapshot_observed_at":"2026-07-06T18:25:57.572780Z","submitted_at":"2024-06-05T15:00:59Z","title":"Audio Mamba: Bidirectional State Space Model for Audio Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03344","snapshot_observed_at":"2026-08-07T14:59:23.460155Z","title":"Audio mamba: Bidirec- tional state space model for audio representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:23.460155Z"},"links":{"cited_paper":"/paper/2406.03344","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:acd39530d1e3c8ec278cdca4883466e97a6902b6233af6784318b22912f71b48","observation_id":"91788d07-7b50-4666-9220-c2445a9be629","resolution":{"observed_at":"2026-08-07T14:59:23.460155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05057","last_updated":"2024-08-09T13:26:08Z","snapshot_observed_at":"2026-08-04T23:08:13.853275Z","submitted_at":"2024-08-09T13:26:08Z","title":"SELD-Mamba: Selective State-Space Model for Sound Event Localization and Detection with Source Distance Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05057","snapshot_observed_at":"2026-08-07T14:59:23.618705Z","title":"Seld-mamba: Selective state-space model for sound event localization and detection with source distance estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:23.618705Z"},"links":{"cited_paper":"/paper/2408.05057","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:e45dbeb7ae1dc1b1899375ac7de32ffeae0893bc4ec97b8c6d6388558151679a","observation_id":"ff2313ae-b225-4f50-9534-cae7a4486dc8","resolution":{"observed_at":"2026-08-07T14:59:23.618705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06086","last_updated":"2024-06-18T10:20:34Z","snapshot_observed_at":"2026-07-06T18:27:58.433967Z","submitted_at":"2024-06-10T08:13:42Z","title":"RawBMamba: End-to-End Bidirectional State Space Model for Audio Deepfake Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06086","snapshot_observed_at":"2026-08-07T14:59:23.774189Z","title":"Rawbmamba: End-to-end bidirectional state space model for audio deepfake detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:23.774189Z"},"links":{"cited_paper":"/paper/2406.06086","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:fc7a9a1ab0b7dfd6e03c949586c3d60a121dc76e460796b6ec203aeeefc73b2f","observation_id":"16fdd3a9-2e46-49a7-94bf-24876a18b4af","resolution":{"observed_at":"2026-08-07T14:59:23.774189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13636","last_updated":"2024-05-22T13:35:56Z","snapshot_observed_at":"2026-07-06T18:17:54.712067Z","submitted_at":"2024-05-22T13:35:56Z","title":"Audio Mamba: Pretrained Audio State Space Model For Audio Tagging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13636","snapshot_observed_at":"2026-08-07T14:59:23.941915Z","title":"Audio mamba: Pretrained audio state space model for audio tagging","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:23.941915Z"},"links":{"cited_paper":"/paper/2405.13636","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:dbe7961d10f6dfa11fbad4a61e20ef15adcd30cf78201191f0ae3fc0e0d0fbec","observation_id":"242fcf2e-96cf-4229-bb6b-05c3307425db","resolution":{"observed_at":"2026-08-07T14:59:23.941915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02178","last_updated":"2024-06-07T18:41:28Z","snapshot_observed_at":"2026-07-06T18:25:05.750197Z","submitted_at":"2024-06-04T10:19:14Z","title":"Audio Mamba: Selective State Spaces for Self-Supervised Audio Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02178","snapshot_observed_at":"2026-08-07T14:59:24.074303Z","title":"Audio mamba: Selective state spaces for self-supervised audio representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:24.074303Z"},"links":{"cited_paper":"/paper/2406.02178","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:4e1d4ec8005ec837f9dd7bc6c63d88d64cc72f98f2fa2a0cd83f0a99927b06fc","observation_id":"bf0d1e81-8b61-4a49-b2d0-6ad5868b188f","resolution":{"observed_at":"2026-08-07T14:59:24.074303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:37.412479Z","title":"Spherical loudspeaker array for local active control of sound","venue":null,"work_id":"770ae4a3-4faf-43a3-b2a5-5819e81dd8f2","year":2009},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:24.185007Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:0b7ca11e0d77b082cac6f9cb763cad6f6221b434c3b077e7f9504d782fa57f89","observation_id":"fec5f08c-ac95-4421-b6d4-889b3fa106c8","resolution":{"observed_at":"2026-08-07T14:59:37.470287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:37.058056Z","title":"Mambagan: Mamba based metric gan for monau- ral speech enhancement","venue":null,"work_id":"7b664305-73ba-497a-8b81-330dfcb43531","year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:24.276087Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:b74676398eefc4caf49f84c701b7b4e30045bcf5f8b5f79f042888bc6ae3a42d","observation_id":"02ed62c5-0abb-468e-9331-f73938f8f156","resolution":{"observed_at":"2026-08-07T14:59:37.245505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11831","last_updated":"2025-02-04T22:29:08Z","snapshot_observed_at":"2026-07-06T18:16:37.476614Z","submitted_at":"2024-05-20T06:58:47Z","title":"SSAMBA: Self-Supervised Audio Representation Learning with Mamba State Space Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11831","snapshot_observed_at":"2026-08-07T14:59:24.404739Z","title":"Ssamba: Self- supervised audio representation learning with mamba state space model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:24.404739Z"},"links":{"cited_paper":"/paper/2405.11831","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:2e564f60bbf700438a563e820fc3f3539c6cbc782467ad2b9320e0d0b2112ead","observation_id":"e2d02072-ce63-467c-97a0-58615112aa88","resolution":{"observed_at":"2026-08-07T14:59:24.404739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07273","last_updated":"2024-09-11T13:48:23Z","snapshot_observed_at":"2026-07-06T19:13:46.489307Z","submitted_at":"2024-09-11T13:48:23Z","title":"Rethinking Mamba in Speech Processing by Self-Supervised Models","version":1},"cited_work":{"arxiv_id":"2409.07273","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.07273","snapshot_observed_at":"2026-08-07T14:59:30.543898Z","title":"Rethinking Mamba in Speech Processing by Self-Supervised Models","venue":"eess.AS","work_id":"f2c22ef3-466e-44a9-bf97-38f4ecdb8654","year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:24.501842Z"},"links":{"cited_paper":"/paper/2409.07273","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:0204e3e4d9e3482ce74053baa05c95f1e0496da1cd879364d8daf9c9390445a0","observation_id":"e321648d-d535-41e6-96bb-d1fe517be712","resolution":{"observed_at":"2026-08-07T14:59:30.664221Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09732","last_updated":"2024-07-13T00:35:21Z","snapshot_observed_at":"2026-07-06T18:45:43.829010Z","submitted_at":"2024-07-13T00:35:21Z","title":"Speech Slytherin: Examining the Performance and Efficiency of Mamba for Speech Separation, Recognition, and Synthesis","version":1},"cited_work":{"arxiv_id":"2407.09732","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.09732","snapshot_observed_at":"2026-08-07T14:59:30.363657Z","title":"Speech Slytherin: Examining the Performance and Efficiency of Mamba for Speech Separation, Recognition, and Synthesis","venue":"eess.AS","work_id":"613a64d1-955a-42c9-86a5-cb7bc752ff88","year":2024},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:24.662164Z"},"links":{"cited_paper":"/paper/2407.09732","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:4f96be15d6eaf247a7bd34dae04e849a3deeac21447b925fcf882a238792a0b5","observation_id":"49666828-4c20-4681-b816-528a39b9e2a5","resolution":{"observed_at":"2026-08-07T14:59:30.394818Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:36.879595Z","title":"Active speech control using wave- domain processing with a linear wall of dipole secondary sources","venue":null,"work_id":"bd3d5973-9302-41aa-8197-6090df058572","year":2017},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:24.758142Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:164a6d12af8b72ffd0c3172c7be65dc0671feeb044779745d70a3cc911a028b7","observation_id":"e87399a4-029b-41ca-9bf3-98b2bc4bfdf8","resolution":{"observed_at":"2026-08-07T14:59:36.940808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:36.749377Z","title":"Speech emission control using active cancellation","venue":null,"work_id":"655a5d31-5bfd-424b-a1d7-577aa791df0e","year":2007},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:24.833837Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:d643b1037257cdcc2df064faf4890f0b07a11cdb446c7acc534e52f3a0b6d4c0","observation_id":"d3f23d0f-3949-46f3-8912-2782970e4bdf","resolution":{"observed_at":"2026-08-07T14:59:36.808842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:24.986989Z","title":"Soundstream: An end-to-end neural audio codec","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:24.986989Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:5c0353ef5eb8b540361a800f8f0eb759384add4caa874098047c69a34fd3369f","observation_id":"792f9be8-924e-4368-8e45-84c3976c69cf","resolution":{"observed_at":"2026-08-07T14:59:24.986989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-03T16:47:47.192907Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-07T14:59:25.143272Z","title":"High fidelity neural audio compression","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:25.143272Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:efc2dbf8dcc4686f1065d8552c7e034cba5890f735dec9ba92951070e56b5ba8","observation_id":"341e83d2-b4d5-41d6-b2f2-318310f8c595","resolution":{"observed_at":"2026-08-07T14:59:25.143272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T14:59:25.257127Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:25.257127Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:b1ffc79020cf2ea66bc3ca94ec62f8cb910e28a64e18883df9a5b60572c9660b","observation_id":"abc72378-8ccc-4edb-89cf-b67f2e4c19cf","resolution":{"observed_at":"2026-08-07T14:59:25.257127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:36.580738Z","title":"Dual-path rnn: efficient long sequence modeling for time-domain single-channel speech separation","venue":null,"work_id":"501b984e-22a6-477a-a24f-94d22f3415fb","year":2020},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:25.364955Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:8531ea9066a13190ed734ed0bdce0fa8f3a9aba79dfc5507a87c46b53d1fba88","observation_id":"39fc5fc6-8bc7-4c60-b636-055701ce8889","resolution":{"observed_at":"2026-08-07T14:59:36.644556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:36.249974Z","title":"Timit acoustic phonetic continuous speech corpus","venue":null,"work_id":"72fb948b-51df-4c04-a373-f97d170248fb","year":1993},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:25.428085Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:d57b07d62a4a1b37d5d591508475b140f73b8fb2527ecee8077f3828c3b97754","observation_id":"2e15bcc2-e8c4-4a5a-94fb-8121abcdc28b","resolution":{"observed_at":"2026-08-07T14:59:36.375922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:36.029156Z","title":"Assessment for automatic speech recognition: Ii","venue":null,"work_id":"9e7b86d5-56c3-4063-9c87-f1daebf0b901","year":1993},"citing_paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T14:59:25.569320Z"},"links":{"citing_paper":"/paper/2505.16911"},"observation_digest":"sha256:a011592a81d5f97d37cdfc8387ee6492ce7d15b2934de568674ed6b6b4759333","observation_id":"77ecad05-5a3c-41d9-ac02-51767de22912","resolution":{"observed_at":"2026-08-07T14:59:36.103242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16911","last_updated":"2025-05-23T14:33:56Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T14:50:51.848949Z","submitted_at":"2025-05-22T17:10:18Z","title":"Active Speech Enhancement: Active Speech Denoising Decliping and Deveraberation"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":86,"verified_exact":6,"verified_fuzzy":7},"total_outbound_references":135},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 135 outbound references and 1 inbound Pith citation observation for arXiv:2505.16911."}