{"as_of":"2026-08-16T13:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:76a48d2c6524b2c0fd4dc1eced9a17ca6efed7795da55653e5eb2b9b4a5ef3da","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:26:18.310961Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:26:14.579174Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T22:26:18.561313Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"cited_work":{"arxiv_id":"2506.22001","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.22001","snapshot_observed_at":"2026-08-06T22:26:18.561313Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","venue":"eess.AS","work_id":"83bc8aee-b154-4b77-9f89-96a00127f052","year":2025},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:14.579174Z"},"links":{"cited_paper":"/paper/2506.22001","citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:089ee4fa517a535ebe30c78b58b300a14266390741c92d27aa26becb0420fe19","observation_id":"59dcd8da-1759-457e-a33d-1593bd8a2f6d","resolution":{"observed_at":"2026-08-06T22:26:18.665569Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.22001/citation-record","integrity":"/paper/2506.22001/integrity","json":"/paper/2506.22001/citation-record.json","paper":"/paper/2506.22001"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:49.522973Z","title":"Traditional single-channel methods [1, 2] relied on signal processing and statistical modeling","venue":null,"work_id":"ff1b8a5a-84d0-46eb-96ac-066b8771d490","year":null},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:14.501633Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:aa303a581d2c7b8e759498e3e440e8306ccc50f6f7d4a66a2f9efec7e5b3dd13","observation_id":"a02fa4b6-8146-451d-a159-e27586c543a4","resolution":{"observed_at":"2026-08-06T22:26:49.561702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"cited_work":{"arxiv_id":"2506.22001","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.22001","snapshot_observed_at":"2026-08-06T22:26:18.561313Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","venue":"eess.AS","work_id":"83bc8aee-b154-4b77-9f89-96a00127f052","year":2025},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:14.579174Z"},"links":{"cited_paper":"/paper/2506.22001","citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:089ee4fa517a535ebe30c78b58b300a14266390741c92d27aa26becb0420fe19","observation_id":"59dcd8da-1759-457e-a33d-1593bd8a2f6d","resolution":{"observed_at":"2026-08-06T22:26:18.665569Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:49.501451Z","title":"System overview The model takes multi-channel input in the form of time- frequency domain representations of noisy speech signals","venue":null,"work_id":"a63f2b08-6978-429c-b664-9d378729f676","year":null},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:14.647536Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:311dd730e2ff642fed3fa38236a91759a3fa9f1b977513f8b862ef9cbd8d05da","observation_id":"31a51d2f-100d-4ca5-8634-f0c7060ff380","resolution":{"observed_at":"2026-08-06T22:26:49.506319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:49.406649Z","title":"All constituent sub-blocks incorporate residual connections to maintain gradi- ent flow and preserve original signal fidelity","venue":null,"work_id":"c766371e-3f21-43bc-8c0c-d041d598a12c","year":null},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:14.726011Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:f886660a74379d366c55365f6d436f2bae470d1b84efcd5910a0823ec0940877","observation_id":"69ccc4a4-e546-4dc2-bbce-1ebbb69e0344","resolution":{"observed_at":"2026-08-06T22:26:49.474234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:49.322980Z","title":"Dataset Preparation We used the public speech dataset LibriSpeech and multi- channel RIR to generate microphone-array signals for experi- ments","venue":null,"work_id":"1507f7eb-c268-47df-a566-00054521152b","year":null},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:14.782952Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:3ed31926cd4e48e4481430e53724c6b123d2e4c1a28db4ad67a3d5b5fb533eaa","observation_id":"11506383-da91-4c82-8b0b-81f15b30da47","resolution":{"observed_at":"2026-08-06T22:26:49.358437Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:49.143554Z","title":null,"venue":null,"work_id":"bc6e2e1d-ebcf-4818-a445-cb916fa41e73","year":null},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:14.889182Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:184cb2287ddf3cd6115236d817c3807ba87eabadfc990813771ac5b86f331b20","observation_id":"8c8166ec-dcca-4a3f-a557-91a29cb862f0","resolution":{"observed_at":"2026-08-06T22:26:49.234284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:48.990276Z","title":null,"venue":null,"work_id":"e8d7e2e8-27dc-447f-92b8-4f26e5fb0798","year":null},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:14.962049Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:45510edfd9fa9f36a0f5033defb7795081f7563543f343f93e2bee9c82e7d519","observation_id":"83d7b956-180a-4f47-a86d-def81e6cc9d4","resolution":{"observed_at":"2026-08-06T22:26:49.033036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:15.035856Z","title":"Suppression of acoustic noise in speech using spectral subtraction,","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:15.035856Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:9ee4ae74f92f24724b978a33b73b9064dfa8de6424c9d6d50e672789145f7530","observation_id":"2fb9948c-29be-4c3b-ac4b-cbf296fa28d4","resolution":{"observed_at":"2026-08-06T22:26:15.035856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:48.838763Z","title":"Nonnegative matrix fac- torization with the Itakura-Saito divergence: With application to music analysis,","venue":null,"work_id":"5072ce04-ec35-4997-98f8-f492429c87f8","year":2009},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:15.105405Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:8f025cb20f051a63e1a408612aea8de5899308f5abf1eecb55a0187f3487314f","observation_id":"3cff5438-b4a9-4c85-a18a-17db6b4efa74","resolution":{"observed_at":"2026-08-06T22:26:48.912160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:15.192360Z","title":"High-resolution frequency-wavenumber spectrum analysis,","venue":null,"work_id":null,"year":1969},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:15.192360Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:0d8152ca9080a5207d1ecf5c33fd86348460bd774353fdbe6a01945e81c56bed","observation_id":"a166c5de-f8a5-477f-bba2-1e70e477c65b","resolution":{"observed_at":"2026-08-06T22:26:15.192360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:23.539888Z","title":"An alternative approach to linearly con- strained adaptive beamforming,","venue":null,"work_id":"66d6cb31-423a-4b0a-a9b6-d39a5f6515bb","year":1982},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:15.264247Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:eae037263a9ce032683be627d77ddf5de02a39ec5ce4037ea6bf9d2dfaf0e576","observation_id":"84f3fd1b-5eda-4f62-b0c7-49d018f0de2b","resolution":{"observed_at":"2026-08-06T22:26:48.739999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:23.314565Z","title":"Sixty years of frequency-domain monaural speech en- hancement: From traditional to deep learning methods,","venue":null,"work_id":"c2a89b13-20bf-4658-8b91-d010c48837a2","year":2023},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:15.367299Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:b41a9ffa32d62f96399b2349872e5867c8be6e6b78048ab9f87367d41f3c17c0","observation_id":"62038b42-b360-4c96-b67e-df25391966ff","resolution":{"observed_at":"2026-08-06T22:26:23.412837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:23.131400Z","title":"Neural network based spectral mask estimation for acoustic beamforming,","venue":null,"work_id":"ffda4375-6f52-4e04-be66-faf046d2a9aa","year":2016},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:15.457794Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:e227da86b3254758a6f8cfb31affaa9f1c6d0ef252956a60d9076fd50b569ffe","observation_id":"18bcf14a-0cf6-4f2a-8588-ad1494dc6817","resolution":{"observed_at":"2026-08-06T22:26:23.226819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:22.831831Z","title":"Improved MVDR beamforming using single-channel mask prediction networks,","venue":null,"work_id":"d7845db8-c4bc-41ee-b437-0f4648d8654f","year":2016},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:15.498335Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:40b3b20df569fbcaa6ad82aad20a6b371401adc2520eb967d730c215536e023d","observation_id":"bde75a9f-cab7-41f9-9c3d-699d5b57ca12","resolution":{"observed_at":"2026-08-06T22:26:23.019559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:22.616999Z","title":"FaS- Net: Low-latency adaptive beamforming for multi-microphone audio processing,","venue":null,"work_id":"0f6bb880-9dd3-407d-9f0e-db732cee5ddb","year":2019},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:15.610855Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:88d0f64580cfe5ff9cb3053c8cf4700f982c388f24669012ef1fd425d0516893","observation_id":"8c2f808f-fff0-4b22-a652-a1c1e55f01ee","resolution":{"observed_at":"2026-08-06T22:26:22.716425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:22.232922Z","title":"Neural spectrospatial filter- ing,","venue":null,"work_id":"c065fdb1-97c8-42c1-81ba-e9ad2a9c53a7","year":2022},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:15.734601Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:f2b0a9b4935a1bbb185b5e562fb5a8e35bd284ff7217936cecf20db8e2511b84","observation_id":"9e2300b2-10ec-4436-9221-0bb9b3b41309","resolution":{"observed_at":"2026-08-06T22:26:22.443070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:21.947291Z","title":"Phase-aware speech enhancement based on deep neural networks,","venue":null,"work_id":"9b48ca5e-0479-4e8e-a9b3-6c3d4efefd1c","year":2018},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:15.867683Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:a8fd1706ef8b06b113c1a1f3e22f6d674de73c0aed2785f1909e5e67fd63f86a","observation_id":"df1d53f1-d589-44f3-9bef-0691b458c1b6","resolution":{"observed_at":"2026-08-06T22:26:22.038428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:21.742171Z","title":"Real-time binaural speech separation with preserved spatial cues,","venue":null,"work_id":"1749ef0b-5bb9-41c5-a290-678782338d52","year":2020},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:16.059385Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:adf7166865e8761234e5034d4f8a043753e7a4efad8cd5fc94e8daf750e00d6a","observation_id":"ddc82631-69a9-42b6-b56d-2fafeafb76b0","resolution":{"observed_at":"2026-08-06T22:26:21.807864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:21.556594Z","title":"MIMO noise suppression preserving spatial cues for sound source localization in mobile robot,","venue":null,"work_id":"4ed28b67-7a8e-4dc4-85e2-88ca4943d1fd","year":2021},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:16.220386Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:34d6b3d832654b882e52f76401ef1894967af919fb10ba4309e4b9e418f6a4e5","observation_id":"9a788a2e-03fd-4a88-930f-d1e32436f165","resolution":{"observed_at":"2026-08-06T22:26:21.659394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:21.433208Z","title":"Complex-valued spatial au- toencoders for multichannel speech enhancement,","venue":null,"work_id":"c744a03e-9157-43e9-8fbd-fe69c9e986c2","year":2022},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:16.334830Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:e917ce485bcb5a0fac2a6543ee774a2e79d89e4b693ee9bce37ec5018e012e40","observation_id":"21c84b46-681d-48b7-8b1a-ad3946fdc91f","resolution":{"observed_at":"2026-08-06T22:26:21.483446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:21.259028Z","title":"Diffusion model-based MIMO speech denoising and dereverberation,","venue":null,"work_id":"61399db4-471e-43da-96cf-cb03c766af67","year":2024},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:16.484152Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:1262b5b5496f18fb2978f14d092cfb799ddf8b561da0c0f33153bd19ac8b7548","observation_id":"de6b2c6e-33a1-4bc2-abab-fafdcb8ba8da","resolution":{"observed_at":"2026-08-06T22:26:21.342298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:21.089190Z","title":"A Causal U-Net Based Neural Beamforming Network for Real-Time Multi-Channel Speech Enhancement,","venue":null,"work_id":"03d2e63f-ec5a-44d6-9749-8a3005aa3ad1","year":2021},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:16.637360Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:6cd389294e8bc05819c1f6067f2341abc1da70dda61c9f17e104151ce8c76e9c","observation_id":"d07297c1-2c5e-4102-968b-4f33c2fe82be","resolution":{"observed_at":"2026-08-06T22:26:21.193156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:20.976704Z","title":"TPARN: Triple-path attentive recurrent network for time-domain multichannel speech enhancement,","venue":null,"work_id":"cf59f0c8-a2d7-4fd2-8588-b17a597c117d","year":2022},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:16.804584Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:77e4e3b74965e15745258b4d7dc29dad43248505f4c2579f3d5530136d4b7cf6","observation_id":"49a150c0-14fe-4496-9bf8-3d0fafd7b099","resolution":{"observed_at":"2026-08-06T22:26:21.025892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:20.805382Z","title":"Multi-microphone complex spectral mapping for utterance-wise and continuous speech sepa- ration,","venue":null,"work_id":"9637bfac-dcf4-4d71-b9ad-7614cec7ffc1","year":2001},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:16.923781Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:8820c707ce3489112c3fd750ef4be51e82786176748d97b52e22eb521d694842","observation_id":"60abfe57-e8b5-4741-9b10-39814aa17454","resolution":{"observed_at":"2026-08-06T22:26:20.899204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:20.616736Z","title":"Binaural Speech Enhancement Using Deep Com- plex Convolutional Transformer Networks,","venue":null,"work_id":"20ff1630-5a59-44b0-b779-61207a677a70","year":2024},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.006577Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:2757e5b2de72da0fad4f3eb3cf9bce0b0d94130b99c1a2babf3cd60ecbbffc3c","observation_id":"744ab5e6-f63b-4c03-a7f8-5c0f0b128782","resolution":{"observed_at":"2026-08-06T22:26:20.698933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:20.440848Z","title":"Cmgan: Conformer- based metric-gan for monaural speech enhancement,","venue":null,"work_id":"289f7b26-3772-4dcf-a2e5-98b4278c6e48","year":2024},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.093077Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:badbc9ddc5dc52828c13ea234f3d9a26d8ad1267e3fb28d8b040fa39e5518857","observation_id":"1781a4fb-4f7a-456a-ad63-1f014d342c6d","resolution":{"observed_at":"2026-08-06T22:26:20.518956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:20.286196Z","title":"Embedding and beamform- ing: All-neural causal beamformer for multichannel speech en- hancement,","venue":null,"work_id":"a7288dfe-b286-443d-a68e-4b132a8b2ca9","year":2022},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.179789Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:e72ddd6deef51513a04708fe9e95bd7cb54087ca0ad20b55549d481dfbf0d99c","observation_id":"480d2401-f36b-4fa7-9149-5b40fbac38d9","resolution":{"observed_at":"2026-08-06T22:26:20.344553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:20.046787Z","title":"A systematic study of DNN based speech enhancement in reverberant and reverberant- noisy environments,","venue":null,"work_id":"2fceb01b-2a63-41bd-aa64-47a3311c9132","year":2025},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.311099Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:67976ea40e66de40c09931a3b13e05dc061d72af51b067589a157d6fe51ff5c3","observation_id":"9bc63e33-8c77-4bba-9293-1711b7c63370","resolution":{"observed_at":"2026-08-06T22:26:20.191690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:19.772291Z","title":"Wavelet convolutions for large receptive fields,","venue":null,"work_id":"86276489-e5c3-4e83-84fa-ed42ed10046a","year":2024},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.398264Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:2d065a546ca5d6a9b72f0ae340e87d774efd2c9be4e1bc03387cc2441e7aae9d","observation_id":"8efa2ff6-3b4e-4037-b652-eabf3ed5d768","resolution":{"observed_at":"2026-08-06T22:26:19.897739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-15T19:06:16.181826Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-06T22:26:17.482190Z","title":"Conformer: Convolution- augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.482190Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:b543ca52fdca053a6af4ded06c3c3625dda6ed151e310f3e2698fa3710a798d2","observation_id":"37fe7df5-fad6-4e18-9363-f78955c3aa74","resolution":{"observed_at":"2026-08-06T22:26:17.482190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:19.506140Z","title":"MCA: Mul- tidimensional collaborative attention in deep convolutional neural networks for image recognition,","venue":null,"work_id":"d333ddda-59ff-4a06-a0be-fa1d87dbcde7","year":2023},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.574972Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:59ad4fa27241e611b8954363ddf30515c2c63b1235c4d454a95baedef42027ea","observation_id":"0f806992-44d8-4f49-b599-0ae709d5e1a9","resolution":{"observed_at":"2026-08-06T22:26:19.608072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:19.242102Z","title":"Complex ratio mask- ing for monaural speech separation,","venue":null,"work_id":"f1397d7e-edf9-401e-93e3-317c6b40b04c","year":2015},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.656111Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:5774d739664dcb8f111f2d593ec064c6d8333d613d46fb9909c9a53316bbe8c1","observation_id":"8062ecc9-563d-4455-a5a4-e7472cf1c970","resolution":{"observed_at":"2026-08-06T22:26:19.348736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T22:26:17.737943Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.737943Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:3b2119985cdf645a18501aa2b46526c99dbe286d83863944806b69c38372a6cd","observation_id":"54152c03-e945-490b-bd52-3b54c4251cf1","resolution":{"observed_at":"2026-08-06T22:26:17.737943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03740","last_updated":"2018-02-15T20:04:02Z","snapshot_observed_at":"2026-08-12T13:00:33.339808Z","submitted_at":"2017-10-10T17:42:04Z","title":"Mixed Precision Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03740","snapshot_observed_at":"2026-08-06T22:26:17.825305Z","title":"Mixed precision training,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.825305Z"},"links":{"cited_paper":"/paper/1710.03740","citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:4d7ef8a422ea5a1d0cee229c5ca9f6d7b6a0a979baa1634bee325d737daf7deb","observation_id":"37bc830d-ca80-403a-810c-a478621b1dd1","resolution":{"observed_at":"2026-08-06T22:26:17.825305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:17.907942Z","title":"Multi-task learning using uncertainty to weigh losses for scene geometry and semantics,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.907942Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:3adc03533d2f05c69cfe1ca520428cf4e1115e46e3e57587d502ac23b1816b24","observation_id":"4b189904-1fd0-4c69-a4ba-10da8d6cb52c","resolution":{"observed_at":"2026-08-06T22:26:17.907942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.02173","last_updated":"2016-07-07T21:06:48Z","snapshot_observed_at":"2026-08-14T21:49:19.478287Z","submitted_at":"2016-07-07T21:06:48Z","title":"Single-Channel Multi-Speaker Separation using Deep Clustering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.02173","snapshot_observed_at":"2026-08-06T22:26:17.988508Z","title":"Single-channel multi-speaker separation using deep clustering,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:17.988508Z"},"links":{"cited_paper":"/paper/1607.02173","citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:96fe85b32f8a3735dc81fe38f78e4369f7ecc357a680c95b436210f41cfb39aa","observation_id":"1c2fb669-71fc-47a0-bc50-6b159660467b","resolution":{"observed_at":"2026-08-06T22:26:17.988508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:19.038981Z","title":"Per- ceptual evaluation of speech quality (PESQ)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":"0b79c5bf-c570-4e84-a324-5d4ade18b167","year":2001},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:18.066886Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:89d5b95708ada6663ccdfac8f84299cea68a1d2dc69ef00c1f7413664363adea","observation_id":"67eed261-05d5-4fdb-80a9-6452b31a1b79","resolution":{"observed_at":"2026-08-06T22:26:19.125916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:18.191777Z","title":"An algorithm for predicting the in- telligibility of speech masked by modulated noise maskers,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:18.191777Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:b87cab9db328f5dfea20eedee4dceda9963358b04b8bd96f8e388c751ec62bf8","observation_id":"53af90c8-685b-486f-886f-4c633610f524","resolution":{"observed_at":"2026-08-06T22:26:18.191777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:26:18.785122Z","title":"SDR– half-baked or well done?","venue":null,"work_id":"56ad202b-f436-431b-8398-863792dd15cf","year":2019},"citing_paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:18.310961Z"},"links":{"citing_paper":"/paper/2506.22001"},"observation_digest":"sha256:4db3e681aaf27a2ca6c511b7c5e421a16fcdcc210029d9ab6d35802551d791f1","observation_id":"d3c431ea-44cf-41b1-a41b-98c2fbbfb118","resolution":{"observed_at":"2026-08-06T22:26:18.915062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.22001","last_updated":"2025-06-27T08:14:17Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-15T13:30:48.124369Z","submitted_at":"2025-06-27T08:14:17Z","title":"WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 1 inbound Pith citation observation for arXiv:2506.22001."}