{"as_of":"2026-08-21T17:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:564fb4d10dbbe956d664bf84e85c612ff588f2456befa349e7a3b8ec3c740c1c","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:43:25.842352Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.12004/citation-record","integrity":"/paper/2501.12004/integrity","json":"/paper/2501.12004/citation-record.json","paper":"/paper/2501.12004"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:27.091043Z","title":"SEGAN: Speech Enhancement Generative Adversarial Network,","venue":null,"work_id":"6d2e8208-235b-4e19-a024-63d67df684fd","year":2017},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.347606Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:976e4fc0b5b6c7e3cc5e7031b7f8e095a6fbadff5ba2c38abda1c8d95d87a5f2","observation_id":"a9ec9a3a-57c1-4570-8b9c-5cce4008c1c0","resolution":{"observed_at":"2026-08-10T17:43:27.096513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:27.075433Z","title":"Real Time Speech Enhancement in the Waveform Domain,","venue":null,"work_id":"e73ad0be-1f8f-4c93-9503-f3327efb1bfd","year":2020},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.389474Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:01c513ec58972b14746f9d7b118b2e1ed4fcb866888da814a990540096042e61","observation_id":"0ea4f0f0-5b04-4140-a93a-c59dc1ea5ae9","resolution":{"observed_at":"2026-08-10T17:43:27.080147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.990956Z","title":"A Convolutional Recurrent Neural Network for Real-Time Speech Enhancement,","venue":null,"work_id":"9d056818-700c-41d1-a493-26f4aa393305","year":2018},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.435036Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:282159fc3e9247b8bafd47b9a8aa286d093ca17731d94506904192927490f03a","observation_id":"0cf62405-336c-4f3e-b20d-f22f9f3f47c4","resolution":{"observed_at":"2026-08-10T17:43:27.049287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.896760Z","title":"DCCRN: Deep Complex Convolution Recurrent Network for Phase-Aware Speech Enhancement,","venue":null,"work_id":"b15df624-c7e5-46ca-b23e-d59828b81899","year":2020},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.480727Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:18051f06983a4a051cc386e8f454ad5f0ccdbb678f4aae5f9ccb1862c2555f87","observation_id":"e9c536bd-b934-4ffe-b7d1-59007b48fed9","resolution":{"observed_at":"2026-08-10T17:43:26.911933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.881979Z","title":"Fullsubnet: A full-band and sub- band fusion model for real-time single-channel speech enhancement,","venue":null,"work_id":"a1e53240-eeeb-4e19-9c62-211470c4a3d8","year":2021},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.526520Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:d20cf7254a38b3692afff4b12bf49ff17bfde0a3b0d056ff243fd042df6aae3c","observation_id":"708b1eab-4f87-413d-bed0-038e09ba141d","resolution":{"observed_at":"2026-08-10T17:43:26.886859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:25.583908Z","title":"Two heads are better than one: A two-stage complex spectral mapping approach for monaural speech enhancement,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.583908Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:6e285f67cae223938bcdd43f93dc7803fd2155ef3736bd71ae6523c835fe4dab","observation_id":"c2d83def-cc43-4ead-b654-a4a4635a8be2","resolution":{"observed_at":"2026-08-10T17:43:25.583908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.857000Z","title":"CMGAN: Conformer-based Metric GAN for Speech Enhancement,","venue":null,"work_id":"ee28379d-28e4-46b7-8fb6-7603f58f11ee","year":2022},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.661482Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:a47ad227c93bdea8ed7047139c4b1117050e39776f79c672e64c0d3909807304","observation_id":"8c313cee-9682-43e3-9874-7374aa285fe6","resolution":{"observed_at":"2026-08-10T17:43:26.861957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.842590Z","title":"Fullsubnet+: Channel attention fullsubnet with complex spectrograms for speech enhancement,","venue":null,"work_id":"9bc73559-4017-455e-95d1-7697c30a78ca","year":2022},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.694816Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:6f44b0e9f40ee9dd868d113670ed5aff91ae58e4fb37c199cffb7b138ef771b6","observation_id":"e5120ed0-10df-41a5-908e-10d116ce3c70","resolution":{"observed_at":"2026-08-10T17:43:26.847429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.826712Z","title":"Improving frame-online neural speech enhancement with overlapped-frame prediction,","venue":null,"work_id":"0bac4237-2f5d-4d2b-95c6-b532290f0aae","year":2022},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.738002Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:0f5babaaba4b5a866b7ff82427f304a112d46019e31d482ddf72afdc5b5b0a2a","observation_id":"5fc56063-3b7d-4047-8624-b36bffbb4651","resolution":{"observed_at":"2026-08-10T17:43:26.832346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04629","last_updated":"2021-02-09T03:34:58Z","snapshot_observed_at":"2026-08-16T18:46:52.463392Z","submitted_at":"2021-02-09T03:34:58Z","title":"Real-time Monaural Speech Enhancement With Short-time Discrete Cosine Transform","version":1},"cited_work":{"arxiv_id":"2102.04629","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.04629","snapshot_observed_at":"2026-08-10T17:43:25.878330Z","title":"Real-time Monaural Speech Enhancement With Short-time Discrete Cosine Transform","venue":"eess.AS","work_id":"084ab942-9335-4a1b-9f2e-0a255d9992d8","year":2021},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.743330Z"},"links":{"cited_paper":"/paper/2102.04629","citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:2a250df24366d4082df706ec70dcd710cd7673dd777d988d75c6d64481f3d7a5","observation_id":"27444aee-ac5f-4c9e-9b7b-41ece9d7b6b0","resolution":{"observed_at":"2026-08-10T17:43:25.885435Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.810608Z","title":"Frcrn: Boosting feature representation using frequency recurrence for monaural speech enhancement,","venue":null,"work_id":"86444ebc-d33d-43d8-bbfa-8bce317d9544","year":2022},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.752594Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:f54bd09c700bd56026607fe8f52ff7c8465963c86738d364c7bc739a2b08342f","observation_id":"1dc09bce-ba6c-4758-8093-f284aff92774","resolution":{"observed_at":"2026-08-10T17:43:26.815608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.707828Z","title":"Iccrn: Inplace cepstral convolutional recurrent neural network for monaural speech enhancement,","venue":null,"work_id":"2b9d7a4c-bfa7-4341-88cb-2e028f483ead","year":2023},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.758697Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:e065ec397f65805cf363d3e6b01e711f164975a115d24b51de68b72e169733d8","observation_id":"256b7306-4f6a-4aa8-89aa-31698fdf6904","resolution":{"observed_at":"2026-08-10T17:43:26.751701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.597033Z","title":"A two-stage framework in cross-spectrum domain for real-time speech enhancement,","venue":null,"work_id":"8d6e4d33-6be2-45d6-97e7-febf5e8cbd0e","year":2024},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.766422Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:238c55fd3631dfb06b80c6162094249f2a2a2a61ad704e026d62d2c8ec29ef66","observation_id":"3c273424-9e08-498c-9214-633eb8db203b","resolution":{"observed_at":"2026-08-10T17:43:26.664115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.580424Z","title":"Discrete cosine transform,","venue":null,"work_id":"57db53a6-3ec1-4c40-a58f-5df97adb82e2","year":1974},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.771182Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:e623791c3f271beb938e184f26d22bada45f2cdaefcfbd6c95a1baf2daa9c227","observation_id":"7b3bf467-7c86-4955-8b37-411fc0ba80a4","resolution":{"observed_at":"2026-08-10T17:43:26.585466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.563792Z","title":"Dual-path rnn: Efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"211ea448-c278-49a6-a3fb-16bfffffe8d8","year":2020},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.777924Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:383eaa1ede045fd669091b2ea48eaec31e268a5d5f26e9f67dc9a78d2e62cace","observation_id":"6bc8622b-c6a4-4803-96cc-e03e4af7d487","resolution":{"observed_at":"2026-08-10T17:43:26.568998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:25.782232Z","title":"Investi- gating rnn-based speech enhancement methods for noise-robust text-to- speech","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.782232Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:608e24e2a72eb7db305f4d06b8773ca97778ab8539f7005d6d72773167af099c","observation_id":"82e112fd-98ff-4e27-8888-15cf4af5b9cf","resolution":{"observed_at":"2026-08-10T17:43:25.782232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.537580Z","title":"The INTERSPEECH 2020 Deep Noise Suppression Challenge: Datasets, Subjective Testing Framework, and Challenge Re- sults,","venue":null,"work_id":"06d4809d-ff4f-442c-8c3a-ca906a227d24","year":2020},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.787340Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:35a69db7410dcd2f46050ed697ce7e2bd492b0fee33c540e1ead539fe3b205d8","observation_id":"c0778040-80c3-4813-9c04-da287be84298","resolution":{"observed_at":"2026-08-10T17:43:26.543053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.500766Z","title":"P. 862.2: Wideband extension to recommendation p. 862 for the assessment of wideband telephone networks and speech codecs,","venue":null,"work_id":"2d3d5d04-7907-4955-b5f7-e9783f977417","year":2005},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.791925Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:3cef1c6395b6b0ccc6299e061a670dacb99e4f3f576f2a1b8f68d5d7125a52d2","observation_id":"cfc75283-f8f6-4aa0-a8ef-078f18f65d78","resolution":{"observed_at":"2026-08-10T17:43:26.527374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:25.796156Z","title":"Evaluation of objective quality measures for speech enhancement,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.796156Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:9f1b71ea165276d291c9742a0e8de75ab42ef065b0045ba93040a00942e51b9b","observation_id":"feb9b5e4-db01-4bc7-b275-2940d53caa12","resolution":{"observed_at":"2026-08-10T17:43:25.796156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.326986Z","title":"Comp- net: Complementary network for single-channel speech enhancement,","venue":null,"work_id":"443fd747-03d8-4152-9dde-fb716993643e","year":2023},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.800494Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:c586221dbb392a80e63cc22b612afab2c0a4b9371c37e7e1ad25d1f23e9516ca","observation_id":"7c7ff96e-7744-4ac2-876a-391bc71ebd97","resolution":{"observed_at":"2026-08-10T17:43:26.372416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.313165Z","title":"Glance and gaze: A collaborative learning framework for single-channel speech enhancement,","venue":null,"work_id":"50c5f539-3316-4b98-bb64-8d8f86b87f66","year":2022},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.805524Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:9fc86ac69c642b479872efb247d2e3140000a4e9edf5743a716556f99b4e793a","observation_id":"65c779b6-b0c8-46ee-b20f-25c7b6611ae3","resolution":{"observed_at":"2026-08-10T17:43:26.317731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.296967Z","title":"Vsanet: Real-time speech enhancement based on voice activity detection and causal spatial attention,","venue":null,"work_id":"3033bb2b-189f-476a-a8b3-f208e302bebe","year":2023},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.810284Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:34ce8c8a4a9e017a207064730120b6a115d8a1eec4feac5e82e21886f0ff7130","observation_id":"027ea34a-de0c-41fe-87f2-b06cceb9b35c","resolution":{"observed_at":"2026-08-10T17:43:26.302500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.281384Z","title":"Sicrn: Advancing speech enhancement through state space model and inplace convolution techniques,","venue":null,"work_id":"881a1b1a-3987-4a5d-9821-f86f42fc7956","year":2024},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.814962Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:3105dbb91e04efff3cdcac2e894a6ec5f20ca5db53a6289bc080b1674349cfaa","observation_id":"a3040c7c-591a-451b-873f-519ff18e4969","resolution":{"observed_at":"2026-08-10T17:43:26.286338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.249888Z","title":"PoCoNet: Better Speech Enhancement with Frequency- Positional Embeddings, Semi-Supervised Conversational Data, and Bi- ased Loss,","venue":null,"work_id":"aa7624ba-9a66-4987-b017-10f37703a0ca","year":2020},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.819452Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:eb0177866bf95b0110cd14a2c57ba3ee7f9a34d9b6edd28fc2d102452d78a1f3","observation_id":"e7ffa7ac-6e25-48ba-9bb8-694ef4555354","resolution":{"observed_at":"2026-08-10T17:43:26.271616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:26.125854Z","title":"Inter-subnet: Speech enhancement with subband interaction,","venue":null,"work_id":"289cf2db-c196-47e6-9f7e-7376fd928151","year":2023},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.823949Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:07698ff2b85b181daa88c61b5b44ef70fba0f582168db4bc2c5ca0abe88323c2","observation_id":"44ac97e8-0650-4874-aeb1-4776cc1c83ca","resolution":{"observed_at":"2026-08-10T17:43:26.200713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:25.989074Z","title":"Speech Enhancement with Fullband-Subband Cross-Attention Network,","venue":null,"work_id":"83f58679-2809-4e20-87b6-8de447b43f87","year":2022},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.828387Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:483f6f9437fd4480ed6d7508d804b31f8e8dda6f0a4679f00c67ed11eb0fc3e6","observation_id":"fdc9b51b-64be-4052-bf04-ca1338804005","resolution":{"observed_at":"2026-08-10T17:43:26.036081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:25.922959Z","title":"Perceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":"c029bd55-19e7-4009-8327-884e061b5848","year":2001},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.833084Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:57a6524ad5ae94b0ae9d2955daf32c697b3a4d4605ed0e2517289400297b0d64","observation_id":"e79f2c6a-abb0-48fa-848a-4ff512337bd3","resolution":{"observed_at":"2026-08-10T17:43:25.957546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:25.837668Z","title":"An algorithm for intelligibility prediction of time–frequency weighted noisy speech,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.837668Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:8cb2d8319c5331b54a9f86ed7d7582d63f464283f1e450f861f35ffbd5150e60","observation_id":"fb7062c2-9bfc-4281-b003-e48f9fefd85b","resolution":{"observed_at":"2026-08-10T17:43:25.837668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:43:25.896858Z","title":"Sdr – half-baked or well done?","venue":null,"work_id":"b52a043f-debe-4bc6-812a-834ed571da80","year":2019},"citing_paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T17:43:25.842352Z"},"links":{"citing_paper":"/paper/2501.12004"},"observation_digest":"sha256:5834a013ac02ad21d1a4c16f3a4c3eab55ee4b0e893edbbe6e159843d2ab6abd","observation_id":"7bec322f-823a-4716-aef6-6d72cd0316b3","resolution":{"observed_at":"2026-08-10T17:43:25.901377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.12004","last_updated":"2025-01-21T09:55:08Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-20T10:27:10.401240Z","submitted_at":"2025-01-21T09:55:08Z","title":"Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2501.12004."}