{"as_of":"2026-08-07T22:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:966df7a72a569aa8926916a7debc1da7b61aecd150d940ef113b9b91bbbb924a","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T10:29:52.007835Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T23:17:45.299833Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T22:49:01.370716Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"cited_work":{"arxiv_id":"2601.09931","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.09931","snapshot_observed_at":"2026-07-03T22:49:01.370716Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","venue":"cs.SD","work_id":"038324f7-514b-459e-8ea8-196a07705068","year":2026},"citing_paper":{"arxiv_id":"2606.23712","last_updated":"2026-06-16T06:39:04Z","snapshot_observed_at":"2026-08-07T11:29:46.940597Z","submitted_at":"2026-06-16T06:39:04Z","title":"Audio-visual Contrastive Alignment for Diffusion-based Visual-conditioned Speech Enhancement","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T23:17:45.299833Z"},"links":{"cited_paper":"/paper/2601.09931","citing_paper":"/paper/2606.23712"},"observation_digest":"sha256:fc538fc91fbad14757bdc496444d20009c69b4657c3aa5c2d1d50b286eeab333","observation_id":"f9107a07-13aa-4db5-aaa1-dd0767c09fdb","resolution":{"observed_at":"2026-07-03T22:49:01.372695Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2601.09931/citation-record","integrity":"/paper/2601.09931/integrity","json":"/paper/2601.09931/citation-record.json","paper":"/paper/2601.09931"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.054080Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.054080Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:9e24f27ed59e7c7afbf9af0e297ad925faf8938e5965f867fe6a1d40aaa9cda9","observation_id":"663f5268-a6b4-454b-81d1-912b6864d606","resolution":{"observed_at":"2026-08-03T10:29:46.054080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.132548Z","title":"Conv-TasNet: Surpassing ideal time–frequency magnitude masking for speech separation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.132548Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:4881efab5c87612c81bdac315a5bc43441b166f5034ba7d732f0476136465e84","observation_id":"c207fc2b-2b91-44d3-adc0-000d8310378a","resolution":{"observed_at":"2026-08-03T10:29:46.132548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.346973Z","title":"TF- GridNet: Making time-frequency domain models great again for monaural speaker separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.346973Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:510649a437f426fba8c0c20c6f0a73b588e8d50a782e2b6e766d527fd9480dac","observation_id":"9b82016b-28ee-4ecf-8133-42e5961d620b","resolution":{"observed_at":"2026-08-03T10:29:46.346973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.371321Z","title":"TF-CrossNet: Leveraging global, cross-band, narrow-band, and positional encoding for single- and multi-channel speaker separation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.371321Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:9e2d7855021ce46a70c6b3fbb5e681ee29ba5aa2863426b58ba6e1d629be8f96","observation_id":"9ef97742-9bbd-48cb-833d-37016d945a95","resolution":{"observed_at":"2026-08-03T10:29:46.371321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.445021Z","title":"SEGAN: Speech enhancement generative adversarial network,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.445021Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:44d8a49cff42cd7acb7f6509a3accf29dcf885c7b8adb87bba45d53478e79d2f","observation_id":"adff0aca-9e62-4493-8b29-6c0872f2fa3a","resolution":{"observed_at":"2026-08-03T10:29:46.445021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.522170Z","title":"Conditional diffusion probabilistic model for speech enhancement,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.522170Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:e322b143502ff6847ca07d8aecb7e42c58a168bdc79dc74a5d84cedca4c7b44d","observation_id":"ac2cf64e-4f1b-4684-abf9-2f98264c5cf2","resolution":{"observed_at":"2026-08-03T10:29:46.522170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.590769Z","title":"StoRM: A diffusion-based stochastic regeneration model for speech enhancement and dereverberation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.590769Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:349868f238fab698b58882aa136b1de7b4de344fe996cd6c4123646c8a8d0686","observation_id":"36774dac-a60f-4dae-b6a7-89b965032054","resolution":{"observed_at":"2026-08-03T10:29:46.590769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.728488Z","title":"A composite predictive-generative approach to monaural universal speech enhancement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.728488Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:13c1390a1768841519429bbd01874d1a74fefe311db3a9622f81c5eae81cf2de","observation_id":"e3c93030-2603-42b8-b75f-5e35c1fce79c","resolution":{"observed_at":"2026-08-03T10:29:46.728488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.809486Z","title":"GAN-based speech enhancement for low snr using latent feature conditioning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.809486Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:4dc0f1e9cb25868772110fe4967294527fed7c99d5e5ac7bbf00a80725b71e42","observation_id":"e4c051cc-0180-4ec5-a50e-6ab5323e1490","resolution":{"observed_at":"2026-08-03T10:29:46.809486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:46.992303Z","title":"Improving deep speech denoising by noisy2noisy signal mapping,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:46.992303Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:721012cb2ca840a92bd6b15d117dcde7e6ce7acd50e2a9a5023c88289f67993f","observation_id":"c22645ca-d22d-4f47-be5b-b35f29500dde","resolution":{"observed_at":"2026-08-03T10:29:46.992303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.156804Z","title":"Analysis of noisy-target training for DNN-based speech enhancement,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.156804Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:46ae16effabc28b8073ad16bd3acd7edcd3ee0d099398dbb4a7267cabc1c6cbb","observation_id":"011dba21-2477-4b49-a131-b74a14bb064f","resolution":{"observed_at":"2026-08-03T10:29:47.156804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.271580Z","title":"Unsupervised sound separation using mixture invariant training,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.271580Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:51533ddced92dce3e893255cd9b825bcb219758b7738b4182283af03600dfff2","observation_id":"af3a3e24-d2d9-4867-8468-99ee421d294c","resolution":{"observed_at":"2026-08-03T10:29:47.271580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.429312Z","title":"RemixIT: Continual self-training of speech enhancement models via boot- strapped remixing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.429312Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:472ba81a2a71070c798553515694c263eaa15e879df6fd9631618ef43e2af531","observation_id":"da5f590a-37d2-43d0-8343-09d445295ccc","resolution":{"observed_at":"2026-08-03T10:29:47.429312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.540467Z","title":"Self-supervised speech denoising using only noisy audio signals,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.540467Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:cece313a7514e98f4d380039354c83c2b5aba5e31b6c100201d0c52227fcb7b4","observation_id":"7f7e4077-549a-4fd1-8e2c-0eb7f92026cb","resolution":{"observed_at":"2026-08-03T10:29:47.540467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.662628Z","title":"A parallel-data-free speech enhancement method using multi-objective learning cycle-consistent generative adversarial network,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.662628Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:7ddaf61aec541dc013b443c2f828db2b9c4e04e0da1ddc86f2148b271b354186","observation_id":"56535acc-bb6b-4359-b83d-9f1f4d71d65f","resolution":{"observed_at":"2026-08-03T10:29:47.662628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.820490Z","title":"MetricGAN- U: Unsupervised speech enhancement/dereverberation based only on noisy/reverberated speech,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.820490Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:f22aebd2b07a62879fca499af3668ee713ec8496266594d14018f2db917a907c","observation_id":"925b11ee-bdb6-4650-95d6-186aa947331a","resolution":{"observed_at":"2026-08-03T10:29:47.820490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:47.969825Z","title":"Statistical speech enhancement based on probabilistic integration of variational autoen- coder and non-negative matrix factorization,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:47.969825Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:e013ec4161f30e95b9579bff0338a00d9dfd219f5f7b1ec8ac7bbd823acc16e1","observation_id":"130569a8-bb11-4c82-9a56-1fc9ac960322","resolution":{"observed_at":"2026-08-03T10:29:47.969825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.122680Z","title":"Unsupervised speech enhancement using dynamical variational autoencoders,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.122680Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:ec806d89c8bd775933fa594848a5345f0fbc8f72b44aaea57deecef08ff565db","observation_id":"d848a438-bd05-4e98-ae11-21aaa2cadfaf","resolution":{"observed_at":"2026-08-03T10:29:48.122680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.240363Z","title":"Unsupervised speech enhancement with diffusion-based generative models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.240363Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:8bdba8cb0e6b7a31daa9f8d150f86f1c8fcb0222f47aaa806ee18fe1119edefd","observation_id":"92487dda-0993-4a8b-aad5-54a19f995015","resolution":{"observed_at":"2026-08-03T10:29:48.240363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.346958Z","title":"Diffusion- based unsupervised audio-visual speech enhancement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.346958Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:c9fdb89f70071074ea78e9c12534c3806d410cab8d5fc7c6ab3de8ea3a2bb5ee","observation_id":"650304c2-52d1-434f-a032-328b912af4a9","resolution":{"observed_at":"2026-08-03T10:29:48.346958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.460810Z","title":"Posterior transition modeling for unsupervised diffusion-based speech enhancement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.460810Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:921bffe0a5c969d907cfc30e3af78774530b574e96d5be1a0c2638d34006a389","observation_id":"db0e63bd-7d6b-4141-b73d-4f247d3cb185","resolution":{"observed_at":"2026-08-03T10:29:48.460810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.601764Z","title":"Diffusion models for audio restoration: A review,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.601764Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:952d9d264d8f2034148c6219d1bc94657dde5e5f98b2113a66fd97a189f14fb3","observation_id":"76084337-5199-4bae-918b-e76cb10caa34","resolution":{"observed_at":"2026-08-03T10:29:48.601764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00083","last_updated":"2024-09-30T17:34:01Z","snapshot_observed_at":"2026-07-06T19:24:48.032228Z","submitted_at":"2024-09-30T17:34:01Z","title":"A Survey on Diffusion Models for Inverse Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00083","snapshot_observed_at":"2026-08-03T10:29:48.698417Z","title":"A survey on diffusion models for inverse problems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.698417Z"},"links":{"cited_paper":"/paper/2410.00083","citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:a0ad67025b876afe6288d479d60e345fa92d157054554d69cf629234ae40fc07","observation_id":"4b8cd1ba-e0bb-45de-8662-38b41a5e48b1","resolution":{"observed_at":"2026-08-03T10:29:48.698417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.868529Z","title":"Parallel diffusion models of operator and image for blind inverse problems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.868529Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:456d01555ae3de50abc71d58b768b459a727f91798d5fb84a24b1d7fa29bc82f","observation_id":"56b9794a-7f86-4357-a04a-9da25366a5c0","resolution":{"observed_at":"2026-08-03T10:29:48.868529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:48.979821Z","title":"Diffusion-based unsuper- vised audio-visual speech separation in noisy environments with noise prior,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:48.979821Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:23fcbb99ae278a401b3794675eeed16b8cb8f4dc626d7a96345a1f9c0dd35074","observation_id":"f4ac0303-e0e9-4585-a3c1-5b658f73f6fc","resolution":{"observed_at":"2026-08-03T10:29:48.979821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.074014Z","title":"Multi-source diffusion models for simultaneous music generation and sepa- ration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.074014Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:046234bbf6d1bbd3ea75be94123926d1d6099b7bf259e06149c86b2a3e2b4530","observation_id":"095e644e-1538-4fe9-ae95-bb20dde71a81","resolution":{"observed_at":"2026-08-03T10:29:49.074014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.195659Z","title":"A recurrent variational autoencoder for speech enhancement,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.195659Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:8bf5b6101129b7cbc3e5d6dbfa4aade17d908d2b2ec41bfed5e4d56820ab2b9c","observation_id":"fe0f2543-2b10-48c5-9a02-4beff7c76f74","resolution":{"observed_at":"2026-08-03T10:29:49.195659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.396160Z","title":"Investigating RNN- based speech enhancement methods for noise-robust text-to-speech,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.396160Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:adf2a4f10a742290664515f12937e9bcd31b5a748b1f5e62dba493f753ae9738","observation_id":"52341dd8-0735-422a-8bd1-0a2393ac90b5","resolution":{"observed_at":"2026-08-03T10:29:49.396160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.521935Z","title":"A connection between score matching and denoising autoen- coders,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.521935Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:e4fe8f17367751bf036dce199dc8932ba9cc9bd006b6cb0e5c825c6d92422039","observation_id":"97e3003c-536f-4034-81f9-17d93022d75c","resolution":{"observed_at":"2026-08-03T10:29:49.521935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.632171Z","title":"Generative modeling by estimating gradients of the data distribution,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.632171Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:614f23cc52468e5d8fa4e2cffc98211a6b7adaee56fb9c9b9a2484fa0aab34e8","observation_id":"c3dcaa5d-eeb0-48ac-a830-d7f8c9639337","resolution":{"observed_at":"2026-08-03T10:29:49.632171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.758395Z","title":"Score-based generative modeling through stochastic differential equations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.758395Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:19599b1a9101a0e5ed220f6ab0ceb1a8dfdb7318f10fa27eb301fe7e59dc2025","observation_id":"a6c6e3fc-53a2-4265-8b3a-73cacfe352b4","resolution":{"observed_at":"2026-08-03T10:29:49.758395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.881354Z","title":"Speech enhancement and dereverberation with diffusion-based generative models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.881354Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:59487534d5bc3573c1a3cc9f863ed7de0f9e033a3f04a5a82969e9c41543a1de","observation_id":"e62547e6-42a2-48cd-bf2d-18de358f272f","resolution":{"observed_at":"2026-08-03T10:29:49.881354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:49.970531Z","title":"Solving inverse problems in medical imaging with score-based generative models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:49.970531Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:12bf669e3a5473f853a27da0b6e7eb3742ec11fa14a98f0e4b808602215762d6","observation_id":"db330aaa-0ff0-4b3b-b124-3dc3391f1a1d","resolution":{"observed_at":"2026-08-03T10:29:49.970531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.050617Z","title":"Tweedie’s formula and selection bias,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.050617Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:02a33f06f020a00b7aba0424c4266f3810e400acc6f298f214882dcc3231b77b","observation_id":"6b2c3c18-90f0-456f-924f-3d1b2eeee005","resolution":{"observed_at":"2026-08-03T10:29:50.050617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.105514Z","title":"Vincent, T","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.105514Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:af94abccd8f53569f63dd65b6fb43ad9a767fa97a32bcef20ecade407356266b","observation_id":"28419408-5dd8-4caa-b65b-e91771f0b0c0","resolution":{"observed_at":"2026-08-03T10:29:50.105514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.264726Z","title":"Nonnegative matrix factorization with the itakura-saito divergence: With application to music analysis,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.264726Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:ce7b1dfa8e4bd2c7e2cff33734fb4ddf6a9d5a520aa66ba22ad5e6e481474bf1","observation_id":"c1f444a2-72dc-4d33-b116-0ff0e2287849","resolution":{"observed_at":"2026-08-03T10:29:50.264726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.482659Z","title":"Diffusion model based posterior sampling for noisy linear inverse problems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.482659Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:266a1b1043b4de43d8eec6e56334805436fc1a7a47401039c62bf3ca45eb91c4","observation_id":"88e4633c-241d-4c1d-826e-eb67a5dcfa4c","resolution":{"observed_at":"2026-08-03T10:29:50.482659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.641902Z","title":"Diffusion posterior sampling for general noisy inverse problems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.641902Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:78f1fb8137d787cbaac5d3dfa9c78f23bbd7dc3762aaa93306d598ab475d7261","observation_id":"348150bd-6ab7-4eba-8cc4-65abda5c80f8","resolution":{"observed_at":"2026-08-03T10:29:50.641902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.817436Z","title":"CSR-I (WSJ0) complete LDC93S6B,","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.817436Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:39cb9497efaae1db71c75e8ee6af57f2b803e52bb83795fa516d1d8154a50c17","observation_id":"803f51d3-1508-481f-8167-6e996c426a39","resolution":{"observed_at":"2026-08-03T10:29:50.817436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:50.981106Z","title":"The voice bank corpus: Design, collection and data analysis of a large regional accent speech database,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:50.981106Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:4e1cf6c385f358aee506070b451d2ae78c8e592ed83b3dd715df6ac790c5a286","observation_id":"cd7e3209-06c4-496f-aa44-42e22c04ed0e","resolution":{"observed_at":"2026-08-03T10:29:50.981106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.150702Z","title":"The QUT-NOISE-SRE protocol for the evaluation of noisy speaker recognition,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.150702Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:6437078b80d02beebc003e767bf4887c18d5f86fe961a2a28735274fde031eaf","observation_id":"fe4d8429-0cf1-4eea-881d-70e6d3692bde","resolution":{"observed_at":"2026-08-03T10:29:51.150702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.245684Z","title":"The diverse environments multi- channel acoustic noise database (DEMAND): A database of multichannel environmental noise recordings,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.245684Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:475a3acb1499abdcd0cf13bb958daeacb45454c48722eec749ea1aec5990b708","observation_id":"8589b014-cd9f-43b5-bbb3-5d82c617e1ab","resolution":{"observed_at":"2026-08-03T10:29:51.245684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.316446Z","title":"Objective measurement of active speech level,","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.316446Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:bc3cacc8e4a342f768120c0c35cbc1a2b4fa37e77cb427678bb1881e0849520f","observation_id":"075b66f7-79ab-4396-8503-6a72eec231d7","resolution":{"observed_at":"2026-08-03T10:29:51.316446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.385846Z","title":"Algorithms to measure audio pro- gramme loudness and true-peak audio level,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.385846Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:eb51dfe86863417b81b466fe6856d8b659af562263d7af7b1a95909be3b7a7cd","observation_id":"951fff6c-87a9-4907-a15f-12c04856cd1a","resolution":{"observed_at":"2026-08-03T10:29:51.385846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.439659Z","title":"SDR–half-baked or well done?,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.439659Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:f80734d7ca3ecb23af5f78540a8086aa3bcb96eeb0bd6ff7692737eeb5062d63","observation_id":"eccd053b-a2a5-4a37-8d77-b269cb16895c","resolution":{"observed_at":"2026-08-03T10:29:51.439659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.531823Z","title":"An algorithm for predicting the intelligibility of speech masked by modulated noise maskers,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.531823Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:e51d6602c3311392b83cd63964e51f3fcf8c1662cd1bf626394815d0ace6cf40","observation_id":"22093f00-df50-4d20-b345-bc502ee47f8a","resolution":{"observed_at":"2026-08-03T10:29:51.531823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.597060Z","title":"Perceptual evaluation of speech quality (PESQ)-a new method for speech quality assess- ment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.597060Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:d69690c85ead9bceac2f75f71ce40d89e0454fc52d880459e2c7f974c54932ec","observation_id":"78b34de6-cd4f-4344-808f-a67941941195","resolution":{"observed_at":"2026-08-03T10:29:51.597060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.692602Z","title":"DNSMOS P. 835: A non-intrusive perceptual objective speech quality metric to evaluate noise suppressors,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.692602Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:de793459560eae47d97ced0a9d9d5f082eede02f53cc81adb43c0c4a7359862a","observation_id":"b23c5985-f460-47a0-8158-81db09813da8","resolution":{"observed_at":"2026-08-03T10:29:51.692602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.748863Z","title":"FiLM: Visual reasoning with a general conditioning layer,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.748863Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:5f22c0f1089f2474b739b1147406b822fda99c8bc7fcf4f8a0096c2b439d754d","observation_id":"31d5a461-73c6-4389-8a82-6a14ef078a8a","resolution":{"observed_at":"2026-08-03T10:29:51.748863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.823762Z","title":"Objective and subjective evaluation of speech enhancement methods in the udase task of the 7th chime challenge,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.823762Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:032521527296f3a8eb130b7364a232bfbed6dd15a845032d59d55c870de56748","observation_id":"32ba2505-f2de-455a-a58e-9ce1a77a3cbb","resolution":{"observed_at":"2026-08-03T10:29:51.823762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:51.936584Z","title":"Sudo rm-rf: Efficient networks for universal audio source separation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:51.936584Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:7223bdaabf15cc04f163a9016f34b12dd6a4c119bfba7966871b5c664dbc5930","observation_id":"3cf71137-459b-4206-9faa-0b66e020b862","resolution":{"observed_at":"2026-08-03T10:29:51.936584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:29:52.007835Z","title":"Masked spectrogram prediction for unsupervised domain adaptation in speech enhancement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T10:29:52.007835Z"},"links":{"citing_paper":"/paper/2601.09931"},"observation_digest":"sha256:94974ca696cbdc18ca9cdb22804091fe30110904b87330a93d74186626cc2578","observation_id":"45030ebc-d7e8-4426-b424-ca67ffac0dfb","resolution":{"observed_at":"2026-08-03T10:29:52.007835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.09931","last_updated":"2026-05-23T22:38:42Z","latest_version":4,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-03T10:29:45.226942Z","submitted_at":"2026-01-14T23:25:56Z","title":"Diffusion-based Frameworks for Unsupervised Speech Enhancement"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 1 inbound Pith citation observation for arXiv:2601.09931."}