Pith. sign in

Paper Citation Record · LEDGER

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement

As of 22 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2505.12288.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.12288 v2

Coverage vector

measured 56 of 56 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T20:43:27.389104Z

measured 56 of 56 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-22T06:32:14.747728+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

56 of 56 outbound references displayed

  • verified exact1
  • verified fuzzy51
  • unresolved4
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation d1d9940e-f54b-4839-b75e-f16361745cbb · outbound

This paper cites Some experiments on the recognition of speech, with one and with two ears,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Some experiments on the recognition of speech, with one and with two ears,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.872899Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.409479Z digest=sha256:12092808de7c967bbd07b360483e95b2803d1d92b7b296ae5a1562956372306e

Observation 518523af-87b2-4a3e-b02b-c512a0482e0a · outbound

This paper cites The cocktail party problem,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement The cocktail party problem,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.858988Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.418615Z digest=sha256:1682dafab65588fd6ca6110e812963b41e99f4a9f3cf9d4c77328f38448e5815

Observation 86e66518-3e0e-48ec-8ad5-d7293d16f4d8 · outbound

This paper cites SEGAN: Speech enhancement generative adversarial network,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement SEGAN: Speech enhancement generative adversarial network,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.845266Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.431647Z digest=sha256:a6a3487015a44c599642570992b8318324c648f209b6c9b1b157543ee6077227

Observation 5d47193f-e870-43f9-9b9b-0918badd53b4 · outbound

This paper cites MetricGAN: Generative adversarial networks based black-box metric scores optimization for speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement MetricGAN: Generative adversarial networks based black-box metric scores optimization for speech enhancement,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.762498Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.436509Z digest=sha256:383b3dcb60a103e9317631744a482429e1d677c0bc87cb901f0ca88ed11ae6f0

Observation 2c8b37db-5aa8-4f79-88d7-46081905d844 · outbound

This paper cites MP-SENet: A speech enhancement model with parallel denoising of magnitude,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement MP-SENet: A speech enhancement model with parallel denoising of magnitude,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.661608Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.441421Z digest=sha256:fb9446b3b48d944ae5f14470a1c28359fb724b6b7ba6c0ae426f22c5017dce21

Observation 186896ed-13ac-441c-be69-b134f96b5bdf · outbound

This paper cites Real-time speech enhance- ment in the waveform domain,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Real-time speech enhance- ment in the waveform domain,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.645424Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.445849Z digest=sha256:b945a4576f37b6f24cdd58b942cf983f116c4b164f37aa882ff1628e0ab9dcd2

Observation 49dc7a1d-0e75-49ea-ba1a-8df7f0a7fd0b · outbound

This paper cites Dual-branch attention-in-attention transformer for single-channel speech enhance- ment,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Dual-branch attention-in-attention transformer for single-channel speech enhance- ment,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.630932Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.450203Z digest=sha256:cbdc623f11fe8d543baee802c6919c5c7950411c6acd2d2e8726a2bbb2c81948

Observation 9ae25c25-9c17-4320-82b4-ced28b578804 · outbound

This paper cites DPT-FSNet: Dual-path transformer- based full-band and sub-band fusion network for speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement DPT-FSNet: Dual-path transformer- based full-band and sub-band fusion network for speech enhancement,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.590390Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.454742Z digest=sha256:0baf1b7032bfa259befd403ff2707c4ccf9a981f42e1676f1c7187f0a79ad35a

Observation 43116a11-3f31-4689-8dba-0b31d6e8cb84 · outbound

This paper cites PhaseN: A phase-and- harmonics-aware speech enhancement network,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement PhaseN: A phase-and- harmonics-aware speech enhancement network,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.424359Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.459660Z digest=sha256:3abde2be5741d11f4fd8981807b700a67e5300de948547cd5ec5e3b5f02c8935

Observation 96262c9e-9847-4bcd-8b80-2df7dfe673da · outbound

This paper cites Neural target speech extraction: An overview,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Neural target speech extraction: An overview,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.409767Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.463982Z digest=sha256:21bdf67f753a328aa838c30f18c15854cdbb61af89c9c7d35fff2cdefee6d4da

Observation 35a2d776-6b0b-492a-8a9a-2242c24f6e94 · outbound

This paper cites An overview of deep learning-based audio-visual speech enhancement and separation,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement An overview of deep learning-based audio-visual speech enhancement and separation,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.395852Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.467790Z digest=sha256:43717ee51bf517dbfc76bebbdfcfa0166d9b2017c95964863fa1b913a6845084

Observation 34941dbc-8c23-4b8b-82e5-a0c72803f6d2 · outbound

This paper cites DPCCN: Densely-connected pyramid complex convolutional network for robust speech separation and extraction,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement DPCCN: Densely-connected pyramid complex convolutional network for robust speech separation and extraction,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.307022Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.485030Z digest=sha256:5e5f016e352a8d94f573f5be18076b73ed75beaff9a1577833697537fe2dc14f

Observation 44657de0-f148-4a62-8342-b94cfd8656d4 · outbound

This paper cites High fidelity speech enhancement with band-split rnn,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement High fidelity speech enhancement with band-split rnn,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.195276Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.516955Z digest=sha256:17dad1f884cbc1cca982500d0dacdd2062732b5e6e0ff8d9d12675312e9c834d

Observation 783562d5-d792-4b11-8587-4396f2d533a2 · outbound

This paper cites X-SEPFORMER: End-to-end speaker extraction network with explicit optimization on speaker con- fusion,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement X-SEPFORMER: End-to-end speaker extraction network with explicit optimization on speaker con- fusion,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.181621Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.556456Z digest=sha256:d2cfea4a39ab07364dbb7ec2e46493a16d1c74b3a60edbe3dd1cb486240afa10

Observation 582c7007-c470-40ce-973c-2f61a9472c39 · outbound

This paper cites Deep- FilterNet: Perceptually motivated real-time speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Deep- FilterNet: Perceptually motivated real-time speech enhancement,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.090577Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.609730Z digest=sha256:3b21a88255f25da34c1f796e7f21305002fe6244e6f353189a33cc4b0e4e594c

Observation 8e4fe6b2-62b9-4682-abe1-b917441f110e · outbound

This paper cites SEF-Net: Speaker embedding free target speaker extraction network,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement SEF-Net: Speaker embedding free target speaker extraction network,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.973132Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.685814Z digest=sha256:1eec54c8e9ae4a7acc09806c41d03404fe424a72319dfc40597ddc4f87227d9e

Observation 0a69d6e0-e924-449f-81d6-54b49e15f982 · outbound

This paper cites Target speaker extraction by directly exploiting contextual information in the time-frequency domain,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Target speaker extraction by directly exploiting contextual information in the time-frequency domain,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.958137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.694460Z digest=sha256:c83e3668c0bd00a82262c228410385e2f542c2a20942a0a8ace23d10ffbd1690

Observation a195858b-e966-444a-ba99-be555f8e452a · outbound

This paper cites Personalized speech enhancement without a separate speaker embedding model,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Personalized speech enhancement without a separate speaker embedding model,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.872659Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.703019Z digest=sha256:4d3558184cb6350e70ba02c5a932ee19471b92c20e722f939dbd73bc84240503

Observation eb765355-3171-43a7-a71b-4ddda00d29c8 · outbound

This paper cites Urgent Challenge: Universality, robustness, and generalizability for speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Urgent Challenge: Universality, robustness, and generalizability for speech enhancement,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.796834Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.717931Z digest=sha256:5f29f37d795d5162a79a30fe413be22148b9ce06a2fcd62ba593b47d09d1f747

Observation a6d54836-3e7b-44a2-a825-5c7cfb9c9e45 · outbound

This paper cites AnyEnhance: A unified generative model with prompt-guidance and self-critic for voice enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement AnyEnhance: A unified generative model with prompt-guidance and self-critic for voice enhancement,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-15T20:43:26.722847Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:43:26.722847Z digest=sha256:6f768f2de91029c8a55e582a4f839f6f40785c9e78e964cf045337885e7ed190

Observation 88aafe99-5fb9-4687-b792-aa87dec94063 · outbound

This paper cites Uniaudio: Towards universal audio generation with large language models,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Uniaudio: Towards universal audio generation with large language models,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.781062Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.727724Z digest=sha256:f30aedacdd1e093d25f0b3c0ff02cf1392fc19d4c7c091a365c2e4882c926742

Observation fa2b64c3-2432-42f2-ab9d-66c7c002d53a · outbound

This paper cites Metis: A Foundation Speech Generation Model with Masked Generative Pre-training.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Metis: A Foundation Speech Generation Model with Masked Generative Pre-training

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-15T20:43:26.732480Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:43:26.732480Z digest=sha256:5dbeaf71c665f2da52451b2739b65d201b36261af732e8b9cd32f1e7183c4c70

Observation 854cc2d4-aa87-4ae8-94ef-5b2e7c0e9a24 · outbound

This paper cites Target confusion in end-to-end speaker extraction: Analysis and approaches,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Target confusion in end-to-end speaker extraction: Analysis and approaches,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.686727Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.814496Z digest=sha256:364e8e6232fc33518e94d6d01a26476c72e38dd195948333fc02446752b5c006

Observation ae850b7f-55c3-4971-9d0a-2510bf5e1dd2 · outbound

This paper cites Self-supervised disentangled representation learning for robust target speech extraction,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Self-supervised disentangled representation learning for robust target speech extraction,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.618947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.885119Z digest=sha256:e2d2b31c9f4c4e7700aeab494ad3bbc631f9acef748cac8f6963a067650cc35d

Observation 8c9aaa58-5b33-42fe-a6b1-66f0434fbff5 · outbound

This paper cites Centroid estimation with transformer-based speaker embedder for robust target speaker extraction,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Centroid estimation with transformer-based speaker embedder for robust target speaker extraction,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.604380Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.899153Z digest=sha256:e540b9f8fed642d3ddcc09680f649e09d2e22a2488ae22df79cd1c352059ceae

Observation a8916cf1-3c90-4ae5-aa7c-29573c7f5031 · outbound

This paper cites SEF-PNet: Speaker encoder- free personalized speech enhancement with local and global contexts aggregation,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement SEF-PNet: Speaker encoder- free personalized speech enhancement with local and global contexts aggregation,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.522920Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.915412Z digest=sha256:3b049cb84bd6b084d3a2a580f9b1fbf5dfda19bec6a66062b2c406318314888f

Observation a9e113f9-266c-4b51-833b-21f1dcdcf520 · outbound

This paper cites ECAPA-TDNN: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement ECAPA-TDNN: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.437800Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.920169Z digest=sha256:2538c273332ce2d38af2730aaeb8f15d98f4b23452b206c0ce8a6da96e4bfe0d

Observation f44d7fce-8080-43c4-8f53-9dac83ead6fa · outbound

This paper cites Deep residual learning for image recognition,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Deep residual learning for image recognition,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.421470Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.925543Z digest=sha256:39b4737567280d262974989f5754f330900e6c85016d404a5699dbf5a76ee562

Observation c3bbb6d7-968f-4c03-b5b1-1f0ce177f231 · outbound

This paper cites Improving speaker dis- crimination of target speech extraction with time-domain speakerbeam,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Improving speaker dis- crimination of target speech extraction with time-domain speakerbeam,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.377760Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.929976Z digest=sha256:4c87827410c3b2460571aace85de06f81b77fbb36136b14bb6b72ce097b8e225

Observation 9598fde2-242e-4c21-bc93-650e64f1e903 · outbound

This paper cites SpEx: Multi-scale time domain speaker extraction network,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement SpEx: Multi-scale time domain speaker extraction network,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.240277Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.933697Z digest=sha256:ce58d1bb32526b4507840615195de2cea52b2b4dc71411b8feeb324a1005e66b

Observation c5f35dc2-73ca-4432-bf71-7ec76a2ab480 · outbound

This paper cites SpEx+: A complete time domain speaker extraction network,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement SpEx+: A complete time domain speaker extraction network,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.223821Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.938581Z digest=sha256:7d476ce2aa284b1cbf4f6fd4d6fe5948b6dcee8f60bbfd3fa8c34273855f06b4

Observation 03d06d95-7265-4c8f-9aef-f062c9880fda · outbound

This paper cites MC-SpEx: Towards effective speaker extraction with multi- scale interfusion and conditional speaker modulation,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement MC-SpEx: Towards effective speaker extraction with multi- scale interfusion and conditional speaker modulation,

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.134465Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.943157Z digest=sha256:c44ff8c609cf9e6dd655be4365cdd9fc3873ec2bdc3c39d00eb75644336b4a0f

Observation fce929e7-a9ff-4a19-97cf-3e6708a3d987 · outbound

This paper cites Contrastive self-supervised speaker embedding with sequential disentanglement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Contrastive self-supervised speaker embedding with sequential disentanglement,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.001281Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.948282Z digest=sha256:3dfdf6443019b5ad0bc610a7d2486438c08e704298199dc60376289884842f10

Observation 1f949b2c-b123-45e5-84e2-4cc274956200 · outbound

This paper cites Noise- disentanglement metric learning for robust speaker verification,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Noise- disentanglement metric learning for robust speaker verification,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.985179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.952489Z digest=sha256:f8f72661430bd70f9fec77b4d1782811319c3ee32d8d90363d4c4083db07873f

Observation 723af5d9-18a4-49e2-b102-9d39dcdb4cee · outbound

This paper cites Disentangled speaker embedding for robust speaker verification,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Disentangled speaker embedding for robust speaker verification,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.818766Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:26.975212Z digest=sha256:20a65aaab966dbf6cb7ebdbfe7ad2de191565e585f47a32313d4e1708402f825

Observation 0e5ef2f1-7724-47ec-bcad-5781bfb48aba · outbound

This paper cites Disentangling voice and content with self-supervision for speaker recognition,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Disentangling voice and content with self-supervision for speaker recognition,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.803819Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.061880Z digest=sha256:05f9d861eab90898b8e22dccef4d85b4502b8156cc35fc4790d4098a09ae7dac

Observation 15e40320-674d-4ac9-b689-2a1a5e74d4c6 · outbound

This paper cites Time-domain target-speaker speech separation with waveform-based speaker embedding,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Time-domain target-speaker speech separation with waveform-based speaker embedding,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.789913Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.112791Z digest=sha256:17a7e90b6116d6e18a7c5f3b9fe362a84b6cd400784154723096c7b1f58e1f38

Observation 1887585c-5bad-47a9-aa64-dd0acef41036 · outbound

This paper cites Universal Speech Enhancement with Score-based Diffusion.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Universal Speech Enhancement with Score-based Diffusion

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-15T20:43:27.126788Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:43:27.126788Z digest=sha256:add471ff8ce17fced3b8e2da48bd4d6467fed6c56ba5b246afe27b0268705cff

Observation ea97cac7-ea84-4318-ade7-285a9ac73fae · outbound

This paper cites Conditional diffusion probabilistic model for speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Conditional diffusion probabilistic model for speech enhancement,

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.670606Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.134066Z digest=sha256:88922c61d7c72de780c2cf765dc3cd4bb132529fc5b774f2aebb2adc8705e3f5

Observation a1f7b319-537d-4ce4-bef8-3832ddef194e · outbound

This paper cites V oiceFixer: A unified framework for high-fidelity speech restoration,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement V oiceFixer: A unified framework for high-fidelity speech restoration,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.624829Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.139136Z digest=sha256:299b48b60bb82cf0ad35aa8febb9c5559cb59a347332d1a9641ae8cc04f3d8f5

Observation 579b063b-90cc-45a7-88ae-f285abf51124 · outbound

This paper cites Toward uni- versal speech enhancement for diverse input conditions,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Toward uni- versal speech enhancement for diverse input conditions,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.609788Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.143713Z digest=sha256:eaea9281a8a7ab538c28725e0cb3bce9617f6d17d44915816793e70e126457d4

Observation 0dfe0907-938c-40b0-abe0-586fed7c85fd · outbound

This paper cites Improving design of input condition invariant speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Improving design of input condition invariant speech enhancement,

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.594211Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.148213Z digest=sha256:3ccc2ab2d827cd97142e92790483a4b3d9ada5c0bef8972c9048830bdc52d57f

Observation 617c6ae1-d378-4593-96cf-e630d12f1d3a · outbound

This paper cites Multi-stage speaker extraction with utterance and frame-level reference signals,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Multi-stage speaker extraction with utterance and frame-level reference signals,

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.519033Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.153080Z digest=sha256:194b70ed71305d24f0bec0b3dd0beb15100dcc569473fde2ef85503d35c4a2bb

Observation 1c1e8085-06a8-4820-b72b-6dfb0e1ffc3a · outbound

This paper cites Short-duration Speaker Verification (SdSV) Challenge 2021: the Challenge Evaluation Plan.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Short-duration Speaker Verification (SdSV) Challenge 2021: the Challenge Evaluation Plan

Reference 44

Resolution
verified exact
local_arxiv, observed 2026-08-15T20:43:27.499365Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.157484Z digest=sha256:664599f207075ce96cf4cdf6c09830f68ee72853a4c82faf7950740d80b1d41d

Observation 31a6eadf-1a8a-475d-acde-7bd2a8c27356 · outbound

This paper cites Discriminative neural embed- ding learning for short-duration text-independent speaker verification,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Discriminative neural embed- ding learning for short-duration text-independent speaker verification,

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.372304Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.234082Z digest=sha256:cffb475e7906bf2ee6396188d0e7ae14cd5d6b8f8dbf8e005e361a4aa5ce371e

Observation 981c31f7-95df-4a96-9f0c-d513979200f4 · outbound

This paper cites ERes2NetV2: Boosting short-duration speaker verification performance with computational efficiency,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement ERes2NetV2: Boosting short-duration speaker verification performance with computational efficiency,

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.356979Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.310802Z digest=sha256:6cb842064159ddfa2ce5edd2faa8d3c08e82ff3e404aa9299917053b2333d1ea

Observation d3c7b274-6911-4316-a786-d6cf905f04b9 · outbound

This paper cites Augmenting short enrollment speech via synthesis for target speaker ex- traction,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Augmenting short enrollment speech via synthesis for target speaker ex- traction,

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.342528Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.322594Z digest=sha256:995df6af4a73d043a98ab25ae67ed1c9e1f01504c4ed3bbe4261eca51bf8a0bf

Observation 7e0b163c-2cb0-4126-aea6-75e56087c694 · outbound

This paper cites Target speaker extraction with ultra-short reference speech by ve-ve framework,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Target speaker extraction with ultra-short reference speech by ve-ve framework,

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.317899Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.340189Z digest=sha256:73f0be31bcea07b0deaa25839524824cae797c54dcb0d07d0ac07545062e8b7c

Observation 3a783352-970d-4bd9-8a78-b461c9acd15b · outbound

This paper cites Sdr–half-baked or well done?.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Sdr–half-baked or well done?

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.263686Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.354172Z digest=sha256:34fc3beb29f5b0b2b15d7cd895c31896765145b719242bef95b118e6cc4ef695

Observation 6771830a-7bab-4547-bc47-dae05fc4360c · outbound

This paper cites LibriMix: An Open-Source Dataset for Generalizable Speech Separation.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement LibriMix: An Open-Source Dataset for Generalizable Speech Separation

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-15T20:43:27.359520Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:43:27.359520Z digest=sha256:77c802d0a1c9b3f6505d8305cff5608972b9eee43b286427995eeb1ad257d04b

Observation 686563ab-2c2f-482e-befd-1d16781b28b1 · outbound

This paper cites Investi- gating rnn-based speech enhancement methods for noise-robust text-to- speech,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Investi- gating rnn-based speech enhancement methods for noise-robust text-to- speech,

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.155754Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.364775Z digest=sha256:282d5067dd5307bb231a0cc2db7d64bd649270e871cc67305c04266e8328b03c

Observation 8c9a7d18-db6e-4a69-9ba2-013a51381679 · outbound

This paper cites On the importance of power compression and phase estimation in monaural speech dereverberation,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement On the importance of power compression and phase estimation in monaural speech dereverberation,

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.138571Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.369494Z digest=sha256:342d5b1dc827896e6f3eedde0f1df9d5f18860b062288fb605bdcbba8e4b0baf

Observation 7b4d8cba-98ab-4b46-9a89-42c30e378ef5 · outbound

This paper cites Adam: A method for stochastic optimization,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Adam: A method for stochastic optimization,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.074763Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.373885Z digest=sha256:a59a94204a89a85addcf2fade502f0e48448a0dde1ea1c2797031ff0461aa397

Observation 021d1725-4bd0-46e8-b739-fcc431225301 · outbound

This paper cites Why gradient clipping accelerates training: A theoretical justification for adaptivity,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Why gradient clipping accelerates training: A theoretical justification for adaptivity,

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:27.952517Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.379561Z digest=sha256:e1022d2451999f55bc234c1963f5dac9ef61c038d0c16b407be52711f7ff2c51

Observation cd9e27b8-ad75-4f37-949e-5f108dd77453 · outbound

This paper cites Pesq (perceptual evaluation of speech quality) wrapper for python users,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Pesq (perceptual evaluation of speech quality) wrapper for python users,

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:27.935027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.384198Z digest=sha256:245657919654b300a6e0d9ffd2d71bbc96d43b5c59fbf96081d832e3e739c90b

Observation 8048fb43-aacc-4ba0-af17-eb6dbdacd029 · outbound

This paper cites A short- time objective intelligibility measure for time-frequency weighted noisy speech,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement A short- time objective intelligibility measure for time-frequency weighted noisy speech,

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:27.841070Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-15T20:43:27.389104Z digest=sha256:d96225766410bc4ffbf021cd72a982bb2bda239c04f24d1e1abe42cb94e036b7

Pith citing papers

No inbound Pith citation observations are available.