Pith. sign in

Paper Citation Record · LEDGER

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement

As of 22 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2505.12288.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.12288 v2

Coverage vector

measured 56 of 56 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T20:43:27.389104Z

measured 56 of 56 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

56 of 56 outbound references displayed

  • verified exact1
  • verified fuzzy51
  • unresolved4
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation d1d9940e-f54b-4839-b75e-f16361745cbb · outbound

This paper cites Some experiments on the recognition of speech, with one and with two ears,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Some experiments on the recognition of speech, with one and with two ears,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.872899Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.409479Z digest=sha256:1e06da144423ce0856b916ab9abbe9427e3687ac74f50e4b6f9a80f29a7b5a15

Observation 518523af-87b2-4a3e-b02b-c512a0482e0a · outbound

This paper cites The cocktail party problem,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement The cocktail party problem,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.858988Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.418615Z digest=sha256:d1d1c12a823cb65e41fcc8ad80a437baee086bdf619e873edc2f163bb0041477

Observation 86e66518-3e0e-48ec-8ad5-d7293d16f4d8 · outbound

This paper cites SEGAN: Speech enhancement generative adversarial network,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement SEGAN: Speech enhancement generative adversarial network,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.845266Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.431647Z digest=sha256:88b34fa9120d3887e7d9b0365c6c93ef1e4e5083d69036933000cff49da54501

Observation 5d47193f-e870-43f9-9b9b-0918badd53b4 · outbound

This paper cites MetricGAN: Generative adversarial networks based black-box metric scores optimization for speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement MetricGAN: Generative adversarial networks based black-box metric scores optimization for speech enhancement,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.762498Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.436509Z digest=sha256:a590f44a5013a7bcaa8fb3d2b888174101693e564621b6796c9e6ea2cb215602

Observation 2c8b37db-5aa8-4f79-88d7-46081905d844 · outbound

This paper cites MP-SENet: A speech enhancement model with parallel denoising of magnitude,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement MP-SENet: A speech enhancement model with parallel denoising of magnitude,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.661608Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.441421Z digest=sha256:d55d98d4b156227d579498ef9a33499ba045bad44df171e600d13e2b6e574506

Observation 186896ed-13ac-441c-be69-b134f96b5bdf · outbound

This paper cites Real-time speech enhance- ment in the waveform domain,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Real-time speech enhance- ment in the waveform domain,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.645424Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.445849Z digest=sha256:90b6d5851f4bd33ee5828b3edf28024f6404bb8fce0950d0b48bf1b88842517d

Observation 49dc7a1d-0e75-49ea-ba1a-8df7f0a7fd0b · outbound

This paper cites Dual-branch attention-in-attention transformer for single-channel speech enhance- ment,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Dual-branch attention-in-attention transformer for single-channel speech enhance- ment,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.630932Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.450203Z digest=sha256:02c7a147ee34e2bd75e19a0042299a5d927274bf2d53e692eb468f9b4151e163

Observation 9ae25c25-9c17-4320-82b4-ced28b578804 · outbound

This paper cites DPT-FSNet: Dual-path transformer- based full-band and sub-band fusion network for speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement DPT-FSNet: Dual-path transformer- based full-band and sub-band fusion network for speech enhancement,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.590390Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.454742Z digest=sha256:fcf9c4f9578301ecf4c9342b10a9e303bfe44c021b050244cad23f2b0604b1b5

Observation 43116a11-3f31-4689-8dba-0b31d6e8cb84 · outbound

This paper cites PhaseN: A phase-and- harmonics-aware speech enhancement network,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement PhaseN: A phase-and- harmonics-aware speech enhancement network,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.424359Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.459660Z digest=sha256:cc5aa190a301a15675f7fb99a5f5f5eb858cbf8e2276d607904bf6e0666ee94c

Observation 96262c9e-9847-4bcd-8b80-2df7dfe673da · outbound

This paper cites Neural target speech extraction: An overview,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Neural target speech extraction: An overview,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.409767Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.463982Z digest=sha256:545441af1c2dcc80b9708cba260f45fde6614b86b76fcb0dc7c4078344738722

Observation 35a2d776-6b0b-492a-8a9a-2242c24f6e94 · outbound

This paper cites An overview of deep learning-based audio-visual speech enhancement and separation,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement An overview of deep learning-based audio-visual speech enhancement and separation,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.395852Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.467790Z digest=sha256:39851060ad8d15ec4e8e25e0e55c0c1f54adc6ca8f7546df723bba9caf2af943

Observation 34941dbc-8c23-4b8b-82e5-a0c72803f6d2 · outbound

This paper cites DPCCN: Densely-connected pyramid complex convolutional network for robust speech separation and extraction,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement DPCCN: Densely-connected pyramid complex convolutional network for robust speech separation and extraction,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.307022Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.485030Z digest=sha256:d498e2afd426cef1e65c4c07f9f0f8345a5b663b2552be4718a8b66c4f5559de

Observation 44657de0-f148-4a62-8342-b94cfd8656d4 · outbound

This paper cites High fidelity speech enhancement with band-split rnn,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement High fidelity speech enhancement with band-split rnn,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.195276Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.516955Z digest=sha256:f8f1b38a4566ef916f88546f66db31acbffe1da85eba2f323f90fa925ff28738

Observation 783562d5-d792-4b11-8587-4396f2d533a2 · outbound

This paper cites X-SEPFORMER: End-to-end speaker extraction network with explicit optimization on speaker con- fusion,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement X-SEPFORMER: End-to-end speaker extraction network with explicit optimization on speaker con- fusion,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.181621Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.556456Z digest=sha256:e9a49d2d14013e48d24a5cc64d44757e86e880dc6ecb598790dcf5db59b1c49a

Observation 582c7007-c470-40ce-973c-2f61a9472c39 · outbound

This paper cites Deep- FilterNet: Perceptually motivated real-time speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Deep- FilterNet: Perceptually motivated real-time speech enhancement,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:30.090577Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.609730Z digest=sha256:38ba1144669616ebbd51e11887fa873ae379e8b0c0343772410e0e9a510ba66f

Observation 8e4fe6b2-62b9-4682-abe1-b917441f110e · outbound

This paper cites SEF-Net: Speaker embedding free target speaker extraction network,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement SEF-Net: Speaker embedding free target speaker extraction network,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.973132Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.685814Z digest=sha256:c933053283afd8c1a4938cfa3cff67ca0525e1f4263a509c589102626ece38d9

Observation 0a69d6e0-e924-449f-81d6-54b49e15f982 · outbound

This paper cites Target speaker extraction by directly exploiting contextual information in the time-frequency domain,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Target speaker extraction by directly exploiting contextual information in the time-frequency domain,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.958137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.694460Z digest=sha256:960c52ed074d789297632948ac22927cce777248fd9d87bc12888206b101dd2b

Observation a195858b-e966-444a-ba99-be555f8e452a · outbound

This paper cites Personalized speech enhancement without a separate speaker embedding model,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Personalized speech enhancement without a separate speaker embedding model,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.872659Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.703019Z digest=sha256:d870c8e2d6acd8d9e4329c3957b54882a40c152ab5079ac8760ed8c254241649

Observation eb765355-3171-43a7-a71b-4ddda00d29c8 · outbound

This paper cites Urgent Challenge: Universality, robustness, and generalizability for speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Urgent Challenge: Universality, robustness, and generalizability for speech enhancement,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.796834Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.717931Z digest=sha256:f0f462b08ac22e60ff38be700b27ffdf92819ad17857f15fe8f62b4b121623bd

Observation a6d54836-3e7b-44a2-a825-5c7cfb9c9e45 · outbound

This paper cites AnyEnhance: A unified generative model with prompt-guidance and self-critic for voice enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement AnyEnhance: A unified generative model with prompt-guidance and self-critic for voice enhancement,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-15T20:43:26.722847Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:43:26.722847Z digest=sha256:6f768f2de91029c8a55e582a4f839f6f40785c9e78e964cf045337885e7ed190

Observation 88aafe99-5fb9-4687-b792-aa87dec94063 · outbound

This paper cites Uniaudio: Towards universal audio generation with large language models,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Uniaudio: Towards universal audio generation with large language models,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.781062Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.727724Z digest=sha256:1033c554dda415b93cdf0d4fd84cd47ebb2d40ec8fdff43d2129871c84c02642

Observation fa2b64c3-2432-42f2-ab9d-66c7c002d53a · outbound

This paper cites Metis: A Foundation Speech Generation Model with Masked Generative Pre-training.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Metis: A Foundation Speech Generation Model with Masked Generative Pre-training

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-15T20:43:26.732480Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:43:26.732480Z digest=sha256:5dbeaf71c665f2da52451b2739b65d201b36261af732e8b9cd32f1e7183c4c70

Observation 854cc2d4-aa87-4ae8-94ef-5b2e7c0e9a24 · outbound

This paper cites Target confusion in end-to-end speaker extraction: Analysis and approaches,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Target confusion in end-to-end speaker extraction: Analysis and approaches,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.686727Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.814496Z digest=sha256:5866d23db1ddb2c0a3851f5da7d944fbd4968a3be6a8db011fd6ebdf56b38ee2

Observation ae850b7f-55c3-4971-9d0a-2510bf5e1dd2 · outbound

This paper cites Self-supervised disentangled representation learning for robust target speech extraction,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Self-supervised disentangled representation learning for robust target speech extraction,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.618947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.885119Z digest=sha256:fee7c1adfa7c1774cf55c7eeb7242756feec915201bf38a77d30fbb8c4b15f89

Observation 8c9aaa58-5b33-42fe-a6b1-66f0434fbff5 · outbound

This paper cites Centroid estimation with transformer-based speaker embedder for robust target speaker extraction,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Centroid estimation with transformer-based speaker embedder for robust target speaker extraction,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.604380Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.899153Z digest=sha256:e35d8a66f245d77f3d6c13914cce161fabdb6217573fff5b69c4ebed26e5c70b

Observation a8916cf1-3c90-4ae5-aa7c-29573c7f5031 · outbound

This paper cites SEF-PNet: Speaker encoder- free personalized speech enhancement with local and global contexts aggregation,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement SEF-PNet: Speaker encoder- free personalized speech enhancement with local and global contexts aggregation,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.522920Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.915412Z digest=sha256:ccaa8d994ec892293136f0e6fee9e148db08aa92c7c185f624740938819f6658

Observation a9e113f9-266c-4b51-833b-21f1dcdcf520 · outbound

This paper cites ECAPA-TDNN: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement ECAPA-TDNN: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.437800Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.920169Z digest=sha256:9e557f157e484f94863204e3e281123309f018df4b27eb8d51cc81e9814e477f

Observation f44d7fce-8080-43c4-8f53-9dac83ead6fa · outbound

This paper cites Deep residual learning for image recognition,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Deep residual learning for image recognition,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.421470Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.925543Z digest=sha256:2607d60f921d8cb8ed6b8c2bd886df2834cffedf8e04c5ed0facb2203e08dcf5

Observation c3bbb6d7-968f-4c03-b5b1-1f0ce177f231 · outbound

This paper cites Improving speaker dis- crimination of target speech extraction with time-domain speakerbeam,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Improving speaker dis- crimination of target speech extraction with time-domain speakerbeam,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.377760Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.929976Z digest=sha256:024636ae3ab270b7d149302f0e257ccb9712a879f7e61cfde9c3650f6e4a92c0

Observation 9598fde2-242e-4c21-bc93-650e64f1e903 · outbound

This paper cites SpEx: Multi-scale time domain speaker extraction network,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement SpEx: Multi-scale time domain speaker extraction network,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.240277Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.933697Z digest=sha256:a81900c165de90c010ba52019cb9c08940a3d5f2e89e0777a0dd45351b83edae

Observation c5f35dc2-73ca-4432-bf71-7ec76a2ab480 · outbound

This paper cites SpEx+: A complete time domain speaker extraction network,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement SpEx+: A complete time domain speaker extraction network,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.223821Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.938581Z digest=sha256:9c22cd1fdd25f8e01f6fa76bd5659aca4c06f4e5ef879757712c186add554ac2

Observation 03d06d95-7265-4c8f-9aef-f062c9880fda · outbound

This paper cites MC-SpEx: Towards effective speaker extraction with multi- scale interfusion and conditional speaker modulation,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement MC-SpEx: Towards effective speaker extraction with multi- scale interfusion and conditional speaker modulation,

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.134465Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.943157Z digest=sha256:c6610461ea12a6b7411bc267c37ad28c878a7d5939342254e6903b3f9289d0a8

Observation fce929e7-a9ff-4a19-97cf-3e6708a3d987 · outbound

This paper cites Contrastive self-supervised speaker embedding with sequential disentanglement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Contrastive self-supervised speaker embedding with sequential disentanglement,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:29.001281Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.948282Z digest=sha256:a46e97c23f0c41e97e65422309ae6929761f43a14b92e69bd6ee355e5d456b9e

Observation 1f949b2c-b123-45e5-84e2-4cc274956200 · outbound

This paper cites Noise- disentanglement metric learning for robust speaker verification,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Noise- disentanglement metric learning for robust speaker verification,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.985179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.952489Z digest=sha256:c027a843b17cb0172d0e284773cee4392a5cb003aeca05c91e4a501c9b88e7da

Observation 723af5d9-18a4-49e2-b102-9d39dcdb4cee · outbound

This paper cites Disentangled speaker embedding for robust speaker verification,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Disentangled speaker embedding for robust speaker verification,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.818766Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:26.975212Z digest=sha256:884c1f4cc96fabce0f1d894f4d8a050070c1ea561e3a56db9019e9fe1a6858a9

Observation 0e5ef2f1-7724-47ec-bcad-5781bfb48aba · outbound

This paper cites Disentangling voice and content with self-supervision for speaker recognition,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Disentangling voice and content with self-supervision for speaker recognition,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.803819Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.061880Z digest=sha256:b3b9a1f8c6d1ab1d9b49d335f39d4700814de7ffce32ce55459bdad52819dc69

Observation 15e40320-674d-4ac9-b689-2a1a5e74d4c6 · outbound

This paper cites Time-domain target-speaker speech separation with waveform-based speaker embedding,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Time-domain target-speaker speech separation with waveform-based speaker embedding,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.789913Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.112791Z digest=sha256:787252464642009171975b161b9974a20ae16b0d94139cf693af905361110318

Observation 1887585c-5bad-47a9-aa64-dd0acef41036 · outbound

This paper cites Universal Speech Enhancement with Score-based Diffusion.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Universal Speech Enhancement with Score-based Diffusion

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-15T20:43:27.126788Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:43:27.126788Z digest=sha256:add471ff8ce17fced3b8e2da48bd4d6467fed6c56ba5b246afe27b0268705cff

Observation ea97cac7-ea84-4318-ade7-285a9ac73fae · outbound

This paper cites Conditional diffusion probabilistic model for speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Conditional diffusion probabilistic model for speech enhancement,

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.670606Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.134066Z digest=sha256:ce1ad3f77b140189d29f1be44f7aba05f5ea0dc6ab5b0e34563133767df96745

Observation a1f7b319-537d-4ce4-bef8-3832ddef194e · outbound

This paper cites V oiceFixer: A unified framework for high-fidelity speech restoration,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement V oiceFixer: A unified framework for high-fidelity speech restoration,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.624829Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.139136Z digest=sha256:89509d758726f04d19002b51e3922171c2d2187d7ba840f9a3a17eed741c6534

Observation 579b063b-90cc-45a7-88ae-f285abf51124 · outbound

This paper cites Toward uni- versal speech enhancement for diverse input conditions,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Toward uni- versal speech enhancement for diverse input conditions,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.609788Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.143713Z digest=sha256:c1a8661ebc09fd433eb5c996955f758545db17a9a060b471e32abce89801636d

Observation 0dfe0907-938c-40b0-abe0-586fed7c85fd · outbound

This paper cites Improving design of input condition invariant speech enhancement,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Improving design of input condition invariant speech enhancement,

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.594211Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.148213Z digest=sha256:af1b16127a0e3ede625b507c731cfeaccec30358c25c33b6756b85601d9aa000

Observation 617c6ae1-d378-4593-96cf-e630d12f1d3a · outbound

This paper cites Multi-stage speaker extraction with utterance and frame-level reference signals,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Multi-stage speaker extraction with utterance and frame-level reference signals,

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.519033Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.153080Z digest=sha256:4aeb1e291d152a9cad5571edb6696f831a2490a255e6963a81a0eb6e0c82fbd2

Observation 1c1e8085-06a8-4820-b72b-6dfb0e1ffc3a · outbound

This paper cites Short-duration Speaker Verification (SdSV) Challenge 2021: the Challenge Evaluation Plan.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Short-duration Speaker Verification (SdSV) Challenge 2021: the Challenge Evaluation Plan

Reference 44

Resolution
verified exact
local_arxiv, observed 2026-08-15T20:43:27.499365Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.157484Z digest=sha256:7d62e1bb1fbc14a71e2798c807f835c72777b219dc4544099e454ffb02f0ffef

Observation 31a6eadf-1a8a-475d-acde-7bd2a8c27356 · outbound

This paper cites Discriminative neural embed- ding learning for short-duration text-independent speaker verification,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Discriminative neural embed- ding learning for short-duration text-independent speaker verification,

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.372304Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.234082Z digest=sha256:910838ea31f82e27cb66a05d37477a30ceaac8c4abc36d6c058acfe13e87d920

Observation 981c31f7-95df-4a96-9f0c-d513979200f4 · outbound

This paper cites ERes2NetV2: Boosting short-duration speaker verification performance with computational efficiency,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement ERes2NetV2: Boosting short-duration speaker verification performance with computational efficiency,

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.356979Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.310802Z digest=sha256:eb64cb8fa598b3aa94775969bbc07f94a1b0ef9c130343b0fc2cdfa7d366da18

Observation d3c7b274-6911-4316-a786-d6cf905f04b9 · outbound

This paper cites Augmenting short enrollment speech via synthesis for target speaker ex- traction,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Augmenting short enrollment speech via synthesis for target speaker ex- traction,

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.342528Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.322594Z digest=sha256:e9d536e414abbf364bc660f21bcc13e1f49c63f5420df91c9dfd4ee49fd78f1d

Observation 7e0b163c-2cb0-4126-aea6-75e56087c694 · outbound

This paper cites Target speaker extraction with ultra-short reference speech by ve-ve framework,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Target speaker extraction with ultra-short reference speech by ve-ve framework,

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.317899Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.340189Z digest=sha256:39713315cfcee0e6104e26e5bb143c2f2d80cbb24f8ae710e119a6f578b07281

Observation 3a783352-970d-4bd9-8a78-b461c9acd15b · outbound

This paper cites Sdr–half-baked or well done?.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Sdr–half-baked or well done?

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.263686Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.354172Z digest=sha256:76dc173bb278f3f3d17bd7aecfd461a484e4c68a84a574d3c7d87dde37cc7337

Observation 6771830a-7bab-4547-bc47-dae05fc4360c · outbound

This paper cites LibriMix: An Open-Source Dataset for Generalizable Speech Separation.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement LibriMix: An Open-Source Dataset for Generalizable Speech Separation

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-15T20:43:27.359520Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:43:27.359520Z digest=sha256:77c802d0a1c9b3f6505d8305cff5608972b9eee43b286427995eeb1ad257d04b

Observation 686563ab-2c2f-482e-befd-1d16781b28b1 · outbound

This paper cites Investi- gating rnn-based speech enhancement methods for noise-robust text-to- speech,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Investi- gating rnn-based speech enhancement methods for noise-robust text-to- speech,

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.155754Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.364775Z digest=sha256:cfd0c59e7a0d746d13ca018ab472cdc4aa4097685c85ee23ecc6e972624a84b0

Observation 8c9a7d18-db6e-4a69-9ba2-013a51381679 · outbound

This paper cites On the importance of power compression and phase estimation in monaural speech dereverberation,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement On the importance of power compression and phase estimation in monaural speech dereverberation,

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.138571Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.369494Z digest=sha256:51a938ca8e2e6252544555479d0c8785873834c20116f75dd721b35e63855053

Observation 7b4d8cba-98ab-4b46-9a89-42c30e378ef5 · outbound

This paper cites Adam: A method for stochastic optimization,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Adam: A method for stochastic optimization,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:28.074763Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.373885Z digest=sha256:aa5d5121edd7e2db1b588149547c8459b05eb3d931c2839912ebcb1037c73166

Observation 021d1725-4bd0-46e8-b739-fcc431225301 · outbound

This paper cites Why gradient clipping accelerates training: A theoretical justification for adaptivity,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Why gradient clipping accelerates training: A theoretical justification for adaptivity,

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:27.952517Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.379561Z digest=sha256:8d8e1dda1c10711b3c76533ae889cdd7a5250db0836cfe56a3996ad9e2a8c5e8

Observation cd9e27b8-ad75-4f37-949e-5f108dd77453 · outbound

This paper cites Pesq (perceptual evaluation of speech quality) wrapper for python users,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement Pesq (perceptual evaluation of speech quality) wrapper for python users,

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:27.935027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.384198Z digest=sha256:df40496d09b3b32abb89b67bff9ba86986f054561e4ba223fca8388627ae6a96

Observation 8048fb43-aacc-4ba0-af17-eb6dbdacd029 · outbound

This paper cites A short- time objective intelligibility measure for time-frequency weighted noisy speech,.

Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement A short- time objective intelligibility measure for time-frequency weighted noisy speech,

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:43:27.841070Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-15T20:43:27.389104Z digest=sha256:8bfd4a0fc79f97e2d31df211922e525a0616aac105d0f7b8f37f26af1d07c42d

Pith citing papers

No inbound Pith citation observations are available.