Pith. sign in

Paper Citation Record · LEDGER

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction

As of 7 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2602.07977.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2602.07977 v2

Coverage vector

measured 35 of 35 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-03T03:30:39.617980Z

measured 36 of 36 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-31T00:58:13.674758Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

35 of 35 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved35
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 051f3d2b-4983-4ad5-969a-c9b1d1346bb2 · outbound

This paper cites Target language extraction at multilingual cocktail parties.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Target language extraction at multilingual cocktail parties

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.466669Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.466669Z digest=sha256:f5c34486cf62fdfe7b4262290712b218bc707ec97daf398c4f38423201db8a76

Observation bb0be067-dcf1-4421-bbe4-74480c0a6ea5 · outbound

This paper cites V oxceleb2: Deep speaker recognition.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction V oxceleb2: Deep speaker recognition

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.482911Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.482911Z digest=sha256:a7dfb761f7f847919fe3695467c8dccde33541ce6a9fe35d59f134d16e214fc1

Observation 9f42fcca-d05e-4618-830b-6d01515119f8 · outbound

This paper cites CLIPSep: Learning Text-queried Sound Separation with Noisy Unlabeled Videos.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction CLIPSep: Learning Text-queried Sound Separation with Noisy Unlabeled Videos

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.500955Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.500955Z digest=sha256:25ae7ba52c0d130a7c9885e641ca4505b7619b6f64713073cd0ed631a47013c9

Observation 5d4231cc-5ec4-44d9-b417-f792aec67698 · outbound

This paper cites Typing to Listen at the Cocktail Party: Text-Guided Target Speaker Extraction.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Typing to Listen at the Cocktail Party: Text-Guided Target Speaker Extraction

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.505616Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.505616Z digest=sha256:18226e6945ec73ccdaecf1a426b3317255d3d342f605c1a14458366d2322c030

Observation fd590abe-7198-4061-acd4-b252eeb941a5 · outbound

This paper cites Kingma and Jimmy Ba.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Kingma and Jimmy Ba

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.517924Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.517924Z digest=sha256:b851f7f08fea3669290eb01d574839859c9e9b396bc335abdac127f3ae859c18

Observation 3dc15ca1-1e37-4a4a-85a7-35535fd09e9c · outbound

This paper cites Audio-visual active speaker extraction for sparsely overlapped multi-talker speech.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Audio-visual active speaker extraction for sparsely overlapped multi-talker speech

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.534482Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.534482Z digest=sha256:213f5d5a94d58dddd0c535c63453fae63dd4d740d8ccd4a059b8fd85fc4a0ca2

Observation 01d1ec63-28eb-4b36-addf-88ef7d720f32 · outbound

This paper cites Av- sepformer: Cross-attention sepformer for audio-visual tar- get speaker extraction.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Av- sepformer: Cross-attention sepformer for audio-visual tar- get speaker extraction

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.539006Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.539006Z digest=sha256:f8ce119fcf2f0d5b734d506bb4ad234c9291b68f46d1e7f1096d53887765bcc8

Observation 2a54fb1e-4ed1-4762-b36d-d3204d3c009b · outbound

This paper cites Plumbley, and Wenwu Wang.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Plumbley, and Wenwu Wang

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.543972Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.543972Z digest=sha256:933acd35c0e5b6300711ff61022a471a4d532bcde34ca9a0df9effffb03d9070

Observation d6d26acb-d1f9-4ed2-bd33-8308f3ca076a · outbound

This paper cites Target speaker extraction with cur- riculum learning.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Target speaker extraction with cur- riculum learning

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.547638Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.547638Z digest=sha256:44e8ab59bfc8e4e3953e93dedf8e3e5dec36bb54a4c0aae2bca47ddbdaa166e5

Observation b19c67e2-3c35-4389-b5df-3035d44712f5 · outbound

This paper cites Conv-tasnet: Surpassing ideal time-frequency magnitude masking for speech separation.IEEE/ACM Trans.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Conv-tasnet: Surpassing ideal time-frequency magnitude masking for speech separation.IEEE/ACM Trans

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.551147Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.551147Z digest=sha256:7dee3947832c67c75a83e3674d6d3e7aceea01faec0d3338832be8ac683e94fa

Observation f58fed34-1e15-46ae-a250-f08522049578 · outbound

This paper cites Music source separation with band-split RNN.IEEE ACM Trans.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Music source separation with band-split RNN.IEEE ACM Trans

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.554702Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.554702Z digest=sha256:237c05961ee02bfaaf6b61549f44d4e7536bb218a497413cb3e21b49e01019ce

Observation b4f2bf09-ef0d-49eb-a6b7-dee26919467b · outbound

This paper cites Clapsep: Leverag- ing contrastive pre-trained model for multi-modal query- conditioned target sound extraction.IEEE/ACM Transac- tions on Audio, Speech, and Language Processing,.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Clapsep: Leverag- ing contrastive pre-trained model for multi-modal query- conditioned target sound extraction.IEEE/ACM Transac- tions on Audio, Speech, and Language Processing,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.558356Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.558356Z digest=sha256:159aa62f7c60210463198806f5310571b0e6a4bc53a06e4e30bc047a503cae01

Observation 083757cc-7dc6-4bfe-af0a-c669f70597ef · outbound

This paper cites Visualizing data using t-sne.Journal of machine learning research, 9(Nov):2579–2605,.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Visualizing data using t-sne.Journal of machine learning research, 9(Nov):2579–2605,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.562597Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.562597Z digest=sha256:d21916cb900d05ccbf475830b7a1ecaf087ac242a0940d185707c67b8ddee849

Observation 0ff8a305-6cbd-46e9-bed6-80e6fb28c285 · outbound

This paper cites All neural low- latency directional speech extraction.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction All neural low- latency directional speech extraction

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.570207Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.570207Z digest=sha256:89e714773c9617e4f654287c40d948325c2bdbcf8e71791075e6e37d36272829

Observation f1c14e61-8a80-40c5-a909-5bd16c178215 · outbound

This paper cites Target speech extraction with pre-trained self-supervised learning models.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Target speech extraction with pre-trained self-supervised learning models

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.573809Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.573809Z digest=sha256:1e6803183a51071ad43ba78ede6faa689a490d86052a95498ed218edc5b393ee

Observation bca869ed-3416-436b-87ab-62f84afe6a3e · outbound

This paper cites Sam audio: Segment anything in audio.arXiv preprint arXiv:2512.18099,.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Sam audio: Segment anything in audio.arXiv preprint arXiv:2512.18099,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.579614Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.579614Z digest=sha256:3620277d2855430e9e65284b2edda9b4b665a2548d1fa1e39fffdb09e3f90737

Observation e806a780-8a8c-4c0e-bf22-e6abb7b88435 · outbound

This paper cites A lightweight hy- brid multi-channel speech extraction system with direc- tional voice activity detection.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction A lightweight hy- brid multi-channel speech extraction system with direc- tional voice activity detection

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.586989Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.586989Z digest=sha256:44c9a3fc5c980b19b09139242e0b03704031e0f42ea3e724f89734e7b9b49b2c

Observation 741a72b9-e840-4f57-9e55-4580ee1e0cd6 · outbound

This paper cites Audio-Visual Target Speaker Extraction with Reverse Selective Auditory Attention.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Audio-Visual Target Speaker Extraction with Reverse Selective Auditory Attention

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.590816Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.590816Z digest=sha256:92941b7d14ef7b1c86d672e332d46cfef03492be84592cb1f7fcec37a0a5f35b

Observation 3f46650b-6e84-4d98-97fa-8e36d6089f95 · outbound

This paper cites Wespeaker: A research and pro- duction oriented speaker embedding learning toolkit.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Wespeaker: A research and pro- duction oriented speaker embedding learning toolkit

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.595828Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.595828Z digest=sha256:fc1993c1d4699dd1267b9310267bd7c3f8c01a8567d22a84de001b3f2ba77657

Observation aaa63050-b550-406d-8f63-2977fc3a4e54 · outbound

This paper cites Unified audio visual cues for target speaker extraction.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Unified audio visual cues for target speaker extraction

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.599615Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.599615Z digest=sha256:ca02e1632524f60b30c4f7687c82ebd9e3a67c8a1cb02a7f5d1b6507c72173b8

Observation 2c8cbdd5-ff49-4eee-a931-49f3380c5644 · outbound

This paper cites Target speaker extraction with ultra-short reference speech by ve-ve framework.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Target speaker extraction with ultra-short reference speech by ve-ve framework

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.603058Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.603058Z digest=sha256:eb8ca13ee47677819c053fbcf4aaa5dce92e2949b5e56abe6d82883f3de8e9c8

Observation 31d6b5c9-564b-4d53-92f3-e17b52e0cb12 · outbound

This paper cites Tspeech-ai sys- tem description to the 5th deep noise suppression (DNS) challenge.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Tspeech-ai sys- tem description to the 5th deep noise suppression (DNS) challenge

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.607065Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.607065Z digest=sha256:e95664f54f0c40db81b63660988a2c4bc6052d69223e10c892130dffbc03c1bd

Observation bb30cc9c-c6e3-4e9d-b985-2638c35bb30e · outbound

This paper cites Multi-Level Speaker Representation for Target Speaker Extraction.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Multi-Level Speaker Representation for Target Speaker Extraction

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.610230Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.610230Z digest=sha256:5004eefe3a08e00c433e33445acadaf2e7651525876afec19b24b8d1e42bcb5e

Observation 493af539-d1ac-4568-af68-1ec63eb37c62 · outbound

This paper cites Mossformer2: Com- bining transformer and rnn-free recurrent network for en- hanced time-domain monaural speech separation.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Mossformer2: Com- bining transformer and rnn-free recurrent network for en- hanced time-domain monaural speech separation

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.614647Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.614647Z digest=sha256:f51bdd5965746bb85b46960de8730819bac60de96e4fc603900abbb6681ca5aa

Observation 5016eb6d-6817-4ab7-9b0d-be524b2bbca7 · outbound

This paper cites Neural target speech extraction: An overview.IEEE Signal Processing Magazine, pages 8–29, 2023.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Neural target speech extraction: An overview.IEEE Signal Processing Magazine, pages 8–29, 2023

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.617980Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.617980Z digest=sha256:92960e5abc275f65e6c0699289bfad15ec306069ad1b65e2196b4d1c4b9cf458

Observation 614b5213-8859-412a-adde-16ab31ebd758 · outbound

This paper cites Lib- rispeech: an asr corpus based on public domain audio books.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Lib- rispeech: an asr corpus based on public domain audio books

Reference 2008

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.566540Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.566540Z digest=sha256:8ab9c4ccbfb98ab779583203cf08ae62f6e3e8d764dbbec13eec3169a603d7cf

Observation 406e503c-86c1-4a25-9012-8c0c122b2b97 · outbound

This paper cites NeMo: a toolkit for building AI applications using Neural Modules.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction NeMo: a toolkit for building AI applications using Neural Modules

Reference 2015

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.524396Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.524396Z digest=sha256:b23bdfd3ddce58d018e661066e28246b2110da01fce556573b5364d85874d208

Observation 1842cc52-26a7-4b0a-a006-3a66ab9697b2 · outbound

This paper cites LibriMix: An Open-Source Dataset for Generalizable Speech Separation.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction LibriMix: An Open-Source Dataset for Generalizable Speech Separation

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.487256Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.487256Z digest=sha256:d7a19d4c5c93f2d1c3af1429717179a95f488268c7271d662942659153389a6f

Observation 2c20bbd6-a8e8-4407-a3da-1d08f5a1975b · outbound

This paper cites Learning pronunciation from a foreign language in speech synthesis networks.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Learning pronunciation from a foreign language in speech synthesis networks

Reference 2019

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.530229Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.530229Z digest=sha256:201ae9f6b72dc8f799bd085be484602ad3ba37c165617d8be8471cf1b691bd05

Observation b02bedfe-81fe-490a-941a-a9ac337401ca · outbound

This paper cites Ecapa-tdnn: Empha- sized channel attention, propagation and aggregation in tdnn based speaker verification.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Ecapa-tdnn: Empha- sized channel attention, propagation and aggregation in tdnn based speaker verification

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.493560Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.493560Z digest=sha256:65f1cea778ccabf5ff55b46c2cf95f98e2c36353ca3c2d18198427b58de89701

Observation 56f49673-8e8a-4a01-9a64-d53ef964ce78 · outbound

This paper cites Experts versus all- rounders: target language extraction for multiple target languages.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Experts versus all- rounders: target language extraction for multiple target languages

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.472758Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.472758Z digest=sha256:fedc8c9f83efd842aa93633bfcd8c29e519da22bb108242321bd1716684dc300

Observation 73d79a71-8441-440e-9c31-b93baa884fe4 · outbound

This paper cites Wavlm: Large-scale self-supervised pre-training for full stack speech processing.IEEE J.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Wavlm: Large-scale self-supervised pre-training for full stack speech processing.IEEE J

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.478013Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.478013Z digest=sha256:06bee01c03ae6396c60085960a5b78ecd2d79bbb86bc61e34d32721079ddba31

Observation 633cb22c-63ca-461b-ab96-3b481214e164 · outbound

This paper cites 3s-tse: Efficient three-stage target speaker extraction for real-time and low- resource applications.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction 3s-tse: Efficient three-stage target speaker extraction for real-time and low- resource applications

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.509911Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.509911Z digest=sha256:2cc7ff609c980541d465c3b09ae4265e96a9236c29828272cb0c890f1f8c7e81

Observation 28700231-1a72-48cc-b73d-df2bec338525 · outbound

This paper cites Centroid estimation with transformer-based speaker embedder for robust target speaker extraction.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Centroid estimation with transformer-based speaker embedder for robust target speaker extraction

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.513505Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.513505Z digest=sha256:adfecd2b50ce0624f74ff8c7b2f2b6e39c1756df66c8197889843a8bad796edd

Observation 8922309d-2750-45c5-9c79-4778bebaed34 · outbound

This paper cites Lever- aging language information for target language extraction.

Detect, Attend and Extract: Keyword Guided Target Speaker Extraction Lever- aging language information for target language extraction

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-03T03:30:39.583323Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T03:30:39.583323Z digest=sha256:39d4d99eab3bcc6da4c8f20a180ec5a8b87485454755a332fa03598b503c20cc

Pith citing papers

Observation e8d614d7-6b92-4100-9602-2d70ff910ecd · inbound

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction cites this paper.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Detect, Attend and Extract: Keyword Guided Target Speaker Extraction

Reference 20

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.674758Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.674758Z digest=sha256:66cd81ef6123edb0a205970e940c9e367200612dce7f2c2c1e25bd4f738cfe2a