Pith. sign in

Paper Citation Record · LEDGER

YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2112.02418.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2112.02418 v4

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 7 of 7 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-22T06:32:14.747728+00:00

measured 7 of 7 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:58:56.253851Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T07:39:39.535781Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 125bd68c-e8c0-4fe7-a11f-2c1873b6e3ab · inbound

MLAAD: The Multi-Language Audio Anti-Spoofing Dataset cites this paper.

MLAAD: The Multi-Language Audio Anti-Spoofing Dataset YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-05-24T04:36:00.854283Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-05-24T04:34:59.205522Z digest=sha256:3d52d6b5c5f109a74ff43d709498a5b74f91018aac8773405034915d42ba05f5

Observation d0f6a7af-550c-4223-a65f-d92468978971 · inbound

EZ-VC: Easy Zero-shot Any-to-Any Voice Conversion cites this paper.

EZ-VC: Easy Zero-shot Any-to-Any Voice Conversion YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T14:58:56.253851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:58:56.253851Z digest=sha256:a038226f369267bfd1fd693bbb4ace207d89b560d341b2171bd68f54c915a508

Observation a57d1b30-d14b-40d6-8b4f-5d4ccd472c98 · inbound

Tell me Habibi, is it Real or Fake? cites this paper.

Tell me Habibi, is it Real or Fake? YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T13:08:14.360429Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T13:08:14.360429Z digest=sha256:873fb649f214bd6af30383c9dc532f795961afdd6c9f7c97b918dfcc0dc66d40

Observation bf7e9da5-bd18-4b7b-bf20-d5cd1830ac11 · inbound

KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features cites this paper.

KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-05T22:17:25.389930Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T22:17:25.389930Z digest=sha256:459557e00288f775d2b4e3dd067ee39714861ab398d6fdf068f96643d92688b1

Observation 16d69811-ce6e-41ab-9d94-19e7485c0d48 · inbound

Tibetan-TTS:Low-Resource Tibetan Speech Synthesis with Large Model Adaptation cites this paper.

Tibetan-TTS:Low-Resource Tibetan Speech Synthesis with Large Model Adaptation YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-05-11T22:17:09.866279Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-05-08T02:59:39.588729Z digest=sha256:b3e8ebb3e02030d27eb8a3cc1a471ce7bb899a2bf62063d020b92ce9ade90599

Observation f5409651-50d8-485b-8997-ae8553e8abae · inbound

Anchoring the Unknown: Open-Set Model Attribution via Proxy-Anchor Learning cites this paper.

Anchoring the Unknown: Open-Set Model Attribution via Proxy-Anchor Learning YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-07-03T07:47:44.703973Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-06-27T11:48:10.283990Z digest=sha256:fa24d8bbaa9ef6c36376bd0adfbd7f50fcb77a8a91005451f0c48839bc7d4e39

Observation 7808b8c0-4c48-4b1a-935a-c9b2081fc002 · inbound

LambdaMark: Semantic Audio Watermarking for Robustness and Radioactivity cites this paper.

LambdaMark: Semantic Audio Watermarking for Robustness and Radioactivity YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 50

Resolution
verified exact
arxiv_id, observed 2026-07-04T07:39:39.537228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-06-26T12:58:27.702138Z digest=sha256:c7417fbe8806e42ea2bd94e999ea8c5b5b2553e4ae42a0b295cfdb832f1cd84e