Pith. sign in

Paper Citation Record · LEDGER

YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2112.02418.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2112.02418 v4

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 7 of 7 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 7 of 7 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:58:56.253851Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T07:39:39.535781Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 125bd68c-e8c0-4fe7-a11f-2c1873b6e3ab · inbound

MLAAD: The Multi-Language Audio Anti-Spoofing Dataset cites this paper.

MLAAD: The Multi-Language Audio Anti-Spoofing Dataset YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-05-24T04:36:00.854283Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-24T04:34:59.205522Z digest=sha256:5c43c0dde2b118c6d9ce38b222d8c33f3ee0839b728ec472348bd8b70f78c189

Observation d0f6a7af-550c-4223-a65f-d92468978971 · inbound

EZ-VC: Easy Zero-shot Any-to-Any Voice Conversion cites this paper.

EZ-VC: Easy Zero-shot Any-to-Any Voice Conversion YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T14:58:56.253851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:58:56.253851Z digest=sha256:59c481d7f4bcf4af1f33725cf8bd34dc401ddbee35b729aa6bc73e4b76d3d748

Observation a57d1b30-d14b-40d6-8b4f-5d4ccd472c98 · inbound

Tell me Habibi, is it Real or Fake? cites this paper.

Tell me Habibi, is it Real or Fake? YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T13:08:14.360429Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T13:08:14.360429Z digest=sha256:af3461d4ef2383caad7dc7db92f00a44d43ef5d2b442de75a67d6614753c8224

Observation bf7e9da5-bd18-4b7b-bf20-d5cd1830ac11 · inbound

KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features cites this paper.

KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-05T22:17:25.389930Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T22:17:25.389930Z digest=sha256:91876c1923d792bd7c41d833e7bdef2c248bcaf757e2e8ee8a49281055139951

Observation 16d69811-ce6e-41ab-9d94-19e7485c0d48 · inbound

Tibetan-TTS:Low-Resource Tibetan Speech Synthesis with Large Model Adaptation cites this paper.

Tibetan-TTS:Low-Resource Tibetan Speech Synthesis with Large Model Adaptation YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-05-11T22:17:09.866279Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-08T02:59:39.588729Z digest=sha256:9f00eadac24273993956d93bd261d9eacf5301b7d9d2e513c8d4627cf309a5f4

Observation f5409651-50d8-485b-8997-ae8553e8abae · inbound

Anchoring the Unknown: Open-Set Model Attribution via Proxy-Anchor Learning cites this paper.

Anchoring the Unknown: Open-Set Model Attribution via Proxy-Anchor Learning YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-07-03T07:47:44.703973Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-06-27T11:48:10.283990Z digest=sha256:ee85022ea0138cb53c0831002d9c30685fe58e3bb151b8cff44c1509b02dad2d

Observation 7808b8c0-4c48-4b1a-935a-c9b2081fc002 · inbound

LambdaMark: Semantic Audio Watermarking for Robustness and Radioactivity cites this paper.

LambdaMark: Semantic Audio Watermarking for Robustness and Radioactivity YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 50

Resolution
verified exact
arxiv_id, observed 2026-07-04T07:39:39.537228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-06-26T12:58:27.702138Z digest=sha256:01f2aef7f4bad4cb5c5e04907612e88551c8787d18daa0acf4e293cb586e9842