Pith. sign in

Paper Citation Record · LEDGER

YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2112.02418.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2112.02418 v4

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 7 of 7 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 7 of 7 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:58:56.253851Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T07:39:39.535781Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 125bd68c-e8c0-4fe7-a11f-2c1873b6e3ab · inbound

MLAAD: The Multi-Language Audio Anti-Spoofing Dataset cites this paper.

MLAAD: The Multi-Language Audio Anti-Spoofing Dataset YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-05-24T04:36:00.854283Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-24T04:34:59.205522Z digest=sha256:7aa9e1b404455374b554bad267e535ce5aef83c0e181a22a2dfe82346d43a5f6

Observation d0f6a7af-550c-4223-a65f-d92468978971 · inbound

EZ-VC: Easy Zero-shot Any-to-Any Voice Conversion cites this paper.

EZ-VC: Easy Zero-shot Any-to-Any Voice Conversion YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T14:58:56.253851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:58:56.253851Z digest=sha256:837493ca5cf81339800a9ad5276645dbeac75c35afb29c01f4004720d04c6fd2

Observation a57d1b30-d14b-40d6-8b4f-5d4ccd472c98 · inbound

Tell me Habibi, is it Real or Fake? cites this paper.

Tell me Habibi, is it Real or Fake? YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T13:08:14.360429Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T13:08:14.360429Z digest=sha256:96f21d55091691bb2d7cd40efb058c586f21ef8603a9beecf293b7a33ff143da

Observation bf7e9da5-bd18-4b7b-bf20-d5cd1830ac11 · inbound

KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features cites this paper.

KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-05T22:17:25.389930Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T22:17:25.389930Z digest=sha256:4dc00ad4c0b19c3e9eab4ca256751b0a4bd878b92eb6d881cb7a89abeabbb24f

Observation 16d69811-ce6e-41ab-9d94-19e7485c0d48 · inbound

Tibetan-TTS:Low-Resource Tibetan Speech Synthesis with Large Model Adaptation cites this paper.

Tibetan-TTS:Low-Resource Tibetan Speech Synthesis with Large Model Adaptation YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-05-11T22:17:09.866279Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-08T02:59:39.588729Z digest=sha256:4112f683b50d33c542e62c87a0a8138287dd4161be3e6ef68d030579f10124b8

Observation f5409651-50d8-485b-8997-ae8553e8abae · inbound

Anchoring the Unknown: Open-Set Model Attribution via Proxy-Anchor Learning cites this paper.

Anchoring the Unknown: Open-Set Model Attribution via Proxy-Anchor Learning YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-07-03T07:47:44.703973Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-27T11:48:10.283990Z digest=sha256:86d155368b0caf5750441645aedd29cf04b5da522036418cc1d7ec67f216d5d8

Observation 7808b8c0-4c48-4b1a-935a-c9b2081fc002 · inbound

LambdaMark: Semantic Audio Watermarking for Robustness and Radioactivity cites this paper.

LambdaMark: Semantic Audio Watermarking for Robustness and Radioactivity YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for everyone

Reference 50

Resolution
verified exact
arxiv_id, observed 2026-07-04T07:39:39.537228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-26T12:58:27.702138Z digest=sha256:8ee167ab495797e3a10862f528f9202c0bc5b4bafdef86b68f0a621f5ed42c9d