Conditional Variational Autoencoder with Adversarial Learning for End-to-End Text-to-Speech (VITS)
Kakao Enterprise · ICML 2021 · 2021 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.
조건부 VAE와 정규화 흐름·적대적 학습·확률적 지속시간 예측을 결합한 완전 end-to-end TTS. 2단계 파이프라인 없이 자연스러운 단일 단계 음성 합성을 달성.
- arXiv
- 2106.06103
- 원문
- https://arxiv.org/abs/2106.06103
관련 항목
출처 및 검증
- [paper] https://arxiv.org/abs/2106.06103
마지막 검증일: 2026-07-22