Grad-StyleSpeech: Any-speaker Adaptive Text-to-Speech Synthesis with Diffusion Models

KAIST · ICASSP · 2023 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.

스타일 기반 확산 모델로 임의 화자의 짧은 참조 음성만으로 적응형 TTS를 생성한다.

arXiv
2211.09383
원문
https://arxiv.org/abs/2211.09383

관련 항목

출처 및 검증

마지막 검증일: 2026-07-22

✎ 정보 수정 제안