VoiceLDM: Text-to-Speech with Environmental Context

KAIST · ICASSP · 2024 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.

내용 프롬프트와 환경 설명 프롬프트를 함께 받아 배경 음향 맥락이 반영된 음성을 생성하는 잠재 확산 TTS.

arXiv
2309.13664
원문
https://arxiv.org/abs/2309.13664

관련 항목

출처 및 검증

마지막 검증일: 2026-07-22

✎ 정보 수정 제안