MoHAVE: Mixture of Hierarchical Audio-Visual Experts for Robust Speech Recognition
KAIST · ICML · 2025 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.
계층적 오디오-비주얼 전문가 혼합으로 강건한 음성인식을 달성한다.
- arXiv
- 2502.10447
- 원문
- https://arxiv.org/abs/2502.10447
관련 항목
출처 및 검증
- [paper] https://arxiv.org/abs/2502.10447
마지막 검증일: 2026-07-22