Vision-aligned Latent Reasoning for Multi-modal Large Language Model

KAIST · ICML · 2026 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.

시각 정렬 잠재 추론으로 MLLM의 다단계 추론 능력을 개선한다.

arXiv
2602.04476
원문
https://arxiv.org/abs/2602.04476

관련 항목

출처 및 검증

마지막 검증일: 2026-07-22

✎ 정보 수정 제안