KOFFVQA: An Objectively Evaluated Free-form VQA Benchmark for Large Vision-Language Models in the Korean Language

NCSOFT · arXiv · 2025 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.

275개 이미지-질문 쌍과 객관적 채점 기준으로 구성된 한국어 자유형 VQA 벤치마크로, 심판 모델의 주관적 평가에 의존하지 않고 VLM을 평가한다.

arXiv
2503.23730
원문
https://arxiv.org/abs/2503.23730

관련 항목

출처 및 검증

마지막 검증일: 2026-07-22

✎ 정보 수정 제안