The BiGGen Bench: A Principled Benchmark for Fine-grained Evaluation of Language Models with Language Models

KAIST · NAACL 2025 · 2025 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.

언어 모델을 평가자로 사용하는 원칙적이고 세밀한 언어 모델 평가 벤치마크이다.

arXiv
2406.05761
원문
https://arxiv.org/abs/2406.05761

관련 항목

출처 및 검증

마지막 검증일: 2026-07-22

✎ 정보 수정 제안