The BiGGen Bench: A Principled Benchmark for Fine-grained Evaluation of Language Models with Language Models
KAIST · NAACL 2025 · 2025 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.
언어 모델을 평가자로 사용하는 원칙적이고 세밀한 언어 모델 평가 벤치마크이다.
- arXiv
- 2406.05761
- 원문
- https://arxiv.org/abs/2406.05761
관련 항목
출처 및 검증
- [paper] https://arxiv.org/abs/2406.05761
마지막 검증일: 2026-07-22