Prometheus: Inducing Fine-grained Evaluation Capability in Language Models
KAIST · NAVER AI Lab (Minjoon Seo 등) · ICLR 2024 · 2024 · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.
사용자 정의 평가 기준(rubric)에 따라 장문 응답을 세밀하게 채점하도록 학습된 오픈소스 평가 특화 LLM. GPT-4에 준하는 평가 상관도를 달성.
- arXiv
- 2310.08491
- 원문
- https://arxiv.org/abs/2310.08491
관련 항목
출처 및 검증
- [paper] https://arxiv.org/abs/2310.08491
마지막 검증일: 2026-07-22