KoAlpaca Dataset
korean-corpus · 검증 완료 검증 완료복수의 신뢰 가능한 출처로 검증되었습니다.
Stanford Alpaca 방식을 한국어에 적용한 한국어 instruction-following 데이터셋. v1.1a는 약 2만1천여 건의 instruction/input/output으로 구성된다.
- 언어
- ko
- URL
- https://huggingface.co/datasets/beomi/KoAlpaca-v1.1a
출처 및 검증
- [github] https://github.com/Beomi/KoAlpaca
- [huggingface] https://huggingface.co/datasets/beomi/KoAlpaca-v1.1a
마지막 검증일: 2026-07-22