대규모 웹데이터 기반 한국어 말뭉치 데이터

korean-corpus · 공식 출처 확인 공식 출처 확인공식 출처 1개 이상으로 확인되었습니다.

웹사이트에서 수집한 10억 어절의 한국어 텍스트를 제목·단락·본문으로 구조화하고 개체명과 신조어를 태깅한 대규모 말뭉치다.

구축 조직
한국지능정보사회진흥원
언어
ko
라이선스
AI-Hub 이용약관
URL
https://www.aihub.or.kr/aihubdata/data/view.do?aihubDataSe=data&currMenu=115&dataSetSn=624&srchDataRealmCode=REALM002&topMenu=100

출처 및 검증

마지막 검증일: 2026-07-23

✎ 정보 수정 제안