옛한글 문자인식(OCR) 인공지능 학습용 데이터
multimodal · 공식 출처 확인 공식 출처 확인공식 출처 1개 이상으로 확인되었습니다.
15세기부터 20세기 초까지의 고문헌·고문서 이미지에서 추출한 옛한글 12,003,864글자를 제공하는 OCR 학습 데이터셋이다.
- 구축 조직
- 한국지능정보사회진흥원
- 언어
- ko
- 라이선스
- AI-Hub 이용약관
- URL
- https://www.aihub.or.kr/aihubdata/data/view.do?aihubDataSe=data&currMenu=115&dataSetSn=504&srchDataRealmCode=REALM002&topMenu=100
출처 및 검증
마지막 검증일: 2026-07-23