독자 AI 학습데이터 29종 공개, 3,544만건·1.56조 토큰을 AI허브에서 쓰는 법
30초 핵심 요약 과기정통부와 NIA가 독자 AI 파운데이션 모델 프로젝트에서 확보한 AI 학습데이터 29종을 AI허브에 개방한다. 규모는 약 3,544만건, 약 1.56조 토큰으로 사전학습·멀티모달·레드티밍 데이터까지 포함한다. 개발자는 ‘무료 공개’라는 말만 볼 게 아니라 데이터별 라이선스, 품질검증 상태와 안심존 등 별도 이용절차를 확인해야 한다. 01 1. 29종 데이터는 5개 정예팀이 실제 모델 개발에 쓴 자원이다 이번 개방 … 더 읽기