[뉴스] 국립중앙도서관, 국가문헌 AI 학습데이터 대국민 첫 공개
국립중앙도서관(관장 남영준)은 9월 17일, 국가문헌에서 구축한 인공지능(AI) 학습데이터를 처음으로 대국민 공개한다. 공개 대상은 텍스트 데이터(Hidden Text PDF, XML, TXT, JSON) 3,974책(건), 표·삽화·광고·사진 등의 이미지 데이터 21,485건, 메타데이터, 문자 단위의 글자 데이터셋 3,830만건 등 총 3,833만 건에 달한다. 이번 데이터 개방과 함께 기존 프로젝트 플랫폼이었던 ‘공유서재(nl.go.kr/aiocr)’를 AI 학습데이터 활용에 최적화된 플랫폼으로 새 단장했다. 이번 개편은 AI … 더 읽기