AI Briefing

옥스퍼드대, Bodleian Library 스캔 125,000건 OpenAI 학습용으로 허용

·2026.09.27 01:06

핵심 내용

옥스퍼드대가 Bodleian Library 스캔 125,000건을 OpenAI 학습용으로 제공한 사실이 내부 문서를 통해 확인됐다.

자세히 보기

학습 데이터 공개

가디언이 검토한 내부 문서에 따르면 옥스퍼드 대학교가 OpenAI에게 Bodleian Library의 텍스트를 AI 모델 학습에 사용하도록 허용한 것으로 드러났다. 2025년 3월에 발표된 초기 계약은 학생과 학자의 자료 접근성을 높이는 디지털화 프로젝트로 소개되었으나, 텍스트가 AI 학습에 사용된다는 사실은 명시되지 않았다.

2025년 6월까지 Bodleian Library는 125,000건의 박사 학위 논문 스캔 파일을 OpenAI에 전달했다. 이 문서에는 19세기 및 20세기 유럽과 미국 대학에서 작성된 논문들이 포함된다. OpenAI 대변인은 10억 명 이상이 자사 기술을 사용하는 만큼 모델이 다양한 문화, 역사, 관점을 반영하는 것이 중요하다고 밝혔다.

기관 반응 및 배경

옥스퍼드 대학교는 AI 학습 목적이 직원들에게 숨겨진 것이 아니라고 주장한다. 스캔이 주된 목표였지만 학습은 알려진 부수적 용도였으며, 스캔 자료는 다음과 같은 특성을 지닌다고 강조했다.

  • 저작권 만료 상태
  • 도서관 전체 소장품 대비 소규모
  • 비독점적으로, 도서관은 권리를 보유하며 조만간 스캔본을 온라인에 게시할 계획

정보 공개 요청으로 확보된 문서에는 평판 훼손과 에너지 소비에 대한 내부 직원들의 우려가 담겨 있었다. 옥스퍼드는 MIT, Caltech, 미시간 대학교 등이 포함된 OpenAI의 NextGenAI 그룹에 속한 유일한 영국 기관이다. AI 기업들이 고품질의 비AI 생성 학습 데이터를 확보하려는 움직임이 커지는 가운데 이번 계약이 체결됐으나, 희귀서 관련 다른 사례들과 달리 Bodleian Library의 장서는 온전히 보존되어 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.