Oxford permite a OpenAI entrenar sus modelos de IA en la Biblioteca Bodleiana

Oxford lets OpenAI train its AI models on Bodleian Library

La Universidad de Oxford ha autorizado a OpenAI, la empresa detrás de ChatGPT, a entrenar sus modelos de inteligencia artificial utilizando textos históricos de la Biblioteca Bodleiana. Esta colaboración ha generado preocupación entre el personal universitario por el riesgo reputacional de asociarse con la empresa y el impacto ambiental de la tecnología involucrada.

Desde marzo de 2025, OpenAI ha estado digitalizando material de la biblioteca, lo que, según documentos internos, se ha utilizado para «poblar el conjunto de entrenamiento de OpenAI». Aunque el anuncio inicial de la colaboración mencionaba que el software de OpenAI ayudaría a hacer el contenido más accesible para estudiantes e investigadores, no se especificó que el material sería utilizado para entrenar modelos de IA.

Un portavoz de OpenAI expresó su orgullo por preservar el conocimiento histórico mundial para el futuro, destacando la importancia de reflejar diferentes culturas, historias y perspectivas. Sin embargo, las actas de reuniones de la Universidad de Oxford, obtenidas mediante una solicitud de libertad de información, revelan preocupaciones sobre el riesgo reputacional y el compromiso ambiental de la universidad.

La digitalización ha incluido 125,000 imágenes de disertaciones históricas y colecciones raras como baladas del siglo XVI y documentos del siglo XVIII. Aunque la universidad asegura que el material digitalizado es «modesto en escala» y cubre solo contenido fuera de derechos de autor, el proyecto ha suscitado debates sobre el uso de colecciones físicas para entrenar modelos de IA.

OpenAI ha firmado acuerdos similares con bibliotecas de investigación en EE.UU., como el Boston Public Library y el MIT, bajo el proyecto NextGenAI, siendo Oxford el único miembro del Reino Unido.

El portavoz de Oxford afirmó que la digitalización es el principal interés de la universidad y que el proyecto contribuirá a hacer el material más accesible. A diferencia de otras prácticas, las colecciones de Bodleian permanecen intactas, y la biblioteca planea publicar el material digitalizado en línea en los próximos meses.

Fuente: https://www.theguardian.com/technology/2026/sep/26/oxford-university-bodleian-library-open-ai-chat-gpt

← Home