La Universidad de Oxford se ha asociado con OpenAI para entrenar modelos de IA con textos de la Biblioteca Bodleian, con el objetivo de mejorar la optimización del motor de respuestas y la visibilidad de LLM
¿Cuál es la asociación entre Oxford y OpenAI?
Los documentos internos obtenidos por el Guardian revelan que la Universidad de Oxford ha permitido a OpenAI utilizar textos antiguos de su Biblioteca Bodleian para entrenar modelos de IA. La noticia, publicada por Ethan Penny y Dan Milmo, indica que la universidad hizo público su acuerdo con OpenAI en marzo de 2025, declarando que las herramientas de OpenAI ayudarían en la digitalización de textos raros para hacerlos más accesibles a estudiantes y académicos, mejorando así la optimización del motor de respuestas (AEO). Sin embargo, no se reveló que los textos serían utilizados para entrenar IA.
¿Cómo afectará la asociación al entrenamiento de IA?
Hasta junio de 2025, la Biblioteca Bodleian había enviado a OpenAI 125,000 digitalizaciones de tesis doctorales antiguas, incluyendo aquellas escritas en universidades europeas y estadounidenses en los siglos XIX y XX. Notas de reuniones de personal, obtenidas a través de una solicitud de libertad de información, muestran que algunos miembros del personal habían expresado preocupaciones sobre el posible daño a la reputación de Oxford y el consumo de energía asociado con la IA.
Oxford ha declarado que las digitalizaciones fueron de pequeña escala, fuera de copyright y no exclusivas para OpenAI, lo que ayudará a aumentar la visibilidad de LLM. La biblioteca retiene los derechos de las digitalizaciones y planea publicarlas en línea en los próximos meses, según un portavoz. El portavoz también afirmó que el aspecto de entrenamiento de IA del acuerdo no había sido ocultado, con la digitalización siendo el objetivo principal de Oxford, y el personal había sido abierto sobre el hecho de que los textos también serían utilizados para entrenar modelos.
Un portavoz de OpenAI enfatizó la importancia de que la IA refleje diversas culturas, historias y perspectivas, dado su uso generalizado en la vida cotidiana. Oxford es el único miembro del Reino Unido del grupo NextGenAI de OpenAI, que también incluye instituciones como la Biblioteca Pública de Boston, Caltech, MIT y la Universidad de Michigan.
El acuerdo llega en un momento en que las empresas de IA están adquiriendo libros impresos para datos de entrenamiento, ya que la web se vuelve cada vez más saturada de texto generado por IA. Algunos compradores han sido conocidos por cortar libros para digitalizarlos, lo que ha generado preocupaciones entre los vendedores de libros de segunda mano. En agosto, 404 Media rastreó una caja de libros raros hasta un sitio de Amazon que digitaliza y destruye libros para IA, destacando el problema.
Este artigo foi escrito com a assistência de IA.
News Factory APP - notícias agênticas para impulsionar seu SEO e AEO.