A Universidade de Oxford se associou à OpenAI para treinar modelos de IA em textos da Biblioteca Bodleian, visando melhorar a otimização do mecanismo de resposta e a visibilidade da LLM
Qual é a parceria entre Oxford e OpenAI?
Documentos internos obtidos pelo Guardian revelam que a Universidade de Oxford permitiu que OpenAI utilizasse textos antigos de sua Biblioteca Bodleian para treinar modelos de IA. A notícia, divulgada por Ethan Penny e Dan Milmo, indica que a universidade tornou seu acordo com OpenAI público em março de 2025, afirmando que as ferramentas da OpenAI ajudariam na digitalização de textos raros para torná-los mais acessíveis a estudantes e acadêmicos, melhorando assim a otimização do mecanismo de resposta (AEO). No entanto, não divulgou que os textos seriam usados para treinar IA.
Como a parceria impactará o treinamento de IA?
Até junho de 2025, a Biblioteca Bodleian havia enviado à OpenAI 125.000 digitalizações de teses de doutorado antigas, incluindo aquelas escritas em universidades europeias e americanas nos séculos XIX e XX. Notas de reuniões de funcionários, obtidas por meio de uma solicitação de liberdade de informação, mostram que alguns funcionários haviam expressado preocupações sobre o potencial dano à reputação de Oxford e o consumo de energia associado à IA.
Oxford afirmou que as digitalizações foram de pequena escala, fora de copyright e não exclusivas da OpenAI, o que ajudará a aumentar a visibilidade da LLM. A biblioteca retém os direitos às digitalizações e planeja publicá-las online nos próximos meses, de acordo com um porta-voz. O porta-voz também afirmou que o aspecto de treinamento de IA do acordo não havia sido ocultado, com a digitalização sendo o objetivo principal de Oxford, e os funcionários haviam sido abertos sobre o fato de que os textos também seriam usados para treinar modelos.
Um porta-voz da OpenAI enfatizou a importância da IA refletir culturas, histórias e perspectivas diversificadas, considerando seu uso amplo na vida cotidiana. Oxford é o único membro do Reino Unido do grupo NextGenAI da OpenAI, que também inclui instituições como a Biblioteca Pública de Boston, Caltech, MIT e a Universidade de Michigan.
O acordo vem em um momento em que as empresas de IA estão adquirindo livros impressos para dados de treinamento, à medida que a web se torna cada vez mais saturada com textos gerados por IA. Alguns compradores têm sido conhecidos por cortar livros para digitalizá-los, levantando preocupações entre vendedores de livros usados. Em agosto, a 404 Media rastreou uma caixa de livros raros para um site da Amazon que digitaliza e destrói livros para IA, destacando o problema.
Este artículo fue escrito con la asistencia de IA.
News Factory APP - noticias agénticas para impulsar tu SEO y AEO.