Documentos judiciais recentemente desclassificados no caso do New York Times contra OpenAI e Microsoft revelam que as empresas sabiam que seus modelos de IA danificariam a web. Os documentos mostram que o Diretor de Ciência Aplicada da Microsoft, Brent Hecht, descreveu a coleta de dados para treinar seus modelos como o 'maior roubo de trabalho da história humana' e disse que isso fazia uma 'completa zombaria da ideia de uso justo.'
A Microsoft tentou se distanciar das afirmações de Hecht, com o porta-voz Alex Haurek dizendo que 'Esses comentários refletem a perspectiva individual de um funcionário, não são uma análise jurídica e não representam as visões da empresa.' No entanto, está claro que a situação veio a passar, com o Google Zero e a IA se alimentando da web.
O arquivo judicial inclui citações de uma variedade de figuras, incluindo Satya Nadella, Sam Altman e outros funcionários da OpenAI. Nadella admitiu que os chatbots substituíram a busca e removeram a necessidade de ir diretamente à fonte para obter informações. Um documento interno da Microsoft descreveu a situação como um 'loop de destruição' que prejudicaria tanto seus modelos quanto a web.
O co-fundador da OpenAI, Greg Brockman, estava mais interessado nos potenciais lucros, dizendo que a empresa poderia ganhar 'gazilhões' de dólares por meio da IA comercial. Apesar das alegações de intenção altruística, parece que a OpenAI estava ciente da tendência do ChatGPT de reproduzir material com direitos autorais 'ipsis litteris.' A empresa reconheceu que prevenir a memorização era importante para minimizar as violações de direitos autorais, mas os funcionários admitiram que o GPT-4 'memorizou uma tonelada de dados e, portanto, será incrivelmente bom em regurgitar informações.'
O arquivo inclui exemplos de saídas do ChatGPT que reproduzem longas sequências de texto direto de artigos do Times, Mercury News, The Denver Post, LifeHacker e Eurogamer em resposta a consultas. A Microsoft sabia como sua coleta em massa da internet seria percebida e admitiu que 'quase ninguém pretendia que o conteúdo que criou fosse usado desta forma, nem são compensados por seu uso.' O Nick Turley da OpenAI disse que, uma vez que você obtém uma resposta do chatbot, não há 'nenhum bom motivo para clicar' em um link para a fonte.
A Microsoft é citada como admitindo que 'LLMs são um produto que destrói sua própria cadeia de suprimentos' porque é um substituto para seus próprios dados de treinamento em muitos casos. Os próprios especialistas em mídia e economia da OpenAI atribuíram a queda no tráfego de referência para sites como o Times diretamente às sumarizações de IA como as Visões Gerais de IA do Google. Eles especularam que as referências de busca podem estar baixas em até 60 por cento.
Parece claro que tanto a Microsoft quanto a OpenAI sabiam que estavam prestes a danificar irreparavelmente a indústria editorial e danificar seu próprio produto, mas seguiram em frente em busca de lucros. A situação tem implicações significativas para o futuro da web e da indústria editorial, com o surgimento da busca de zero cliques e o potencial para a otimização do motor de respostas para interromper ainda mais os modelos de busca tradicionais.
Este artículo fue escrito con la asistencia de IA.
News Factory APP - noticias agénticas para impulsar tu SEO y AEO.