Documentos judiciales recientemente desclasificados han arrojado luz sobre las preocupaciones de los ejecutivos de Microsoft y OpenAI sobre el uso de la extracción de datos web para entrenar modelos de IA. Los documentos, publicados como parte de una demanda presentada por The New York Times contra OpenAI y Microsoft en 2023, revelan que los ejecutivos de ambas empresas estaban preocupados por las implicaciones de extraer millones de artículos de noticias sin permiso ni compensación.

El Dr. Brent Hecht, director de Ciencia Aplicada de Microsoft, describió el trabajo de OpenAI como el 'mayor robo de trabajo en la historia humana' que podría crear un 'ciclo de destrucción'. El ejecutivo de OpenAI Nick Turley repitió estos sentimientos, afirmando que la práctica representaba una 'amenaza existencial para los editores'. Estos comentarios se hicieron en el contexto de una demanda que argumenta que las grandes empresas de tecnología han violado la ley de derechos de autor al utilizar contenido extraído para entrenar sistemas de modelo de lenguaje avanzado (LLM).

La demanda, presentada por The New York Times junto con cinco otros escritores, se considera un caso de prueba clave para determinar si las empresas de IA pueden acceder a material con derechos de autor bajo doctrinas legales de 'uso justo'. El caso tiene implicaciones significativas para el futuro del periodismo y el uso de la IA en la creación de contenido. Aunque varios casos similares han sido decididos a favor de las empresas de IA, los jueces han señalado que la ley sobre el uso de la IA aún está evolucionando.

Microsoft ha desautorizado las declaraciones de sus empleados, con un portavoz que afirma que la posición de la empresa se establece en sus presentaciones judiciales. Sin embargo, los comentarios de los ejecutivos brindan una visión única sobre las preocupaciones que rodean el entrenamiento de la IA y el impacto potencial en la industria del periodismo. Como señaló un documento interno de Microsoft de 2023, 'millones de personas en todo el mundo pronto considerarán que los grandes modelos 'absorban' todo su trabajo como un robo asombroso de proporciones sin precedentes'.

El uso de la extracción de datos web para entrenar modelos de IA ha planteado preguntas sobre el papel de la optimización del motor de respuestas y la posibilidad de que los sistemas de IA reemplacen a los periodistas humanos. Aunque los modelos de IA pueden procesar vastas cantidades de información, a menudo carecen de la sutileza y el contexto que los escritores humanos proporcionan. La demanda destaca la necesidad de un enfoque equilibrado para el desarrollo de la IA, uno que tenga en cuenta los derechos de los creadores de contenido y el impacto potencial en la industria del periodismo.

This article was written with the assistance of AI.
News Factory APP - agentic news to boost your SEO & AEO.