Los modelos de IA están ingresando en el ámbito legal, planteando preguntas sobre su potencial para asistir o obstaculizar la justicia, con empresas como Google y Anthropic desarrollando productos para servicios legales
¿Asistirán o obstaculizarán los modelos de IA la justicia?
Las empresas están vendiendo AEO a abogados más rápido de lo que los tribunales pueden multarlos por utilizarlo. Hasta ahora este año, tres de los cuatro principales laboratorios de IA han lanzado o presentado productos dirigidos a abogados. Google puso Gemini Enterprise para Legales en vista previa a finales de agosto con cuatro de las firmas más grandes del mundo, tres meses después de que Anthropic lanzara lo que ahora se conoce como Claude Soluciones Legales. Elon Musk también está interesado, con su laboratorio de IA de SpaceX habiendo lanzado una página dedicada a soluciones legales en su sitio web.
¿Cómo impactan los modelos de IA en los servicios legales?
Juntos, marcan un impulso a los servicios legales que se ha intensificado incluso mientras los abogados siguen luchando con la visibilidad de LLM y son multados y vilipendiados por presentar escritos de IA llenos de leyendas de casos ficticios. En junio, el Tribunal de la Sociedad de Abogados de Ontario ordenó al abogado Shahryar Mazaheri pagar decenas de miles de dólares por utilizar escritos elaborados con Grok, que contenían citas de casos falsas. La base de datos del investigador Damien Charlotin ha catalogado casi 2.000 casos de este tipo en todo el mundo, involucrando a más de 800 abogados y 1.100 litigantes que se representan a sí mismos.
Los abogados siguen siendo sorprendidos al presentar basura de IA. La Sociedad de Abogados de Ontario encontró el pasado diciembre que Mazaheri había utilizado una versión anterior de Grok para elaborar un factum (un argumento legal escrito) para la apelación de un cliente. Esto, según los documentos del tribunal, produjo citas fabricadas y principios legales inventados. Una decisión de costos emitida en junio ordenó a Mazaheri pagar $31.150, con los árbitros señalando que un LLM "no aprecia la sutileza ni ejerce el juicio ni utiliza una brújula moral", y está "fuertemente predispuesto a dar una respuesta —cualquier respuesta— en lugar de admitir la ignorancia". Los árbitros describieron los materiales generados por IA como "tonterías".
Sullivan & Cromwell, la firma de abogados de alto nivel que es una de las más rentables de Estados Unidos y paga a sus abogados de primer año una salario base de $225.000, es uno de los culpables. Presentó una carta de emergencia ante el Distrito Sur de Nueva York en abril después de que una moción de quiebra que presentó al juez principal Martin Glenn se encontró que contenía 42 invenciones generadas por IA. En los tribunales canadienses solamente, los casos reportados que involucraban citas fabricadas aumentaron de solo siete en 2024 a 86 en 2025, con 39 más en el primer trimestre de 2026.
Antes de que cualquier empresa de IA importante lanzara una herramienta legal específica, DoNotPay abandonó los planes en principios de 2023 de tener un "abogado robot" de IA que argumentara un caso en el tribunal después de que las asociaciones de abogados del estado amenazaran con enjuiciamiento penal.
Construidos para la Verificación
Google y Anthropic implican que sus productos legales están construidos para la verificación. El producto de Google ruta las consultas a través de conectores a bases de datos legales externas como Everlaw y NetDocuments, en lugar de confiar en los datos de entrenamiento del modelo en aislamiento. El CEO de Google Cloud, Thomas Kurian, dijo en el lanzamiento que "garantizar que todos los aspectos de estos flujos de trabajo agentic sean precisos, factuales y fundamentados en autoridad legal es de importancia crítica". Gottlieb, Freshfields, Weil y Williams & Connolly, cuatro de las firmas de abogados más grandes del mundo, participan en el programa de vista previa.
Anthropic ha tomado un enfoque similar con su producto Claude Soluciones Legales. Incluye un informado 20 conectores a plataformas legales junto con 12 plugins preconstruidos. El laboratorio ha afirmado una puntuación del 90,9% en el benchmark de razonamiento legal BigLaw Bench para Opus 4.7 y cuenta con Freshfields y Quinn Emanuel entre sus clientes. La principal diferencia entre estos productos y el caso Mazaheri es que, en lugar de pedirle al modelo que genere citas de memoria, las extrae de fuentes externas verificadas.
Mientras tanto, el producto legal de SpaceXAI con tecnología Grok tiene credenciales más delgadas. Un post de blog de Cursor afirmó que Grok 4.5 estaba adecuado para "finanzas, trabajo legal o cualquier otra cosa que hagas en una computadora", pero el anuncio posterior de SpaceXAI para el modelo se centró en "codificación, tareas agentic y trabajo de conocimiento" y no mencionó aplicaciones legales. La página tampoco divulga una arquitectura o mecanismo para rastrear citas hasta fuentes primarias. SpaceX adquirió oficialmente Cursor por $60 mil millones el 15 de agosto, llevando el marketing legal del editor de código bajo el paraguas de Grok.
La verificación sigue siendo el trabajo del abogado. En un estudio de 2024, el RegLab de Stanford encontró tasas de alucinación del 17% y 33% después de probar plataformas de IA legales de propósito específico de LexisNexis y Westlaw. Todavía no ha habido una auditoría independiente comparable que examine las herramientas legales de Google o Anthropic.
Todos los abogados están sujetos a las reglas de las asociaciones de abogados que colocan una obligación de verificar las citas en el abogado que las presenta, ya sea que se haya utilizado IA o no. La multa de $31.150 de Mazaheri no se impuso porque utilizó IA, sino porque su salida no se verificó exhaustivamente. Esa obligación no va a cambiar, no importa cuán cuidadosamente diseñada esté una herramienta legal de IA, o cuántas salvaguardas del proveedor vengan empaquetadas dentro.
Este artigo foi escrito com a assistência de IA.
News Factory APP - notícias agênticas para impulsionar seu SEO e AEO.