Anthropic anunció el viernes que su chatbot Claude comenzará a incorporar marcas de agua invisibles en cada pieza de texto que genere, con el objetivo de cumplir con el Código de Transparencia de la Ley de IA de la Unión Europea. El artículo de blog de la empresa explica los mecanismos, el impacto esperado en los usuarios y el plan de lanzamiento de una API de detección.
Según Anthropic, la marca de agua funciona insertando un patrón sutil en opciones de palabras de bajo riesgo, como si se describe el cielo como "nublado" o "gris". Para un lector humano, el texto parece sin cambios; para cualquiera con la clave de descifrado adecuada, el patrón es detectable. La empresa enfatiza que la marca de agua no degrada la calidad de la salida de Claude, diciendo que una respuesta con marca de agua es "indistinguible de una sin marca de agua".
Anthropic empleará el método SynthID-Text desarrollado por Google DeepMind a principios de este año. Este enfoque difiere de las herramientas de detección de IA comerciales que buscan "señales lingüísticas". En su lugar, incorpora una firma criptográfica que puede ser verificada directamente. La empresa planea hacer que una API de detección de marcas de agua esté disponible públicamente, lo que permitirá a terceros confirmar si un pasaje determinado se originó en Claude.
La reacción en las redes sociales ha sido mixta. Un hilo de Reddit se produjo después de que la empresa dio una pista inicial sobre la marca de agua, con un usuario que calificó el esfuerzo de "conspiración contra usuarios inocentes de Claude". En X, decenas de usuarios anunciaron que cancelaban sus suscripciones, citando preocupaciones de que la marca de agua podría ser utilizada para rastrear o restringir su contenido. Business Insider informó la misma ola de cancelaciones.
Anthropic abordó la pregunta más común: ¿se puede eliminar la marca de agua mediante edición? La empresa admite que la edición ligera, como cambios menores de palabras o corrección de pruebas, probablemente dejará la marca de agua intacta. Solo una reescritura completa, donde se reemplaza cada palabra, eliminaría por completo la firma. En tal escenario, el texto podría no calificar como generado por IA, señaló Anthropic.
El blog también abordó cómo la marca de agua afectará la generación de código. Dado que el código funcional ofrece menos opciones de palabras discrecionales, la huella de la marca de agua será mínima. Sin embargo, en áreas donde los desarrolladores pueden elegir entre sinónimos, como comentarios o nombres de variables, la marca de agua todavía se puede aplicar. Anthropic asegura a los usuarios que la marca de agua no interferirá con la corrección del código.
Más allá de Claude, Anthropic dijo que otros desarrolladores de modelos importantes han firmado el mismo Código de Prácticas y estarán implementando sus propias soluciones de marca de agua. La empresa enmarca la iniciativa como un paso proactivo hacia la transparencia, en lugar de una reacción a la presión regulatoria.
En resumen, el nuevo sistema de marca de agua de Anthropic incorpora un patrón invisible y verificable criptográficamente en el texto de Claude, promete no perder calidad y estará detectable a través de una API próxima. Si bien los detalles técnicos buscan tranquilizar, un segmento de la base de usuarios sigue siendo escéptico, con algunos optando por abandonar el servicio por completo.
Cet article a été rédigé avec l'assistance de l'IA.
News Factory APP - actualités agentiques pour booster votre SEO et AEO.