Una sorprendente vulnerabilidad ha sido descubierta en el Modo Automático de Claude Code Opus 5, que puede ser secuestrado con una tasa de éxito de ataque significativa. Este hallazgo contradice una evaluación reciente de terceros que informó una tasa de éxito de ataque de inyección de prompting del 0,00% para el mismo modelo.

La cadena de ataques, demostrada en una publicación reciente, explota el clasificador de seguridad del modelo, permitiendo la ejecución de código y actividad maliciosa. La vulnerabilidad surge cuando Claude Code Opus 5 se utiliza para procesar contenido de un sitio web malicioso, que engaña al modelo para que utilice el comando curl para descargar un archivo ZIP.

Una vez que se descarga el archivo, Claude Code Opus 5 extrae su contenido e intenta decodificar los registros JSON incluidos. Sin embargo, el modelo se niega a ejecutar el decodificador binario proporcionado, optando en su lugar por escribir su propio decodificador de Python. Desafortunadamente, este decodificador importa el módulo base64, que luego se utiliza para ejecutar código Python arbitrario debido a un archivo struct.py malicioso en el archivo.

Esta vulnerabilidad permite a un atacante ejecutar código malicioso, establecer una llamada de retorno de C2 controlada y incluso generar nuevos procesos. La tasa de éxito de ataque se encontró que era tan alta como el 80% en algunas variantes, lo que destaca la necesidad de precaución al utilizar el Modo Automático.

Anthropic, el desarrollador de Claude Code Opus 5, ha declarado que el Modo Automático es una característica de conveniencia y no una garantía de seguridad. La empresa enfatiza la importancia de utilizar la isolación del sistema operativo y el control de egreso de la red para prevenir tales ataques.

El descubrimiento de esta vulnerabilidad sirve como recordatorio de que los invariantes de seguridad no son opcionales, y los usuarios deben ejercer precaución al utilizar modelos de inteligencia artificial, especialmente cuando se manejan contenidos no confiables. También destaca la necesidad de investigación y pruebas continuas para identificar y abordar posibles vulnerabilidades en los sistemas de inteligencia artificial.

This article was written with the assistance of AI.
News Factory APP - agentic news to boost your SEO & AEO.