TechCrunch encontró que Claude Opus 4.6 de Anthropic, un modelo aún ofrecido a través de la API de la empresa, genera consistentemente material sexual explícito cuando se le solicita con una técnica de jailbreak de varios giros. El método, divulgado por un investigador anónimo del Reino Unido, coaccionó al modelo para que pasara sus estándares de uso universales declarados. Aunque las versiones más nuevas de Claude parecen ser más resistentes, Opus 4.6 y los modelos más antiguos siguen en uso activo, lo que plantea preocupaciones de cumplimiento en las regulaciones estatales emergentes sobre contenido sexual impulsado por IA para menores.
Leer más