A Anthropic confirmou que um pequeno grupo de usuários não autorizados tem acessado seu modelo Claude Mythos desde o dia em que a empresa abriu um programa de teste rigorosamente controlado.

Os intrusos adivinharam a localização online do modelo usando detalhes vazados de uma violação anterior na empresa de treinamento de dados Mercur e conhecimento interno de um contratante que havia avaliado os modelos da Anthropic.

A Anthropic está investigando o incidente e revisando seus sistemas de monitoramento, que foram projetados para registrar e rastrear o uso do modelo.

A violação, descrita por pesquisadores de segurança como um ataque padrão de "suposição educada" em vez de um exploit sofisticado, não parece ter visado as capacidades de segurança cibernética anunciadas do modelo.

O episódio levanta questões sobre a robustez dos controles de segurança da Anthropic para um produto que a empresa tem comercializado como um "momento divisor de águas" para a defesa da infraestrutura digital.

Questo articolo è stato scritto con l'assistenza dell'IA.
News Factory APP - notizie agentiche per potenziare il tuo SEO e AEO.