A Anthropic anunciou na quinta-feira que adicionou o Claude Opus 5 ao seu portfólio em crescimento de modelos de IA, destacando o sistema como o mais capaz e o mais alinhado que já foi lançado. A empresa afirma que o Opus 5 iguala ou supera o desempenho do seu modelo de bandeira Fable 5 na maioria dos benchmarks de codificação e trabalho de conhecimento, enquanto cobra aproximadamente metade do preço por token.
O Opus 5 chega apenas semanas após o lançamento do Sonnet 5, marcando o quarto modelo importante que a Anthropic lançou em menos de dois meses. O lançamento segue o Fable 5 no início de junho, o Sonnet 5 no final de junho e agora o Opus 5 em 24 de julho. Cada modelo visa um slot de preço-desempenho distinto, e o Opus 5 se situa entre a faixa de preço premium do Fable e a faixa de preço acessível do Sonnet.
No Frontier-Bench, uma avaliação de codificação que pede aos modelos que construam software funcional a partir de desenhos de engenharia, o Opus 5 mais que dobrou a pontuação registrada por seu antecessor e superou todos os sistemas concorrentes, incluindo o Fable 5. O modelo também brilhou no ARC-AGI 3, um teste de resolução de problemas novos, onde registrou uma pontuação aproximadamente três vezes maior do que o próximo melhor modelo. No Zapier's AutomationBench, que mede a conclusão de tarefas de negócios reais de ponta a ponta, o Opus 5 passou mais tarefas do que qualquer rival, mesmo quando executado em sua configuração de menor esforço.
Além do desempenho bruto, a Anthropic enfatiza os ganhos de alinhamento do Opus 5. A auditoria de segurança automatizada registrou a menor taxa de comportamento enganoso já vista em um modelo da Anthropic. Embora o sistema ainda perca para o Mythos 5 em tarefas de cibersegurança ofensiva - por design, porque a Anthropic evitou treinar o Opus 5 em trabalhos de cibersegurança -, as métricas gerais de honestidade estabelecem um novo padrão para a empresa.
Os desenvolvedores podem acessar o Opus 5 hoje como o modelo padrão no Claude Max e a opção mais forte no Claude Pro. O modelo também está disponível por meio da API da Anthropic, Amazon Bedrock, Google Cloud e Microsoft Foundry. Um modo "Rápido" executa em duas vezes e meia a velocidade padrão por duas vezes o preço base, dando aos usuários um atalho de desempenho quando a latência é importante.
Dois novos recursos de API são lançados junto com o modelo. Primeiro, as alterações de ferramentas em meio à conversa permitem que os desenvolvedores troquem ferramentas sem quebrar o cache de prompts, preservando o contexto e reduzindo a latência. Segundo, os fallbacks automáticos roteiam solicitações sinalizadas para um modelo diferente em vez de bloqueá-las, melhorando a confiabilidade para aplicações sensíveis à segurança.
O ritmo de lançamento rápido sinaliza uma mudança no mercado de modelos de IA. A Anthropic mudou de entregar um modelo de bandeira por trimestre para entregar quatro modelos em aproximadamente oito semanas, cada um calibrado para um caso de uso e ponto de preço específico. O Opus 5 preenche uma lacuna para desenvolvedores que precisam de inteligência próxima à fronteira para codificação e trabalho de conhecimento diários, mas não exigem as restrições de cibersegurança que limitam o Fable ou o acesso restrito que mantém o Mythos atrás de portas fechadas.
Os observadores da indústria veem a movimentação como uma resposta ao aumento da concorrência de outros provedores de IA que estão expandindo suas famílias de modelos e faixas de preço. Ao oferecer uma opção de alto desempenho e custo-efetiva, a Anthropic visa capturar um segmento mais amplo do mercado empresarial e de desenvolvedores, mantendo seu foco em segurança e alinhamento.
Este artigo foi escrito com a assistência de IA.
News Factory APP - notícias agênticas para impulsionar seu SEO e AEO.