OpenAI e Anthropic anunciaram reduções de preços acentuadas para seus modelos de linguagem de grande escala de médio nível na terça-feira, um sinal claro de que os laboratórios de IA dos EUA estão se esforçando para manter o ritmo com alternativas chinesas cada vez mais acessíveis. O modelo GPT-5.6 Luna mais recente da OpenAI agora custa $0,20 por milhão de tokens de entrada e $1,20 por milhão de tokens de saída, abaixo de $1 e $6, respectivamente. Anthropic, por outro lado, lançou o Opus 5 por $5 por milhão de tokens de entrada e $25 por milhão de tokens de saída, um desconto de 50 por cento em comparação com seu modelo de bandeira Fable 5.

Os dois laboratórios também ajustaram suas estratégias de preços. Anthropic cancelou um aumento de preços planejado para seu modelo Sonnet 5, que estava programado para entrar em vigor em setembro, enquanto a OpenAI deixou suas taxas de nível superior inalteradas, focando as reduções no meio de sua linha de produtos.

Como funciona o preço por token

Os clientes são cobrados pelos tokens que alimentam um modelo (tokens de entrada) e pelos tokens que o modelo gera (tokens de saída). O preço por token, no entanto, não conta a história toda. Modelos mais capazes podem frequentemente concluir uma tarefa com menos tokens ou menos tentativas, o que significa que uma taxa mais alta por token pode se traduzir em um custo geral mais baixo para um determinado trabalho.

Os modelos também são executados em diferentes configurações de "esforço", que ajustam a potência de processamento alocada a uma solicitação. Um esforço mais alto pode melhorar o desempenho, mas aumenta o custo por token. A Artificial Analysis, uma empresa de benchmark, descobriu que o Opus 5 da Anthropic em um nível de esforço médio entregou desempenho e custo por tarefa comparáveis ao Kimi K3 da Moonshot em esforço máximo. O GPT-5.6 Luna da OpenAI em esforço máximo performou em par com o V4 Flash da DeepSeek no mesmo nível de esforço, mas custou apenas abaixo de duas vezes mais por tarefa.

Reação da indústria

Uma fonte próxima da Anthropic disse que o preço mais baixo para o Opus 5 reflete a estratégia de "família de modelos" da empresa, e não uma tentativa direta de igualar os concorrentes. "Construímos uma linha de modelos em camadas, onde cada modelo atende a um caso de uso específico", explicou a fonte.

Mantas Lukauskas, líder de tecnologia de IA da provedora de hospedagem de sites Hostinger, observou que, embora os preços para os modelos mais avançados tenham permanecido estáveis ou aumentado, as novas reduções representam o primeiro teste real de se os laboratórios dos EUA podem proteger a estrutura de custos de suas ofertas premium. "Os laboratórios dos EUA cortaram o meio e estão defendendo o topo", disse Lukauskas.

Tanto a OpenAI quanto a Anthropic se recusaram a comentar sobre as mudanças de preços. Os analistas esperam que a guerra de preços se intensifique à medida que as empresas chinesas continuam a lançar modelos de alto desempenho a preços mais baixos, pressionando os provedores dos EUA a equilibrar a lucratividade com a necessidade de reter desenvolvedores que são cada vez mais sensíveis ao custo.

Para os desenvolvedores e as empresas que dependem de modelos de linguagem de grande escala para tudo, desde a geração de código até o suporte ao cliente, as novas taxas podem se traduzir em economias significativas, especialmente para cargas de trabalho que envolvem grandes volumes de tokens. No entanto, o impacto final dependerá de quão rapidamente os modelos podem concluir tarefas de forma mais eficiente em configurações de esforço mais baixas e se as reduções de preços estimulam uma adoção mais ampla ou apenas mudam a participação de mercado entre os jogadores existentes.

Este artigo foi escrito com a assistência de IA.
News Factory APP - notícias agênticas para impulsionar seu SEO e AEO.