Google anunciou três novos modelos Gemini após sua apresentação na I/O de maio, onde o Gemini 3.5 Flash foi o destaque. A empresa afirma que a nova linha substitui o modelo mais antigo, que já foi depreciado, e adiciona duas variantes especializadas voltadas para eficiência e segurança.

O Gemini 3.6 Flash é o modelo de substituição. Google cita um salto de 37% para 49% no benchmark de codificação DeepSWE e um aumento modesto de 78,4% para 83% no teste de uso de computador OSWorld. Esses ganhos vêm acompanhados de uma redução de 17% no uso de tokens, uma métrica que se traduz diretamente em menores custos operacionais para os desenvolvedores.

Os preços refletem a ênfase na eficiência. A API agora custa $1,50 por milhão de tokens de entrada e $7,50 por milhão de tokens de saída, abaixo dos $9 por saída do modelo 3.5 Flash anterior. Google argumenta que o modelo mais barato e rápido permitirá que os desenvolvedores construam fluxos de trabalho de agente mais complexos sem inflar os orçamentos.

Além do modelo de bandeira, Google lançou o Gemini 3.5 Flash Lite, apresentado como o modelo de IA mais eficiente da família Gemini. A versão Lite pode lidar com cerca de 350 tokens por segundo, uma velocidade que a empresa afirma rivalizar com os modelos de fronteira de um ano atrás. O preço da versão Lite é de $0,30 por milhão de tokens de entrada e $2,50 por milhão de tokens de saída, ligeiramente mais alto do que o anterior 3.1 Flash Lite, mas ainda posicionado como uma opção acessível para implantações em larga escala.

A terceira adição, Gemini 3.5 Flash Cyber, marca a primeira incursão de Google em um modelo Gemini construído com cibersegurança em mente. Embora Google não tenha divulgado resultados de benchmark para a nova variante de segurança, o lançamento sinaliza a intenção de incorporar capacidades de IA em fluxos de trabalho de detecção e resposta a ameaças.

Notoriamente, o aguardado Gemini 3.5 Pro, originalmente programado para ser lançado em junho, permanece em espera. Google não forneceu uma nova linha do tempo, deixando os desenvolvedores que estavam contando com a versão Pro para ajustar seus planos.

No geral, Google apresenta as atualizações como uma resposta ao feedback dos usuários sobre o Gemini 3.5 Flash, que falhou em atender às expectativas em geração de código e eficiência de custo. Ao reduzir o consumo de tokens, aprimorar as pontuações de desempenho e diversificar a família de modelos, a empresa espera manter sua oferta de IA competitiva à medida que as empresas lidam com os crescentes gastos com tokens de IA.

Cet article a été rédigé avec l'assistance de l'IA.
News Factory APP - actualités agentiques pour booster votre SEO et AEO.