Google está introduzindo dois novos modelos que trazem avanços no raciocínio em tempo real para habilitar de forma mais eficaz os agentes de voz e tornar as conversas com IA mais intuitivas e inteligentes. O Gemini 3.8 Live é projetado para escalabilidade e eficiência de custo, combinando inteligência conversacional com diálogo fluido e fundamentação visual. O Gemini 3.8 Live Extended Thinking é projetado para tarefas de alta complexidade, com inteligência aumentada e raciocínio em várias etapas.

Para desenvolvedores e empresas, esses modelos fornecem os blocos de construção para agentes de voz confiáveis e prontos para produção. Eles também tornam a comunicação com o Gemini, por meio do aplicativo Gemini, Google Workspace e Pesquisa, mais fluida e colaborativa — ajudando os usuários a realizar tarefas complexas usando apenas a voz. Experimente conversas mais fluidas e inteligentes com o Gemini 3.8 Live Extended Thinking, que fornece conclusão de tarefas e inteligência de nível empresarial.

O Gemini 3.8 Live Extended Thinking conquistou a primeira posição geral no Índice de Qualidade de Fala para Fala da Artificial Analysis e lidera na conclusão de tarefas agênticas. Ele também fornece fortes capacidades de raciocínio, obtendo altas pontuações no Big Bench Audio, enquanto mantém um ponto de preço altamente competitivo em comparação com outros modelos de fronteira. O Gemini 3.8 Live mostrou uma alta preferência entre os usuários, garantindo o segundo lugar na Arena de Agentes de Voz, e permanece altamente eficiente em termos de custo — fornecendo aos desenvolvedores e empresas um modelo capaz e eficiente projetado para escalabilidade.

No EVA-Bench da ServiceNow, uma referência para avaliar agentes de voz, os modelos da Google impulsionam a Fronteira de Pareto para fluxos de trabalho complexos, equilibrando com sucesso a precisão com a qualidade conversacional. O Gemini 3.8 Live processa entradas visuais em tempo real, enriquecendo as conversas com contexto para respostas mais úteis. Ele detecta automaticamente e transita entre 97 idiomas suportados durante a conversa e executa ferramentas e chamadas de API em segundo plano, continuando a conversa.

Para tarefas que exigem raciocínio mais profundo, o 3.8 Live Extended Thinking raciocina e fala simultaneamente, fornecendo inteligência aumentada para fluxos de trabalho complexos, mantendo um fluxo conversacional ininterrupto. Em todo o Google Workspace e Pesquisa, os modelos Live fornecem experiências mais intuitivas e colaborativas — especialmente ao lidar com tarefas complexas. Obtenha ajuda de solução de problemas passo a passo e em tempo real, impulsionada pelo Gemini 3.8 Live — diretamente na Pesquisa Live.

Ao usar a API Gemini Live, plataformas de desenvolvedor como Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel e Vision Agents habilitam os desenvolvedores a criar e implantar interfaces de voz de alto desempenho com facilidade. Essas plataformas gerenciam a infraestrutura de transmissão de mídia em tempo real complexa nos bastidores, permitindo que os desenvolvedores se concentrem inteiramente na criação da experiência do usuário. A Google também está se associando a empresas como Salesforce, Genspark e Lumeris, que estão entusiasmadas com o 3.8 Live e o 3.8 Live Extended Thinking, destacando sua impressionante latência, fluidez e capacidades de chamada de ferramentas.

Toda a áudio gerada pelos produtos de IA de Google é marcada com SynthID, uma marca d'água imperceptível tecida diretamente na saída de áudio, garantindo que o conteúdo gerado por IA permaneça detectável para ajudar a prevenir a desinformação. Para obter detalhes sobre a abordagem da Google em relação à segurança e responsabilidade, revise o cartão do modelo.

This article was written with the assistance of AI.
News Factory APP - agentic news to boost your SEO & AEO.