Google está introduciendo dos nuevos modelos que traen avances en razonamiento en tiempo real para habilitar de manera más efectiva a los agentes de voz y hacer que conversar con la IA se sienta más intuitivo e inteligente. Gemini 3.8 Live está diseñado para escalabilidad y eficiencia de costo, combinando inteligencia conversacional con diálogo fluido y fundamentación visual. Gemini 3.8 Live Extended Thinking está diseñado para tareas de alta complejidad, con inteligencia aumentada y razonamiento multi-paso.

Para desarrolladores y empresas, estos modelos entregan los bloques de construcción para agentes de voz confiables y listos para producción. También hacen que hablar con Gemini a través de la aplicación Gemini, Google Workspace y Búsqueda sea más fluido y colaborativo — ayudando a los usuarios a abordar tareas complejas utilizando solo su voz. Experimente conversaciones más fluidas e inteligentes con Gemini 3.8 Live Extended Thinking, que proporciona finalización de tareas de nivel empresarial y inteligencia.

Gemini 3.8 Live Extended Thinking ha ocupado el primer lugar en general en el Índice de Calidad de Habla a Habla de Análisis Artificial, y lidera en finalización de tareas agénticas. También proporciona capacidades de razonamiento sólidas, obteniendo una alta puntuación en Big Bench Audio, mientras mantiene un punto de precio altamente competitivo en comparación con otros modelos de vanguardia. Gemini 3.8 Live ha mostrado una alta preferencia entre los usuarios, asegurando el segundo lugar en la Arena de Agentes de Habla, y sigue siendo altamente rentable — proporcionando a desarrolladores y empresas un modelo capaz y eficiente diseñado para escalabilidad.

En EVA-Bench de ServiceNow, una referencia para evaluar agentes de voz, los modelos de Google impulsan la frontera de Pareto para flujos de trabajo complejos al equilibrar con éxito la precisión con la calidad conversacional. Gemini 3.8 Live procesa entradas visuales en tiempo real, enriqueciendo las conversaciones con contexto para respuestas más útiles. Detecta automáticamente y transita entre 97 idiomas compatibles en medio de la conversación, y ejecuta herramientas y llamadas a API en segundo plano mientras continúa la conversación.

Para tareas que requieren un razonamiento más profundo, 3.8 Live Extended Thinking razona y habla simultáneamente, entregando una inteligencia aumentada para flujos de trabajo complejos mientras mantiene un flujo conversacional ininterrumpido. A través de Google Workspace y Búsqueda, los modelos Live entregan experiencias más intuitivas y colaborativas — especialmente cuando se abordan tareas complejas. Obtenga ayuda de solución de problemas paso a paso y en tiempo real impulsada por Gemini 3.8 Live — justo dentro de Búsqueda en vivo.

Al utilizar la API de Gemini Live, plataformas de desarrollo como Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel y Vision Agents permiten a los desarrolladores crear e implementar interfaces de voz de alto rendimiento con facilidad. Estas plataformas gestionan la infraestructura de transmisión de medios en tiempo real detrás de las escenas, permitiendo a los desarrolladores centrarse por completo en la creación de la experiencia del usuario. Google también se está asociando con empresas como Salesforce, Genspark y Lumeris, que están emocionadas con 3.8 Live y 3.8 Live Extended Thinking, destacando su impresionante latencia, fluidez y capacidades de llamada de herramientas.

Todo el audio generado por los productos de IA de Google está marcado con SynthID, una marca de agua imperceptible tejida directamente en la salida de audio, garantizando que el contenido generado por IA permanezca detectable para ayudar a prevenir la desinformación. Para obtener más detalles sobre el enfoque de Google hacia la seguridad y la responsabilidad, revise la tarjeta del modelo.

Este artigo foi escrito com a assistência de IA.
News Factory APP - notícias agênticas para impulsionar seu SEO e AEO.