A OpenAI introduziu o GPT‑Live, o mais recente modelo de voz que impulsiona a experiência conversacional do ChatGPT em aplicativos móveis e navegadores da web. Diferentemente do sistema baseado em turnos anterior, o GPT‑Live opera em uma arquitetura full-duplex que permite que o assistente ouça e responda ao mesmo tempo. Os usuários agora ouvem breves interjeições naturais - "mhmm", "yeah" - enquanto falam, reduzindo pausas e cortes desajeitados que afligiam as versões anteriores.

O novo modelo é executado em um único motor multimodal, lidando com a conversão de fala para texto, geração de linguagem e síntese de texto para fala em um único pipeline. Quando uma pergunta exige uma razão mais profunda ou pesquisa, o GPT‑Live pode silenciosamente passar a tarefa para modelos de backend mais capazes, como o GPT‑5.5, mantendo a conversa fluindo sem atrasos notáveis.

O acesso ao GPT‑Live varia de acordo com o nível de assinatura. Os usuários do ChatGPT Pro, Plus e Go recebem o modelo GPT‑Live‑1 completo, enquanto os usuários do plano gratuito são limitados ao GPT‑Live‑1 mini, uma versão mais leve sem as configurações de inteligência personalizáveis. Para iniciar uma sessão de voz, os usuários tocam no ícone de onda no canto direito da caixa de texto, concedem permissão de microfone se solicitado e uma órbita flutuante aparece na tela. A órbita permanece ativa mesmo se o usuário mudar de aplicativo ou bloquear o dispositivo.

Os assinantes pagos podem ajustar o nível de "inteligência" do modelo - Instantâneo, Médio ou Alto - através do menu de configurações. Níveis mais altos adicionam um split-segundo de tempo de processamento extra, permitindo que o modelo realize uma razão mais aprofundada antes de responder. O modelo mini não suporta essa personalização. Os usuários também podem selecionar diferentes vozes, alterar as configurações de idioma ou definir o modo de voz como a opção de lançamento padrão.

Embora o GPT‑Live marque um passo significativo à frente, ele ainda não suporta compartilhamento de tela ou vídeo. Os usuários que desejam reverter para o modelo de voz anterior podem fazê-lo navegando até as configurações de voz e selecionando uma opção anterior. A atualização, no entanto, já recebeu elogios por sua fluidez. Os revisores observam que o assistente não interrompe mais no meio da frase e o ritmo conversacional se sente quase antecipatório, especialmente durante consultas mais longas.

Além das conversas casuais, o GPT‑Live mostra promessa para tarefas de tradução em tempo real. Uma transcrição da troca falada está sempre disponível rolando para baixo e o modelo pode gerar widgets interativos quando uma resposta visual é apropriada. O nível de inteligência Instantâneo padrão lida com perguntas cotidianas rapidamente, enquanto tópicos mais desafiadores se beneficiam dos níveis Médio ou Alto, que invocam uma análise mais profunda sem quebrar o fluxo natural.

No geral, o GPT‑Live posiciona o ChatGPT como um assistente de voz mais acessível para os usuários que preferem falar em vez de digitar. Ao mesclar a escuta e a fala em um loop contínuo e descarregar a razão pesada para modelos de backend, a OpenAI visa tornar as conversas de IA se sentirem menos como interagir com um script e mais como conversar com um parceiro conhecido.

Questo articolo è stato scritto con l'assistenza dell'IA.
News Factory APP - notizie agentiche per potenziare il tuo SEO e AEO.