A OpenAI lançou um novo modo de processamento chamado Ultrafast para seu modelo de linguagem grande GPT-5.6 Sol, prometendo um aumento dramático na velocidade de saída. A empresa afirma que o modo pode entregar até 750 tokens de saída por segundo, aproximadamente 14 vezes a taxa da configuração padrão do modelo. Em um post de blog de quinta-feira, a OpenAI enquadrou o desenvolvimento como um passo em direção a "mais trabalho útil por segundo", observando que o desempenho em tempo real anteriormente exigia a troca para modelos menores ou especializados.
Os ganhos de desempenho do Ultrafast decorrem de uma parceria de hardware com a Cerebras, uma fabricante de chips conhecida por aceleradores de IA de alto débito. A pré-visualização é limitada a um pequeno grupo de clientes, enquanto a OpenAI monitora a capacidade e a confiabilidade. A empresa indicou que mais usuários terão acesso à medida que o sistema se escalona.
A OpenAI destacou vários cenários corporativos onde o aumento de velocidade poderia ser mais importante. Equipes de resposta a incidentes poderiam analisar alertas e gerar etapas de mitigação em tempo quase real. Bots de suporte ao cliente poderiam lidar com volumes de consulta mais altos sem sacrificar a qualidade da resposta. Analistas financeiros poderiam executar simulações de tendências de mercado rápidas, e plataformas de comércio eletrônico poderiam personalizar recomendações de produtos em tempo real.
Concorrentes introduziram suas próprias ofertas aceleradas, mas a OpenAI afirma que o Ultrafast supera-as. O Claude, da Anthropic, por exemplo, oferece um modo rápido que não atinge a taxa de tokens por segundo anunciada pela OpenAI. A empresa posicionou o novo modo como evidência de progresso em uma "nova direção" para modelos de linguagem grande, enfatizando o débito em vez da redução do tamanho do modelo.
Embora a funcionalidade ainda esteja em pré-visualização, o anúncio da OpenAI sinaliza uma mudança na forma como os provedores de IA abordam as preocupações de latência para usuários empresariais. Ao combinar um modelo de alto desempenho com hardware especializado, a empresa visa tornar as aplicações de IA em tempo real mais viáveis em uma variedade de setores. O lançamento provavelmente informará decisões futuras sobre a escalabilidade da tecnologia e a expansão do acesso além do grupo de teste inicial.
Cet article a été rédigé avec l'assistance de l'IA.
News Factory APP - actualités agentiques pour booster votre SEO et AEO.