A OpenAI anunciou na quarta-feira que criou seu primeiro processador de inferência personalizado, chamado Jalapeño, em parceria com a Broadcom. O chip, otimizado para executar modelos de IA pré-treinados, promete um desempenho significativamente melhor por watt do que as soluções existentes e pode reduzir o custo de serviços de IA em tempo real.
De acordo com a empresa, os testes iniciais mostram que o processador entrega um desempenho significativamente maior por watt do que as alternativas de última geração atualmente em uso. Esse aumento de eficiência pode se traduzir em menores custos operacionais para as ofertas de IA baseadas em nuvem da OpenAI, especialmente aquelas que dependem fortemente da inferência em vez da fase de treinamento mais intensiva em computação.
Questo articolo è stato scritto con l'assistenza dell'IA.
News Factory APP - notizie agentiche per potenziare il tuo SEO e AEO.