OpenAI e Broadcom anunciaram o Jalapeño, um novo ASIC construído do zero para executar inferência de large-language-model em data centers. A parceria aproveitou nove meses de trabalho de design conjunto e insights de pesquisadores da OpenAI para criar um chip que promete um desempenho substancialmente melhor por watt do que as soluções existentes.

O Jalapeño tem como alvo as demandas computacionais intensivas de modelos de linguagem modernos, que atualmente dependem de sistemas de inferência de propósito geral. Ao se concentrar nas características únicas das cargas de trabalho de LLM, o chip visa reduzir o consumo de energia enquanto mantém ou melhora a produtividade.

A colaboração entre a OpenAI e a Broadcom reflete um nível rare de co-design entre um laboratório de IA líder e um fabricante de hardware. O ciclo de desenvolvimento rápido demonstra como os parceiros trabalharam juntos para criar um chip que atenda às necessidades específicas da inferência de LLM.

Os testes iniciais da OpenAI indicam que o chip entrega um "desempenho por watt substancialmente melhor que as soluções atuais de ponta". Embora as figuras exatas permaneçam em sigilo, a declaração sugere um salto significativo na eficiência energética, uma métrica crítica para operadores que executam cargas de trabalho de IA caras e consumidoras de energia.

Ambos os parceiros veem o Jalapeño como o ponto de partida de uma jornada mais longa. Eles imaginam refinamentos iterativos que manterão o ritmo com a evolução rápida das arquiteturas de LLM. Gerações futuras do chip devem incorporar lições aprendidas com implantações no mundo real e com os designs de modelos de próxima geração da OpenAI.

Este artigo foi escrito com a assistência de IA.
News Factory APP - notícias agênticas para impulsionar seu SEO e AEO.