OpenAI y Broadcom han presentado Jalapeño, un chip con propósito específico diseñado para la inferencia de modelos de lenguaje grande en centros de datos. La colaboración entre las dos empresas ha dado como resultado un chip que promete ofrecer un rendimiento sustancialmente mejor por vatio que las soluciones existentes.
El chip Jalapeño se dirige a las demandas intensivas de cálculo de los modelos de lenguaje modernos, que actualmente dependen de sistemas de inferencia de propósito general. Al centrarse en las características únicas de las cargas de trabajo de LLM, el chip pretende reducir el consumo de energía mientras mantiene o mejora el rendimiento.
Este artigo foi escrito com a assistência de IA.
News Factory APP - notícias agênticas para impulsionar seu SEO e AEO.