A ZML, com sede em Paris, lançou o LLMD, um servidor de inferência gratuito que executa modelos de linguagem grandes de código aberto em chips Nvidia, AMD, Google TPU, Apple Metal e Intel Arc. O fundador Steeve Morin afirma que o objetivo é quebrar o lock-in de fornecedores, reduzir custos e aumentar a eficiência energética para as empresas. Apoiada por Yann LeCun e US$ 20 milhões em financiamento de venture, a equipe de 20 pessoas espera que o lançamento gere dados de uso e abra caminho para futuras receitas.
Ler mais