O rumor do setor aponta para um possível acordo de $13 bilhões entre a Nvidia e a Hugging Face, a plataforma de modelos de IA de peso aberto frequentemente descrita como o "GitHub para IA". Se confirmado, o acordo marcaria a investida mais agressiva da Nvidia no ecossistema de desenvolvedores que sustenta os grandes modelos de linguagem não pertencentes aos laboratórios de fronteira dominantes.
A Hugging Face hospeda uma vasta biblioteca de modelos que os desenvolvedores podem ajustar e implantar sem pagar taxas por token. Sua plataforma se tornou um ímã para empresas que buscam executar tarefas de alto volume e repetitivas - chatbots de atendimento ao cliente, por exemplo - onde um modelo de peso aberto personalizado pode reduzir os custos de inferência.
No mês passado, a Nvidia selou uma parceria de $6 bilhões com a Poolside, uma construtora de modelos de peso aberto cuja equipe migrará em grande parte para a fabricante de chips. O movimento sinalizou a intenção da Nvidia de diversificar além de suas relações tradicionais com os hyperscalers e os grandes laboratórios que projetam modelos proprietários. Uma estratégia semelhante parece estar se desenrolando na Stripe, que pagou mais de $7 bilhões pela OpenRouter, um provedor líder de modelos de peso aberto para empresas.
Enquanto isso, os rivais estão construindo seu próprio hardware. A OpenAI anunciou seu chip de inferência Jalapeño esta semana, enquanto o Google continua a desenvolver chips para seus modelos Gemini. A Nvidia, que já oferece a família de modelos de peso aberto Nemotron, viu uma adesão limitada a esses modelos. A aquisição da Hugging Face daria à empresa acesso direto a uma base de usuários maciça que poderia ser direcionada para as GPUs e pilhas de inferência da Nvidia.
A adoção de modelos de peso aberto permanece modesta. Uma pesquisa da Ramp sobre o gasto corporativo encontrou que apenas cerca de 6% das empresas usam esses modelos, e os dados da Jellyfish mostram que cerca de 2% dos engenheiros de software trabalham com eles. No entanto, o nicho está crescendo, impulsionado pela promessa de controle e configurabilidade. As empresas afirmam que estão menos interessadas no custo apenas e mais na capacidade de personalizar os modelos para casos de uso específicos.
"Tokens são a moeda central para as empresas que constroem com IA", disse o co-fundador da Stripe, Patrick Collison, após o acordo da OpenRouter. A declaração destaca uma crença mais ampla da indústria de que gerenciar recursos de computação de forma eficiente moldará a economia da IA nos anos vindouros.
Lin Qiao, CEO da Fireworks - uma roteadora e hospedeira de modelos de peso aberto concorrente - afirma que sua plataforma processa 40 trilhões de tokens diariamente, superando os volumes tratados pelas APIs da Gemini e da OpenAI. A Fireworks apostou na diversidade de modelos, instando todas as empresas de aplicativos a considerar um pesquisador interno que possa treinar um modelo ajustado aos seus dados.
Os analistas veem a movimentação rumorosa da Nvidia como uma tentativa de garantir um pipeline de desenvolvedores que poderiam de outra forma se desviar para alternativas mais baratas de empresas chinesas como a Moonshot, a DeepSeek ou a Alibaba. Embora os modelos de peso aberto atendam atualmente a uma pequena fatia do mercado, sua participação pode expandir à medida que mais empresas amadurecem seus fluxos de trabalho de IA e buscam opções de auto-hospedagem.
Por enquanto, a Nvidia não confirmou as negociações, e os termos exatos permanecem especulativos. A possível aquisição ilustraria, no entanto, como os fabricantes de chips estão se posicionando em meio a uma paisagem de IA em mudança, onde a propriedade de modelos, o desempenho de hardware e a eficiência de custo se intersectam.
Cet article a été rédigé avec l'assistance de l'IA.
News Factory APP - actualités agentiques pour booster votre SEO et AEO.