Nvidia anunció Nemotron 3.5 Lightning el martes, posicionando el nuevo modelo como la última adición a su cartera de inteligencia artificial de peso abierto. El sistema de 30 mil millones de parámetros de mezcla de expertos (MoE) activa tres mil millones de parámetros en cualquier momento dado, combinando capas Mamba-2, MoE y de atención. Una característica destacada es su ventana de contexto de un millón de tokens, mucho más grande que la mayoría de los modelos contemporáneos. Nvidia colocó los pesos en Hugging Face y ModelScope y lanzó el modelo bajo la licencia OpenMDW-1.1, que permite explícitamente el uso comercial sin tarifas ni permiso previo.
La empresa destacó dos cifras de velocidad para ilustrar el rendimiento del modelo. En entornos de laboratorio, Nemotron 3.5 Lightning generó tokens hasta cuatro veces más rápido que los rivales de tamaño similar. En la ejecución de tareas del mundo real, completó 10,000 tareas de referencia un 30 por ciento más rápido que Qwen 3.6 35B de Alibaba, manteniendo una precisión comparable. Las referencias muestran puntuaciones respetables: 81,94 en MMLU Pro, 75,44 en GPQA Diamante y 51,56 en SWE-bench Verificado, después de entrenar en más de 20 billones de tokens.
Más allá del modelo mismo, Nvidia introdujo NeMo Switchyard, una biblioteca de enrutamiento de código abierto diseñada para enviar cada paso de un flujo de trabajo de agente al modelo mejor adaptado para el trabajo. En pruebas realizadas por MarkTechPost, LangChain utilizó Switchyard para dividir el trabajo entre Nemotron 3.5 Lightning y Claude Opus 4.8. El enfoque redujo el costo general en un 74 por ciento, con solo el 7 por ciento de las llamadas que golpean el modelo de frontera costoso, preservando alrededor de seis puntos de precisión. Nvidia presenta esto como evidencia de que la mayoría de las tareas de agente no requieren el modelo más poderoso, un punto dirigido directamente a los laboratorios de investigación que confían en sistemas pesados.
Los observadores de la industria señalan que la estrategia de Nvidia se alinea con un patrón familiar: el fabricante de chips suministra modelos de alto rendimiento gratuitos para impulsar la demanda de sus GPU. Al hacer que el software esté disponible de forma gratuita, Nvidia espera expandir las cargas de trabajo de inferencia, lo que a su vez impulsa las ventas de hardware. La empresa ha vinculado previamente el trabajo de seguridad y la defensa del peso abierto a su agenda de hardware, y Jensen Huang incluso publicó sobre el lanzamiento en X, subrayando el motivo comercial.
Mirando hacia adelante, Nvidia divulgó planes para Nemotron 4, un modelo que superará los mil millones de parámetros, más del doble de los 550 mil millones de parámetros de Nemotron 3 Ultra. El cronograma sugiere un posible debut a finales de otoño. Sin embargo, incluso a ese tamaño, Nemotron 4 seguiría siendo más pequeño que los principales modelos abiertos de China. El modelo Kimi K3 de Moonshot actualmente ostenta el récord del modelo de peso abierto más grande, y Qwen 3.6 de Alibaba también sirve como referencia en las comparaciones de rendimiento de Nvidia.
Las empresas chinas han dominado el frente de peso abierto, con DeepSeek reduciendo los precios para hacer que sus modelos sean la opción más rentable, y Alibaba y Moonshot intercambiando el primer lugar a lo largo del año. Las iniciativas de peso abierto de Estados Unidos han sido en gran medida argumentos de política en lugar de productos listos para el mercado. Nemotron 3.5 Lightning, aunque pequeño en tamaño, marca un cambio tangible al entregar un modelo de alto rendimiento genuinamente abierto desde el proveedor de hardware que alimenta la mayoría de la inferencia de inteligencia artificial.
Si Nemotron 4 finalmente inclina la balanza a favor de Nvidia sigue siendo incierto. Si se coloca cerca de la parte superior de las listas de peso abierto, Nvidia asegurará un asiento en una mesa en la que históricamente solo ha invertido. Si se queda atrás de Kimi K3, el lanzamiento sigue sirviendo a su propósito principal: generar demanda de GPU al ofrecer software gratuito y de vanguardia. Ambos resultados refuerzan el libro de jugadas de Nvidia de larga data: regalos de software para impulsar las ventas de hardware.
Questo articolo è stato scritto con l'assistenza dell'IA.
News Factory APP - notizie agentiche per potenziare il tuo SEO e AEO.