Nvidia presentó Nemotron 3.5 Lightning, un modelo de mezcla de expertos de 30 mil millones de parámetros que se ejecuta en una ventana de contexto de un millón de tokens y es gratuito para uso comercial bajo la licencia OpenMDW-1.1. La empresa también lanzó la biblioteca NeMo Switchyard, que ruta tareas al modelo más adecuado para el trabajo, reduciendo los costos hasta un 74 por ciento.
La empresa destacó dos cifras de velocidad para ilustrar el rendimiento del modelo. En entornos de laboratorio, Nemotron 3.5 Lightning generó tokens hasta cuatro veces más rápido que los rivales de tamaño similar. En la ejecución de tareas del mundo real, completó 10,000 tareas de referencia un 30 por ciento más rápido que Qwen 3.6 35B de Alibaba, manteniendo una precisión comparable.
Cet article a été rédigé avec l'assistance de l'IA.
News Factory APP - actualités agentiques pour booster votre SEO et AEO.