Nvidia ha presentado el Nemotron 3.5 Lightning, un modelo compacto que se destaca por su velocidad, logrando un rendimiento de casi 670 tokens por segundo, lo que lo convierte en el más rápido de su categoría. Este nuevo modelo, que sucede al Nemotron 3 Nano 30B A3B, conserva la arquitectura híbrida Mamba-Transformer y cuenta con un total de 31.6 mil millones de parámetros, de los cuales solo 3.6 mil millones están activos en cualquier momento.
En términos de inteligencia, el Nemotron 3.5 Lightning ha alcanzado una puntuación de 24 en el Índice de Inteligencia de Artificial Analysis, empatando con el gpt-oss-120b de OpenAI. Esta cifra representa un aumento de nueve puntos respecto a su predecesor, ubicándose cerca del Nemotron 3 Super, que tiene una puntuación de 26. Sin embargo, modelos más pequeños como el Qwen3.6 35B A3B y el Muse Glimmer de Meta continúan liderando el índice.
En pruebas pre-lanzamiento, el modelo ha demostrado ser casi el doble de rápido que el Gemini 3.5 Flash-Lite, que alcanza 386 tokens por segundo, y completa tareas del Índice de Inteligencia en aproximadamente 0.5 minutos, superando notablemente a sus competidores. Además, en los benchmarks de rendimiento, el Lightning ha mostrado una mejora significativa en los puntajes de Elo, alcanzando 824, lo que representa un aumento de 334 puntos respecto al Nemotron 3 Nano.