NVIDIA presentó el modelo Nemotron 3.5 Lightning para hacer más eficientes las tareas de alto volumen y repetitivas que permiten a los agentes automatizados funcionar de manera continua. Aunque este modelo tiene un total de 30 mil millones de parámetros, solo activa 3 mil millones de parámetros por token, lo que ofrece la capacidad de un modelo más grande con un costo computacional menor.

Nemotron 3.5 Lightning está diseñado para la capa de ejecución de los agentes automatizados y permite que los sistemas realicen tareas repetitivas como invocar herramientas, controlar resultados, ejecutar comandos y transferir tareas. Este modelo puede ejecutarse localmente y es compatible con plataformas como DGX Spark, Jetson y las tarjetas gráficas GeForce RTX 5090 de NVIDIA.

NVIDIA presenta Nemotron 3.5 Lightning como parte de un sistema en el que los modelos más grandes se utilizan para la planificación y la toma de decisiones complejas, mientras que los modelos más pequeños se emplean para la ejecución. El modelo ha sido entrenado para ser compatible con marcos de agentes populares como OpenClaw y Hermes Agent, lo que ayuda a los agentes a realizar llamadas de herramientas con mayor precisión y reduce la latencia en las tareas repetitivas.