Nvidia lanza Nemotron 3.5 Lightning, su modelo de IA gratuito para agentes que se ejecuta en local

Nvidia acaba de entrar de lleno en la carrera de la inteligencia artificial de código abierto con el lanzamiento de Nemotron 3.5 Lightning, un modelo gratuito de pesos abiertos diseñado específicamente para agentes de IA que ejecuten tareas especializadas. La noticia, publicada por Xataka, incluye también NeMo Switchyard, una herramienta complementaria que reduce el coste de ejecutar agentes a gran escala.

Por qué Nvidia regala su modelo de IA

La apuesta tiene lógica de negocio: Nvidia no vive de vender modelos de inteligencia artificial, sino del hardware que los ejecuta. Al ofrecer gratis un modelo competente y ligero, la empresa busca atraer a más desarrolladores y compañías al desarrollo de agentes, sabiendo que todos ellos seguirán necesitando GPUs para funcionar (preferiblemente, GPUs de Nvidia).

El CEO Jensen Huang lleva semanas defendiendo públicamente esta estrategia, argumentando que los modelos abiertos generan «una mayor demanda de chips». En una carta reciente, Huang advirtió contra «restricciones prematuras» que puedan frenar la innovación en IA abierta, un mensaje dirigido directamente a Washington tras la llegada de Kimi K3 de Moonshot AI, modelo chino que ha reducido la brecha tecnológica con Estados Unidos.

Qué ofrece Nemotron 3.5 Lightning

Nemotron 3.5 es lo bastante ligero como para ejecutarse en un solo PC convencional con una GPU, sin necesidad de todo un centro de datos. Según Nvidia, genera respuestas hasta cuatro veces más rápido y completa tareas aproximadamente un 30% más rápido que modelos abiertos comparables. Sin embargo, no está pensado para chat general, sino para tareas acotadas dentro de sistemas multiagente más amplios.

El modelo se ha construido mediante destilación, una técnica común en modelos locales que consiste en entrenar un modelo pequeño con los resultados de uno mayor. Así, Nemotron 3.5 condensa capacidades de los modelos Nemotron más grandes en una fracción de su tamaño.

Empresas como CrowdStrike, CodeRabbit y Harvey ya lo han probado y personalizado. El modelo está disponible para descarga en Hugging Face, ModelScope, OpenRouter y la web de Nvidia, sin necesidad de pagar ni pedir permiso para usarlo o modificarlo.

NeMo Switchyard: inteligencia para ahorrar costes

La otra pieza del anuncio es NeMo Switchyard, una herramienta de código abierto que decide automáticamente qué modelo de IA debe encargarse de cada paso de una tarea. El sistema sopesa la precisión requerida y el coste antes de enviar la petición al modelo más potente (y caro) disponible.

Según pruebas internas de Nvidia, Switchyard puede igualar el rendimiento de modelos punteros reduciendo el coste de completar tareas a aproximadamente un tercio de lo que supondría utilizar Claude Opus 4.8 de Anthropic por sí solo.

Contexto: la batalla por la IA abierta

Nvidia no es la única gran tecnológica apostando por modelos de pesos abiertos. Un día antes de este lanzamiento, Meta presentó Muse Spark, su propio modelo especializado en programación, acompañado de una defensa pública de Mark Zuckerberg sobre la IA de código abierto. Zuckerberg afirmó que los modelos abiertos estadounidenses deberían «aspirar a ser los mejores del mundo».

Kari Briski, vicepresidenta de software de IA generativa para empresas en Nvidia, declaró al Wall Street Journal Leadership Institute que herramientas como Lightning y Switchyard «ayudan a las empresas a proteger sus propios datos», respondiendo a la reticencia de ciertos sectores a enviar información confidencial a grandes tecnológicas.

La estrategia de Nvidia es clara: cuanto más accesible y económica sea la IA, más empresas construirán con ella. Y cada una de esas empresas necesitará hardware para ejecutarla.

Fuente: Xataka · Esta información ha sido elaborada por la redacción de Imbest con apoyo de herramientas editoriales automatizadas.

No te lo pierdas
Noticias relevantes