
Hace un par de meses estaba revisando logs en Tokio y me di cuenta de algo caleta: la mayoría de los agentes de IA que probamos terminan mandando todo a la nube de turno. Prometen autonomía, pero al final dependes de la conexión y de los términos de servicio de alguien más. No me gusta eso. Si voy a delegar tareas a una IA, prefiero que haga la pega acá, en mi hardware, donde yo decido qué pasa con los datos.
Por eso me llamó la atención lo que anunció NVIDIA esta semana. Sacaron Nemotron 3.5 Lightning, un modelo de 30 mil millones de parámetros con arquitectura mixture-of-experts, pensado específicamente para agentes que corren todo el día sin descanso. Según sus benchmarks, completa tareas agenticas un 30% más rápido que modelos similares y entrega hasta 4 veces más velocidad de salida. Eso no es marketing vacío: en la pega de sysadmin, cuando un agente revisa alertas de seguridad o responde tickets, cada segundo cuenta.
Pero lo más bacán no es solo el modelo. Es que viene con NeMo Switchyard, una librería open source que te permite armar un router inteligente para tus agentes. La wea funciona así: en vez de mandar cada consulta al mismo modelo gigante, Switchyard decide qué modelo ejecuta cada tarea. Una consulta compleja va al modelo grande, una revisión de código va al especializado, una pregunta simple va al más chico. Todo local, todo bajo tu control, sin reescribir aplicaciones.
Open source y privacidad real
NeMo Switchyard es open source. Eso para mí es no negociable. Puedes auditar el código, saber qué está haciendo el router y, lo más importante, no depender de una API externa para tareas críticas. NVIDIA ya había liberado Nemotron 3 Nano antes, pero ahora con Lightning y Switchyard está armando un ecosistema completo para que las empresas (y los locos como yo que administramos nuestra propia infraestructura) podamos montar agentes sin entregar los datos.
El modelo puede correr en RTX PCs, DGX Spark, Jetson y estaciones de trabajo. O sea, no necesitas un datacenter para probarlo. Eso es una señal clara: NVIDIA entendió que la IA agentica no va a vivir solo en la nube. Va a estar en tu laptop, en tu edge, en tu servidor de la oficina.
Mi opinión
He visto muchas promesas de «IA descentralizada» que al final terminan siendo un wrapper de OpenAI con un frontend bonito. Esto es distinto. Es un modelo abierto, customizable con NeMo para tu dominio específico, con una librería de routing que no te ata a su nube. CrowdStrike ya lo está usando para ciberseguridad, Harvey para legal, CodeRabbit para revisión de código. No son startups de pitch deck; son empresas que necesitan que la IA funcione sin filtrar datos sensibles afuera.
Obviamente NVIDIA no lo hace por caridad. Te quiere vendiendo GPUs. Pero prefiero mil veces ese modelo de negocio al de las APIs de IA que te cobran por token y se quedan con tu información. Al menos acá el hardware es tuyo, el modelo es tuyo, y si mañana cambias de proveedor, no perdiste nada.
Si eres de los que está armando pipelines con agentes autónomos, dale una mirada a esto. La combinación de un modelo rápido, abierto y un router inteligente puede cambiar cómo piensas la arquitectura de tus proyectos. Yo ya estoy viendo cómo meter Nemotron 3.5 Lightning en Tokio para que revise logs y me avise antes de que algo se queme. Si funciona, te cuento.
Fuente de inspiración: NVIDIA Nemotron 3.5 Lightning and NeMo Switchyard Deliver Faster, Smarter, More Efficient Agentic AI
