A medida que la IA pasa de los chatbots a los agentes autónomos, los modelos abiertos responden a la demanda de control total sobre dónde se ejecuta la IA y cómo se despliega. NVIDIA ha contestado a esa demanda con dos lanzamientos.

Nemotron 3.5 Lightning

La compañía ha ampliado su familia Nemotron 3 con Nemotron 3.5 Lightning, un modelo de mezcla de expertos de 30.000 millones de parámetros presentado como el más eficiente de su clase para cargas de agentes de larga duración. Llega tras Nemotron 3 Nano.

El modelo está pensado para tareas especializadas dentro de sistemas multiagente más amplios. Las cifras que aporta la empresa:

  • Velocidad de salida hasta cuatro veces mayor que la de otros modelos de su clase
  • En consecuencia, tareas de agente completadas un 30 por ciento más rápido
  • Al ser abierto y personalizable, puede reentrenarse con NVIDIA NeMo sobre los datos, herramientas y flujos de trabajo propios de cada organización

El modelo se desarrolló con aportaciones de la Nemotron Coalition, cuyos miembros facilitaron metodologías de evaluación, software de inferencia y conjuntos de datos.

La idea del sistema de modelos

La arquitectura que describe NVIDIA no se apoya en un único modelo gigante, sino en un conjunto. Los sistemas de agentes siempre activos operan cada vez más como sistemas de modelos, con distintos modelos especializados en distintas tareas.

En la práctica, eso significa que un modelo puntero de razonamiento como Nemotron 3 Ultra o GPT-5.6 planifica y orquesta un flujo de trabajo, mientras que modelos más pequeños y especializados como Nemotron 3.5 Lightning realizan tareas concretas: revisión de código, uso de herramientas, vigilancia de alertas de seguridad o respuesta a preguntas de facturación.

NeMo Switchyard

El segundo lanzamiento completa la pieza que faltaba. NeMo Switchyard es una biblioteca de código abierto para el enrutado inteligente dentro de herramientas de agentes populares, con la que las empresas pueden construir un enrutador según sus necesidades.

Una vez desplegado, Switchyard dirige cada petición al modelo más capaz y adecuado para el trabajo, entre la mezcla propia de modelos abiertos, propietarios y de NVIDIA, sin exigir reescribir las aplicaciones.

Quién lo usa

Según la compañía, responsables de IA de distintos sectores están adaptando el modelo a sus cargas: CrowdStrike en ciberseguridad, Harvey junto a Trajectory en servicios jurídicos y CodeRabbit con Baseten en revisión de código. Lila Sciences trabaja en mejorar el razonamiento para tareas de agente en ciencias físicas y de la vida, mientras que Fastino Labs afirma que su versión personalizada logra precisiones destacadas en desarrollo de software, finanzas y sanidad.

El modelo también puede ejecutarse en sistemas locales de IA, lo que da a las organizaciones control sobre la privacidad y el despliegue.