NVIDIA lanza Nemotron 3.5 Lightning y NeMo Switchyard para acelerar agentes de IA

Fuentes: NVIDIA launches Nemotron 3.5 Lightning and NeMo Switchyard for faster, smarter agentic AI

NVIDIA amplía su familia de modelos abiertos Nemotron 3 con el lanzamiento de Nemotron 3.5 Lightning, un modelo de 30.000 millones de parámetros basado en arquitectura mixture-of-experts (MoE) orientado a tareas especializadas dentro de sistemas multiagente de larga duración. La compañía afirma que ofrece hasta cuatro veces más velocidad de salida y reduce un 30% el tiempo de finalización de tareas agentic frente a otros modelos de su categoría. El modelo es de código abierto, personalizable mediante NVIDIA NeMo con datos propios de cada organización y puede ejecutarse en PCs con RTX, estaciones DGX, dispositivos Jetson o en la nube.

Junto al modelo, NVIDIA presenta NeMo Switchyard, una biblioteca de código abierto para enrutamiento inteligente de solicitudes dentro de herramientas agentic. El sistema dirige cada petición al modelo más adecuado —abierto, propietario o de NVIDIA— sin reescribir las aplicaciones, y permite ajustar el enrutador según prioridades de calidad, latencia o coste. Pruebas internas indican que mantiene una precisión de frontera y reduce el coste de finalización de tareas a cerca de un tercio del que se obtiene usando únicamente Opus 4.8.

Varios socios ya están integrando o evaluando ambas tecnologías. CrowdStrike la adapta a ciberseguridad; Harvey con Trajectory, a servicios jurídicos; CodeRabbit con Baseten, a revisión de código; Lila Sciences, a razonamiento en ciencias; y Fastino Labs, a cargas de software, finanzas y salud. En el lado del enrutamiento, Boomi, Cadence, Classmethod, Cognition, Kong, LangChain, LiteLLM, Nous Research y Ramp han reportado mejoras de entre el 9,9% y el 74% en coste o eficiencia. NVIDIA publica también el conjunto de datos Nemotron-RL-Agentic-Terminal-Pivot para post-entrenar el modelo en capacidades de agente de programación.