NVIDIA Revoluciona la IA con Nemotron 3.5 Lightning y NeMo Switchyard

NVIDIA Nemotron 3.5 Lightning and NeMo Switchyard Deliver Faster, Smarter, More Efficient Agentic AI

En un momento en que la inteligencia artificial (IA) evoluciona de simples chatbots a agentes autónomos, NVIDIA ha dado un paso significativo con la expansión de su familia de modelos Nemotron 3. La compañía ha lanzado el Nemotron 3.5 Lightning, un modelo de alta eficiencia diseñado para tareas de IA agentica de larga duración. Este modelo, que sigue al Nemotron 3 Nano, refleja el compromiso de NVIDIA de mejorar continuamente los modelos abiertos para lograr mayor precisión y velocidad.

El Nemotron 3.5 Lightning, con sus 30 mil millones de parámetros, está construido para tareas especializadas dentro de sistemas multi-agente más grandes. Este modelo ayuda a crear aplicaciones agenticas más inteligentes y eficientes. Además, NVIDIA ha presentado NeMo Switchyard, una biblioteca de código abierto para el enrutamiento inteligente dentro de herramientas populares para agentes. Las empresas pueden utilizar esta biblioteca para construir un enrutador basado en sus necesidades específicas, permitiendo dirigir cada solicitud al modelo más adecuado sin necesidad de reescribir sus aplicaciones.

Juntos, el Nemotron 3.5 Lightning y el NeMo Switchyard ofrecen un control sin precedentes sobre cómo se despliega la IA, dónde se ejecuta y cuán eficientemente opera, ya sea en PCs, estaciones de trabajo, centros de datos o en la nube. El modelo Nemotron 3.5 Lightning proporciona inteligencia de vanguardia en un modelo abierto, pequeño y personalizable, diseñado para flujos de trabajo agenticos de alto volumen.

Los sistemas agenticos modernos operan como sistemas de modelos, con diferentes modelos especializados en diferentes tareas. Los modelos abiertos de Nemotron están diseñados para esta arquitectura. Un modelo de razonamiento de frontera como el Nemotron 3 Ultra o el GPT-5.6 puede planificar y orquestar un flujo de trabajo, mientras que modelos más pequeños y especializados como el Nemotron 3.5 Lightning pueden realizar tareas específicas como revisión de código, uso de herramientas, monitoreo de alertas de seguridad y responder preguntas de facturación.

El Nemotron 3.5 Lightning es un modelo abierto completamente personalizable construido para tareas de alto volumen que alimentan agentes siempre activos. Fue desarrollado con contribuciones de la Coalición Nemotron, cuyos miembros proporcionaron metodologías de evaluación, software de inferencia y conjuntos de datos para ayudar a avanzar el modelo.

Las empresas líderes en IA están personalizando el Nemotron 3.5 Lightning para sus cargas de trabajo, incluyendo CrowdStrike para ciberseguridad, Harvey con Trajectory para servicios legales y CodeRabbit con Baseten para revisión de código, mejorando así la precisión para tareas agenticas específicas de dominio. Además, Lila Sciences está mejorando las capacidades de razonamiento para tareas agenticas en ciencias físicas y de la vida, y Fastino Labs ha personalizado el modelo logrando precisiones líderes para cargas de trabajo en desarrollo de software, finanzas y atención médica.

El Nemotron 3.5 Lightning también ofrece a las organizaciones control sobre la privacidad y el despliegue. Puede ejecutarse en sistemas de IA locales, como PCs NVIDIA RTX, NVIDIA DGX Spark, NVIDIA DGX Station y NVIDIA Jetson, para ayudar a los usuarios a maximizar las inversiones en infraestructura existente, o escalar a través de dispositivos de IA de borde, estaciones de trabajo NVIDIA RTX PRO, centros de datos y entornos en la nube para casos de uso empresarial. Y puede ejecutarse localmente o en las instalaciones para tareas especializadas de alto volumen que requieren respuestas rápidas.

NVIDIA publica tanto como le permite la licencia de los datos de entrenamiento y técnicas utilizadas en cada lanzamiento de Nemotron, lo que permite la trazabilidad, auditoría y entrenamiento de otros modelos. Junto con Lightning, NVIDIA está lanzando el Nemotron-RL-Agentic-Terminal-Pivot, un conjunto de datos de aprendizaje por refuerzo agentico utilizado para el post-entrenamiento de capacidades de agentes de codificación.

La eficiencia de las aplicaciones de IA mejora con el enrutamiento de modelos. Algunos modelos son mejores para codificación, otros para razonamiento, algunos para tareas ligeras y otros están optimizados para ejecutarse localmente para mayor privacidad y eficiencia. Si los clientes dependen de un modelo predeterminado, podrían gastar de más o perder calidad; si gestionan el enrutamiento manualmente, se convierte en un trabajo de integración que puede ralentizar un despliegue.

NVIDIA NeMo Switchyard es una biblioteca de enrutamiento de modelos de código abierto para agentes de IA. La tecnología dirige automáticamente las solicitudes al modelo más capaz y eficiente para cada paso de un flujo de trabajo de agente, basado en necesidades específicas. Los desarrolladores de aplicaciones de agentes pueden ajustar o modificar el enrutador con diferentes algoritmos de enrutamiento para coincidir con sus prioridades, como calidad, latencia y requisitos de costo. En un sistema de modelos, las empresas pueden crear agentes de IA potentes con una mejor tokenomía.

Los benchmarks internos de NVIDIA muestran que NeMo Switchyard mantiene una precisión de nivel frontera mientras reduce el costo de finalización de tareas a casi un tercio del Opus 4.8 solo.

NVIDIA está trabajando con socios en todo el ecosistema de IA para llevar el enrutamiento inteligente de modelos a las herramientas y plataformas que los desarrolladores ya utilizan.

Fuente: https://blogs.nvidia.com/blog/nemotron-lightning-switchyard-rtx-dgx/

← Home