NVIDIA ha presentado dos nuevas herramientas de código abierto diseñadas para optimizar la ejecución de agentes autónomos. Por un lado, la compañía ha lanzado el modelo Nemotron 3.5 Lightning, pensado para tareas especializadas dentro de sistemas complejos. Por otro lado, ha publicado NeMo Switchyard, una librería que redistribuye las consultas entre distintos modelos según el coste y la velocidad requeridos. Ambas novedades están orientadas a su despliegue tanto en ordenadores con tarjetas NVIDIA RTX como en centros de datos o entornos en la nube.
La propuesta de la firma busca resolver los problemas de coste y latencia que sufren las aplicaciones basadas en inteligencia artificial continua. Con este movimiento, la empresa da continuidad a su catálogo de software especializado. La iniciativa sigue la estela marcada por la presentación de Nemotron 3 Nano Omni, el modelo multimodal enfocado en la percepción de audio y vídeo.
El nuevo Nemotron 3.5 Lightning utiliza una arquitectura de mezcla de expertos (MoE) con 30.000 millones de parámetros. Su función principal no es orquestar todo el flujo de trabajo, sino ejecutar labores concretas como la revisión de código, la supervisión de alertas de seguridad o la atención de consultas técnicas. Según los datos de la compañía, este modelo genera texto hasta cuatro veces más rápido. Esta velocidad permite completar tareas de agentes un 30 % más rápido que otras opciones equivalentes de su categoría.
La segunda pieza del anuncio es NeMo Switchyard, una librería abierta disponible en GitHub. Esta herramienta actúa como un enrutador inteligente dentro de los sistemas agénticos. El software analiza cada petición del usuario y la redirige automáticamente hacia el modelo más adecuado. De este modo, las consultas sencillas se envían a modelos locales o más pequeños, mientras que las tareas complejas se derivan a modelos de mayor tamaño.
Este sistema de distribución evita el gasto excesivo derivado de recurrir siempre a un único modelo principal. Las pruebas internas de la empresa señalan que esta gestión reduce el coste de ejecución a casi un tercio en comparación con el uso exclusivo de modelos de gran tamaño, sin perder precisión en las respuestas. Plataformas como LangChain, LiteLLM, Cognition o Ramp ya han comenzado a integrar este enrutador en sus flujos de trabajo.
Nemotron 3.5 Lightning se distribuye con pesos abiertos y licencias que permiten su ajuste con datos propios mediante la plataforma NVIDIA NeMo. Además, el modelo incluye un conjunto de datos público denominado Nemotron-RL-Agentic-Terminal-Pivot para el entrenamiento de habilidades de programación. El modelo ya se encuentra disponible en repositorios como Hugging Face, OpenRouter y la plataforma build.nvidia.com mediante microservicios NIM.
Te interesa 👉 Las mejores tarjetas gráficas que puedes comprar
La estrategia de la compañía refuerza su presencia en el ecosistema de software abierto. Al permitir la ejecución local en equipos con procesadores gráficos NVIDIA RTX, las organizaciones pueden procesar información confidencial sin enviar datos a servidores externos, reduciendo la factura en servicios de la nube.
La marca alemana be quiet! ha presentado el Light Mount TKL. Este teclado mecánico en…
Ejecutar modelos de inteligencia artificial avanzados directamente en el ordenador sin depender de servidores externos…
El gigante taiwanés, TSMC, continúa demostrando un dominio absoluto en el mercado de fabricación de…