NVIDIA impulsa la IA en local con el modelo Nemotron 3.5 Lightning y nuevas herramientas para agentes

Entre las herramientas destacan nuevas arquitecturas de enrutamiento, herramientas de conexión de hardware y una amplia colaboración con empresas del sector para optimizar el rendimiento sin depender del procesamiento en la nube.
12 de agosto, 2026
NVIDIA impulsa la IA en local con el modelo Nemotron 3.5 Lightning y nuevas herramientas para agentes

El ecosistema de código abierto está facilitando a desarrolladores y profesionales de las tecnologías de la información la creación y ejecución de agentes de inteligencia artificial localmente en los ordenadores de los usuarios, un movimiento al que se ha sumado NVIDIA con nuevas herramientas y modelos de lenguaje.

Entre las novedades presentadas por la firma de Jensen Huang destaca Nemotron 3.5 Lightning, un modelo de mezcla de expertos de treinta mil millones de parámetros diseñado para operar agentes. Este desarrollo ofrece una generación de información hasta cuatro veces más rápida frente a otras alternativas de su categoría y, al ser de pesos abiertos, permite su ajuste fino con datos propios para tareas corporativas específicas como la redacción de informes, la programación o áreas especializadas de diseño.

Junto a este modelo, la compañía ha introducido NeMo Switchyard, una biblioteca de enrutamiento de código abierto orientada al control de los gastos operativos. La función principal de NeMo Switchyard es dirigir automáticamente cada paso del flujo de trabajo de un agente hacia el modelo más adecuado en función de la precisión, la velocidad y el coste.

Según pruebas de la misma NVIDIA, esta herramienta ayuda a mantener un nivel óptimo de resolución de tareas al mismo tiempo que reduce el coste de ejecución a una tercera parte en comparación con el uso exclusivo de otros sistemas de mayor tamaño, permitiendo a las empresas trabajar con distintos proveedores de inteligencia artificial según la tarea requerida.

El impulso a la computación local también incluye la colaboración con Meta en el lanzamiento de su nuevo modelo Muse Glimmer, el cual es un modelo denso de pesos abiertos creado específicamente para la programación y la inteligencia artificial orientada a agentes locales. Optimizado para funcionar en equipos con tarjetas gráficas de consumo y en estaciones de trabajo especializadas, este modelo permite a los agentes procesar archivos privados, manejar credenciales y realizar tareas secuenciales en un único sistema de manera ininterrumpida, reduciendo así drásticamente la dependencia de los servidores externos.

Para facilitar la ejecución de modelos de gran tamaño que requieren la potencia combinada de más de una máquina, se ha actualizado la aplicación NVIDIA Sync con un nuevo asistente de agrupamiento que automatiza la conexión de múltiples sistemas DGX Spark para proporcionar la capacidad de memoria y el rendimiento necesarios para las cargas de trabajo más exigentes.

El avance del procesamiento local se nutre, igualmente, de una extensa variedad de modelos desarrollados por la comunidad de código abierto y otras empresas; por ejemplo, en el campo de la visión artificial y la robótica se ha lanzado Cosmos 3 Edge, un modelo de cuatro mil millones de parámetros que puede operar en dispositivos periféricos. Para la generación multimedia destaca MiniMax-H3, que produce vídeo y audio estéreo sincronizado de manera nativa a partir de indicaciones de texto o imágenes.

En el ámbito del desarrollo de código fuente, Poolside AI ha presentado Laguna S 2.1, una herramienta de ciento dieciocho mil millones de parámetros capaz de abordar tareas de desarrollo de larga duración en un único equipo optimizado. Por su parte, entidades como DeepSeek y Thinking Machines Lab han actualizado modelos de cientos de miles de millones de parámetros que ahora pueden ejecutarse localmente gracias a distintas optimizaciones de la comunidad en los formatos de archivo.

La generación y edición de contenidos visuales también recibe actualizaciones con la llegada de Wan-Animate-2 de Alibaba para la transferencia de expresiones faciales y de movimiento a imágenes estáticas, y el modelo LTX 2.5, que aporta soporte para múltiples tomas y un mayor control sobre el resultado del vídeo final.

Finalmente, la firma Unsloth ha puesto a disposición de los profesionales una aplicación de escritorio de código abierto que integra, en una sola plataforma de uso local, la ejecución de modelos, la creación de imágenes, el ajuste fino de parámetros y la investigación automatizada en la web.