NVIDIA Revoluciona la IA Local en IFA 2026 con RTX Spark y Nuevas Herramientas

Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026

La inteligencia artificial de frontera se está volviendo local. En el evento IFA 2026, NVIDIA, junto a Microsoft y sus socios, ha anunciado una serie de innovaciones que aceleran la inferencia local y facilitan el uso de agentes en hardware de NVIDIA. Entre las novedades, destacan los nuevos PCs compactos NVIDIA RTX Spark, que estarán disponibles en octubre, ofreciendo a entusiastas de la IA, desarrolladores y creadores más opciones para ejecutar agentes de manera local y segura.

Entre los anuncios realizados se incluyen mejoras en el soporte de IA local para GPUs de NVIDIA, que estarán disponibles en herramientas como Hermes Agent, OpenClaw y Perplexity Portable Computer. Estas optimizaciones permiten una inferencia local hasta 1.9 veces más rápida gracias a las nuevas optimizaciones de llama.cpp y vLLM, accesibles directamente a través de LM Studio y Ollama.

Otra de las innovaciones destacadas es NVIDIA PAIR, una herramienta de enrutamiento de IA personal que distribuye inteligentemente la inferencia de IA a través de los PCs en la red local del usuario. Además, los nuevos PCs Windows de NVIDIA RTX Spark, fabricados por Lenovo y Acer, llegarán en octubre. Importantes desarrolladores de videojuegos como Electronic Arts, Embark y Ubisoft están llevando sus títulos más populares a esta plataforma.

El mes de agosto también fue significativo para la IA local con el lanzamiento de modelos como Nemotron 3.5 Lightning, que puede ejecutarse en PCs NVIDIA RTX, estaciones de trabajo RTX PRO, DGX Spark y Jetson. Este modelo de 30 mil millones de parámetros ya está disponible. Por su parte, Z.ai presentó su modelo GLM-5.3-Flash, un modelo multimodal de mezcla de expertos que lleva la IA agentic a la estación DGX.

Qwen ha lanzado Qwen3.8-Flash-Next, un modelo multimodal de peso abierto que puede ejecutarse localmente en DGX Spark y DGX Station, junto con Qwen3.8-27B, un modelo abierto de 27 mil millones de parámetros optimizado para cargas de trabajo agentic y de codificación en GPUs de NVIDIA.

Además, LTX presentó LTX 2.5, un modelo de generación de video de mundo abierto optimizado para GPUs NVIDIA RTX, DGX Spark y DGX Station, con mejoras como NVFP4, FastVideo y ComfyUI para una generación local más rápida y eficiente en memoria. MiniMax-H3 es otro modelo de generación de video con audio sincronizado que puede ejecutarse localmente en GPUs de NVIDIA a través de ComfyUI. FastVideo, en colaboración con investigadores de NVIDIA, ha mejorado este modelo lanzando FastH3, una versión destilada en cuatro pasos que mejora el rendimiento en 7x.

Meta también ha lanzado Muse Glimmer, un modelo de 30 mil millones de parámetros para cargas de trabajo de codificación y agentic que puede ejecutarse localmente en PCs GeForce RTX, DGX Spark, DGX Station y Jetson. NVIDIA ha lanzado la cuantización NVFP4 con soporte para DGX Spark para un despliegue local más eficiente en memoria.

DeepSeek v4 Flash es un modelo de mezcla de expertos de 284 mil millones de parámetros con 13 mil millones de parámetros activos que puede ejecutarse localmente en un clúster de 2x DGX Spark y DGX Station.

La configuración de agentes locales se simplifica con las nuevas experiencias de configuración en Windows, basadas en llama.cpp e incorporando las últimas optimizaciones de inferencia de NVIDIA, diseñadas para reducir la configuración manual y facilitar la puesta en marcha de agentes locales. Perplexity ha introducido su agente Portable Computer, que permite a los usuarios ejecutar Perplexity localmente en sistemas Linux como NVIDIA DGX Spark, con modelos, orquestación y herramientas empaquetadas en una sola aplicación. Este agente estará disponible pronto en Windows, permitiendo a más usuarios de PC ejecutar flujos de trabajo completos localmente sin consumir créditos, mientras que partes de una tarea pueden escalarse a modelos de frontera en la nube cuando se necesite investigación adicional.

Hermes Agent, desarrollado por Nous Research, es un agente de propósito general que destaca por su fiabilidad y auto-mejora. Es agnóstico de modelos y proveedores, y está diseñado para funcionar todo el día en sistemas locales, haciendo que los PCs RTX, estaciones de trabajo RTX PRO y DGX Spark sean una opción natural. La configuración de un modelo local en Hermes ofrece una configuración de un solo clic en sistemas RTX y DGX en Windows, detectando automáticamente la GPU de NVIDIA, seleccionando un modelo y configuración apropiados, y ejecutándolo a través de llama.cpp con optimizaciones de inferencia de NVIDIA ya integradas, eliminando la descarga y ajuste manual de modelos. El soporte para Linux estará disponible próximamente.

Fuente: https://blogs.nvidia.com/blog/local-ai-ifa-next-gen-agents-nv-pair-rtx-spark/

← Home