NVIDIA ha presentado en IFA 2026 una batería de novedades para reforzar la inteligencia artificial ejecutada en local. La compañía busca simplificar el despliegue de agentes, acelerar la inferencia, ampliar el catálogo de modelos optimizados y llevar aplicaciones creativas y de productividad a equipos domésticos.
Entre los anuncios destaca NVIDIA Personal AI Router (PAIR), una herramienta gratuita y de código abierto que detecta PCs compatibles en una red local y reparte entre ellos solicitudes independientes de inferencia. Funciona como router virtual compatible con Windows, macOS y Linux, GeForce RTX 20 y posteriores, RTX PRO con arquitectura Turing o superior, DGX Spark y Apple Silicon M4 o posterior. En la demostración de la firma, una tarea con cinco subagentes y el modelo Qwen3.6 35B A3B pasó de 6 minutos y 18 segundos con una sola RTX 5090 a 3 minutos y 48 segundos con un clúster de dos RTX 5090.
En paralelo, NVIDIA ha optimizado llama.cpp, que alcanza hasta 1,9 veces más rendimiento en una RTX 5090, y vLLM, con mejoras de hasta 1,4 veces en configuraciones con dos DGX Spark. También llegarán Perplexity Portable Computer, Hermes Agent con configuración en un clic y OpenClaw para sistemas Windows con al menos 24 GB de VRAM. El catálogo de modelos locales se amplía con Nemotron 3.5 Lightning, GLM-5.3-Flash, Qwen3.8-Flash-Next, Qwen3.8-27B, LTX 2.5, MiniMax-H3, Muse Glimmer de Meta y DeepSeek v4 Flash.
CyberLink PhotoDirector AI PC Mode será una de las primeras aplicaciones creativas en integrar modelos de difusión locales con aceleración TensorRT-RTX y FP8. En octubre debutará RTX Spark, plataforma con GPU Blackwell de hasta 1 petaflop, 128 GB de memoria unificada y CPU Grace de 20 núcleos, presente en equipos de ASUS, Acer y Lenovo, con soporte de Electronic Arts, Embark, Ubisoft y otras firmas de videojuegos.
