NVIDIA, Microsoft y sus socios presentaron el 3 de septiembre de 2026, durante IFA 2026, nuevas herramientas para facilitar la ejecución local de modelos y agentes en equipos con hardware NVIDIA. La compañía también anunció la llegada en octubre de nuevos ordenadores NVIDIA RTX Spark con Windows de Lenovo y Acer.
Hermes Agent, OpenClaw y Perplexity Portable Computer incorporarán configuraciones simplificadas para modelos locales en Windows. Estas experiencias se apoyan en llama.cpp y en optimizaciones de inferencia de NVIDIA para reducir la configuración manual. Perplexity Portable Computer también permitirá ejecutar flujos completos localmente en GPUs NVIDIA RTX con al menos 24 GB de VRAM en Linux, mientras que la compatibilidad con Windows llegará próximamente.
NVIDIA afirma que las nuevas optimizaciones de llama.cpp ofrecen hasta 1,9 veces más rendimiento de inferencia en una GeForce RTX 5090. En vLLM, las mejoras alcanzan 1,2 veces en una RTX PRO 6000 Blackwell Workstation Edition y hasta 1,4 veces en dos clústeres DGX Spark. Los avances están disponibles mediante los backends de llama.cpp y vLLM, así como a través de LM Studio y Ollama.
La compañía también presentó NVIDIA Personal AI Router (PAIR), una herramienta gratuita y de código abierto que distribuye de forma inteligente la inferencia entre los ordenadores conectados a la red local del usuario. NVIDIA indicó que más de la mitad de los hogares estadounidenses cuentan con dos o más ordenadores, parte de cuya capacidad permanece sin utilizar durante el día.
Electronic Arts, Embark y Ubisoft figuran entre las compañías que preparan títulos para NVIDIA RTX Spark. NVIDIA también destacó nuevos modelos para ejecución local, entre ellos Nemotron 3.5 Lightning, Qwen3.8-Flash-Next, Qwen3.8-27B, LTX 2.5, MiniMax-H3, Meta’s Muse Glimmer y DeepSeek v4 Flash.
Fuente: NVIDIA.