El 26 de agosto de 2026, NVIDIA anunció una ampliación de NVIDIA NVLink Fusion con NVIDIA NVHBM, una tecnología de memoria de alto ancho de banda destinada a infraestructuras de inteligencia artificial. La propuesta está orientada a proveedores de servicios en la nube y empresas de IA que desarrollan sistemas semi personalizados con aceleradores propios, conocidos como XPUs, y busca coordinar el diseño de cómputo, memoria, almacenamiento, redes y software.
NVHBM se basa en una arquitectura que traslada el controlador de memoria desde el chip del XPU hasta la base de la pila 3D de HBM. En las arquitecturas HBM tradicionales, el controlador se integra en el propio XPU y ocupa una parte del silicio que puede dedicarse a las capacidades de cómputo. NVIDIA afirma que NVHBM permitirá alcanzar hasta un 30% más de ancho de banda de memoria y reducir hasta un 15% el consumo de energía de HBM frente a HBM4E estándar.
La compañía también señala que este diseño libera hasta un 25% más de superficie en el chip de cómputo del XPU en comparación con HBM4E estándar. NVIDIA indica que NVHBM se ha construido a partir de la misma tecnología que utilizará en futuras GPU, aunque el anuncio no especifica los productos concretos que incorporarán esta memoria.
NVIDIA establecerá una implementación estándar de NVHBM que estará disponible a través de varios proveedores de memoria. Según la empresa, este enfoque puede reducir el trabajo de ingeniería necesario para integrar y validar la memoria de distintos fabricantes. Para los clientes de NVLink Fusion, el objetivo es acelerar el desarrollo y la llegada al mercado de chips de IA personalizados.
Amazon’s Annapurna Labs será el primer colaborador de NVIDIA en la tecnología NVHBM, dentro de una colaboración más amplia en torno a NVLink Fusion. Annapurna Labs trabajará también con NVIDIA en la arquitectura NVLink de expansión a escala, con el objetivo de mejorar el rendimiento y la eficiencia de las cargas de trabajo de IA en futuras infraestructuras de AWS.
Esta colaboración amplía el apoyo anunciado anteriormente por AWS a NVLink Fusion. Annapurna Labs incorporará compatibilidad con NVLink Fusion en sus chips Trainium de próxima generación, a partir de Trainium4. Esta integración permitiría que los chips de Amazon y las GPU de NVIDIA funcionen conjuntamente mediante una arquitectura común para sistemas desplegados a escala de rack.
NVLink Fusion permite a sus socios conectar XPUs y CPU personalizados con la plataforma de NVIDIA para sistemas a escala de rack. El programa proporciona acceso a chiplets NVIDIA NVLink, NVLink-C2C, conmutadores NVLink y sistemas y racks NVIDIA MGX. También incluye un ecosistema de socios formado por proveedores de CPU, diseñadores de ASIC, fabricantes de sistemas y otros proveedores tecnológicos.
NVIDIA presenta NVLink Fusion con cada generación de su arquitectura para sistemas a escala de rack. La compañía sostiene que este modelo permite a las empresas de servicios en la nube y a las compañías centradas en IA concentrar sus recursos de ingeniería en el desarrollo de sus propios XPUs, mientras utilizan la plataforma de NVIDIA para las redes de expansión y conexión entre sistemas, los sistemas de rack y el software.
La información procede de NVIDIA: NVIDIA NVLink Fusion Expands With NVHBM Custom High-Bandwidth Memory.
Fuente: NVIDIA