8月27日消息,达推这是功耗一款面向定制AI加速器的定制HBM解决方案。该技术面向的降面积省是未来的定制芯片设计。英伟达近日宣布为NVLink Fusion定制芯片生态推出全新组件NVHBM,英伟可反哺计算单元提升性能,达推在数千上万颗芯片规模下,功耗主芯片占用面积更小。降面积省单颗芯片节省的英伟功耗累积效应显著,或在固定功耗预算内部署更多加速器。达推主芯片计算可用面积最多可增加30%。功耗
英伟达已与领先内存厂商完成NVHBM的降面积省设计与验证。已量产的英伟Vera Rubin机柜级系统并不搭载NVHBM,NVHBM单栈带宽相比标准HBM4E最高提升30%,达推NVHBM比标准商用HBM4E低15%。功耗同时功耗更低、供其集成到自有芯片中。后续芯片有望接入NVHBM。
英伟达同时还向NVLink Fusion合作伙伴提供小型定制PHY物理层IP,NVHBM并非用来取代通用HBM产品,
需要指出的是,
功耗方面,NVHBM将控制器下沉至HBM基片后,占用本可用于计算的宝贵硅面积。
NVHBM的核心设计在于将内存控制器从主芯片转移到HBM堆栈的基片之中。其下一代Trainium4 AI芯片已支持NVLink Fusion扩展接口,传统方案将HBM内存控制器集成在主芯片上,
Annapurna Labs副总裁Nafea Bshara表示期待通过合作赋能AWS下一代基础设施设计。
英伟达宣称,亚马逊旗下Annapurna Labs成为首家合作伙伴。