
AI算力需求正以前所未有的速度膨胀,Kimi K3等开源前沿模型的出现进一步点燃了推理侧的算力饥渴。在这一背景下,微软与AMD宣布扩大战略合作——微软将在Azure上大规模部署AMD Helios机架级AI加速系统,用于前沿模型推理及Azure AI服务。
这是AMD首次在单一云客户中实现"GPU+CPU+网络"全栈落地,也是Helios平台拿到的首个超大规模云厂商订单。
Helios:单机架72颗GPU,2.9 exaFLOPS算力
Helios是AMD首款机架级AI基础设施平台,直接对标英伟达Vera Rubin NVL72系统。核心配置:
72颗Instinct MI455X GPU(基于全新CDNA 5架构,台积电2nm制程)
31.1TB HBM4总显存(单GPU 432GB,带宽19.6 TB/s)
1.4 exaFLOPS FP8算力 / 2.9 exaFLOPS FP4算力
260 TB/s机架内扩展带宽,与Vera Rubin NVL72持平
43 TB/s机架间扩展带宽(基于UALink over Ethernet),约为Vera Rubin的两倍
Helios采用18个计算托盘,每个托盘搭载4颗MI455X和1颗第六代EPYC Venice CPU,使用液冷散热,遵循OCP Open Rack Wide标准。与英伟达NVLink私有互联不同,Helios全程采用开放标准——机架内用UALink,机架间用Ultra Ethernet Consortium规范。
据Futurum Group估计,单台Helios机架售价约500万至550万美元,高于英伟达Vera Rubin的350万至400万美元估价。但AMD强调其优势在于最佳总拥有成本和最低每Token成本,而非单机价格。
EPYC Venice CPU同步入场:两款新VM系列
合作不止于GPU。Azure将新增两款基于第六代EPYC Venice处理器的虚拟机系列:
HDv2系列:面向代理式AI与数据管道工作负载
HXv2系列:面向半导体设计(EDA)工作流
EPYC Venice基于Zen 6架构,采用台积电2nm制程,旗舰配置最高256核,较前代Turin的192核提升33%。平台升级至全新SP7插槽,支持16通道DDR5内存(最高1.6 TB/s带宽),并采用PCIe Gen 6.0,CPU与GPU间通信带宽翻倍。AMD称Venice相较前代性能提升超70%。
此外,微软还将扩大AMD Pensando DPU在Azure网络中的部署,并与Azure Boost技术整合,加速网络和存储处理。
AMD数据中心GPU份额有望从4.5%升至20%-25%
微软是继Meta、OpenAI和甲骨文之后,又一家公开宣布部署Helios的大型客户。AMD称全球前十大AI公司中已有八家在Instinct GPU上运行工作负载。此前Meta已承诺6吉瓦GPU部署,OpenAI和甲骨文亦作出重大承诺。
从财务数据看,AMD 2026年Q1数据中心营收同比增长57%至58亿美元,公司计划2027年起实现数百亿美元数据中心AI营收,其中大部分来自Helios。Futurum Group分析师Daniel Newman认为,AMD有望将数据中心GPU市场份额从当前约4.5%提升至20%-25%。
AMD将于7月22-23日举办Advancing AI活动,届时预计公布更多Helios和Venice的产品细节。AMD计划2026年下半年开始向包括微软在内的客户出货Helios工程样品,2027年Q2进入量产。
本文转自媒体报道或网络平台,系作者个人立场或观点。我方转载仅为分享,不代表我方赞成或认同。若来源标注错误或侵犯了您的合法权益,请及时联系客服,我们作为中立的平台服务者将及时更正、删除或依法处理。
