FP64计算能力70 ExaFLOPS,马斯克算力集群目标全球第一

来源:半导纵横发布时间:2026-08-14 10:44
算力
技术进展
生成海报
马斯克称xAI将在2027年底前将数据中心算力扩容7倍

马斯克在SpaceX内部会议上向员工表示,xAI数据中心的电力容量将在2027年底前扩大7倍,达到10GW。据马斯克称,若该目标实现,公司数据中心将带来每年3000亿至5000亿美元的收入。

SpaceX的市值在过去不到两个月内已蒸发近5700亿美元。与此同时,该集群的综合算力将远远超越Top 500榜单上所有超级计算机的总和,以及目前全球所有正在运行的AI集群。

“我们已经建成了全球最强大的AI训练集群,”马斯克在SpaceX内部会议上对员工表示。“预计到明年年底完成的算力规模,将是迄今为止的10倍左右。……我们的目标是到明年年底达到10GW的算力。……每瓦特的价值大概在30至50美元之间,这意味着如果我们在明年年底前上线10GW的AI算力,年收入将达到3000亿至5000亿美元。”

庞大的电力需求

目前,SpaceX位于孟菲斯和绍瑟文(Southaven)的xAI数据中心额定功率为1.4GW。公司计划到2027年底前将数据中心的电力容量提升至10GW,即在约1.5年内扩容约7倍。

需要指出的是,额定功率1.4GW的AI基础设施并不等同于1.4GW的算力容量。一个电力使用效率(PUE)约为1.2的大型AI数据中心,可供IT设备使用的功率约为1.17GW(即230MW被冷却系统、水泵、风扇、加湿/除湿系统、照明、配电损耗、UPS损耗及其他设施系统消耗)。

这1.17GW并非全部用于AI加速器:CPU、内存、网络设备和存储也占据相当比例的电力消耗。如果IT功率中约70%至80%最终对应加速器,那么对于一个1.4GW的数据中心,加速器实际可用功率大约在0.8GW至0.95GW之间。

惊人的算力规模

考虑到xAI目前混合使用基于Hopper和Blackwell架构的加速器,很难精确判断公司当前拥有多少算力。由于xAI目前似乎将重心押注在英伟达Vera Rubin系统上,目前可以对公司到2027年底基于Rubin的算力进行一个较为合理的估算。

假设新增8.6GW额定功率全部基于英伟达NVL72 VR200机架级系统,PUE约为1.2,则新增容量的IT功率预算为6.88GW。根据IT功率中分配给GPU的比例不同,实际Rubin AI加速器将获得4.816GW至5.504GW的功率。

每颗Rubin GPU在Max-P配置下的预期功耗为2.3kW。因此,xAI的集群将容纳约209.4万至239.3万颗Max-P模式下的Rubin GPU,对应29,083至33,236套NVL72 VR200系统。

NVL72 VR200系统的性能已有公开数据,根据xAI到2027年底部署的机器数量,算力数字将相当惊人:

  • NVFP4推理性能: 105至120 ExaFLOPS
  • NVFP4训练性能: 73至84 ExaFLOPS
  • FP6/FP8训练能力: 37至42 ExaFLOPS
  • 原生FP64计算能力: 70至80 ExaFLOPS

当然,以上数字仅为粗略估算,因为部分系统可能不会以Max-P配置运行。

算力超Top 500算力系统总和

作为参照,目前Top 500榜单上所有系统的FP64性能总和为18.73 ExaFLOPS。如果该集群部署完成,xAI将拥有3.7至4.3倍于该数字的算力。

至于AI性能,105至120 ExaFLOPS的NVFP4推理和73至84 ExaFLOPS的NVFP4训练,将使该集群进入一个与目前公开运行的任何系统完全不同的量级——这意味着即将迎来复杂程度大幅提升的AI模型。

xAI的综合算力能否使其实现每年3000亿至5000亿美元的收入,仍有待观察。SpaceX并非唯一一家向AI公司出售算力的企业,竞争可能会非常激烈。不过,马斯克此时发表此类言论也恰逢其时——SpaceX的市值在6月20日达到2.44万亿美元的峰值后,于8月1日跌至1.43万亿美元,随后在8月12日回升至1.87万亿美元。

本文转自媒体报道或网络平台,系作者个人立场或观点。我方转载仅为分享,不代表我方赞成或认同。若来源标注错误或侵犯了您的合法权益,请及时联系客服,我们作为中立的平台服务者将及时更正、删除或依法处理。

评论
暂无用户评论