
近日,IBM官宣与开源AI云服务商Together AI达成多年期算力合作协议,整体合同规模达2.4亿美元。按照合作规划,IBM将在自家IBM Cloud平台搭建专属大规模算力集群,整机搭载英伟达最新Blackwell架构HGX B300服务器系统,配套Spectrum-X高速以太网组网技术,集群定位全面服务开源大模型生产级推理业务,整套基础设施预计2027年第一季度正式上线商用。此次部署也是IBM Cloud首个基于HGX B300打造的纯推理专属大型算力集群。
伴随生成式AI从早期模型竞赛转向企业规模化商用落地,市场需求重心已经完成明显切换:前期行业普遍聚焦千亿参数大模型预训练,海量资金涌入训练算力采购;现阶段企业客户更看重稳定、低成本、高并发的推理服务,云端日常对话、内容生成、企业知识库调用、智能办公等场景,均需要持续吞吐海量词元,推理算力需求增速已然超越训练算力。与此同时,OpenAI、Anthropic等闭源大模型高昂的调用成本、数据隐私管控局限逐步显现,Meta、DeepSeek、MiniMax、Kimi等开源模型凭借灵活可定制、性价比突出、数据自主可控的优势,迅速成为中小企业与科技初创公司的主流选择,专注开源模型推理运营的服务商迎来业务爆发窗口期,Together AI正是这一浪潮中的核心玩家。
总部坐落于旧金山的Together AI创立于2022年,自诞生之初便锚定“AI原生云”赛道,核心业务围绕开源大模型全生命周期展开,涵盖开源模型托管、轻量化微调、无服务器推理、专属GPU集群租赁等服务,面向全球开发者、AI创业团队与传统企业输出算力底座。近期公司刚刚完成8亿美元C轮融资,投后估值攀升至83亿美元,英伟达也位列投资方阵营,资金加持之下,企业算力储备扩张需求迫切。当前Together AI平台月词元处理规模已经达到400万亿Token,服务客户数量突破八千家,涵盖智能应用开发商、代码工具厂商、科研机构等群体。实测数据显示,依托平台优化后的算力调度方案,企业选用开源模型推理的综合成本,相较主流闭源API可下降数倍乃至数十倍,低廉的使用门槛持续拉动订单稳步上涨,现有算力资源逐渐无法匹配持续攀升的并发需求,扩充高端算力集群成为必然选择。
本次合作选用的英伟达HGX B300平台,是当下面向大规模推理场景的标杆级硬件方案,搭载8颗Blackwell Ultra GPU,单卡配备288GB超大HBM 3e显存,单节点总显存容量高达2.3TB,对比上代H200服务器显存容量提升幅度巨大。充足的显存空间可以轻松承载超大参数开源模型、超长上下文对话需求,同时大幅提升并发调用承载量,FP4低精度算力优化让推理吞吐效率较前代产品提升十余倍;整机依靠NVLink高速互联技术实现GPU间数据互通,搭配800Gbps超高带宽Spectrum-X以太网组网,有效解决大规模集群分布式运算的数据延迟瓶颈,尤其适配海量用户同时访问的云端推理场景。整套集群落地美国本土机房,能够为北美乃至全球客户提供低时延推理服务,Together AI内部预判,集群正式投用前两到三个月,算力资源就会被客户提前预订一空,市场需求旺盛程度可见一斑。
对于IBM而言,这份2.4亿美元的长期算力订单,是其重塑云业务、加码AI基础设施赛道的关键布局。长久以来,IBM在政企混合云、企业软硬件解决方案领域积淀深厚,但在通用公有云、AI算力租赁赛道的市场份额始终落后于头部云厂商。随着全球政企数字化转型普遍搭载AI能力,传统企业更倾向选择合规性强、运维体系成熟、数据安全管控完善的算力服务商,IBM恰好契合这类客户诉求。此次借助英伟达顶尖算力硬件搭建专属推理集群,IBM得以切入高速增长的开源AI算力市场,不再局限于传统软硬件售卖模式,转为长期云服务订阅营收,营收结构持续优化。同时,首个HGX B300专属推理集群的落地,也能够完善IBM Cloud的高端AI算力产品矩阵,强化自身在企业级AI基础设施领域的行业辨识度,承接更多传统大型企业的AI数字化改造项目。
合作双方的业务诉求形成互补:Together AI无需投入巨额资金一次性采购上万颗高端GPU,以多年分期合约的方式锁定稳定算力供给,规避GPU价格波动、产能紧缺带来的供应链风险,将资金更多投向模型调度算法优化、开源生态适配、客户运营等核心业务;IBM依托自身机房资源、运维能力承接算力部署与日常运维,收获稳定长期现金流,借助AI算力红利盘活闲置数据中心资源;英伟达则通过软硬件一体化方案持续打通云端算力渠道,Blackwell系列硬件出货规模进一步提升,完整打通芯片、服务器、云服务商、终端企业的产业链路。
本文转自媒体报道或网络平台,系作者个人立场或观点。我方转载仅为分享,不代表我方赞成或认同。若来源标注错误或侵犯了您的合法权益,请及时联系客服,我们作为中立的平台服务者将及时更正、删除或依法处理。
