壁仞科技BR20X成功点亮,配售约34.34亿元备战量产

来源:半导纵横发布时间:2026-10-08 11:39
AI芯片
Chiplet
生成海报
AI芯片的竞争正从单卡算力转向系统级交付能力,BR20X的进度直接影响本土GPU在高端训推市场的地位。

10月8日,壁仞科技在港交所发布配售公告,披露公司新一代AI芯片产品BR20X已成功点亮,完成启动测试,进入流片后验证阶段。BR20X基于自研指令集、计算核心与Chiplet架构,支持FP8/FP4低精度计算,自研BLink 2.0互连协议最大支持1024卡Scale-up扩展,原生集成超节点互连能力。公司正与客户接洽产品部署,并制定了大规模生产计划,预期将在未来数个季度内进行客户送样并推进量产。

同日,公司宣布配售1.3亿股新H股,所得款项净额约34.34亿元,主要用于BR20X的供应链采购、生产准备及商业化。

BR20X支持FP8/FP4,以低精度换高算力密度

BR20X最值得关注的技术变化,是对FP8和FP4低精度计算格式的原生支持。

AI模型训练和推理中,数据精度直接关系到计算效率和显存占用。传统GPU普遍支持FP32和FP16格式,精度高但计算量大、显存占用高。FP8和FP4把每个数字的位宽压缩到8位和4位,同样面积的芯片能塞进更多的计算单元,同样显存能装下更大的模型。对于大模型推理来说,精度降低带来的准确率损失在可接受范围内,但吞吐量可以明显提升。

BR20X的原生支持说明芯片从设计阶段就围绕低精度计算做了优化,而不是通过软件模拟来实现。壁仞科技此前在BR10X系列上已经积累了对多种数据格式的支持经验,BR20X把FP8/FP4的支持做到了芯片层面,这对需要大规模部署AI推理的云厂商和数据中心来说,是一个重要变化。

1024卡超节点互连,缩短GPU通信路径

BR20X的另一个技术亮点,是BLink 2.0互连协议和超节点架构。

传统GPU集群中,卡与卡之间的通信需要通过PCIe总线或外部交换机,路径长、延迟高、功耗大。当集群规模从几十卡扩展到上千卡时,通信开销会迅速吃掉算力。BR20X的BLink 2.0支持最多1024张GPU共享同一个内存空间,原生集成超节点互连能力。壁仞科技此前公布的方案中,基于BR20X构建了16卡标准服务器、128卡高密整机柜和1024卡分布式解耦架构三级产品矩阵。

这套超节点方案让大规模GPU集群在逻辑上更接近一台计算机,而不是上千台独立设备通过网络拼在一起。大模型训练中,梯度同步和数据交换的效率可以更高,集群的整体利用率也会更好。

配售约34.34亿元,供应链采购和生产准备是重点

BR20X的点亮和配售募资同步进行,指向同一个目标:为量产做准备。

公告显示,配售所得款项净额约34.34亿元,其中约70%用于新一代产品的战略供应链采购、生产准备及商业化,包括提前采购、产能预留和库存缓冲,以应对供应链交付周期的波动。约20%用于提升研发能力及软件生态系统,约10%用于营运资金及一般公司用途。

当前半导体行业的关键材料和组件涨价、产能持续紧张,壁仞科技此时配售募资,是在为BR20X的供应链锁定产能和物料。芯片从点亮到量产,中间还要经过流片后验证、客户送样、小批量试产和产能爬坡等多个环节,每一步都需要资金和供应链的配合。34.34亿元的募资规模,在本土GPU企业的融资中属于较大体量,也说明公司对BR20X商业化的投入力度较大。

BR20X的进度,影响本土GPU在高端训推市场的地位

从目前进度看,BR20X的推进速度比此前预期更快。壁仞科技在配售公告中表示,开发进度较先前配售时预期更快。按照公司此前规划,BR20X预计在2026年第四季度进入回片后验证及送测阶段,2027年实现规模化部署。据国金证券研报指出,BR20X原生支持FP8/FP4并对标英伟达H200。

从本土GPU的竞争格局来看,这个时间表比较紧。AI训练和推理对算力的需求在持续增长,云厂商和智算中心对本土GPU的采购意愿也在提升。但客户选择一款GPU,不只看单卡算力,还要看软件生态、集群部署能力和长期供应稳定性。BR20X能否在客户送样阶段拿出稳定表现,量产阶段能否保证良率和交付,将直接影响它在高端训推市场的实际份额。

配售募资到位后,BR20X的供应链和生产准备会进入加速阶段。接下来几个季度,认证结果和良率爬坡将决定它能否真正走向规模商用。

本文转自媒体报道或网络平台,系作者个人立场或观点。我方转载仅为分享,不代表我方赞成或认同。若来源标注错误或侵犯了您的合法权益,请及时联系客服,我们作为中立的平台服务者将及时更正、删除或依法处理。

评论
暂无用户评论