星期一, 20 7 月

华为出招 AI 晶片集群亮相 以量取胜和辉达别苗头

在2026世界人工智慧大会(WAIC)上,大陆多家厂商不约而同将展示重点放在智算集群和超节点上。其中,华为首次展示支持1,024张神经网路处理器(NPU)高速互联的升腾950超节点(Atlas 950 SuperPoD)真机,并披露去年发布的升腾384超节点已累计规模商用超过750套。

真机亮相通常代表产品已经跨越实验室验证阶段,在高速互联、散热设计、系统稳定性等工程能力上具备规模交付条件。

而中兴通讯则联合壁仞科技、沐曦股份、燧原科技等多家大陆国产GPU企业,打造国产高性能Matrix超节点。中科曙光则首发scaleX十万卡超智融合集群系统,这也是大陆规模最大的AI4S(科学智慧)计算集群。不同厂商采用不同技术路线,但共同指向一个趋势,大陆国产AI算力正从单晶片竞争迈向系统级集群能力竞争。

去年9月,华为轮值董事长徐直军发布升腾晶片的演进和目标。他表示,未来三年,华为已经规划了升腾多款晶片,包括950PR、950DT以及升腾960和970。

其中,升腾950系列按照不同训练和推理场景划分为950PR和950DT两个型号,如今,Atlas 950 SuperPoD亮相,正是这一产品路线图的落地。

由于受限于先进制程的获取,华为单颗升腾晶片的算力目前还难以直接与辉达晶片竞争,但华为以量取胜,透过「超节点+集群」的算力解决方案,满足持续增长的算力需求。

超节点,是将数百至数千颗AI晶片高效互联,形成‌物理上多机组成、逻辑上单机运行‌的超级计算单元,实现记忆体统一编址,解决大模型训练中的「通信墙」瓶颈,大幅提升AI训练推理效率。

透过资源的高效调度,超节点在一定程度上可以弥补晶片工艺的差距。以Atlas 950 SuperPoD为例,以单柜64卡为基本单元,支持1,024张NPU卡高速互联,并实现256TB统一记忆体编址。

不过集群也面临能耗高、占地面积大等问题。徐直军去年就表示,只有依靠超节点和集群,才能持续为大陆AI提供充裕算力。

值得注意的是,华为并不是少数押注超节点的企业。国外有辉达推出GB200 NVL72(72颗GPU),并计划进一步推出NVL144,透过NVLink Switch将更多GPU组成统一计算域;Meta宣布建设Prometheus和Hyperion两座超大规模AI资料中心,目标部署数10万张GPU。

此外,大陆的阿里、字节、腾讯、百度、中科曙光、浪潮信息、新华三等多家厂商也均推出超节点方案。

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注