华为亮出 Atlas 950 SuperPoD:1024 颗昇腾芯片,号称算力 6.7 倍于英伟达
华为在上海世界人工智能大会(WAIC 2026)上首次公开展示了 Atlas 950 SuperPoD 实物——1024 颗昇腾 NPU 塞进 16 个机柜,目标很明确:在美国芯片出口管制下,给中国 AI 产业造一条自己的算力高速公路。
三个关键信息
规格亮眼。 现场展示的 1024 NPU 配置可提供 1 EFLOPS(FP8)/ 2 EFLOPS(FP4)算力,256 TB 全局可寻址统一内存,NPU 间互联带宽达 TB 级、往返延迟仅 3 微秒。满配 8192 颗 NPU 时,整套系统占地约 1000 平方米、160 个机柜,FP8 算力跃升至 8 EFLOPS。
直接对标英伟达。 华为声称 Atlas 950 SuperPoD 的算力是英伟达下一代 NVL144 超级节点的 6.7 倍,内存容量是其 15 倍。这是在美国出口管制持续收紧背景下,华为给国产替代方案贴上的最激进的性能标签。
Q4 2026 量产。 华为计划在 2026 年第四季度开始交付,搭配自研 HBM 高带宽内存。从 MWC 2026 首秀到 WAIC 实物展出,产品化节奏正在加快。
王斗视角
6.7 倍于 NVL144?这个数字拿来做 PPT 比拿来做工程参考更有用。华为给的是峰值理论算力对比,但实际训练效率取决于互联带宽、编译器成熟度、软件生态三件套——偏偏这三样是昇腾生态公认的短板。英伟达 NVL144 背后是 CUDA 十五年的开发者惯性,Atlas 950 背后是 CANN 和 MindSpore 还在追赶 PyTorch 的现实。不过话说回来,在出口管制封死高端 GPU 进口的大背景下,华为不需要赢规格战,它需要的是「能用且买得到」。如果 Q4 真的能批量交付,对中国头部大模型公司来说,Atlas 950 不是最优解,但可能是唯一解。
