×
首页 首页 IT数码 智能和AI 查看内容
发表文章
分享

华为发布全球首个采用 NPO 的超节点“昇腾 960 超节点”,2027 年 Q3 上市

发布者: IT007编辑01| 2026-9-18 16:19| 查看: 103| 评论: 0|原作者: 浩渺|来自: IT之家

摘要: 华为全联接大会 2026 上,汪涛发布基于“灵衢 +Hi-ONE”的昇腾 960 超节点,可扩展至 4096 卡,支持 8EFLOPS FP8 算力。同时鲲鹏超节点升级至 4096 节点,并推出 OceanStor M900 集群。

9 月 18 日消息,9 月 17 日,华为全联接大会 2026 在上海启幕,华为副董事长、轮值董事长汪涛发表题为“智启新未来,打造智能世界的硅基黑土地”的主题演讲,发布全球首个采用 NPO 技术的超节点 —— 昇腾 960 超节点,2027 年 Q3 正式上市。


华为发布全球首个采用 NPO 的超节点“昇腾 960 超节点”,2027 年 Q3 上市


据华为官方介绍,随着大模型迈向十万亿级规模,超节点是超大规模 AI 基础设施建设的必然选择。华为超节点设计理念是以一套协议平等连接集群内所有组件、支持跨物理服务器的内存访问、并采用近铜远光的互连。华为坚持系统级创新,把多年来积累的光技术,用于超节点系统内,推出全球首个 NPO 光引擎 Hi-ONE,这是业界首个量产的 NPO 产品,是行业目前最大传输能力的 NPO 产品,总容量达到 7.2T,也是唯一实现内置光源的 NPO 产品。


我们注意到,汪涛在会上正式发布了基于“灵衢 +Hi-ONE”打造的昇腾 960 超节点。作为全球首个采用 NPO 光引擎的超节点,昇腾 960 超节点采用领先的正交架构和全液冷设计,基于灵衢实现内存统一编址,可扩展至 4096 卡规模,实现 8EFLOPS FP8、16EFLOPS FP4。昇腾 960 超节点用 5500 个 Hi-ONE,替代原本需要的 4 万 8 千颗 800G 光模块,功耗降低超 550 千瓦,系统无故障运行时间提升一倍,系统可用度达到 99.8%,加速前沿模型的训练与推理创新。


华为发布全球首个采用 NPO 的超节点“昇腾 960 超节点”,2027 年 Q3 上市


华为将超节点架构引入通算系统,全新升级鲲鹏超节点,基于灵衢全光组网,最大支持 4096 节点,形成 256TB 统一内存池,可实现 Agent 更高密的沙箱、更快的沙箱启动速度和更好的 Agent 向量检索性能。同时,发布了基于灵衢 UnifiedBus 总线、支持“一跳直连”的 L3.5 层 PB 级 KV 缓存解决方案 OceanStor M900 集群。


多个昇腾 960 超节点,采用灵衢网络或 RoCE 连接在一起,构建更大规模的超节点集群,通过二层 CLOS 四平面组网,最大集群规模可达到 51.2 万卡,再结合多轨道拓扑技术,最大可支持 100 万卡昇腾超节点集群

AI 解读

超节点拼的是互连不是单卡

  • 昇腾 960 用 5500 个 Hi-ONE 光引擎替代 4.8 万颗 800G 光模块,功耗降超 550 千瓦。
  • 单节点可扩至 4096 卡,FP8 算力 8EFLOPS、FP4 算力 16EFLOPS。
  • 系统可用度 99.8%,无故障运行时间比原方案提升一倍。
  • 多节点组网最大可到 51.2 万卡,多轨道拓扑下支持 100 万卡集群。


这代产品的重点不在单卡算力,而在互连方式。大模型规模上去以后,瓶颈往往不是一颗芯片算得多快,而是几千几万张卡之间怎么高效通信。华为用 NPO 光引擎把光模块数量压下来,省的是功耗和故障点,这两项直接决定集群能不能长时间稳定跑。


代价也很清楚:整套系统绑在灵衢协议和 Hi-ONE 上,属于系统级方案,不是买几张卡就能复现的。对普通用户来说,这类基础设施不会直接出现在消费产品里,它的影响是间接的,训练和推理成本能不能降下来,最终会反映到模型服务的价格上。


上市时间是 2027 年第三季度,价格和具体型号目前还没有公布。


判断:这一代拼的是集群稳定性和功耗,不是单卡跑分。

以上内容由 AI 依据原文补充生成,不代表本站观点,仅供参考。

本文导航

邀请
最新评论(0)