华为昇腾960超节点发布:业界首个采用NPO的超节点,支持十万亿大模型训练和推理
9月17日,华为全联接大会2026在上海启幕,华为副董事长、轮值董事长汪涛在主题演讲环节发布全球首个采用NPO技术的超节点——昇腾960超节点,加速十万亿规模的大模型训练和推理。

据介绍,昇腾960超节点基于“灵衢+Hi-ONE”打造。作为全球首个采用NPO光引擎的超节点,昇腾960超节点采用正交架构和全液冷设计,基于灵衢实现内存统一编址,可扩展至4096卡规模,实现8EFLOPS FP8、16EFLOPS FP4。昇腾960超节点用5500个Hi-ONE,替代原本需要的4万8千颗800G光模块,功耗降低超550千瓦,系统无故障运行时间提升一倍,系统可用度达到99.8%,加速前沿模型的训练与推理创新。
汪涛表示,华为坚持系统级创新,把多年来积累的光技术,用于超节点系统内,推出全球首个NPO光引擎Hi-ONE。据了解,这是业界首个量产的NPO产品,是行业目前最大传输能力的NPO产品,总容量达到7.2T,也是唯一实现内置光源的NPO产品。
随着大模型迈向十万亿级规模,超节点是超大规模AI基础设施建设的必然选择。华为超节点设计理念是以一套协议平等连接集群内所有组件、支持跨物理服务器的内存访问、并采用近铜远光的互连。
这次华为将超节点架构引入通算系统,全新升级鲲鹏超节点,基于灵衢全光组网,最大支持4096节点,形成256TB统一内存池,可实现Agent更高密的沙箱、更快的沙箱启动速度和更好的Agent向量检索性能。同时,发布了基于灵衢UnifiedBus总线、支持“一跳直连”的L3.5层PB级KV缓存解决方案 OceanStor M900 集群。
据介绍,多个昇腾960超节点,采用灵衢网络或RoCE连接在一起,构建更大规模的超节点集群,最大集群规模可达到51.2万卡,再结合多轨道拓扑技术,最大可支持100万卡昇腾超节点集群。
汪涛也在主题演讲中披露了华为昇腾芯片的最新进展。其中,昇腾960芯片研发进度超预期,性能实现倍增。昇腾960DT在推出时间比原目标提前三个季度,将在2027年一季度就会准备就绪。昇腾960PR将在2027年的三季度可以准备就绪,未来昇腾的芯片将继续坚持一年一代的演进节奏,在2028年和2029年将陆续推出昇腾970和昇腾980芯片,依托韬定律的创新方向来实现算力规格继续翻倍。
