在华为全联接大会上,华为副董事长、轮值董事长汪涛发表了题为“智启新未来,打造智能世界的硅基黑土地”的主题演讲,并宣布推出全球首个采用NPO技术的超节点——昇腾960超节点。这一创新成果旨在加速十万亿规模的大模型训练和推理,为智能世界的发展提供强大算力支持。
华为的AI战略以算力为核心,致力于打造智能世界的坚实基础。汪涛在演讲中强调,华为将坚持硬件变现,聚焦AI基础设施建设,通过系统架构创新构建竞争力。围绕“超节点+集群”的理念,华为正打造中国坚实的算力底座,并构建开源开放的算力生态,为全球提供新的选择。
随着大模型规模迈向十万亿级,超节点成为超大规模AI基础设施建设的必然选择。华为超节点设计理念强调平等连接集群内所有组件,支持跨物理服务器的内存访问,并采用近铜远光的互连技术。基于这一理念,华为推出了全球首个NPO光引擎Hi-ONE,这是业界首个量产的NPO产品,具备最大传输能力7.2T,并实现了内置光源的突破。
昇腾960超节点作为全球首款采用NPO光引擎的超节点,采用了领先的正交架构和全液冷设计。基于灵衢技术,它实现了内存统一编址,可扩展至4096卡规模,提供8EFLOPS FP8和16EFLOPS FP4的算力。这一超节点用5500个Hi-ONE替代了原本需要4万8千颗800G光模块,功耗降低超550千瓦,系统无故障运行时间提升一倍,系统可用度达到99.8%,显著加速了前沿模型的训练与推理创新。
除了昇腾960超节点,华为还将超节点架构引入通算系统,全新升级了鲲鹏超节点。基于灵衢全光组网,鲲鹏超节点最大支持4096节点,形成256TB统一内存池,为Agent提供了更高密的沙箱、更快的沙箱启动速度和更好的Agent向量检索性能。同时,华为还发布了基于灵衢UnifiedBus总线、支持“一跳直连”的L3.5层PB级KV缓存解决方案OceanStor M900集群。
多个昇腾960超节点通过灵衢网络或RoCE连接在一起,可以构建更大规模的超节点集群。通过二层CLOS四平面组网,最大集群规模可达到51.2万卡,再结合多轨道拓扑技术,最大可支持100万卡昇腾超节点集群,为大规模AI应用提供了前所未有的算力支持。
汪涛在演讲中还指出,构建开源开放的算力生态是华为的核心战略。华为的CANN平台已经全面开源开放,并进入了常态化的开源社区运营阶段。从“可用”到“易用”,昇腾已经跨越了生态拐点,为开发者提供了更加便捷、高效的开发环境。华为将继续坚持打造强大的AI基础设施,支持主流大模型基于昇腾原生训练,积极拥抱百模千态,共同迎接智能世界的加速到来。








