华为发布全球首个NPO光引擎超节点昇腾960,打造智能世界硅基黑土地
SmartHey9月17日消息:9月17日,华为全联接大会2026在上海启幕。华为副董事长、轮值董事长汪涛发表题为“智启新未来,打造智能世界的硅基黑土地”的主题演讲,并正式发布全球首个采用NPO(Near-Packaged Optics)技术的超节点——昇腾960超节点,显著加速十万亿参数规模大模型的训练与推理进程。
华为副董事长、轮值董事长汪涛发表主题演讲
华为AI战略以算力为核心,坚持硬件变现路径,聚焦构建坚实的AI基础设施,致力于成为智能世界的“硅基黑土地”。公司围绕“超节点+集群”双轨架构,通过系统级创新持续强化竞争力,打造自主可控、高性能、高可靠的中国算力底座,并推动开源开放的算力生态建设,为全球提供值得信赖的新选择。
随着大模型参数规模迈入十万亿级别,超节点已成为超大规模AI基础设施演进的必然方向。华为超节点设计理念强调协议统一、内存跨服务器直访与“近铜远光”互连架构——即芯片间采用高速铜互连、机架间及跨机柜则依托先进光互连技术。在此基础上,华为将多年积累的光通信技术深度融入系统设计,推出业界首款量产NPO光引擎Hi-ONE:该产品不仅是当前行业传输能力最强的NPO方案(总带宽达7.2T),更是全球唯一实现光源内置的NPO引擎,具备更高集成度与能效比。
会上,汪涛正式发布基于“灵衢互联架构+Hi-ONE光引擎”联合打造的昇腾960超节点。作为全球首台搭载NPO光引擎的超节点设备,昇腾960采用正交模块化架构与全液冷散热设计,依托灵衢实现全局统一内存编址,单节点最大支持4096颗昇腾AI芯片,算力达8EFLOPS(FP8)与16EFLOPS(FP4)。其部署5500颗Hi-ONE即可替代传统方案所需的4.8万颗800G光模块,整机功耗降低超550千瓦,平均无故障运行时间(MTBF)提升一倍,系统可用性高达99.8%,大幅缩短前沿大模型的迭代周期。
华为同步将超节点架构延伸至通用计算领域,全新升级鲲鹏超节点:基于灵衢全光组网,单集群最大支持4096个计算节点,构建256TB统一内存池,显著提升智能体(Agent)沙箱密度、启动速度及向量检索效率;同时发布基于灵衢UnifiedBus总线设计的L3.5层PB级KV缓存解决方案——OceanStor M900集群,支持“一跳直连”,满足实时AI推理对低时延、高吞吐的严苛要求。
多个昇腾960超节点可通过灵衢网络或RoCE高速互联,组成更大规模超节点集群。借助二层CLOS四平面组网架构,单集群最大可扩展至51.2万卡;结合多轨道拓扑优化技术,最终可支撑百万卡级昇腾超节点集群,为超大规模AI训练提供坚实底座。
汪涛强调,构建开源开放的算力生态是华为长期坚持的核心战略。CANN(Compute Architecture for Neural Networks)已全面开源并进入常态化社区运营阶段,工具链与开发体验持续优化,正从“可用”迈向“易用”,昇腾生态已成功跨越关键拐点。
汪涛表示:“华为将持续投入AI基础设施创新,坚持开源开放路线,全力支持主流大模型在昇腾平台原生训练,积极适配百模千态,携手伙伴共同迎接智能世界的加速到来。”
据悉,华为全联接大会2026于2026年9月17日至19日在上海世博展览馆与世博中心举行。本届大会以“智启新未来”为主题,通过“战略全景—产业技术—生态发展”三维视角,系统呈现华为全面智能化战略的最新进展,集中发布系列创新产品与解决方案、行业智能化落地样板、以及面向开发者的高效易用工具与平台。更多详情请访问大会官网:www.huawei.com/cn/events/huaweiconnect
