华为全联接大会2026开幕:发布昇腾960超节点与NPO光互联技术,打造智能世界硅基黑土地

SmartHey9月17日消息,今日,华为全联接大会2026在上海启幕。华为副董事长、轮值董事长汪涛在大会上发表题为“智启新未来,打造智能世界的硅基黑土地”的主题演讲,携手产业界共同探讨如何共建强大AI基础设施,夯实算力底座,把握智能时代的历史性机遇与挑战。

当前,AI变革正以远超以往任何技术革命的速度演进:大模型参数已迈入10万亿量级,预计2030年将突破100万亿;智能体工作周期从小时级迈向月级;中国日均AI推理Token达约500万亿,2030年有望跃升至百万万亿级。端侧智能同步飞跃——手机端大模型参数从2024年的3B跃升至当前30B,未来将向100B迈进。这些跃迁对AI基础设施的规模、性能与可靠性提出前所未有的高要求,唯有持续强化底层支撑,方能筑牢智能世界的坚实根基。

面向加速到来的智能世界,华为坚定聚焦AI基础设施建设,致力于打造“智能世界的硅基黑土地”。其AI战略以算力为核心,坚持硬件变现路径,围绕“超节点+集群”系统架构创新构建竞争力,构筑中国自主可控的坚实算力底座;坚持开源开放生态,全面支持主流大模型基于昇腾原生训练,积极适配“百模千态”;面向客户,提供线上线下灵活算力方案,加速千行百业智能化升级;面向丰富端侧场景,通过大、中、小、微四级多样性算力布局,推动AI入端、上车、赋能物联轻智能,实现智能无处不在;同时围绕“用算”重构通信网络,依托5G-A/6G与万兆光网,构建从云到边到端的智能联接体系,让智能真正触达每个人、每个家庭与每家企业。

超节点已成为产学研共识:建设超大规模AI基础设施的必然路径

目前,昇腾910C超节点部署已超1000套,昇腾950超节点进入规模化商用阶段。超节点已在产业界、学术界与科研机构形成广泛共识——它是一种物理上由多计算节点通过高效互联协议紧密耦合、逻辑上具备统一内存编址能力与“单台计算机”特性的新型计算系统。

在十万亿级SOTA模型训练成为刚需的当下,10万卡集群已成为行业标配,但传统服务器架构导致集群内通信开销占训练总时长超40%,严重拖累MFU(模型浮点算力利用率)。华为马尔科夫实验室仿真表明:采用4K超节点构建的10万卡集群,相较8卡服务器组成的同规模集群,MFU提升达2.75倍。

基于灵衢UnifiedBus打造11颗关键芯片,首发业界首个NPO光互联超节点——昇腾960

昇腾芯片是整个AI系统的核心引擎。华为宣布昇腾960系列研发进度大幅超前:960DT将于2027年第一季度就绪(较原计划提前三个季度),960PR将于2027年第三季度交付(提前一个季度)。未来昇腾芯片将持续保持“一年一代”演进节奏——2028年与2029年将分别推出昇腾970、980,依托τ定律持续突破,实现算力规格翻倍,并大幅提升访存带宽、容量及互联带宽。

除昇腾芯片外,华为基于灵衢UnifiedBus统一总线,同步研发覆盖计算、互联、存储、管理等全栈能力的系列化套片,夯实超节点技术基座。

超节点的本质在于多NPU高效协同,而协同效能取决于互联。华为自主研发新一代NPO(Near-Packaged Optics)光互联产品Hi-ONE:通过光、机、电、磁、热多维协同设计,单引擎实现7.2T超高传输容量。这是全球首个量产NPO产品,亦为当前业界最大传输能力且唯一内置光源的NPO方案,首次将“高带宽、高可靠”与“低时延、低功耗”深度融合。Hi-ONE与灵衢总线协议共同构成可规模扩展的超节点互联系统。华为已向全球光互联标准组织OIF提交NPO标准立项建议,获多家头部伙伴积极响应,加速构建开放共赢的NPO产业生态。

依托昇腾960芯片与Hi-ONE,华为正式发布业界首个采用NPO技术的超节点——昇腾960超节点:单节点支持4096卡,峰值算力达8E FP8,配备高达1PB HBM显存。该节点采用5500颗Hi-ONE替代传统方案所需的4.8万颗800G光模块,整机功耗降低超550千瓦,无故障运行时间提升一倍,系统可用度达99.8%。

鲲鹏超节点升级+AI记忆存储OceanStor M900亮相,支撑百万卡级Agentic集群

面对10T级SOTA模型训练与推理需求,单一AI服务器或智算超节点已无法满足复杂系统要求。新一代算力系统需融合智算超节点、通算超节点、免协议转换的平等互联架构,并集成PB级KV缓存集群。

首先,鲲鹏超节点完成重大升级:基于灵衢全光组网,最大支持4096节点,构建256TB统一内存池,显著提升Agent执行效率。在Agent沙箱场景中,十万级沙箱启动速度较传统方案提升30倍,沙箱密度再增25%;在百亿级千维向量检索任务中,检索性能实现翻倍。

其次,华为推出面向Agent推理的AI记忆存储——OceanStor M900。针对Agent与长序列对多层次KV Cache的刚性需求,华为首创L3.5层PB级“一跳直连”KV缓存集群,基于灵衢UnifiedBus实现毫秒级访问延迟。M900采用混合介质架构与优化Retention算法,SSD读写寿命提升16倍,从底层保障KV命中率与长期稳定运行。

依托“计算+通信”融合优势,华为进一步推出Agentic超节点集群:通过灵衢UnifiedBus统一多种互联协议,消除协议转换开销,实现昇腾超节点、鲲鹏超节点与KV缓存集群的平等互联与资源共享;结合二层CLOS四平面组网,最大集群规模达51.2万卡;叠加多轨道拓扑技术后,可扩展至百万卡级昇腾超节点集群,全面加速10万亿参数大模型训练与推理。

开源开放是华为算力生态的基石战略

鲲鹏生态持续引领千行百业数智化转型:全球鲲鹏开发者超416万,生态伙伴逾7200家,支持560余个全球开源项目;openEuler装机量突破2000万套,稳居中国服务器操作系统市场份额第一。

昇腾生态已跨越关键拐点:作为生态根基的CANN框架,已进入常态化开源社区运营阶段,由“可用”迈向“易用”。CANN外部开发者占比达61%,月活跃开发者超5200人,成为中国最活跃的开源社区之一;基于昇腾+CANN原生训练的大模型超40个,是国内唯一完整支持预训练的技术路线;昇腾已深度融入PyTorch、Triton、vLLM、veRL等90余个主流三方社区。在Linux基金会支持下,昇腾正式成为PyTorch官网可直接安装的算力平台——这也是首个来自中国的官方支持算力平台,全球开发者均可便捷接入昇腾创新成果。

以多样性算力推进AI入端、上车,实现智能无处不在

AI终端化进程全面提速。华为正构建四大支柱:一是麒麟+昇腾双芯协同,实现端侧算力自给自治;二是盘古大模型与三方模型联合优化,确保端侧智能好用易用;三是HarmonyOS作为“Agent OS”,从系统架构、运行机制到交互逻辑全面重构,支撑人与Agent共生共用;四是繁荣的小艺智能体生态,为端侧AI应用提供丰沃土壤。

华为重点打造AI Phone、AI PC、智能汽车与全屋智能四大端侧算力平台,通过端端协同与端云协同,构建分布式群体智能,覆盖个人移动空间、办公空间、车载空间与家居空间,提供连续、一体、伴随式的全场景智能服务。

没有网络的算力是信息孤岛:围绕“用算”重构新一代通信网络

AI算力价值的充分释放,离不开新一代通信网络的深度适配。华为正推动网络从“连接人”向“服务算力”根本转型,依托5G-A/6G、万兆光网与多级协同低时延承载网,构建“中心—边缘—终端”全栈智能联接体系,让算力真正流动起来、智能真正落地生根。

最后,汪涛强调:“人工智能或是人类社会最后一次技术革命,其变革之深、之广、之快前所未有。没有任何一家企业能独自托起整个智能世界。华为将持续聚焦AI基础设施,打造触手可及的硅基黑土地;坚持软件开源开放,释放开发者无限潜能;坚持拥抱‘百模千态’,激发多元价值创造;坚持开放合作,助力客户成功、伙伴成长。让我们携手同行,共建万物互联的智能新时代。”

2026年9月17日至19日,华为全联接大会2026在上海世博展览馆与世博中心举行。本届大会以“智启新未来”为主题,从“战略全景—产业技术—生态发展”三维视角,系统呈现华为全面智能化战略最新进展,并集中发布创新产品与解决方案、行业智能化标杆应用、以及易用高效的开发者工具与平台。