华为发布灵衢互联架构及系列化算力底座,开启Agentic AI时代集群计算新范式

SmartHey9月17日消息,在华为全联接大会2026期间,华为常务董事、ICT BG CEO杨超斌发表主题演讲,系统阐述全新计算架构——灵衢互联,并正式推出基于该架构的系列化算力底座,全面强化生态协同能力,加速客户、伙伴与开发者在AI应用层面的创新落地。

华为常务董事、ICT BG CEO杨超斌发表主题演讲

当前主流计算架构面临显著瓶颈:随着集群规模扩大,资源利用率不升反降——十万卡集群的实际模型算力利用率仅约20%,大量算力闲置于通信等待;10T参数大模型训练需处理海量中间激活值,远超单卡显存承载极限;而Agentic AI场景下,Agent与模型每小时交互可达数百次,对CPU/NPU动态协同、KV Cache跨层级缓存提出极高要求。在此背景下,集群内各部件间的互联带宽、时延与语义一致性,已成为决定整体计算效能的核心制约因素。

为此,华为以“灵衢互联”为技术基石,构建集群与超节点协同演进的新一代计算架构,旨在系统性支撑Agentic AI时代爆发式增长的异构、高频、低时延计算需求。该架构具备四大关键能力:

一、协议归一,内存语义统一。将原本分散的十余种互联协议融合为统一的灵衢协议,互联带宽跃升至TB级,端到端RTT时延压缩至2微秒,首次实现超节点内全局内存统一编址与零感知访问。

二、多样算力,异构平等协同。CPU、NPU、内存、SSD等核心部件通过灵衢直连,打破中心化调度依赖,支持算力资源按需动态配比;依托分层分级Transformer硬加速技术,实现Attention与FFN模块解耦及AF分离部署,大幅提升模型训练与推理效率。

三、分级存储,资源全局池化。构建混合介质(DDR/HBM/SSD)统一资源池,将DDR作为NPU“第二内存”,显著降低搜推广类业务响应时延;千亿级、数千维向量检索性能提升一倍;同时缓解10T大模型对单卡HBM容量的强依赖,有效提升集群MFU(Model FLOPs Utilization)。

四、光电融合,弹性组网无界。打造全域超高带宽、超低时延“数据高速公路”,支持从单柜到百万卡集群的平滑扩展,真正实现大小算力按需聚散。

大会上,华为同步发布分层分级灵衢互联设备体系,覆盖柜内、跨柜与集群三级互联场景,全面适配从边缘到超大规模智算中心的多样化部署需求。其中:柜内灵衢刀片实现全光直连、零电缆与零电路损耗,单个4096卡超节点可节省196公里铜缆;跨柜互联设备支持176端口,单端口速率高达1.6T,整机全光互联带宽达280T,为业界带宽最高、端口密度最大的高速总线协议设备,RTT稳定控制在2微秒;UBG灵衢网络交换机具备1024 Radix超大扇出能力,可原生支撑百万卡超节点集群,前瞻性满足未来几十万亿参数模型的互联扩展需求。

此外,华为正式推出基于灵衢架构的Agentic AI超节点集群,由鲲鹏950通用算力超节点、昇腾960AI算力超节点、OceanStor M900记忆型存储及星河UBG交换机构成,实现多类型算力深度融合与分级资源统一调度。

灵衢技术不仅面向超大规模集群,也深度赋能轻量化部署。华为基于该架构推出覆盖1卡至8卡的系列化AI一体机及鲲鹏-昇腾融合模组。例如Atlas 650E风冷服务器通过双机灵衢直连,实现16颗NPU免交换器全互联,两台物理设备逻辑上等效为单一超节点,支持无缝扩容,让中小企业也能在本地高效运行万亿参数大模型。

在生态建设方面,昇腾已与DeepSeek Harness、OpenCode、openJiuwen等主流开源框架深度协同,联合打造智能调度、推理加速、安全可信等Agent插件化组件,并全部开源;目前已携手50余家客户、合作伙伴及高校共建26个垂直行业算子库,并与90余个全球主流开源社区建立合作,大幅降低行业Agent开发门槛与IT系统集成复杂度。

杨超斌在演讲中强调:“AI驱动的智能化变革,本质是算力基础设施的代际跃迁。华为将持续坚持系统级创新,提供从芯片、互联、硬件到软件栈的系列化算力底座,坚持开源开放,与客户、伙伴和开发者共同构筑繁荣、自主、易用的AI生态,为全球智能化进程提供坚实可靠的新选择。”

2026年9月17–19日,华为全联接大会2026在上海世博展览馆与世博中心举行。本届大会以“智启新未来”为主题,围绕“战略全景—产业技术—生态发展”三维视角,全面呈现华为智能化战略最新进展,集中发布创新产品与解决方案、标杆行业智能化应用案例,以及面向开发者的易用工具链与平台能力。更多信息请访问大会官网:www.huawei.com/cn/events/huaweiconnect