阿里云栖大会重磅发布:Qwen4迈向5-10T参数、真武V900芯片算力提升3倍、灵骏超节点扩展至50万卡

撰文 | 李信马

题图 | SmartHey摄

“今天,机器思考的总量,大概不到人类的3%。”

2026云栖大会主论坛上,阿里巴巴集团CEO吴泳铭提出一项关键推演:未来机器可供给的思考总量,将达人类思考总量的1000倍以上——这意味着AI算力供给仍有数万倍增长空间,也勾勒出AI基础设施市场的核心增长边界。

吴泳铭以电力革命类比AI发展:“无论后续涌现多少新应用,第一步必须建足够多的‘发电站’、铺足够广的‘电网’。1900年前后,电器已走入家庭,但全球年发电量按今日标准仅够运行两小时。”由此,他将AI模型、AI芯片与AI云定义为机器智能时代的三大基石——它们共同构成规模化“思考供给”的底层支撑,也是阿里巴巴长期战略的核心锚点。

过去三天,阿里围绕这三大基石集中发布关键进展。

01、模型:Qwen加速迈向超级智能

在吴泳铭看来,大模型的本质是“构建可自进化的顶级大脑”,而实现路径是递归式自我改进(RSI):模型通过真实反馈识别短板,自主设计实验、构造数据、评估结果,并持续迭代优化。

Qwen3.8-Max正是这一范式的首次完整实践——全程零人工干预,自主搭建训练流程、生成训练数据、开展33轮有效迭代,历时超一个月。依托RSI与后训练联合优化,其在Artificial Analysis基准测试中得分从40跃升至45分,跻身Claude、GPT最强版本同一梯队,显著领先GLM5.3、Kimi-K3等主流国产模型。

更突破性的是,该能力已延伸至训练之外:Qwen3.8-Max在未接触过平头哥新款GPU的前提下,自主完成推理框架适配与优化,使下代模型Qwen3.8-Flash单实例吞吐量提升96%;在芯片协同设计中,仅依据一份总线模块规范,即自主完成前端设计、验证与物理实现全链路迭代,在超60小时连续运行、调用EDA工具逾万次后,实现芯片面积缩减42%。

参数规模方面,新一代架构Qwen4已启动训练,Qwen4.5与Qwen5将逐步扩展至5–10T参数量级,“目标是支撑更复杂、更长程任务,稳步向通用人工智能(ASI)演进”。

与此同时,Qwen3.8-Flash已开源下一代千问架构,通过注意力机制与信息传递机制创新,在保持前沿性能的同时,训练成本降低近90%;并凭借极低参数激活率,将推理效率推向全新帕累托最优前沿。

多模态能力同步跃升。吴泳铭强调:“仅有一个聪明大脑远远不够”,AI还需具备感知与交互能力——理解语音、图像、表情、动作,并对齐人类文化、审美与价值观。本次大会正式发布全模态模型Qwen3.8-Omni;语音模型家族Qwen-Audio-3.1在转写、合成与实时交互三大场景全面升级;同声传译模型Qwen3.8-LiveTranslate将字均延迟压缩至2.3秒(人类同传平均约4秒)。

视觉领域,Qwen-Image-3.1实现秒级视觉设计交付(原需数小时);音乐模型Happy Shrimp 1.1支持百余种曲风及十余种主流语言;世界模型HappyOyster 2.0 Preview强化了实时交互、长期记忆、响应速度与物理规律遵循能力;视频生成模型Wan3.0斩获Artificial Analysis文生视频与视频编辑双榜首;下一代视频模型将于2026年11月发布。

开源生态持续领跑。截至目前,阿里已开源Qwen系列模型超460个,全球下载量突破30亿次,衍生模型超30万个,稳居全球第一开源大模型家族。9月16日,Qwen3.8-27B登顶Hugging Face最受欢迎开源大模型榜单,超越DeepSeek-R1、Meta-Llama3.1等国际热门模型,创该平台历史纪录。

02、芯片:真武V900实现三倍算力跃迁

“如果说Token是AI时代的电,芯片就是发电机。”

吴泳铭以此阐明芯片的战略定位——面对无上限的Token需求,芯片必须持续提升性能与供给能力。目前,平头哥已完成AI芯片(真武)、服务器CPU(倚天)、智能网卡(磐脉)、互联芯片(ICN Switch)与存储主控(镇岳)全栈自研,覆盖超大规模AI集群所需的算力、网力与存力。

本届大会发布的训推一体AI芯片真武V900,是中国当前算力最强的自研AI芯片:单芯片性能达前代真武M890的3倍,配备216GB显存,片间互联带宽高达1200GB/s,原生支持FP8/FP4低精度计算,可高效支撑万亿参数级大模型训练与推理,计划于2027年Q1量产并大规模部署于阿里云数据中心。

借助自研ICN Switch互联芯片,多颗真武V900可组成具备原生内存语义与统一编址能力的“超节点”,实现千卡全带宽高速互联——上千颗芯片能如单一“超级芯片”协同运行。现场发布的升级版超节点服务器,单集群最大可扩展至50万卡规模。此前,基于M890的AI超节点已成功支撑超2万亿参数大模型高效推理,本季度起已在阿里云规模化商用。

吴泳铭透露:“随着平头哥芯片产品线成熟及客户广泛应用,其AI芯片年出货量将显著提升。”

平头哥同步公布倚天CPU路线图:2027年将推出倚天720与倚天730两代产品,其中倚天730首次采用全自研CPU微架构,单核SPECint2017/GHz性能较倚天710提升40%;2029年发布的倚天750将搭载第二代自研核,并通过ICN总线与真武AI芯片直连,进一步强化CPU-AI芯片协同效率。

03、AI云:构建全球规模的“思考输送网络”

吴泳铭将AI云比作“电网”——它的使命是把Token高效输送到每一个需要它的地方。模型持续训练与推理、Agent长期任务执行、AI原生软件爆发式增长……这些都将使云成为“思考居民”的永久家园,持续调用底层算力。

因此,这张“网”必须更大、更快、更广。作为首个国产十万卡云上超节点集群,阿里云灵骏真武M890超节点继乌兰察布首批开服后,将于2026年Q4在宁夏中卫新增服务节点;2027年,灵骏真武V900超节点将上线,性能再提升3倍,搭载业界首发200Pbps通信带宽与6微秒时延集群架构,依托自研SNPO实现全光互联,支持千卡Scale-Up互连,单集群仍可扩展至50万卡,并向广域超节点演进。

全球布局同步加速:未来12个月,阿里云将在土耳其、芬兰、荷兰首次设立云计算地域节点,并扩建马来西亚、德国、阿联酋、法国与中国香港数据中心,全面提升本地化AI与云服务能力。

目前,阿里云已在全球31个地域运营107个可用区,拥有3200+边缘节点;新一代AI数据中心最快100天交付,单机柜计算密度达传统数据中心5–10倍;按规划,到2032年,阿里云全球运营数据中心总规模将突破20GW。

“阿里巴巴将携手所有合作伙伴,全力投入AI基础设施建设,打造一朵真正面向‘机器智能时代’的AI云。”吴泳铭表示。

写在最后

为期三天的云栖大会,留下一串极具张力的数字:

5–10T参数规模|3倍芯片算力|50万卡超节点|20GW全球数据中心

当这些数字被置于同一逻辑框架,它们共同指向一个清晰判断:在机器智能时代,“思考”正成为一种可规模化生产与输送的商品,而供给能力,最终取决于基础设施的深度与厚度。正如吴泳铭所言:“把繁重的任务交给机器,把时间、创造力以及对美好事物的感受留给人类。这一切,现在刚刚开始。”