9 月 22 日杭州云栖大会,阿里把平头哥的新一代 AI 芯片真武 V900 正式推上台面。三个数字可以先记下来,算力是上一代真武 M890 的三倍,单集群能扩到 50 万张加速卡,2027 年第一季度量产并商业化上市。前两个决定它能训多大的模型,第三个决定你什么时候才真的用得上。
真武 V900 升级了什么
官方这次的表述相当克制,只给了算力倍数和集群上限,制程、显存带宽、互联规格这些硬参数一个都没公布。我核对了现场几家媒体的口径,说法一致但也都停在同一层,所以下面写的是目前能确认的部分,其余只能等量产时再看。
算力与集群规模
真武 V900 的单芯片算力达到真武 M890 的三倍。基于它构建的单一 AI 集群,可以支持最多 50 万张加速卡协同工作,主要面向前沿大模型的训练与推理。50 万卡这个量级放在全球也属于第一梯队,作为参照,10 万张芯片集群的端到端吞吐优化已经能让智谱那套 Infra Agent 拿到 3.2 倍提升,规模再往上翻五倍,调度、互联和故障恢复就要另起一套方案了。
量产时间
2027 年第一季度。这个时间点意味着今年年底到明年上半年,阿里云上真正扛活的还是 M890 系列,V900 暂时只是路线图上的东西。
和 M890 摆在一起看
上一代并没有退场。吴泳铭在会上说,基于 M890 的 AI 超节点已经能支撑 2 万亿参数规模大模型的推理,本季度开始规模化上架阿里云数据中心,他还补了一句,全球能做到的企业屈指可数。
| 项目 | 真武 M890 | 真武 V900 |
|---|---|---|
| 算力 | 基准 | 约为 M890 的 3 倍 |
| 单集群规模 | 未公开 | 最多 50 万张加速卡 |
| 已知能力 | 支撑 2 万亿参数模型推理 | 前沿模型训练与推理 |
| 落地状态 | 本季度规模化上架 | 2027 年 Q1 量产上市 |
表格里最值得留意的是落地状态那一栏的落差。算力翻三倍听起来很猛,但从发布到量产隔了差不多五个季度,这中间阿里云能拿出来的算力增量,靠的还是 M890 超节点的铺货速度。
芯片之外,模型这条线同时开了新局
同一场大会上,Qwen 团队给的口径更激进。基于下一代架构的 Qwen4 已经投入训练,后续的 Qwen4.5、Qwen5 参数规模规划到 5 万亿至 10 万亿。现役旗舰 Qwen3.8-Max 大约 2.4 万亿参数,新路线相当于它的两到四倍。想直观感受这个体量,可以看已经放出来的 Qwen3.8-2.4T-A95B 开源权重,那是目前公开可查的最大一档。
更值得琢磨的是递归自我改进,也就是 RSI。阿里披露 Qwen3.8-Max 已经能自己搭建训练流程、构造数据、设计实验并定位缺陷,在人类零参与的情况下持续迭代超过一个月,完成 33 轮有效迭代,让 Artificial Analysis 的得分提升 12.5%。这个数字我保留一点看法,评测涨分和真实能力提升之间从来不能直接划等号,但零参与跑满一个月这件事本身,说明训练流程的自动化程度已经到了一个新位置。RSI 目前也落地到了推理优化和芯片模型协同设计上。
团队层面同样有变动。云栖大会开幕前,刘大一恒接掌通义千问大模型,正是他以 Qwen LLM 项目负责人的身份在会上讲了 Scaling 是通往 ASI 的路径这一判断。同场还有一组数字,Qwen3.8-Flash 通过注意力机制等创新把训练成本降低了近 90%,一个月内 Qwen3.8 相关模型下载量超过 5600 万次,衍生模型超过 1900 个。
数据中心扩张,以及卡住它的东西
阿里计划到 2032 年把阿里云全球数据中心总容量提升到 20 吉瓦以上。吴泳铭没有回避限制条件,全球产业链卡在数据中心设备、电力和相关基础设施的供应上,扩张速度因此被拖住。他的判断是中长期的需求增速仍远超供应,阿里正在加快 AI 超节点的部署并从本季度起大规模投入商业运营。
顺便提一下同行进度,OpenAI 首款自研芯片 Jalapeño 是与 Broadcom 合作、九个月完成设计的。各家把算力握在自己手里的方向基本一致,节奏差别不小。
常见问题
真武 V900 什么时候能用上?
官方口径是 2027 年第一季度量产并商业化上市。在那之前,阿里云数据中心上架的仍是 M890 AI 超节点。
50 万卡集群对普通开发者有意义吗?
直接关系不大。它服务的是万亿参数级模型的训练与推理,普通开发者接触到的还是云上的 API 和实例规格。集群规模上去之后,会传导下来的其实是单位算力的价格和供给量。
这次有开源动作吗?
有。阿里在会上提到开源了千问 2.7B 模型,并推出千问移动端 AI 解决方案。累计口径上,阿里已开源 460 多个千问模型,整体下载量超 30 亿次,衍生模型超 30 万个,Perplexity、Airbnb、Pinterest 和路透社等企业已基于 Qwen 做 Agent、AI 助手或自研模型。
小结
真武 V900 目前更像一张路线图,已知的只有三倍算力、50 万卡上限和 2027 年 Q1 量产这三件事。真正会在未来一年影响算力供给的,是 M890 超节点的铺货和 20 吉瓦数据中心的建设节奏。芯片参数还没到能评价的时候,等量产版规格出来再说。
