阿里发布甄武 V900:216GB 显存、单集群可扩到 50 万加速卡,但量产要等到 2027 年第一季度

阿里旗下芯片公司平头哥于 9 月 22 日在杭州举行的 2026 云栖大会上发布新一代训推一体 AI 芯片甄武 V900。公开的规格为 216GB 内存、1200GB/s 的芯片间互连带宽,原生支持 FP8 与 FP4 低精度计算,性能为上一代甄武 M890 的三倍。阿里 CEO 吴泳铭称其为「当今中国最强的 AI 芯片」。该芯片被设计为在系统中协同工作而非单卡使用:平头哥自研的 ICN Switch 互连可把 1000 颗以上 V900 连成一个整体系统,用于万亿参数模型训练和大规模 AI agent 推理;结合阿里云新的 AI 计算中心网络架构,单集群可扩展至多达 50 万张加速卡。量产与大规模上市安排在 2027 年第一季度。路线图上还有 2027 年第三季度的下一代甄武 J900,以及同期的倚天 720 和 730 服务器 CPU,其中倚天 750 将支持 ICN 互连协议以实现 CPU 与 AI 芯片直连。基础设施方面,阿里宣布计划到 2032 年把阿里云全球数据中心容量扩展到 20 吉瓦以上,并已承诺三年内在云与 AI 基础设施上投入超过 530 亿美元。模型路线图方面,公司披露即将推出的 Qwen 4.5 与 Qwen 5.0 参数量在 4 万亿到 10 万亿之间。市场反应上,阿里港股当日收涨 2%,美股盘前涨逾 3%。已落地的部分是:基于上一代甄武 M890 的超节点服务器已大规模商用,支撑 2 万亿参数以上的模型,甄武系列累计服务超过 650 家企业客户,覆盖自动驾驶、金融、能源和制造等领域。华为昇腾目前主导中国国产芯片市场,上周同样发布了新的 AI 基础设施。

先看日期:这是路线图,不是现在能买到的东西

量产和大规模上市安排在 2027 年第一季度。也就是说,今天被称作「当今中国最强」的这颗芯片,还要等一个多季度才会量产。 这不是挑刺,是读这类发布的基本方法。芯片发布会上的内容通常横跨三种状态:**已经在跑的、即将量产的、和更远的路线图**。甄武 V900 属于第二类;倚天 720/730 和甄武 J900 排在 2027 年第三季度,属于第三类。 所以真正能支撑判断的是第一类——**已在大规模商用的是上一代甄武 M890**,其超节点服务器正在支撑 2 万亿参数以上的模型,甄武系列累计服务超过 650 家企业客户。这一句比任何一项新规格都重要,因为它是已发生的事实,而且它说明这条国产路线不是从零起步。

216GB 的意义在系统层,不在单芯片跑分

单看规格容易陷入单卡对比。但这次发布的结构本身在说另一件事:V900 被明确设计为在系统中协同工作。ICN Switch 可把 1000 颗以上连成一个整体系统,配合新的网络架构,单集群可扩展至 50 万张加速卡。 这就是路线的重点。在拿不到最新一代进口加速卡的条件下,**补单芯片差距的办法是互连和规模**——把更多颗拼成一个足够大的一致内存域,让万亿参数级别的训练和大规模 agent 推理跑得起来。倚天 750 将支持 ICN 协议以实现 CPU 与 AI 芯片直连,也是同一条思路的延伸:不是在某一颗上赢,是在整条链路上少一次转换。 由此得到一个更有用的对照口径:**同样的预算和电力下,能组出多大的一致内存域、以及跨卡通信占整体时间的比例。**这两项目前都没有第三方数据,官方也未给出与任何具体进口型号在真实训练任务上的端到端对比。在有独立测试之前,「三倍于上一代」是厂商口径的代际提升,不能直接换算成与其他厂商产品的相对位置。

哪些数字是承诺,哪些是事实

这份发布里的数字需要分三类读。 **已发生的**:M890 超节点大规模商用、支撑 2 万亿参数以上模型、650 家企业客户、股价当日的反应。 **有明确日期的承诺**:V900 在 2027 年第一季度量产,J900 与倚天 720/730 在 2027 年第三季度。 **长期承诺**:到 2032 年把数据中心容量扩到 20 吉瓦以上,三年内投入超过 530 亿美元。请注意 20 吉瓦那个目标的时间点是六年后——它是一个方向,不是一个可近期检验的指标。 模型那一侧同样要按口径读:Qwen 4.5 和 Qwen 5.0 的参数量被写成「4 万亿到 10 万亿」。这么宽的区间本身说明还没定型,属于路线图语言而非产品规格。 本站昨天写软银借 110 亿美元垃圾债去买 OpenAI 股权时提过一个共同点,这里同样适用:**AI 基建公告里头条数字的兑现期,普遍比新闻周期长得多。**九月里这已经是第四条——Nscale 的合同储备、Crusoe 的 1400 亿合同总额对 1 吉瓦已交付、软银的分期出资,现在是阿里的 2032 年 20 吉瓦。

两条需要说清的边界

一是竞争格局。华为昇腾目前主导中国国产 AI 芯片市场,上周也发布了新的 AI 基础设施。所以这不是一家独大的故事,而是国产供给侧同时在推进的多条路线之一。 二是同一家公司的两件事可以分开看。本站 9 月 21 日写过 Qwen-Image-2.1 把许可从 Apache 2.0 收成仅限研究,而今天这条里阿里在谈 4 万亿到 10 万亿参数的下一代 Qwen。芯片、云和模型被放在同一场发布会上讲,是想呈现一个垂直整合的故事;但对使用者来说,**能不能用、按什么许可用,仍然要一个模型一个模型地去查**——发布会上的整合叙事不改变具体那份许可文件写了什么。

via: TechNode 报道TrendForce 报道ABC News 报道Quartz 报道