2026 年 9 月 22 日杭州云栖大会,阿里把三件东西一起掀开:芯片、模型、数据中心规划。芯片是平头哥真武 V900,单卡算力是真武 M890 的 3 倍,搭载 216GB 显存,片间互联带宽 1200GB/s,原生支持 FP8 与 FP4。模型是 Qwen4 已在训练中,Qwen4.5、Qwen5 将扩展到 5-10 万亿参数规模。规划是 2032 年阿里云运营的全球数据中心规模超过 20GW。
这场发布会把"机器智能时代"的三个支柱一次性亮明。CEO 吴泳铭的判断是:今天机器思考的总量还不到人类的 3%,未来将达人类的 1000 倍以上。在这个判断下,芯片就是发电机,模型是负载,云是电网。三件事只能一起做。
一颗芯片到底改了哪三样
真武 V900 的关键升级落在三个数字上:算力 3 倍、显存 216GB、互联 1200GB/s。前一项决定单卡能跑多大的模型,后两项决定集群能跑多稳。
上一代真武 M890(2026 年 5 月发布)显存 144GB、互联 800GB/s。四个月后 V900 把显存从 144GB 拉高到 216GB,互联从 800GB/s 拉到 1200GB/s。这个时间点比外界预期大幅提前,背后是 AI 模型从稠密走向 MoE(Mixture of Experts,混合专家架构)后的硬约束:每个 token 只激活部分专家,但专家之间要通讯,显存越大单卡能装下更多专家,带宽越大专家调度越快。
50 万卡单一集群怎么落地
芯片单点变强不够用,关键在于把上千颗芯片协同得像一颗芯片。这一步靠平头哥自研的 ICN Switch 互联芯片。
官方描述是:原生内存语义和内存统一编址能力,让上千颗真武 V900 能像一颗"超级芯片"一样协同工作。这背后是分布式共享内存的硬功夫:每个卡看到的是统一地址空间,而不是各自独立显存。芯片之间无需显式做数据搬运,编译器自动把算子落到合适位置。
这套超节点加上磐脉智能网卡与镇岳 SSD 主控芯片,组成磐久超节点服务器。阿里云新一代网络架构把这套硬件串起来,单一集群可扩到 50 万卡规模。上代真武 M890 的超节点已经在跑 Qwen3.8、Kimi K3 等超 2 万亿参数规模模型,并实现规模化推理。
Qwen4 训练中,5-10 万亿是下一站
模型侧的进展是 Qwen4 已经在训练中。Qwen 团队称在递归式自我改进(RSI)方向取得进展,未来 Qwen4.5、Qwen5 将扩展到 5 至 10 万亿参数。
5 万亿到 10 万亿是一个量级跳跃。Qwen3 系列目前最大的版本约 4,800 亿参数(Qwen3-Max 旗舰档)。从 0.48T 到 5-10T 是 10-20 倍的体量跨越,对应到训练算力需求是 100-400 倍(按 MFU 30% 估)。
吴泳铭的"机器思考总量是人类的 1000 倍"在这个目标里被具体化:5-10 万亿参数模型如果按 MiMo-V2.6 Pro 的同口径算(单任务成本约 0.13 美元),跑 100 万次思考就是 13 万美元;上千万次是 130 万美元。再往上的体量只有靠芯片与集群规模硬撑。
2032 年 20GW 是什么概念
阿里云规划到 2032 年全球数据中心规模超 20GW(吉瓦)。换算一下:20GW 满载一年耗电约 1,752 亿度,相当于 2025 年上海全市用电量的 1.4 倍。
这个数字对得上"机器思考是人类的 1000 倍"的判断。1GW 数据中心大致对应 100 万张 H100 等效卡(按每卡 700W 估算含散热损耗)。20GW 对应约 2,000 万张卡。真武 V900 单卡功耗约 1,200W(按 FP8 满载估算),50 万卡集群单点满载约 0.6GW,20GW 相当于约 33 个满载的 50 万卡集群。
这不是规划数字。3 倍算力芯片已经在 2027 年第一季度量产,并部署到阿里云数据中心。650 家企业客户已在使用真武系列,覆盖智驾、金融、大模型、具身智能、能源、制造六大行业。
Agentic Cloud 是另一张牌
云栖大会上还公布了 Agentic Cloud 战略,核心是 AgentCore 平台与新一代 CPFS 存储。后者据称可将 AI 存储成本降低 69%。
Agentic Cloud 的提法把 Agent 视为云的"客户":任务规划、状态管理、工具调用、代码沙箱、多 Agent 编排,这些动作每一项都需要算力调度、文件访问、并发锁、消息队列。AgentCore 把这些中间层抽象成云服务。配套的 CPFS(Cloud Parallel File System,云并行文件系统)解决了 Agent 长会话、高频小文件读写的存储瓶颈。
平头哥首次公布的倚天服务器 CPU 规划也指向这个方向。2027 年推出的倚天 720、730 两代芯片中,倚天 730 首次基于全自研 CPU 微架构设计,单核 SPECint 2017/GHz 性能最高可达倚天 710 的 1.4 倍。后续的倚天 750 支持自研 ICN 片间互联总线协议,可与真武 AI 芯片通过 ICN 总线直接互联,提升 CPU 与 AI 芯片的协同效率。Agent 的任务调度跑在 CPU 上,模型推理跑在 AI 芯片上,两者需要低延迟耦合。
把数字落回去:芯片、模型、场景
发布会结束后真武系列已有的进展:服务超 650 家企业客户,M890 超节点跑通 2 万亿参数模型,V900 进入量产倒计时。Qwen 系列已有的进展:Qwen3.8 Max 在 Artificial Analysis 综合智能指数 v4.3 上排开源第二(仅次于 MiMo-V2.6 Pro 的 46 分),Qwen4 在训练中。
把三条线叠在一起看:
| 维度 | 真武 V900 | Qwen4/4.5/5 | 2032 数据中心 |
|---|---|---|---|
| 核心指标 | 单芯 3 倍 M890、216GB、1200GB/s | 5-10 万亿参数 | 超 20GW |
| 时间节点 | 2027 Q1 量产 | 训练中、未来扩展 | 6 年期 |
| 已验证 | 650 家客户 | Qwen3.8 Max 开源第二 | 2027 Q1 起量产 |
这个发布会把"自研芯片 + 自研模型 + 自研数据中心"三件事一次性推到台前。在美国出口管制持续收紧的背景下,这是国产 AI 基础设施的一次集中亮相。
讨论回复
加载中...正在加载回复...
推荐
智谱 GLM-5 已上线
我正在智谱大模型开放平台 BigModel.cn 上打造 AI 应用,智谱新一代旗舰模型 GLM-5 已上线,在推理、代码、智能体综合能力达到开源模型 SOTA 水平。