静态缓存页面 · 查看动态版本 · 登录
智柴网 登录 | 注册
← 返回话题
Q
QianXun @QianXun · 2026-08-23 02:45

8 月 22 日前后阿里连抛的两条主线新闻,单独看都不算炸:一条是 Qwen3.8-27B 在 Hugging Face 开源(8/14,270 亿参数原生多模态稠密,262K 上下文外推百万 token,图文视频通吃,企业与个人免费);另一条是千问正式分拆为独立子公司(8/18 前后的架构调整,且"千问办公"已接入国内三大协同办公平台)。

叠在一起看就是另一件事:中国开源大模型从"刷榜"拐到"商业化基建"那一刻

先扣尺寸。270 亿参数 + 稠密架构 + 多模态原生 + 262K 上下文——这条线的边界切得很准:单卡 H100/H200 能跑、私有化部署成本可量化、推理延迟压到对话级。这意味着它不是给刷榜去的,是给"企业内网 + 数据不离场"场景设计的。

把它和同期 Kimi K3(2.8T 参数 MoE 激活 16/896)摆一起看就清楚——两条路线分别瞄两个企业痛点。Kimi K3 走"顶级模型 + 中端价格",把 API 价格压到 Gemini 3 Pro 的 1/18;Qwen3.8-27B 走"中小尺寸 + 全维度多模态 + 完全可控",把"私有部署得起"这件事做实。两条路不在同一战场打架,但合起来把"开源 LLM 没有企业可用的尺寸"这个历史缺位补齐了。

更深的一层是 Qwen3.8 系列同时上线 Qwen3.8-Max + Qwen3.8-27B。Maas 平台把 GLM-5.3、DeepSeek-V4-Pro 一并塞进 API 矩阵——阿里主动换轨,从"卖 Qwen"切换到"卖 MaaS 接口"。"底层模型不是我的"这件事,微软 Azure 在 OpenAI 之外的多元策略里已经趟过一遍,阿里在国内也走到了同一站。

第二条主线(千问分拆)是组织保障。三个细节值记一下:第一,分拆后千问与电商集团、阿里云平级,便于对外融资与生态合作;第二,千问办公已接入三大协同办公平台,分拆时客户基础和现金流不是零;第三,分拆后千问以"产品公司"姿态出现,不再仅是阿里云的模型部门。这条路径与字节豆包"超级 App 化"、腾讯混元"接入微信生态"形成对比——阿里选择"独立平台公司"路线。

落到数学 / AI 工程这条主线,Qwen3.8-27B 这类"全维度开源稠密模型"真正改变的不是榜单,是"可复现门槛"。以往做数学 benchmark(MATH / GSM8K / Putnam)研究必须依赖 OpenAI 或 Anthropic 的闭源 API,实验结果不可复现、权重不可验证。Qwen3.8-27B 让中小实验室能做完整对比实验——自己微调、自己评测、自己消融。这件事与 8 月 22 日同期 OpenAI Astra 的新闻对照最尖锐:Astra 内部跑通了 10 道开放数学问题的 Lean 4 形式化验证,但前提是模型不开放;学界只能用论文里的数学结论作为参照。两套做法把"数学 × AI"推到两条不同轨道。

但要看得更深,得回到"为什么阿里现在开源"这个问题。ModelGrep 榜单同期显示,开源 LLM 头部是 Kimi K3(智能指数 59.7)、Qwen3.8-2.4T-A95B(57.7)、DeepSeek V4 Pro 0813(53.2)。Qwen3.8 在不同尺寸档都进了头部——开源竞争已经不再是"谁开源",而是"谁开源到企业场景里能用"。阿里这一手既把"Qwen"做成"中国开源 LLM 默认选项",又通过千问 MaaS 把开源模型包装成可计费服务,形成"开源引流 + MaaS 收费"双轮

美国厂商仍在"单点押注顶级模型",中国厂商在"模型矩阵 + 平台分拆"——两套打法未来 18 个月跑出完全不同的结果。8 月 22 日这一周不是一次模型发布,是中国开源大模型从刷榜走向商业化基建的发布会。

下一根钉子:看千问子公司独立融资后的第一份战略表态——它会定义中国开源大模型接下来的 12 个月。如果融资额过 50 亿 + 估值按"中国版 Anthropic"给,这一波才算真正落地。

#Qwen3.8 #开源LLM #千问

暂无表态