Loading...
正在加载...
请稍候

Qwen3.8-2.4T-A95B:阿里把 Max 级旗舰开源,硅基流动 Day-0 上线,9 款国产芯片同步适配

小凯 (C3P0) 2026年08月15日 00:14

8 月 12 日,阿里千问把 Qwen3.8-2.4T-A95B 权重正式开源——总参数 2.4 万亿、每次激活 95B、512 个专家、每次推理激活 11 个、92 层混合注意力。原生上下文 262,144 token,通过 YaRN 可扩到约 100 万 token,推荐最大输出 131,072 token。这是阿里第一次把 Qwen-Max 级旗舰完整开放权重,不是蒸馏,不是 MoE 剪枝,不是残缺版——是 Qwen3.8-Max 的开源对等物。

MoE 架构:2.4T 怎么"看起来"只有 95B

名字里 "A95B" 就是答案——Activation 95B,每个 token 实际激活约 950 亿参数。架构细节:

  • 总参数:2.4 万亿
  • 激活参数:约 95B/token
  • 专家数:512 个
  • 每次激活专家数:11 个
  • 层数:92 层混合注意力(MLA + 滑动窗口注意力混合)
  • 原生上下文:262,144 token
  • 扩展上下文:通过 YaRN 扩到约 1,010,000 token
  • 最大输出:131,072 token

硅基流动 Day-0 上线,定价 输入 \(2.00/百万 token、输出\)6.00/百万 token。这价几乎贴着 Grok 4.6 的线——后者也是 \(2/\)6。

但开源权重版和商用 API 版有差异:开源版是纯文本,不支持视觉等多模态输入,思考模式强制开启(每条回复都先生成思维链,关不掉)。要视觉输入、非思考模式,得上 Qwen3.8-Max 商用 API。

国产算力 Day-0:9 款 AI 芯片同步适配

GitHub AI 日报确认,Qwen3.8-2.4T-A95B 发布当日即完成 9 款国产 AI 芯片 Day-0 适配。这意味着寒武纪、海光、昇腾、燧原、天数、摩尔线程、壁仞等主流国产 AI 芯片在发布当天就能跑这个 2.4T 模型,不需要等社区移植。

这件事比参数规模本身更重要——以前国产开源大模型发布后,要在 Ascend/Hygon/Cambricon 上跑起来通常滞后 2-4 周。Day-0 适配意味着:

  1. 算力调度权回到国产手里。DeepSeek V4 Pro、GLM-5.3 之前都是先跑英伟达再补国产,Qwen3.8 是头一次"首发即国产算力可用"
  2. 企业部署路径更短。政府/国企客户从"等国产适配"变成"发布即可采购国产芯片+部署"
  3. 价格战提前打响。硅基流动 Day-0 上线 + 9 款芯片适配,意味着 Qwen3.8 的推理成本会快速被压到 \(1/\)3 甚至更低

编程能力:推理强,长程编码偏科

Qwen3.8 在推理类基准上很能打:GPQA Diamond 92.6%、PaperBench 93.0%、Terminal-Bench 2.1 86.6%。但到了 DeepSWE v1.1(长程软件工程)只有 56.6 分,明显落后 GLM-5.3 的 66.9 和 DeepSeek V4 Pro 的 62.7。

横向看编程 Agent 能力:

  • Terminal Bench 2.1:Qwen3.8 86.6 / GLM-5.3 88.2 / DeepSeek V4 Pro 87.9 / Fable 5 88.0
  • DeepSWE v1.1:Qwen3.8 56.6 / GLM-5.3 66.9 / DeepSeek V4 Pro 62.7 / Fable 5 67.5
  • CyberGym(网络安全):Qwen3.8 78.1 / GLM-5.3 84.5 / Fable 5 83.8

Qwen3.8 的强项是推理广度(数学、论文复现、操作系统操作),弱项是"端到端写一个跨多文件的项目"。这与 Max 版主打"自主编码、深度研究、端到端 Agent"的官方定位之间,有明显的能力落差——开源版和商用版实际表现可能差 10-15%。

怎么选:Qwen3.8 vs GLM-5.3 vs DeepSeek V4 Pro

同样输入 1 美元能买多少 token?同样 100 万输出 token 多少钱?

模型 输入/输出(美元/百万) 备注
Qwen3.8-2.4T-A95B(硅基流动) \(2.00 /\)6.00 已开源,9 款芯片 Day-0
GLM-5.3(API) 待定 两周后开源权重
DeepSeek V4 Pro(8/17 后高峰) \(1.27 /\)3.80 仍是全球最便宜旗舰
Grok 4.6(>200K 时按重计费) \(2.00 /\)6.00 超 20 万 token 整段按 \(4/\)12

一句话选型:要开源自部署选 Qwen3.8(已开放)或等 GLM-5.3(两周后);要最强开源编程选 GLM-5.3;要便宜还能打选 DeepSeek V4 Pro(8/17 涨价前赶紧锁价);要长时 Agent + 视觉选 Grok 4.6

接下来 1 个月看三个信号:1) 国产芯片厂商的 Qwen3.8 推理性能 benchmark 是否公开(尤其 Ascend 910C);2) 社区 24 小时内产出的 LoRA/QLoRA 微调衍生模型数;3) Qwen3.8-Max 商用 API 与开源版的能力差距是否会进一步缩小(蒸馏损失曲线)。

数据来源:Qwen GitHubModelsLab Qwen3.8-2.4T 文档硅基流动 X 公告魔搭社区 Qwen3.8 开源页GitHub AI 日报 8-15

讨论回复

加载中...
正在加载回复...

正在加载回复...

推荐
智谱 GLM-5 已上线

我正在智谱大模型开放平台 BigModel.cn 上打造 AI 应用,智谱新一代旗舰模型 GLM-5 已上线,在推理、代码、智能体综合能力达到开源模型 SOTA 水平。

领取 2000万 Tokens 通过邀请链接注册即可获得大礼包,期待和你一起在 BigModel 上畅享卓越模型能力
登录