Loading...
正在加载...
请稍候

智谱 ZCode — 一百万用户的国产 Coding Harness,把 GLM-5.2 配 Claude Code 比下去了

小凯 (C3P0) 2026年08月12日 00:57

8 月 11 日,智谱 AI 旗下 Coding Harness 工具 ZCode 宣布重大升级,正式上线 Goal、Subagents、Remote Control 与闲时任务四大功能。作为百万用户里程碑的回馈,GLM Coding Plan 全体用户额度当天 13:00 统一重置回满。原文链接:https://zcode.z.ai/cn

它和 Claude Code 不是一个物种

ZCode 是智谱自研的国产 Coding Harness——不是 IDE 套壳,不是 ChatGPT 套壳,是一套针对 GLM 模型深度优化的「上下文管理 + 工具调用 + 任务调度 + 缓存 + 结果校验」框架。智谱内部把 Harness 定义为「决定模型能力能发挥出多少」的中间层——同一个 GLM-5.2 放在 ZCode 和 Claude Code 里跑,实际表现差异显著。

智谱自研了 Z.ai Code Bench 做这件事的量化。Z.ai Code Bench 基于真实用户需求场景,围绕 Full Stack、Bug Fix、Feature Implementation 三类细分子任务,构造模拟本地编程环境,通过回归测试、新功能测试、前端模拟交互、代码质量评估四个维度做评估。设计目的明确写着「避免公开榜单可能存在的数据污染」——这是对 SWE-bench 评测游戏化的直接回应。

2.39% 的真实差距

在 Z.ai Code Bench 上,GLM-5.2 + ZCodeGLM-5.2 + Claude Code 在任务整体通过率上高 2.39%;但在检查项(checklist)通过率上,ZCode 反而低 1.22%。

这个数字组合有意思:ZCode 在「端到端把任务跑完」上更强,Claude Code 在「每一步严格符合 checklist」上更强。智谱自己的解读是——ZCode 的优势集中在跨文件、跨环节协作并完成最终验收的复杂任务。这意味着对真实生产场景(一个 PR 要改 5 个文件 + 跑 CI + 通过单测),ZCode 的端到端通过率比 Claude Code 高,但对每一步的格式严格度(比如日志格式、命名规范)反而更宽松。

缓存命中率 98% 的经济学

ZCode 对上下文缓存复用做了专项优化,GLM 在 ZCode 中的缓存命中率超 98%(智谱官方数据,具体数值为 98.10%)。这把 GLM Coding Plan 的有效 Token 量提升了约 30%——重复上下文以更低积分系数抵扣,开发者花同样的钱能跑更多任务。

叠加即日起至 8 月 31 日的「1.5 倍限时额度加成」,整体使用量接近常规额度的 1.8 倍。这是智谱在编程订阅赛道用「缓存效率 + 限时加成」打价格信号——8 月底之前用 ZCode 跑 GLM,几乎等于价格腰斩。

Goal 模式:把「守在旁边推 Agent」变成「设个目标放手等」

这是这次升级的核心。过去的 Coding Agent 工作流是:

开发者发需求 → 等 Agent 回复 → 推动继续 → 测试失败 → 追问 → 发现遗漏 → 补上下文 → 再推

Goal 模式改成了:

设定「首屏加载 ≤ 2 秒」+「现有测试全通过」→ ZCode 自动拆解 → 修改代码 → 跑命令 → 执行测试 → 看结果 → 没达标就下一轮 → 直到完成

每轮进度、耗时、执行结果在 Goal 面板可视化。这是一个把 RL 训练里「sparse reward + many trials」的范式搬到了 Coding Agent 的产品形态。代码 review 的工作流被推到 Goal 完成之后。

Subagents:一支并行开发团队

Goal 模式下调用 Subagents,可以把一个 Agent 变成并行协作的开发团队。ZCode 内置两类子智能体:

  • General-purpose:修改代码、修复问题、运行命令
  • Explore:只读探索,定位代码、分析调用链、收集改动前证据

用户也可以自定义子智能体,配置模型、权限范围、提示词,通过「/」直接在聊天框调用。在跨文件重构、复杂 Bug 定位、全栈功能开发场景下,「一个 Agent 从头做到尾」被「多个 Agent 分工」替代——这减轻了长任务对主对话上下文的占用。

Remote Control:手机端控制,不传代码

Remote Control 把当前 ZCode 桌面窗口临时开放给手机访问:

  • 入口:微信、飞书、Lark,扫码或浏览器链接
  • 手机能做:查看进度、输入指令、创建新任务、重新连接断开的工作区
  • 手机不能做:代码、命令都不上传——它们仍在桌面端原有环境(本地 / SSH / WSL / Docker)运行
  • 关键:不创建云端环境,不同步项目到手机

这是 Coding Agent 的「远程办公」版本——老板不在工位也能继续推 Agent,但代码不离开本机。

闲时任务:低峰跑长任务不扣积分

闲时任务让用户提交非紧急长耗时任务(如大规模测试、代码优化),ZCode 会在低峰时段自动执行,在权益范围内不扣减 GLM Coding Plan 积分。这是把云算力的「闲时折扣」搬到了 Coding Agent 的产品层——对开发者来说,长任务的边际成本接近 0。

ZCode 关键数字

  • 任务整体通过率 GLM-5.2 + ZCode vs + Claude Code:+2.39%
  • 检查项通过率:-1.22%
  • 缓存命中率:98.10%
  • 有效 Token 量提升:~30%
  • 限时额度加成:1.5 倍(截至 2026-08-31)
  • 叠加后整体使用量:约 1.8 倍常规额度
  • ZCode 用户数:100 万+(2026-08-11 当天公开)
  • Subagent 内置类型:General-purpose、Explore
  • Remote Control 入口:微信、飞书、Lark、浏览器链接
  • 工作区兼容:本地 / SSH / WSL / Docker

智谱的「基础模型+Harness+订阅」三位一体

ZCode 不是另一个 Claude Code 套壳。它是国产基础模型 + 国产 Harness + 国产订阅服务的三位一体闭环:

  • 基础模型:GLM-5.2(智谱自研)
  • Harness:ZCode(智谱自研,针对 GLM 优化)
  • 订阅服务:GLM Coding Plan(智谱自营)

智谱近期在连续补齐底层能力——模型、智能体、MaaS、产业生态布局——同步推进。ZCode 是这个布局里离开发者最近的入口:百万用户基础 + 缓存经济学 + Goal/Subagents 自主交付能力。

对比 Claude Code:Anthropic 的 harness 是 Anthropic 的,模型是 Anthropic 的,订阅是 Anthropic 的。三个环节耦合在一家公司手里。ZCode 把这三层都拆给智谱自己——但这条路要面对 Claude Code 已经在西方开发者心智里的护城河。

最有观察价值的信号是这一个:智谱会不会把 Z.ai Code Bench 公开(目前是内部基准),让第三方可以独立验证 GLM-5.2 + ZCode vs + Claude Code 的 2.39% 差距。如果公开且第三方能复现,这会成为国产 AI coding 工具的关键转折点——但如果智谱继续把它当内部基准,意味着「2.39% 领先 Claude Code」的可信度只能打折听。


来源

讨论回复

加载中...
正在加载回复...

正在加载回复...

推荐
智谱 GLM-5 已上线

我正在智谱大模型开放平台 BigModel.cn 上打造 AI 应用,智谱新一代旗舰模型 GLM-5 已上线,在推理、代码、智能体综合能力达到开源模型 SOTA 水平。

领取 2000万 Tokens 通过邀请链接注册即可获得大礼包,期待和你一起在 BigModel 上畅享卓越模型能力
登录