8 月 13 日 21:28,《科创板日报》发出消息:DeepSeek Harness 开发者预览版(v0.1)面向全球 Harness 开发者开放测试,源代码以 MIT 协议同步开源。GitHub 仓库地址是 github.com/deepseek-ai/deepseek-harness。
更戏剧性的是时间窗:宣布公测两小时前,DeepSeek 官方刚宣布 V4-Pro 正式版上线 + 价格大幅上涨。两件事叠加,社交媒体直接炸锅:半小时内 Harness 仓库星数破万,2 小时内突破 3 万。
三个关键数字值得记住
- 15 分钟 / 60 分钟 / 180 分钟:消息发布后 GitHub star 数从 0 跑到 1 万用了半小时,从 1 万爬到 3 万只用了一个半小时。
- 「一切皆插件」架构:模型、工具、技能、会话、沙箱、存储、循环、调度、UI 等所有 Agent 能力均由插件组合,可自由替换与灵活重组。
- MIT 协议 + 北大联合论文:底层 Cordis 元框架理念来自北京大学与 DeepSeek 联合署名的论文《A Programming Paradigm for Spatiotemporal Composability》,论文 PDF 也在仓库里同步公开。
这跟 Code Agent 不一样
大部分人第一眼看到「DeepSeek Harness」会把它当成又一个 Cursor 或 Codex 竞品——一个「能帮你写代码的工具」。但 DeepSeek Harness 团队负责人崔添翼的原话是:
这是一个预览版本,可能存在很多粗糙之处,希望大家多提意见。
他强调 DeepSeek Harness 定位更接近「可组装的 Agent 运行时底座」,与功能固定的 Coding Agent 有明显区别。Harness 的目标用户是 Harness 开发者,而不是只想下载客户端直接写代码的普通用户。
具体来说,Harness 把工具调用拆成了一条可扩展流水线:请求执行前会经过 Hook、审批、权限检查、沙箱和超时控制;执行后还可进行结果改写、记录和 UI 渲染。开发者无需修改工具或 Agent Loop,就能在各个环节插入插件。
四种模式是四套插件组合
基于同一套底座,DeepSeek Harness 当前提供四种运行模式:
- 标准模式:完整工具组合,面向常规 Agent 任务
- PTC 模式:程序化工具调用(Programmatic Tool Calling),允许模型生成代码,将多轮工具调用组合执行
- 极简模式:只保留 shell 和文件编辑两个工具,主要用于最小环境测试模型能力
- 创造模式:Agent 可以检查当前运行时,在内存中试验 Cordis 插件,并据此组合、创作新的运行模式
最后一种最值得关注——传统 Harness 的运行方式通常由产品开发者预先写定,用户只能在既有配置中选择;创造模式让 Agent 直接理解自己所处的运行时,再按任务需要试装插件。换句话说,Harness 的配置本身也开始成为 Agent 可以操作的对象。
多 Agent 架构已内置
DeepSeek Harness 已经内置完整的多 Agent 系统:父 Agent 可以通过 Spawn 启动拥有全新上下文的子 Agent,也可以通过 Fork 让子 Agent 继承已有会话。这套架构跟 Anthropic 8 月 13 日同一天发布的多智能体系统研究形成了有趣的对照——一边在工程上提供「可组装底座」,另一边在学术上警告「多智能体交互的失败模式尚未被理解」。
如果两类进展都按当前节奏推进,6-12 个月内我们就会看到「可组装 Harness」撞上「未被解决的多智能体失败模式」。谁先准备好分层防御,谁就能在下一轮 AI coding 工具换代里吃到最稳的红利。
护城河在哪
DeepSeek 这次最狠的一招是把 Harness 协议、底层论文、参考实现、配置示例一次性全部开源,MIT 协议意味着任何厂商都可以基于它造出 Coding Agent、多 Agent 协作平台、甚至传统 SaaS 产品的智能化改造引擎。
这跟 Nvidia Nemotron 系列的玩法完全不同——Nemotron 是「模型开源 + GPU 绑定」,DeepSeek Harness 是「底座开源 + 协议中立」。后者对开发者的吸引力更大,因为没有锁定任何硬件、任何云、任何模型。
对整个 AI coding 赛道来说,2026 年 8 月 13 日这个时间点可能比 5 月 Cursor 估值 300 亿时更值得关注:基础设施层的开源动作,往往比应用层的估值爆炸更早预告下一代格局。
讨论回复
加载中...正在加载回复...
推荐
智谱 GLM-5 已上线
我正在智谱大模型开放平台 BigModel.cn 上打造 AI 应用,智谱新一代旗舰模型 GLM-5 已上线,在推理、代码、智能体综合能力达到开源模型 SOTA 水平。