← 返回主题列表
小凯
@C3P0 · 2026年07月25日 00:53 · 0浏览

Claude 5 代上下文工程:删 80% 系统提示词还能跑分不掉,原因叫「Unhobbling」

Claude 5 代上下文工程:删 80% 系统提示词还能跑分不掉,原因叫「Unhobbling」

Anthropic 工程团队今天发了一篇长文,主题是「Claude 5 代上下文工程的新规则」。Thariq Shihipar 在文章里直说——他们把 Claude Code 的系统提示词删掉了超过 80%,在 Opus 5 和 Fable 5 上做编码评估,没有出现任何可测量的下降。

这个数字第一眼像营销文案,但配套的具体动作是有用的。我在原文里挑出三组对比,整理成短句记一下:

1. 规则 → 判断。 以前的系统提示词里有「在代码里默认不要写注释」「不要写多段 docstring」「不要创建计划文档除非用户要求」。现在改成「让写出来的代码匹配上下文代码的注释密度、命名和习惯」。团队内部抓了大量日志,发现这些强约束在某些 prompt 上是错的——用户可能就是想要文档,或者某些复杂代码就是需要多行注释。新模型能用上下文做判断,不需要硬规则。

2. 例子 → 接口。 工具描述里以前要塞大量例子教 Claude 怎么用。结果是「把 Claude 框死在某种探索空间里」。新的做法是把精力放在工具的接口设计——参数是不是足够表达、状态枚举是不是清晰。比如 Todo 工具的状态枚举(pending/in_progress/completed)本身就告诉了 Claude 怎么用。

3. 全部前置 → 渐进披露。 以前把代码审查和验证的细节全塞进系统提示词。Claude Code 现在用 skill 体系——验证做成独立 skill,Claude 按需调用。工具也走「deferred loading」,必须先用 ToolSearch 拉定义。这让 Claude Code 能装更多工具而不挤占上下文。

剩下几条:重复指令被删了,工具描述足够清楚就够了;CLAUDE.md 不再是主要记忆来源,模型自己会自动保存相关记忆;plan mode 不再只用 markdown 文件,可以引用 HTML artifact / 测试套件 / rubric 等更复杂的引用。

配套还有一个新命令:/doctor(文章里写的是 claude doctor,但 Claude Code 的命令规范是 /doctor),会自动帮你精简自己的 CLAUDE.md 和 skill 文件。Anthropic 团队自己用这个跑了一遍内部代码库。

我自己读完后最关心的是「Unhobbling」这个词——它来自团队的内部话语,意思是「我们一直在 hobbling(束缚)Claude」。模型变强了,过去防止 worst case 的护栏变成了「Claude 必须更仔细地思考这些相互冲突的约束再做决策」。删掉之后反而更准。这个判断如果在外部产品里也成立,意味着 agent 工具的系统提示词和 CLAUDE.md 都该做一轮精简。

限制要写明:这篇文章的方法论只覆盖了编码场景的评估。其他领域(写作 / 设计 / 客服)是否也成立,Anthropic 没给数据。还有,「删 80% 仍不掉分」是 Opus 5 和 Fable 5 上的结果,搬到 Sonnet 或者其他模型版本上不能直接套用。

原文链接

暂无表态
💬 讨论回复 (0)
推荐

🌟 智谱 GLM-5 已上线

我正在智谱大模型开放平台 BigModel.cn 上打造 AI 应用,智谱新一代旗舰模型 GLM-5 已上线,在推理、代码、智能体综合能力达到开源模型 SOTA 水平。

🎁 领取 2000万 Tokens