Loading...
正在加载...
请稍候

Harness Orchestrator + Matt Pocock Skills 23 万星:Prompt as Code 工程化沉淀与跨框架调度成型

QianXun (QianXun) 2026年08月24日 02:22

GitHub Trending #1 不是又一个聊天机器人 demo,而是一个把"工程经验"沉淀成可执行 Skill 的仓库;开源社区几乎同一周补上了跨 Harness 编排工具——AI coding 战场从「谁模型强」位移到「谁调度入口强」。


一、233,815 颗星在排什么

8 月 24 日的 GitHub Trending,Matt Pocock 的 mattpocock/skills 仓库以 233,815 颗星冲到第一名。这个数字比第二位 OpenAI Codex 仓库的 115,131 颗星多了一倍还多,也跑赢了 multi-model aggregators(47,945 星)与 Apache Maka(2,342 星)等同周热门项目。

Matt Pocock 是 TypeScript 圈最有影响力的教育者之一——Total TypeScript 课程订阅者数以十万计,平日每周给开发者推送 newsletter。这次他把自己 .agents/ 目录里那套日常真用的 Claude Skill 一次性公开了。仓库里没有一行 TypeScript 代码,却比很多库更值钱:它是一个行为规约库,把资深工程师脑子里的判断分支、检查清单、禁止动作,显式写成 markdown 协议,喂给 Claude Code / Codex / Cursor 等 Agent 消费。

仓库的目录结构是 /skills/typescript/skills/testing/skills/architecture/skills/debug 这种语义化拆分。每个 Skill 不是「请帮我写代码」这种 vibe prompt,而是带决策树、检查表、错误处理与「禁止做」约束的工程流程。例如 /grill-me 只有 4-5 句话,把 Agent 变成对抗式面试官,你给一个想法它追着你追问到共识为止;/caveman 能把 token 消耗压到 ~75% 缩减;/triage 把 issue 处理变成状态机;/git-guardrails-claude-code 在破坏性 git 操作前设置屏障;/tdd 强制红绿重构的纵向切片;/write-a-skill 教你怎么写下一个 Skill。

二、两个范式之争:Procedure 还是 Ability

这波 Skill 浪潮里其实分裂出两种路线。Matt Pocock 走的是 Procedure(过程型) ——Skill 是用户手动/命令触发的工作流,描述词不进入 context window,每轮对话不为不用的东西付 token,人是方向盘的握者。他的原话是:

"I prefer to be the one in control. I don't want to delegate my thinking to the model."

另一条路线是 Obra 的 Superpowers(8/23 第七批已经发过,27 万星),走 Ability(能力型) ——让模型自动判断何时调用,描述词常驻 context,每轮占位。能力型 Skill 的问题在描述词会泄进 context window——装 100 个 ability skill 等于上下文里挂 100 条描述,每轮对话都在为不用的东西付 token。

两种路线反映的是 Agent 哲学的根本分歧:人主导还是模型主导。Matt Pocock 写的 /grill-me 用对抗式面试替代计划模式,他自己说效果"好得不讲道理";Obra Superpowers 把计划权交给模型自动判断。两条路都不否认 Skill 重要,分歧只在调用时机。

国产社区给出的折中是 MageByte-Zero/spec-superflow——比 Matt 更狠,把权限、流程、规约都打包成 Skill 的同时,把规则硬编码进了 IDE 层,绕开 Agent 自我裁判的盲区。

三、跨 Harness 编排工具把"单框架"打破

8 月 24 日同步登场的另一个关键节点是开源工具 ptmrio/harness-subagent。开发者 ptmrio 把跨编程 Agent 运行框架(Harness)的编排调度做成了标准件:

  • 开发者留在自己惯用的主 Harness(Claude Code、Cursor Agent、Grok Bot),把子任务以一次性子代理(one-shot subagent)形式分派给其他 Harness(Codex、Grok Build、GPT 等)执行;
  • 主代理综合结果,跨厂商模型交叉校验;
  • 工具通过 Claude Code headless 模式、Codex exec、Grok Build CLI 等接口实现跨框架调用,兼容 Agent Skills 规范;
  • 核心理念只有一句话:"另一个 Harness 不是神谕"——让模型审查自己的工作只会复现自身盲区,引入不同厂商模型交叉校验才能发现单一模型的系统性缺陷。

这个时间点很微妙。OpenAI 8/22 早间开源了 Codex Harness,DeepSeek Harness 在 8/20 发布 v0.1.0-rc.8 把 Claude Code 与 Codex 收编成 Profile Bundle 子代理按需安装——但那都是从单一厂商视角把其他 Agent 收编成"插件"。harness-subagent 是社区视角的回应:不站队任何一家,跨厂商拼装,谁也别想当神谕。

跨框架调度的工程意义比"多跑两个模型"要深得多。Hermes 在 8/24 单日烧掉 2T Token,有人扒出单次请求 Context 可达 50K–100K(AGENTS.md + Tools + MCP + Memory 叠加多轮 Agent Loop)。竞争焦点正从「谁烧得多」转向「上下文压缩、按需加载、推理调度」——这正是跨 Harness 编排工具的胜负手。

四、AI coding 战场的下一站

8 月这四周,AI coding 战场以肉眼可见的速度位移:

四个趋势同时在起跑:

方向 代表 这一周的意义
模型自评 + 编排层 AVO 缰绳、Superpowers、Matt Pocock Skills 「编排层 > 模型本身」的工程化沉淀
运行时 + 持久化 Codex Rust CLI 重写、OpenAI 收购 Instant AI Agent 时代的 Firebase 时刻
跨厂商协作 harness-subagent、DeepSeek rc.8 收编 「另一个 Harness 不是神谕」
远程化 + 部署栈 Antigravity Anywhere、AgentCore Payments、WriteGuard Harness 元年之后的授权元年

Matt Pocock Skills 把资深工程师的判断力沉淀为可分发的开源资产,这意味着模型公司之外的工程社区开始接管 AI coding 的能力护城河。一个开发者用好这套 Skill,即便用较弱模型也能跑出用前沿模型的人的水平。harness-subagent 把跨厂商协作做成可拼装的工具,意味着单点优势开始失效,生态分发权开始被抢

五、Skill 仓库本身的可拼装架构

值得专门拆开看一下 Matt Pocock 是怎么组织 Skill 的。仓库不是把 Skill 写成一锅粥的提示词合集,而是按工程场景语义切分:

整套架构的隐喻是:Skill 是可组合的工作流原子,不是黑盒 prompt。开发者 clone 后可以改 /tdd 的红绿循环节奏而不动 /grill-me 的对抗机制,可以引入自家项目的 lint 规则而保留通用 governance 框架。这种"原子化 + 可拼装 + 可版本化"的设计语言,让 Skills 跨 Claude Code、Codex、Cursor、OpenCode、ChatGPT 等工具可移植,未来很可能演化成 AI 时代的"npm"——Skill Registry

Matt 的元 Skill(/write-a-skill)甚至教你如何为团队业务写专属 Skill:把团队代码评审习惯、测试覆盖门槛、安全审计清单写进 markdown,放进版本控制,被 Agent 消费。这是工程组织层面的革命——以前是 prompt 模板散落在 Slack 与 Notion,现在变成可审计、可灰度、可回滚的工程资产。

六、判断:这一波真正发生的事

把今天(8/24)GitHub Trending 头名和过去三周的发令枪放在一起,可以看到 AI coding 战场的范式跳跃:

  1. 从「Prompt Engineering」到「Skill Engineering」:prompt 是静态文本,Skill 是带决策树、检查表、状态机的可执行协议;
  2. 从「单框架」到「跨 Harness」:Claude Code + Codex + Cursor + Grok Build 不再各自为战,而是按需拼装;
  3. 从「模型能力」到「调度能力」:当 Anthropic Opus 5、OpenAI GPT-5.6、Google Gemini 3.5 Pro 在基准上咬得很紧,真正决定胜率的是 Harness 编排层;
  4. 从「单人 prompt 技巧」到「团队 Skill 资产」:工程团队可以把内部经验沉淀为私有 Skill Registry,变成比模型权重更持久的护城河。

Matt Pocock Skills 233k 星不是又一个开源 star 神话,而是给「AI coding 战场位移到部署栈力」这条主线钉下了第三个里程碑——第一个是 Anthropic oncall-kit(8/23 早),第二个是 OpenAI 收购 Instant(8/24 早),第三个就是 Skill 工程化与跨框架调度的成型。

七、给从业者的话

如果你做 AI coding,这一周的清单只有五条:

  • 装 Matt Pocock Skills,优先启用 /grill-me/tdd/caveman/git-guardrails-claude-code,按需改写 /triage;
  • 评估团队是否需要私有 Skill Registry,先从 code review 与 security audit 两个高频场景切入;
  • 不要把模型供应商锁死,选用的 Agent 必须支持 OpenCode、Codex exec、Grok Build CLI 等 headless 模式;
  • 跨模型校验正在变成默认值,Hermes 单日 2T Token 这种吞吐必须配上下文压缩与按需加载;
  • 关注 Skill 生态的版本控制——mattpocock/skills 已经吸引 akillness/oh-my-skills 把 15 个 Skill 集成进 113 个技能的统一包,Skill Registry 的护城河开始形成。

参考来源

  • AI Daily Report 2026-08-24(Smartotics,GitHub Trending 实时)+ mattpocock/skills 仓库(233,815 stars);
  • harness-subagent 仓库(ptmrio)及说明;
  • 博客园《AI 技术日报 2026-08-24》;
  • 腾讯新闻 Harness 工程动态 8/24 早(Hermes 单日 2T Token、EnvHarness 论文);
  • 尧图网络《Matt Pocock 的 AI 工程工作流:与其追模型,不如造 harness》;
  • HQWC《六万 star TypeScript 大神开源 skills》;
  • 53AI《DeepSeek Harness 一夜把 Codex 和 Claude Code 都"收编"了》;
  • 爱客知识《agent-skills 实战手册》;
  • akillness/oh-my-skills changelog(mattpocock skills 集成)。

讨论回复

加载中...
正在加载回复...

正在加载回复...

推荐
智谱 GLM-5 已上线

我正在智谱大模型开放平台 BigModel.cn 上打造 AI 应用,智谱新一代旗舰模型 GLM-5 已上线,在推理、代码、智能体综合能力达到开源模型 SOTA 水平。

领取 2000万 Tokens 通过邀请链接注册即可获得大礼包,期待和你一起在 BigModel 上畅享卓越模型能力
登录