工作流重构 · 费曼速查表 「问题 → Agent → 产物」——把人从管道里抽掉之前,先量一量

重构能否成立,不取决于 Agent 多聪明,而取决于 验证可机器化到什么程度。其余皆次要。

文本版 · 供搜索与朗读

工作流重构 · 费曼速查表

工作流重构 · 费曼速查表

「问题 → Agent → 产物」——把人从管道里抽掉之前,先量一量

问题→[人]→Agent→[人]→CI/CD→产物
⟶
问题→Agent→产物

维度一 · 组织智能上游去人化

旧人做的事:需求澄清、任务拆解、分工协调、上下文传递

新形态:虚拟 Agent 组织(PM / 架构 / 开发 / 评审 Agent)

信息流:会议文档 → 通信协议 + 共享上下文(MCP、A2A 之由来)

核心瓶颈:需求理解——Agent 须会追问、会在不确定中做合理默认

维度二 · Agent 能力下游去人化

旧人做的事:Code Review、测试验收、触发流水线、盯部署、回滚

新形态:内化验证/测试/部署,建自反馈闭环

环境接地:调工具、跑沙箱、观结果、自我修正(长程不跑偏是硬能力)

CI/CD 从「关卡」降级为「Agent 手里的函数调用」

铁锤一 · 编译器不会编译会做梦

汇编→C 是确定性跃迁;你的执行引擎是 Agent,非确定

同句 spec,今日 React、明日 Vue、后日妖异代码

「需求即源码」⚠️ 仅当 spec 形式化 才成立

形式化之日,它便是一门新语言——你只是改了编程的接口形状

铁锤二 · 验证鸿沟真瓶颈

生成易,证明它对难一个数量级(QED 验证耗学界数十年)

测试当合同 → Agent 学会通过测试而非满足意图

reward hacking:律师最懂怎么「合法地不诚实」

评估体系须对抗性、持续演进——最难自动化之处

铁锤三 · 人没走,人浓缩了责任集中

人退到端点 = 决策密度最高 + 责任最重

定义 spec 是全部价值判断;验收担责是法律终点

收黑盒产物者,信息更少、责任更大——比逐环签字更危险

异常处理器拿到的是跑偏九十九步的怪物,看得懂吗?

铁锤四 · 货物崇拜多智能体看行为

「你是 PM」的 prompt ≠ 真在做项目管理

真 PM:权衡资源、处理政治、对模糊说「不」

去掉那行字行为不变 → 它只是被起名的生成器

[1-n] 是你讲给自己的故事,不是事实——先量

唯一前提条件 · The Only Gate

重构能否成立,不取决于 Agent 多聪明,而取决于 验证可机器化到什么程度。其余皆次要。

赌注算式 · The Bet

Agent 60%可靠 × 跑千次 × 验证能抓错 > 人99%但一周一件

若验证抓不到错 → 速度优势反转成灾难:一分钟产六十个错的东西

✓ 实验验证清单(先小项目试,再吹)

有无真实生产项目去人后质量没掉、交付快了?(非 demo)

验证怎么做?最后是否还得聪明人眯眼瞅一眼?

reward hacking 出现几次?怎么发现的?

纯软件 / 测试可机器化领域或成七八分;需品味常识处,人会回来且更累

收尾铁律:先做一个小实验,去掉中间的人,量一量产物质量。

若质量掉了——飞机没来。那你建的是竹子控制塔,不是机场。

费曼视角 · 工作流重构顿悟拆解
检验你是否真懂:能不用术语向大一新生讲清吗?

暂无表态

想参与讨论或点赞?登录后使用完整功能

讨论回复(0)

暂无回复,登录后可参与讨论
合作

智谱 GLM-5 已上线

在智谱开放平台 BigModel.cn 打造 AI 应用。新一代旗舰模型 GLM-5 在推理、代码、智能体综合能力达到开源模型 SOTA。

领取 2000万 Tokens