2026 年 7 月 18 日,Peter Steinberger 在 X 上只抛了一句话:「我们还在讨论循环,还是已经转向图了?」据说两天内揽下 260 万浏览。六周前他那句「别再亲手提示编程 Agent 了,去设计能提示 Agent 的循环」,据称更是 840 万。两条加起来,1100 万次目光,把 AI 编程最热的话题推到了下一个节点。
可当你把这条「叙事快线」扒开来看,会发现它既惊艳,又经不起细抠。本文不站队,只做一件事:把 Prompt → Loop → Graph 这三迁讲清楚,再把三桩对不上的账,一笔一笔摊在桌上。
1. 一条推文,按下快进键
想象一下:你队伍里最聪明的工程师,不再自己写代码,而是写一段 Bash,让 AI 自己一遍遍跑,跑到做对为止。这不是科幻——这是 2025 年夏天就有的招,叫 Ralph。
while :; do cat PROMPT.md | claude-code ; done
一行循环,背后藏着一条硬约束:2025 年中,上下文窗口(context window)上限大约 20 万 token。长会话跑着跑着,失败代码、废话、旧决策堆在一起,模型就开始「变笨」——行内叫 context rot(上下文腐化)。Ralph 的解法是:每次迭代都重启一个全新进程(fresh-context),把进度和计划压进文件系统,靠「健忘」换「清醒」。
这条路子,后来被 Boris Cherny(Claude Code 的创造者)一句话点破:「我现在已经不再提示 Claude 了。我运行的是一些循环,由这些循环去提示 Claude。」Addy Osmani 随后写下《Loop Engineering》,给了定义:循环工程,就是让自己退出亲自提示 Agent 的位置,转而设计一个替你完成这件事的系统。
2. 从「写提示词」到「写循环」:第一迁
Loop Engineering 真火起来,是 2026 年四五月——各大 harness 把手工循环产品化成了「目标」。
- Codex CLI 0.128.0(2026-04-30)率先推出
/goal:一个持久目标,附带完成条件(什么状态应该成立、怎么检查成功、哪些约束必须始终保留)和预算(token budget)。普通提示词说的是「接下来做这件事」;Goal 说的是「继续工作,直到这个结果成立」。 - Claude Code 2.1.139(2026-05-11)、Hermes 0.14(2026-05-16)、Cursor
/loop(2026-05-20)紧随其后。
一句话总结这次迁移:开发者越来越不需要琢磨怎么跟单个 Agent 对话,而是开始设计 Agent 反复运行、自己判断「做完了没」的循环。
3. 下一站:Graph——但 Graph 到底是什么
Steinberger 那条推文的问题,其实指向一条更远的路:当单个循环扛不住,你就得把多个循环连成图——每个 Agent 跑自己的循环,彼此用依赖关系接起来。
讨论串里最精彩的一句是 Luis Catacora 说的:「循环有很大的容错空间。图会迫使你承认,工作流里还有多少部分根本没被真正建模。」说白了:Loop 是延期决策(先让一个 Agent 包揽,扛不住再重构);Graph 是提前决策(你得一上来就声明谁负责什么、什么依赖什么、分支失败怎么办)。
Shubham Saboo 与 Preston Holmes 把这套拆成两张图,这是全文最该记住的模型:
- Org Graph(组织图):稳定、预先部署。一群长期存在的 Agent,各自守一块领域,保留上下文、专业能力和工具权限——像公司的组织架构,也像篮球场上的「区域联防」。
- Work Graph(工作图):动态、每任务生成、做完即弃。它随新证据拆分、合并、重排、消失——像一份实时生成又实时作废的项目计划。
两张图跑在不同时间尺度上:组织图你设计好就部署;工作图为每件事临时长出,完事就丢。
4. 三桩悬案:刷屏数字、会场、与「多 Agent 协作」的误读
热闹归热闹,有三笔账,原文没算清,吾辈须替它算。
悬案一:那两个天价浏览量,源头只有一篇二手稿。 2.6M 与 8.4M 这两个数字,追到底都出自 36Kr/InfoQ 同一篇编译稿(原作者 Tina),并非 X 平台一手数据。其余二手源给的数字互相打架:explainx.ai 记 6.5M、腾讯云记 24 小时 220 万、另一处记 800 万+。引用时,请务必标「据 InfoQ 编译稿」,别当已证实数据使。
悬案二:Boris Cherny 的「Anthropic 开发者大会」存疑。 那段「我的工作是写循环」的引文,经 Osmani 原博一字不差证实;但「Anthropic 开发者大会」这个会场,二手源分别记作 Acquired Unplugged、Meta Scale、Sequoia AI Ascent——没有一处确认是 Anthropic 官方大会。大概率是转述时安错了地方。
悬案三:Codex 的 Goals,不是「多 Agent 编排」。 官方文档写得很清楚:Goals 是单 worker 的续作循环,测试由 worker 自己跑,预算到了就停。它协调的是「自己跟自己」,不是「多个 Agent 互相协调」。原文说「Codex 团队借鉴 Ralph 构建基础设施、协调多个 Agent」,与官方定义有出入——别被「图」这个词带偏。
5. 生产现场:早就是多 Agent 了,只是没叫 Graph
把目光从推文移开,真实世界里多 Agent 系统早就跑了:
- Anthropic 多 Agent 研究系统:Orchestrator-Worker,子 Agent 独立上下文、压缩后回传,多 Agent 比单 Agent 强 90.2%。
- Replit Agent:从单循环迭代到 manager/editor/verifier 多角色,靠「最小作用域隔离」压错误率。
- Factory Droids:专职 Droid(Code/Knowledge/Reliability)+「Missions」编排,把 Agent 当基础设施即代码(IaC)管。
- Cognition Devin:planner/shell/editor/browser/verifier 长程循环,SWE-bench 现约 50%+。
至于 Steinberger 推文里 Rafael Mendiola 那桩「React 转 React Native,用 Skill + 每 30 分钟 Cron 替代 50–100 张工单」的案例——人、公司、成果可考(两人初创 8 天 85 个 PR),但「Skill + 30 分钟定时」这个机制,Mendiola 本人的 LinkedIn 只写了「Web 管理面板 + 并行 Claude Code 会话」,没出现原文那套说法。更像演绎,缺原帖佐证。
关键判断:Org/Work 双图不是某个生产系统的 documented 架构,而是一个有用的心智模型。 它的底层模式(稳定角色 + 动态任务路由)确实映射在上述系统里,但「两张图同时跑」这话本身,带着 Twitter 式炒作——flowtivity.ai 就指出过,曾冒出伪造的「斯坦福 310 万美元资助」研究。
6. 冷静剂:Graph 不是银弹,也不是新发明
把框架摆上桌一比就明白:
- LangGraph 最接近 Org Graph(静态拓扑、checkpoint 持久化);
- AutoGen 的动态协调最接近 Work Graph;
- Anthropic 的 orchestrator-worker 最接近双图真实系统。
说白了,Graph Engineering 80% 是换名 + 重构,20% 是真增益——真增益只有两条:① 把心智模型从「编程单个 Agent 的行为」上移到「编程多 Agent 的组织」;② 把 Org(部署期稳定)与 Work(任务期易逝)的双时间尺度显式分了家。
至于「任务执行中图自行重写自身结构」这种最性感的说法——目前没有任何真实系统撑得起,LangGraph 拓扑编译期就固定了,AutoGen 也只是动态选下一个发言者。口号归口号。
反方也凶:图本就包含循环,Loop 是图的一个节点(单节点自环),所以「Loop vs Graph 是假问题」;小任务上图是净债务,LangGraph 被吐槽「鸡肋,像 Spring 之于 Java」;底层无非是用了十几年的 Airflow / DAG / 状态机。具名质疑者(DavidKPiano、PawelHuryn 等)直指这是「cron 戴了顶新帽子」。
7. 你该用 Loop 还是 Graph?(决策清单)
别被叙事带着走,照这张表选:
- 用 Loop:任务重复、验证能自动化(测试/lint)、token 预算吃得消、目标明确、单人小团队。
- 上 Graph:单循环不够——要并行多源、要「产的人」和「验的人」分开、跨小时多 Agent、强可控(金融/医疗/合规)。上之前先画图、精简状态。
- 都不用:流程 100% 可穷举 → 直接上 Airflow / n8n / Dify,不必请 LLM;一次性任务 → 一条好 prompt 更快更便宜(有统计说约 60% 团队用 LangGraph 属技术错配)。
- 改用动态协作(AutoGen 类):角色 ≥5、流程无法穷举、需频繁迭代。
若真上 Graph,记住七道坎:死锁/循环依赖、状态膨胀 OOM、可观测性崩坏、协调开销致成本爆炸、分支维护地狱、同模型多 Agent「有组织胡说」互相背书、高并发共享会话 ID 致用户数据串线。
8. 结语
范式迁移是真的,但别把它读成断裂式的革命。Loop 没死,它只是降格成 Graph 里的一个零件。Graph 也不是凭空冒出的新技术,它是对既有多 Agent 编排的再命名 + 视角升维。
所以,下次再看到「Loop 时代终结」这种标题,不妨笑笑:时代没终结,只是换了个更贵的词。真正该问的,从来不是「我用 Loop 还是 Graph」,而是「我这摊事,值不值得为了一个名词,把架构图重画一遍」。
#Wired #智柴赛博前线🎙️🚀🔌 #LoopEngineering #GraphEngineering #AI编程 #多Agent编排
讨论回复
加载中...正在加载回复...
推荐
智谱 GLM-5 已上线
我正在智谱大模型开放平台 BigModel.cn 上打造 AI 应用,智谱新一代旗舰模型 GLM-5 已上线,在推理、代码、智能体综合能力达到开源模型 SOTA 水平。