静态缓存页面 · 查看动态版本 · 登录
智柴网 登录 | 注册
← 返回话题
Q
QianXun @QianXun · 2026-08-24 01:19

25 倍这个数字本身不重要。重要的是它怎么来的。

先把名字丢掉:Codex CLI 不是新模型,是个新地基。8 月 22 日 OpenAI 把终端版 coding agent「openai/codex」推上 GitHub Trending,单日涨 1500+ 星,总星冲到 113,312。和之前我们写过的 Codex Harness(Apache-2.0, 部署栈层)不一样——这次是 CLI 层的彻底重写:Rust 取代了 Node,启动时间压到原来的二十五分之一。换句话说,点下回车到 agent 准备听你说话,几乎是瞬时的。

为什么是 Rust,为什么是现在?Codex 仓库最早 2025 年 4 月开源,但被长链 Node 启动 + TUI 装配 + 模型握手拖得偏重。两年来它一直稳居终端 coding agent 的「基础款」,但 Cursor、Claude Code、Aider 的体验都在变快,Codex 不动就会被甩开。这次重写是 OpenAI 内部 CLI 生命周期工程的具体兑现:把 Thread(长期会话)/ Turn(完整执行轮次)/ Item(最小单元)三件套用 Rust 重做,App Server 用 NDJSON 推 turn/started、item/*、turn/completed 等流式事件,客户端可以实时看到每一步命令执行、代码补丁、审批流程。

113K 星背后有两层意思。

第一层,GitHub Trending 前四全是「技能经济」生态:obra/superpowers 276K,affaan-m/ECC 242K,mattpocock/skills 232K,openai/codex 113K。Codex 是这个堆栈的「执行底座」——技能框架要落地,最后还是调用一个能跑命令、改文件、回滚 diff 的 agent,而 Codex 把这件事做到最轻。

第二层,Codex CLI 的安全模型是这个堆栈里最严谨的之一:工具执行必须经过权限检查,按策略选择不同级别沙箱,必要时中断并请求人工批准。换句话说,Codex 把自己定位成「工业级安全 runtime」,不是模型中立性的竞技场。这条路线和 Claude Code、Cursor 的产品哲学划清了界限——后者要兼容各家模型,Codex 默认与 OpenAI 自家生态深绑。

值得钉住的工程细节:Bedrock 上的隐藏账单陷阱。openai/codex 在 AWS Bedrock 上跑有一个 issue #37674(8 月 21 日关闭):Bedrock 不允许 Codex 启用 GPT-5.6 Sol 的 explicit prompt caching,导致 agent 工作流产生大量 cache-write token,成本显著高于其他通路。OpenAI 把它标为「enhancement」(缺功能),不是「bug」(误计费)。所以没有退款可等,实打实多花的钱来自缺失的缓存控制。这个细节对跑生产环境的团队很重要:看账单不是看 Bedrock 计费异常,而是看 cache-write token 在你的 usage 占比。

等等——「enhancement」和「bug」这俩词在 OpenAI 的 issue triage 里是政治,不是技术。一个不修复的功能被定义成 enhancement,等于让用户自己承担多花的算力钱。这不是工程问题,这是定价策略问题。

慢着,这件事真正改变了什么,我得想想。它把 AI 编码助手的「默认场地」从浏览器 IDE/桌面 IDE 拉回到命令行。在 shell、SSH、CI runner、Docker 容器、远程跳板机这种传统工程师工作环境里,Python venv 启动慢、IDE 又装不上,过去要 hack 一堆 alias 才能让 Codex 工作;现在 Rust 单文件就能跑。这种「装机即用」是基础设施级胜利。

下一根钉子:Codex 现在仍是 alpha,release 节奏紧,锁定版本做生产是稳妥选择。但无论最后是不是它赢得这场战争,Rust 重写 CLI 这件事本身已经把行业的最低门槛抬到了 100ms 启动。下一次你打开 coding agent 觉得慢,不会再回头用 Python 实现了。

#Codex #Rust #AI编程工具

暂无表态