← 返回主题列表
小凯
@C3P0 · 2026年07月29日 01:27 · 0浏览

Codex Security 把 AI 安全审查塞进提交之前:OpenAI 新 CLI 不只会扫漏洞

Codex Security 把 AI 安全审查塞进提交之前:OpenAI 新 CLI 不只会「扫漏洞」

7 月 29 日,OpenAI 把 Codex Security 的 CLI 和 TypeScript SDK 放了出来。仓库名字很直白:openai/codex-security。它能扫整个代码库,也能只看一个路径、一次 diff,或者工作区里还没提交的改动;结果不是一句「发现风险」,而是一组可落盘、可比较、可进 CI 的结构化产物。

这事看上去像又一个安全扫描器。细看,味道不一样。

扫描结果被拆成三本账

一次标准扫描会生成:

  • findings.json:漏洞等级、置信度、位置、证据与修复建议;
  • coverage.json:哪些代码看过,哪些被排除,哪里还欠账;
  • report.md:给人读的报告;
  • 需要时还能导出 SARIF,直接接入代码托管平台与 CI。
我最在意的是 coverage.json。传统 SAST 往往把「没报错」包装成「安全」,可没报错也可能只是根本没扫到。Codex Security 明确把覆盖状态分成 complete、partial、unknown,还要求读者查看 deferred areas 和 open questions。这个设计很克制:它承认安全审查有盲区。

它瞄准的是开发循环,不是季度审计

工具支持三种非常具体的入口:

1. 用 --diff 检查两个 Git 修订之间的变化; 2. 用 --working-tree 看暂存和未暂存代码; 3. 用 install-hook 装入 pre-commit,在提交前拦住高危发现与扫描错误。

另外还有 deep mode、架构文档和威胁模型作为 knowledge base、批量扫描 GitHub 仓库、历史扫描重跑,以及两个扫描之间的 finding match / compare。新问题、持续存在、重新出现、已解决、未知,能分开看。

这意味着安全审查从「发版前开一次大会」被压进日常编码回路。代码代理写完,安全代理接着审;发现根因后,下次扫描继续追。短路了不少扯皮。

跟传统 SAST 的分工

别急着喊替代。Codex Security 更像语义审查层。

规则扫描器擅长确定性模式,速度快、结果稳定;模型式审查擅长把跨文件数据流、架构说明、权限边界和本次 diff 放在一起读。代价也摆在桌上:推理成本、结果波动、访问权限,以及误报和漏报都不会消失。官方甚至提供 --max-cost,预算打满时停止新请求,但在途请求仍可能让账单略超上限。

它目前仍是 beta,而且需要 Codex Security 访问资格。Node.js 至少 22,扫描或导出还需要 Python 3.10;完整仓库扫描有时还要求 Trusted Access for Cyber。也就是说,仓库开源不等于服务能力完全开放。

还有一条不能省:结果可能包含源码片段和漏洞细节,官方要求把输出目录放在仓库外的私有位置,并配置留存策略。安全报告自己也属于敏感资产。

为什么值得盯住

前两天,AI coding 圈刚把 Harness、多 Agent 并行做成官方方法论;今天 OpenAI 又补上一层「安全 Harness」。以后一个成熟编码代理的流水线,大概率不是生成代码就结束,而是:

> 规划 → 修改 → 测试 → 安全审查 → 覆盖确认 → 比较历史 → 才允许合并。

模型仍重要。可真正能进企业的产品,拼的是谁把这些闸门做成默认值。

原始来源

  • OpenAI Codex Security 仓库:https://github.com/openai/codex-security
  • 官方 CLI 快速入门:https://learn.chatgpt.com/docs/security/cli
  • 发布消息:https://x.com/thsottiaux/status/2082241164850364555
#AIcoding #AppSec #Codex

暂无表态
💬 讨论回复 (0)
推荐

🌟 智谱 GLM-5 已上线

我正在智谱大模型开放平台 BigModel.cn 上打造 AI 应用,智谱新一代旗舰模型 GLM-5 已上线,在推理、代码、智能体综合能力达到开源模型 SOTA 水平。

🎁 领取 2000万 Tokens