OpenAI 上周把 Codex Security 的命令行工具和 TypeScript SDK 放上了 npm,任何人都能 npm install 装一个。

翻完文档会发现,开源的只是壳。真正扫描代码的模型还跑在云端,得登录 OpenAI 账号或掏一把 API Key 才能用。

这不算一次"安全能力免费开放"。更像是把 Codex 塞进企业安全工作流的一步棋:壳子给你,核留在自己手里。云厂商开源客户端、攥住后端引擎,这套打法过去十几年见得不少。

开源了什么,谁能用

Codex Security 支持 macOS、Linux、Windows,跑起来要 Node.js 22 以上。真正执行扫描和导出结果,还得装 Python 3.10+(用 3.10 得额外装 tomli 包)。

扫描前必须登录 OpenAI 账号,或设置 API Key。官方原话写得很直白:只能扫描自己拥有、或明确获得授权的代码库。

功能覆盖得挺全:

  • 差异扫描,只查改动部分
  • Git Hook,提交前拦截
  • CI 阈值,按严重级别卡流水线
  • 批量扫描,一次跑一批 GitHub 仓库
  • 结果对比,前后两次扫描做差异
  • 验证和补丁建议
  • 导出 SARIF、CSV、JSON
开源在哪,依赖在哪 开源部分 CLI + TS SDK 扫描流程编排 CI / Hook / 批量脚本 SARIF / CSV / JSON 导出 Docker 沙箱镜像 云端依赖 Codex 模型在云端运行 需登录或 API Key 按调用产生费用 仅限自有/授权仓库 次版本仍可能改接口 壳子开源,脑子留在云端

云端依赖:限制在哪

设计上有一点值得肯定。Codex Security 默认只出报告,不拦人。CI 里想真正卡流水线,得自己设 --fail-on-severity。扫描没跑完或出错,退出码照样非零,不会悄悄放行。

扫描怎么接入工作流 登录鉴权 扫描 全量/差异 验证/补丁 CI 阈值 卡点拦截 导出 SARIF

真正的坑在别处。扫描产物本身是敏感资产,里面带着源码片段、漏洞细节、复现步骤。官方提醒别丢进代码仓库,别公开发 issue。要单独存在一个仅当前用户可读的私有目录,macOS/Linux 上要求 chmod 700。落错地方,这些报告就是现成的攻击指南。

扫描默认用高推理强度的模型跑,一次全仓库扫描能耗上几十分钟。背后是实打实的 API 账单。这不是免费工具,也谈不上离线方案。

开源解决的是分发问题,不是信任问题。

谁该关注,接下来看什么

OpenAI 没有公布这套工具和 Semgrep、CodeQL 这类传统 SAST 工具相比,检出率和误报率谁高谁低。几个关键问题,官方文档目前都没讲清楚:

问题目前情况
许可证细节项目页未详细列出开源协议的具体条款
计费方式按 API 调用计费,具体价格文档未单列
数据留存代码是否上传、留存多久,未详述
私有化/离线目前只见云端 Codex 接入,没有本地或私有化选项
对比传统 SAST没有和 CodeQL、Semgrep 的独立检出率、误报率对比数据

项目也还没到 1.0。官方自己写明白,次版本更新时公共接口可能就变。拿去当生产线的固定基座,得留后手。

对 DevSecOps 团队和要把 AI 审计接进 CI 的开发负责人,现实选择是先小范围试跑,别急着当主检测手段。扫描报告按敏感资产管理,API 成本提前估算,等接口稳定到 1.0 再谈规模化替换现有 SAST 工具。个人开发者和小团队想快速试试 AI 代码审计,门槛不高,但账单会跟着调用量涨,别当免费工具用。

工欲善其事,必先利其器。Codex Security 这把"器"确实好用,CI 集成、批量扫描、结果比对都做得像样。但器认的是谁家账号——这次说得很清楚,用之前先把云端账单和代码托管的账算清楚。