OpenAI 将 Codex Security CLI 开源,用于代码仓库扫描与 CI
该软件包为经批准的客户提供了对 OpenAI 在三月以与 GitHub 连接的研究预览形式推出的安全扫描器的脚本化访问。
By Ryan Merket · Published
Primary source: X
Why it matters
OpenAI is placing application-security review inside the local and CI workflows used by coding agents. That gives Codex a route into security budgets while challenging AppSec vendors on validation, remediation and developer distribution.

Thibault "Tibo" Sottiaux (@thsottiaux), OpenAI 的 Codex 负责人,于 7 月 28 日 发布了一个开源的命令行界面和 TypeScript SDK,用于在软件仓库中查找、验证和修补漏洞。
Sottiaux 在 X 的一篇帖子 中宣布了该发布,并将开发者指向新的 Codex Security 存储库。该包采用 Apache-2.0 许可证,可扫描完整仓库、选定路径或针对 Git diff 的更改。它还可以保留扫描历史、比较随时间变化的发现,并在持续集成管道中运行。
此次发布扩展了 Sottiaux 在 OpenAI 编码部门内部构建的产品职能。OpenAI Forum 的个人简介 表明,他此前负责 Gemini 的人类数据工作,并在 Google DeepMind 构建了机器学习工作流基础设施。他拥有 Universite catholique de Louvain 的计算机科学、计算数学和应用数学学位。
从连接的服务到流水线工具
OpenAI 在 3 月 6 日 推出了 Codex Security,此前在名为 Aardvark 的私人测试版中进行了内测。该研究预览直接连接到 GitHub 仓库,生成可编辑的威胁模型,检查仓库历史,尝试在隔离环境中重现疑似漏洞,并为人工审查提出补丁建议。
该 CLI 和 SDK 将该扫描器引入本地开发和自动化工作流。开发者可以通过 npm install @openai/codex-security 安装该包,通过 OpenAI 帐户或 API 密钥进行身份验证,并对仓库运行 npx codex-security scan。该包支持 macOS、Linux 和 Windows,要求 Node.js 22 或更高版本,并在扫描和导出发现时使用 Python 3.10 或更高版本。
该扫描器可以将架构文档和威胁模型作为外部知识摄入,仅审查指定文件夹,或检查相对于某个分支(例如 origin/main)的更改。结果可以导出为 JSON、CSV 或 SARIF,这是代码扫描系统使用的标准格式。CI 作业可以设置严重性阈值,当扫描发现达到或超过该级别的问题时返回失败退出代码。
Codex Security 还包括 validate 和 patch 命令。第一个让代理测试一个候选发现;第二个生成一个建议修复。OpenAI 的当前产品文档 表示补丁仍需人工审查,且该 CLI 和 SDK 对经批准的客户和合作伙伴仍为有限测试版。源代码是公开的,而对底层扫描器的访问仍受限。
OpenAI 警告称,生成的扫描工件可能包含源码摘录、重现实验步骤和漏洞细节。该存储库指示用户将这些文件存放在被扫描 Git 工作树之外,并远离公共问题跟踪器或共享目录。pre-commit 钩子也可以在扫描产生高严重性发现或未完成时阻止更改。
OpenAI 将 Codex 推向应用安全领域
Codex Security 将 OpenAI 更深入地推向了一个已有 Snyk、Semgrep、GitHub、Checkmarx、Veracode 等应用安全供应商服务的市场。例如,GitHub 的 Copilot Autofix 可以从 CodeQL 警报生成修复,而其 agentic 模式会探索仓库并重新运行 CodeQL 来验证提议的更改。Semgrep 将确定性静态分析与 AI 支持的分析和修复相结合。Snyk 也在整个开发工作流中增加面向代理的控制和自动修复。
OpenAI 的卖点集中在项目特定的推理上。Codex Security 构建了信任边界、敏感数据和攻击者入口点的模型,然后尝试在呈现发现之前验证攻击路径。传统扫描器经常依赖规则、签名或已知的数据流模式,尽管成熟厂商正越来越多地将这些系统与语言模型结合起来。
性能数据仍由 OpenAI 自行提供。在 3 月的研究预览发布时,OpenAI 表示 Codex Security 在前 30 天内对外部测试仓库扫描了超过 120 万 次提交,识别出 792 条严重(critical)和 10,561 条高严重性(high-severity)发现。OpenAI 还列出了 14 个分配的 CVE,这些 CVE 与向开源项目报告的漏洞相关联。上述总数描述的是在受控测试版期间生成的发现,而非与竞争扫描器的独立比较。
分发为 Sottiaux 的产品提供了显著机遇。OpenAI 在 6 月 2 日 表示 Codex 的每周活跃用户已超过 500 万。该新包允许经批准的客户在编码代理已经运行的同一终端、仓库和 CI 环境中插入安全检查,将漏洞审查变成另一个可编程的 Codex 任务。