AI 编程工具让写代码越来越快,但安全问题却被大面积忽视。
身边很多朋友用 Vibe Coding 半天就能上线一个产品,但权限没收紧、数据库没做验证、API 密钥直接硬编码——这些坑,AI 生成的代码里比比皆是。
最近 OpenAI 悄悄把自家的安全插件 Codex Security 开源了。而且不是那种只能绑在 Codex 上用的半封闭工具,是正儿八经的 npm 包,CLI 命令行、TypeScript SDK、CI/CD 集成全给,Claude Code 和 Cursor 也能装。
这可能是今年以来对 AI 编程生态影响最大的一个开源发布。
Codex Security 是什么?
简单说,它是一个 AI 驱动的代码安全扫描工具。但它跟传统的 SAST(静态应用安全测试)工具不一样。
传统工具如 Semgrep、CodeQL,本质上是”规则匹配”——跑一遍已知漏洞模式,匹配到了就报。问题在于误报太多,一次扫描甩过来几百条告警,大半是假阳性,修都不知道从哪修起。
Codex Security 的思路是”上下文语义分析”。它依托 GPT 模型理解代码逻辑,走三步闭环:
发现(Find):读你的代码仓库,构建项目级威胁模型,找到潜在的漏洞路径。
验证(Validate):在隔离沙箱里尝试复现问题,确认漏洞是否真的可达——这一步把大量误报直接干掉了。
修复(Patch):对验证过的真实漏洞,生成带上下文理解的补丁建议。
每次扫描完会生成四份产物:scan-manifest.json(扫描元数据)、findings.json(漏洞记录)、coverage.json(覆盖范围)、report.md(人话版报告)。
这个工具的前身叫 Aardvark,是 OpenAI 2025 年 10 月内部发布的 AI 安全研究员,今年 3 月改名为 Codex Security 并整合进 Codex 插件。上个月底 OpenAI 以 Apache 2.0 协议完全开源,GitHub 上已经拿了 1500+ star。
怎么装、怎么用
安装很简单,Node.js 22+ 和 Python 3.10+ 就行:
npm install -g @openai/codex-security
认证有三种方式:用 OpenAI API Key、ChatGPT 登录态、或者 OpenRouter 等第三方 API。日常用最方便的是设环境变量:
export OPENAI_API_KEY=sk-你的key
然后在项目根目录跑:
codex-security scan .
等它扫完,打开 report.md 就能看到一份人话版的漏洞清单。每个漏洞都标注了严重程度、攻击路径和修复建议。
它还提供两个扫描模式:
Standard 模式:日常检查用,速度快,够用。
Deep 模式:大版本上线前用,多个 worker 并行深挖,但也更耗 Token。扫完一轮后再修,修完用 scans compare 对比前后结果,新增、复发、已解决的问题一目了然。
如果你只想扫本次改动而不是整个仓库,加个 diff 范围就行:
codex-security scan . --diff origin/main...HEAD
这个省 Token 省到点上。
不止 OpenAI 一家在卷安全
有意思的是,在 AI 代码安全这条线上发力的不止 OpenAI。
Claude Code 内置了 Security Guidance 插件,写完代码、结束任务和提交 commit 时都会做安全检查。国内阿里的编程工具 Qoder 也有 Qoder Security 插件。
几家头部 AI 公司不约而同地在做同一件事,说明一个问题:AI 生成代码的安全风险,已经大到必须专门做工具来应对了。
OpenAI 官方透露的数据:过度报告严重程度下降超 90%,误报率下降超 50%。Codex Security 还帮多个知名开源项目找到了高危漏洞(包括 OpenSSH、GnuTLS 等),已经分配了多个 CVE 编号。
老达点评
Codex Security 开源这件事的意义,不在于它本身有多强,而在于它传递了一个明确的信号:AI 编程的安全检查,正在从”可选步骤”变成”标配动作”。
就像写完代码要跑测试一样,以后 AI 写出来的代码,跑一遍安全扫描会成为标准流程。Codex Security 开源的 Apache 2.0 协议意味着任何团队都能把它嵌进自己的 CI 管线,不管是配 Codex 还是 Claude Code 还是 Cursor。
如果你手上正好有个 Vibe Coding 出来的产品挂在公网上,花半小时装一下跑一遍。虽然它替代不了专业安全审查,但在出事之前揪出一两个真漏洞,这轮扫描就值了。
相关阅读: