はじめに
OpenAIが2026年3月6日、アプリケーションセキュリティエージェント「Codex Security」のリサーチプレビューを開始しました。本稿では、このツールの仕組みと性能、そしてOpenAIによるオープンソースコミュニティへの支援活動についてまとめます。
参考記事
- タイトル: Codex Security: now in research preview
- 著者: OpenAI
- 発行元: OpenAI
- 発行日: 2026年3月6日
- URL: https://openai.com/index/codex-security-now-in-research-preview/


要点
- Codex Securityは、プロジェクト固有の脅威モデルを生成し、コードリポジトリ内の複雑な脆弱性を自律的に検出・修正提案するAIセキュリティエージェントである
- ベータ期間中にノイズを最大84%削減、重大度の過大報告を90%以上低減、誤検知率を50%以上改善した
- 直近30日間で120万件超のコミットをスキャンし、重大脆弱性792件・高深刻度脆弱性10,561件を検出した
- ChatGPT Pro・Enterprise・Business・Eduユーザー向けに、1か月間の無償リサーチプレビューとして提供開始された
- OpenSSH、GnuTLS、GOGSなど広く使われるOSSへの脆弱性報告も実施し、14件のCVEが登録されている
詳細解説
Codex Securityとは
Codex Securityは、OpenAIのフロンティアモデルとCodexエージェントを活用したアプリケーションセキュリティエージェントです。もともと「Aardvark」という名称で昨年からプライベートベータとして運用されており、今回正式名称を改めてリサーチプレビューとして一般公開されました。
セキュリティ分野においてAIツールが普及する中で、課題とされてきたのが「ノイズの多さ」です。影響度の低い指摘や誤検知が大量に出力されることで、セキュリティチームのトリアージ(優先度付け)に多くの時間が割かれてしまうという問題がありました。Codex Securityはこの課題に正面から取り組み、システム固有の文脈を深く理解した上で脆弱性を評価することで、信頼度の高い指摘に絞り込む設計となっています。
3段階のスキャンプロセス
OpenAIによれば、Codex Securityは以下の3つのステップで動作します。
まず、リポジトリを解析して脅威モデルを自動生成します。脅威モデルとは、そのシステムが何を行い、何を信頼し、どこが最も攻撃にさらされやすいかを整理した文書です。チームが編集して内容を更新することも可能で、エージェントが組織の状況に合わせた判断を行えるよう設計されています。
次に、この脅威モデルを文脈として活用しながら脆弱性を探索し、実際のリスクに基づいて優先度を分類します。サンドボックス環境での検証も可能で、プロジェクト固有の環境が設定されていれば、実際の動作環境に近い形で脆弱性の有無を確認できます。実際の動作環境を模した検証ができることで、誤検知をさらに減らし、攻撃者が悪用できる証拠(Proof of Concept)の生成も可能になると考えられます。
最後に、発見された脆弱性に対してシステム全体の意図と周辺コードの動作を踏まえた修正案を提案します。これにより、セキュリティを改善しながら既存の機能への影響を最小限に抑えるパッチを提供できるとされています。
ベータ期間中の実績と精度改善
OpenAIによれば、ベータ期間中の同一リポジトリへの繰り返しスキャンでは、最初のロールアウト以来ノイズを最大84%削減できたケースがありました。また、重大度を過大に報告する指摘の割合を90%以上低減し、誤検知率もすべてのリポジトリで50%以上改善されました。
また直近30日間のスキャン実績として、外部ベータユーザーのリポジトリで120万件超のコミットをスキャンし、重大脆弱性792件と高深刻度脆弱性10,561件を特定したとされています。重大な問題はスキャン対象のコミット全体の0.1%未満に出現しており、大量のコードから本当に重要な問題だけを抽出できていることを示しています。
社内での初期利用でも、SSRF(Server-Side Request Forgery:サーバーを経由して内部ネットワークへの不正アクセスを試みる攻撃手法)や、テナント間の認証を突破するクリティカルな脆弱性が発見され、セキュリティチームが数時間以内にパッチを適用したとのことです。
オープンソースコミュニティへの貢献
OpenAIは、Codex Securityを使って自社が依存するオープンソースリポジトリのスキャンも実施し、発見した重要な脆弱性をメンテナーに報告する活動を進めています。
報告先にはOpenSSH、GnuTLS、GOGS、Thorium、libssh、PHP、Chromiumなどの著名プロジェクトが含まれており、これまでに14件のCVE(Common Vulnerabilities and Exposures:脆弱性の識別番号)が登録されています。GnuTLSに関してはヒープバッファのオーバーフローやダブルフリーなど複数の脆弱性が報告されており、GOGSでは二要素認証のバイパスや認証回避の問題が含まれています。
OSSメンテナーとの対話で共通して聞かれた課題は、「脆弱性報告が少ないのではなく、質の低い報告が多すぎること」だったとOpenAIは述べています。この声を受けて、大量の推測的な指摘ではなく、メンテナーがすぐに対応できる高信頼性の問題に絞って共有する方針を採っているとのことです。
また「Codex for OSS」プログラムとして、OSSメンテナーへのChatGPT ProおよびPlusアカウントの無償提供、コードレビュー支援、Codex Securityの提供も開始されており、vLLMなどのプロジェクトがすでに活用しています。今後数週間でプログラムの対象を拡大する予定とされています。
利用方法と対象ユーザー
Codex Securityは現在、Codex WebよりChatGPT Pro・Enterprise・Business・Eduユーザーを対象にリサーチプレビューとして提供されており、開始から1か月間は無料で利用できます。Enterprise・Business・Eduユーザーへの展開は今後数日以内に順次行われる予定とのことです。セキュリティ観点でのAI活用を検討しているチームにとって、試す機会として注目されます。
まとめ
OpenAIのCodex Securityは、脅威モデルの自動生成とサンドボックス検証を組み合わせることで、従来のセキュリティツールの課題だったノイズ問題を改善しようとする取り組みです。OSSへの貢献も含め、今後の精度向上と活用範囲の広がりが注目されます。
