[ニュース解説]AnthropicがMozillaと連携——Claude Opus 4.6がFirefoxの高深刻度脆弱性を2週間で14件発見

目次

はじめに

 AnthropicはMozillaと連携し、Claude Opus 4.6を活用してFirefoxのセキュリティ脆弱性の発見に取り組んだ成果を、2026年3月6日に公開しました。本稿では、この取り組みの内容と成果、AI活用による脆弱性研究の現状と課題について解説します。

参考記事

要点

  • AnthropicはMozillaと共同でClaude Opus 4.6を活用し、2週間でFirefoxの脆弱性22件を発見した
  • そのうち14件が高深刻度と評価され、2025年に修正されたFirefoxの高深刻度脆弱性全体の約5分の1に相当する
  • 合計約6,000件のC++ファイルをスキャンし、112件のレポートを提出、多くがFirefox 148.0で修正された
  • Claudeは脆弱性の発見は得意だが、それを悪用するエクスプロイト開発の成功率は低い
  • 「タスク検証器」と呼ばれる自己確認ツールの活用が、AI活用セキュリティ研究の精度向上に有効である

詳細解説

取り組みの背景と経緯

 Anthropicは2025年後半、Claude Opus 4.5がCyberGymというセキュリティベンチマークのほぼすべてのタスクを解けるほどの能力を持つことに気づきました。CyberGymは既知の脆弱性をLLMが再現できるかを評価する指標で、Claudeの能力が実用的なセキュリティ研究に近づいていることを示すものでした。

 そこでAnthropicは、より難易度の高いテスト対象としてFirefoxを選択しました。Firefoxは数億人のユーザーが日常的に利用する複雑なコードベースを持ち、世界でも特にテストが充実したオープンソースプロジェクトの一つです。ブラウザは信頼できないウェブコンテンツを日常的に処理するため、脆弱性が悪用された場合の影響が大きく、AIの脆弱性発見能力を測る厳しい試験台として適していると判断されました。

発見の詳細と成果

 Anthropicはまず、過去のFirefoxの既知脆弱性(CVE)をOpus 4.6が再現できるかを検証しました。その後、現在のFirefoxに存在する未知の脆弱性を探索する本格的な調査に移行しました。

 探索開始からわずか20分で、Opus 4.6はJavaScriptエンジンに「Use After Free」と呼ばれるメモリ脆弱性を発見しました。Use After Freeは、解放済みのメモリ領域への不正なアクセスを通じて攻撃者が任意のコードを実行できる可能性がある、危険度の高い脆弱性の一種です。Anthropicの研究者が独立した仮想環境で検証し、確認後にMozillaのバグトラッカーBugzillaへ報告しました。

 Anthropicが発見した22件の脆弱性のうち、Mozillaは14件を高深刻度と評価しました。Anthropicの発表によれば、これは2025年に修正されたFirefoxの高深刻度脆弱性全体の約5分の1に相当します。また、約6,000件のC++ファイルをスキャンした結果、最終的に112件の固有レポートが提出され、その多くがFirefox 148.0で修正されました。

脆弱性発見とエクスプロイト開発の非対称性

 Anthropicはこの研究と並行して、Claudeが発見した脆弱性を実際に悪用するエクスプロイト(攻撃コード)を作成できるかを評価しました。脆弱性の発見能力だけでなく、攻撃者が行うような実際の悪用が可能かどうかを把握することが目的です。

 結果として、Anthropicの発表では数百回の試行に対して約4,000ドルのAPI費用をかけたにもかかわらず、実際にエクスプロイトに成功したのは2件のみでした。この結果が示すように、Claudeは脆弱性の発見は得意ですが、それを武器化するプロセスは格段に難しいと言えます。また、脆弱性の発見コストはエクスプロイト作成コストの10分の1以下にとどまるとされており、発見と悪用の間には大きな非対称性があります。

 なお、成功した2件のエクスプロイトは、サンドボックスなど一部のセキュリティ機能を意図的に除いたテスト環境でのみ機能するものでした。実際のFirefoxには多層的な防御機能(「多層防御」)が備わっており、今回の攻撃手法に対しては有効に機能するとされています。

タスク検証器の活用と推奨プロセス

 今回の研究で得られた知見として、Anthropicは「タスク検証器」(Task Verifier)と呼ばれるツールの重要性を強調しています。タスク検証器とは、AIエージェントが出力した結果が目標を達成しているかを確認する仕組みです。リアルタイムのフィードバックを通じてエージェントが自らの作業を繰り返し改善できるため、脆弱性の発見精度と修正パッチの品質向上に有効と考えられます。

 脆弱性を修正するパッチを自動生成する「パッチエージェント」においても、タスク検証器は二つの要件を確認する必要があります。一つは元の脆弱性が修正されているかどうか、もう一つは既存の機能が壊れていないかどうかです。Anthropicはこれらを自動テストするツールを構築し、品質向上に活用しました。

 また、Mozillaとの協力を通じて、脆弱性レポート提出時に有効な要素も明らかになりました。具体的には、最小限の再現テストケース、詳細な概念実証、候補パッチの3点が信頼性を高める上で重要とされています。

今後の展望と課題

 Anthropicは今後もこの取り組みを拡大し、LinuxカーネルなどほかのOSSプロジェクトの脆弱性発見・報告も継続する方針を示しています。また、Claude Code Securityという脆弱性発見・修正支援機能を限定的な研究プレビューとして提供開始したことも発表されました。

 一方で、現在は脆弱性の発見能力がエクスプロイト開発能力を大きく上回っているものの、この差が今後も続くとは限らないとAnthropicは指摘しています。フロンティアモデルがこの差を埋めた場合には、追加的な安全策が必要になると見られており、開発者には今のうちにソフトウェアのセキュリティ強化に取り組むことが呼びかけられています。

まとめ

 Claude Opus 4.6はMozillaとの連携により、2週間でFirefoxの高深刻度脆弱性14件を含む22件を発見しました。AIが防御側に優位な今の時期に、開発者がセキュリティ対策を強化することの重要性を改めて感じさせる事例と思います。今後の能力向上とともに、AIセキュリティ研究の在り方が問われ続けることになりそうです。

この記事が気に入ったら
フォローしてね!

  • URLをコピーしました!
  • URLをコピーしました!
目次