[ニュース解説]Claude Sonnet 5が登場——Opus 4.8に迫る性能をSonnet価格で、エージェント性能が前世代から大幅向上

目次

はじめに

 AnthropicがClaude Sonnet 5を2026年6月30日に発表しました。Sonnetクラスの価格帯を維持しながら、Opus 4.8に近い性能を実現したとされるモデルで、エージェント系タスクにおいて前世代のSonnet 4.6から大幅に強化されています。本稿では発表内容をもとに、Sonnet 5の性能・安全性・価格について解説します。

参考記事

関連記事

あわせて読みたい
[ニュース解説]Claude Opus 4.8が登場——誠実さが4倍向上、fast modeは3倍の価格効率に はじめに  Anthropicが2026年5月28日、主力モデルの新バージョン「Claude Opus 4.8」をリリースしました。前バージョンの Opus 4.7 から性能・安全性・コスト効率の3面...
あわせて読みたい
[開発者向け]Claude Sonnet 4.6登場——Opus級の性能をSonnet価格で、コンピュータ操作も大幅強化 はじめに  Anthropicが2026年2月17日、最新モデル「Claude Sonnet 4.6」を発表しました。コーディング、コンピュータ操作、長文脈推論、エージェント計画など全領域に...
あわせて読みたい
[開発者向け]Claude Opus 4.7が登場——高度なコーディングスキルと高解像度ビジョンで何が変わるか はじめに  AnthropicのClaude Opus 4.7が2026年4月16日に一般公開されました。前モデルであるOpus 4.6からの直接アップグレードとなる本モデルは、高度なソフトウェア...

要点

  • Claude Sonnet 5はエージェント性能に特化した設計で、推論・ツール使用・コーディング・ナレッジワークの各評価でSonnet 4.6を上回り、Opus 4.8に近い結果を示している
  • BrowseCompおよびOSWorld-Verifiedにおけるコストパフォーマンス曲線で、Sonnet 5はSonnet 4.6を全域で上回り、高effort時にはOpus 4.8と同等の水準に達する場合がある
  • 安全性評価では幻覚・おべっか(sycophancy)の発生率がSonnet 4.6より低下し、プロンプトインジェクション攻撃への耐性も向上している
  • サイバー悪用リスクへの対応として、デフォルトでサイバーセーフガードが有効化されている
  • 導入期間(〜2026年8月31日)の価格は入力 $2/MTok・出力 $10/MTok で、8月31日以降は $3/MTok・$15/MTok に移行する

詳細解説

Sonnetクラスの新たな位置づけ

 AnthropicによればSonnet 5は「これまでで最もエージェント的なSonnetモデル」と位置づけられています。同社によると、Sonnetクラスのモデルはエージェント時代の実用的な入口として機能してきたモデル群であり、Claude Sonnet 3.5・3.6・3.7はコーディングとツール使用で高い実力を示してきました。一方で直近の明確な進化はOpusクラスに集中しており、Sonnet 5はその差を大きく縮めた位置にあるとされています。

 2026年5月に発表されたClaude Opus 4.8はfast modeによる高いコストパフォーマンスが特徴でしたが、Sonnet 5はさらに低価格帯でOpus 4.8に近い性能を提供する設計となっています。Anthropicは「ユーザーはSonnet 5とOpus 4.8の間でeffortレベルを調整しながら、コストと性能の最適なバランスを選べる」と説明しています。

エージェント性能の具体的な改善

 Anthropicのパートナー評価では、Sonnet 5は「前世代のSonnetモデルが途中で止まってしまう複雑なタスクを最後まで完遂する」「明示的に指示しなくても自ら出力を確認する」といった点が一致して報告されたとされています。これはエージェント的な判断力と自律性の向上を示すものと考えられます。

 性能評価の面では、BrowseComp(エージェントを用いたウェブ検索評価)とOSWorld-Verified(コンピュータ操作評価)の2つのベンチマークでコストパフォーマンス曲線が公開されています。

 Anthropicによれば、Sonnet 5(オレンジ線)はSonnet 4.6(グレー線)を全effortレベルで上回り、中程度のeffortで大幅なコスト効率の改善を示しています。また高effortの場合にはOpus 4.8(イエロー線)と同等の水準に達するタスクがあるとされています。なお、コストパフォーマンス曲線のチャートは発表後に方法論の修正が行われ、Sonnet 5の性能が当初より高く更新されています。

安全性評価と設計上の配慮

 Anthropicは事前の安全性評価について詳しく報告しています。Sonnet 5はSonnet 4.6と比較して、幻覚(hallucination)の発生率・おべっか(sycophancy)の発生率がいずれも低下したとされています。また、エージェント利用における安全性として、悪意あるリクエストの拒否率の向上と、プロンプトインジェクション攻撃への耐性向上が確認されています。

 一方でサイバー攻撃関連の能力については、意図的な訓練は行われていないとAnthropicは説明しています。Firefoxの脆弱性エクスプロイト開発能力を測定した評価(Mozillaとの共同開発、Firefox 148でパッチ済み)では、Sonnet 5は完全な動作エクスプロイトを開発できず成功率は0.0%でした。ただし部分的な成功率はSonnet 4.6よりわずかに高く、これは特定のサイバー訓練によるものではなく、汎用的な知能向上の副産物と説明されています。このため、Sonnet 5にはデフォルトでサイバーセーフガードが有効化されており、これはClaude Opus 4.7・4.8と同等の仕組みとされています。

 自動行動監査(automated behavioral audit)の結果では、Sonnet 5はSonnet 4.6より全体的に低い誤動作率を示しています。ただし、Opus 4.8やClaude Mythos Previewと比較するとやや高い結果となっており、性能グレードに応じた安全性の差が存在することも明示されています。

価格・提供形態・トークナイザの変更

 Anthropicによれば、Sonnet 5は2026年6月30日時点でFree・Pro・Max・Team・Enterprise全プランで利用可能で、Free・Proプランのデフォルトモデルに設定されています。Claude CodeおよびClaude Platform(API)でも利用可能で、APIモデル文字列は claude-sonnet-5 です。

 価格は導入期間(〜2026年8月31日)の入力 $2/MTok・出力 $10/MTok から、9月以降は入力 $3/MTok・出力 $15/MTok に移行します。また注意点として、Sonnet 5ではトークナイザが更新されており、同じ入力でもSonnet 4.6より1.0〜1.35倍程度多くのトークンが消費される場合があるとAnthropicは説明しています。導入期の価格設定はこのトークン増加を考慮してコスト中立的になるよう調整されているとのことです。

 なお、Sonnet 5はAnthropicのCyber Verification Programの対象となっており、すでに登録済みの組織は再申請不要で同等のアクセス権が引き継がれます。

まとめ

 Claude Sonnet 5はSonnetクラスの価格帯を維持しながら、エージェント性能においてOpus 4.8との差を大幅に縮めた点が特徴的です。安全性の向上も明示されており、エージェント活用を検討している開発者・企業にとって選択肢が広がった発表だと思います。前バージョンのSonnet 4.6との詳細な比較は過去記事でも整理していますので、あわせてご覧いただければと思います。

この記事が気に入ったら
フォローしてね!

  • URLをコピーしました!
  • URLをコピーしました!
目次