Anthropicは2026年9月28日、最新AIモデル「Claude Sonnet 5.5」を発表しました。
Claude 5.5ファミリーとしては、先日登場したClaude Opus 5.5に続く2つ目のモデルです。
Sonnet 5.5では、従来のClaude Sonnet 5と比較して出力速度が30%以上高速化。APIのトークン単価を据え置きながら、タスクを完了するために必要なトークン数やツール呼び出し回数を削減することで、Anthropicのテストでは1タスクあたりのコストを最大30%削減したとしています。
Claude Sonnet 5.5とは
Claude Sonnet 5.5は、Anthropicの最新世代「Claude 5.5」シリーズに属する中核モデルです。
Anthropicは最上位のClaude Opus 5.5を、複雑で長時間にわたる判断が必要な作業向けと位置付ける一方、Sonnet 5.5については、
- 日常的なタスク
- バグ修正
- ソフトウェア開発
- ドキュメント作成
- スライド・スプレッドシート作成
- デザイン・UI制作
など、比較的明確に定義された作業を高速に処理するモデルとして位置付けています。
また、Claude Sonnet 5.5は最大100万トークンのコンテキストと、最大12万8,000トークンの出力に対応します。
大量のソースコードや複数のドキュメントをまとめて扱う用途にも適しており、Google Cloudでも同様のコンテキスト・出力仕様が案内されています。
Sonnet 5から30%以上高速化
Sonnet 5.5で特に大きく改善されたのが処理速度です。
Anthropicによると、Sonnet 5.5はSonnet 5よりも30%以上高速に出力を生成し、歴代Sonnetモデルの中でも最速としています。
単純に生成速度を向上させただけではなく、同じタスクを完了するために必要なトークン数やツール呼び出し回数についても効率化されています。
その結果、APIのトークン単価自体はSonnet 5から変わっていないものの、Anthropicのテストでは実際のタスクを処理するコストが最大30%低下しています。
AIエージェントやコーディング用途では複数回のツール呼び出しが発生するため、単純なトークン単価だけでなく、タスク完了までに必要な処理量を削減した点もSonnet 5.5の大きな特徴です。
コーディング性能が大幅に向上
Sonnet 5.5では、特にエージェント型コーディング性能が大きく強化されています。
Anthropicが公開した主なベンチマーク結果は以下の通りです。
| ベンチマーク | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 |
| Humanity’s Last Exam(with tools) | 64.5% | 54.9% | 67.7% |
| OSWorld 2.1(partial) | 80.1% | 57.0% | 81.8% |
※ベンチマークによってEffort設定や評価条件は異なります。Terminal-Bench 4.0のOpus 5.5はXhigh Effortでの最高スコアです。
Terminal-Bench 4.0ではSonnet 5.5が70.6%を記録し、Opus 5.5の66.4%を上回りました。
Terminal-Benchは、ターミナル上でツールを操作しながら複数の工程をこなすエージェント型タスクを評価するベンチマークで、Sonnet 5.5のコーディングエージェントとしての性能向上が表れています。
一方、実際のCursorセッションから抽出された、曖昧さを含む複数ファイルのタスクを評価するCursorBench 4.0では、Sonnet 5.5が55.5%、Opus 5.5が57.8%となっています。
最上位モデルとの差は約2ポイントまで縮まっており、日常的なコーディング用途ではSonnet 5.5がOpus 5.5にかなり近い性能を発揮していることが分かります。
ただしAnthropic自身も、ベンチマーク結果だけではモデルの能力全体を評価できないと説明しています。
特に曖昧な問題や長時間の推論、継続的な判断が必要になる複雑なタスクでは、依然としてOpus 5.5の方が高い能力を発揮するとしています。
API料金はSonnet 5から据え置き
Claude Sonnet 5.5のAPI価格は以下の通りです。
| 項目 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| 入力100万トークン | $2 | $4 |
| 出力100万トークン | $10 | $20 |
| Cache Write | $2.50 | $5 |
| Cache Read | $0.20 | $0.20 |
Sonnet 5.5の入力・出力価格は、Sonnet 5から据え置かれています。
また、Opus 5.5と比較すると、通常の入力・出力トークン料金は半額です。
単価そのものを引き下げるのではなく、モデル自体の効率を改善し、タスクに必要なトークン数やツール呼び出し回数を削減することで実質的なコストを抑えた点が、今回のアップデートの特徴です。
性能とコストのバランスを重視するAPIユーザーや、AIコーディングエージェントを大量に動かす開発者にとっては、特に恩恵が大きそうです。
CursorやGitHub Copilotでも利用可能
Claude Sonnet 5.5はAnthropicのClaudeやClaude Code、Claude APIだけでなく、すでに主要なクラウドサービスや開発プラットフォームでも提供が始まっています。
Anthropicによると、Sonnet 5.5は以下のクラウドプラットフォームで利用できます。
- Amazon Web Services
- Google Cloud
- Microsoft Azure
AWSではAmazon Bedrockなどを通じて利用可能です。
また、Cursorでも「claude-sonnet-5-5」として提供されており、最大100万トークンのコンテキストやThinkingに対応しています。
GitHub CopilotでもSonnet 5.5の展開が開始されており、Copilot Pro、Pro+、Max、Business、Enterpriseユーザーが対象となっています。
Visual Studio Codeをはじめ、GitHub Copilotが対応する各種開発環境から利用できます。
Sonnet 5.5は発表時点から主要なAIコーディング環境へ広く展開されており、開発用途におけるAnthropicの主力モデルとして普及していくことになりそうです。
初の「高度なサイバー対策」を搭載したSonnetに
性能向上に伴い、安全対策も強化されています。
Sonnet 5.5のサイバーセキュリティ能力はSonnet 5から大幅に向上しており、Anthropicによると、同社が高性能モデル向けに開発してきた高度なサイバーセキュリティ対策やフォールバック機構を導入した初のSonnetモデルとなります。
これらの安全対策は、高リスクと判断された一部のリクエストを対象としています。
通常のソフトウェア開発やバグ修正などへの影響は基本的になく、高リスクと判断された一部のサイバーセキュリティ関連リクエストでは、Sonnet 5へフォールバックする場合があります。
なお、APIでは拒否カテゴリーやserver-side fallbackの設定によって挙動が異なります。
モデルのサイバーセキュリティ能力が向上する一方で、それに合わせて安全対策についても強化された形です。
Sonnet価格でOpus 5.5に迫る性能
Sonet 5.5は、30%以上の高速化に加え、タスクを完了するために必要なトークン数やツール呼び出し回数を削減し、コーディングやナレッジワークでは一部のベンチマークで最上位のOpus 5.5に迫る性能を実現しています。
特にTerminal-Bench 4.0ではOpus 5.5を上回っており、比較的明確なコーディングタスクでは非常に高い性能を発揮します。
一方で、複雑で曖昧なタスクや長時間にわたって判断を続ける必要がある作業では、引き続きOpus 5.5が上位モデルとして位置付けられています。
そのためClaude 5.5世代では、Opus 5.5は複雑で難易度の高いタスク向け、Sonnet 5.5は速度・性能・コストのバランスを重視した日常利用向け
という役割分担がより明確になったと言えそうです。
Sonnet 5と同じAPI価格を維持しながら性能と速度の両方を大きく改善したSonnet 5.5は、Claude 5.5世代における実質的な主力モデルとなりそうです。
情報元
Anthropic「Introducing Claude Sonnet 5.5」