
Anthropic、Claude Sonnet 5.5を正式発表#
2026年9月28日、AnthropicはClaude 5.5ファミリーの第2弾モデル「Claude Sonnet 5.5」を正式にリリースした。前世代のClaude Sonnet 5と比較して、速度・コスト・性能のすべての面で改善が図られた注目のアップデートだ。
Claude 5.5ファミリーにおけるSonnet 5.5の位置づけ#
Claude 5.5ファミリーは、用途に応じた複数のモデルで構成される。現時点でリリース済みのモデルは以下の2つだ。
- Claude Opus 5.5:複雑な判断を要する高度なタスク向けの上位モデル
- Claude Sonnet 5.5:日常的なタスク、バグ修正、ドキュメント・スライド・スプレッドシートの作成など、明確にスコープされた作業に強みを持つモデル
さらに、大量処理やコスト重視の用途向けに設計されたClaude Haiku 5.5が、数週間以内にファミリーに加わる予定とされている。
主要な改善ポイント#
⚡ 速度:前世代比30%以上高速化#
Sonnet 5.5は、Sonnet 5と比較して出力速度が30%以上向上しており、現時点でSonnetシリーズ史上最速のモデルとなっている。この速度向上により、複雑度の低いタスクでの高速な反復作業にも適していると説明されている。
💰 コスト:価格据え置きでタスクあたりコストを最大30%削減#
料金体系はSonnet 5と同一で、入力トークン100万件あたり2ドル、出力トークン100万件あたり10ドル、キャッシュリード100万トークンあたり0.20ドルに設定されている。しかし、同一のタスクをこなす際に必要なトークン数が大幅に少なくなるため、実質的なタスクあたりコストは最大30%削減されるという。
🧠 性能:一部ベンチマークでOpus 5.5に匹敵#
Sonnet 5.5は複数のベンチマークでSonnet 5を大幅に上回る結果を示している。主な評価結果は以下の通りだ。
| ベンチマーク | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0(エージェント型コーディング) | 70.6% | 10.3% | 66.4% |
| GDPval-AA v2.1(ナレッジワーク) | 1844 | 1449 | 1846 |
| OSWorld 2.1(コンピューター使用) | 80.1% | 57.0% | 81.8% |
| Humanity’s Last Exam(多分野推論) | 64.5% | 54.9% | 67.7% |
| Chartography(ビジュアルチャート認識) | 61.6% | 15.6% | 64.4% |
特に注目すべきは、Terminal-Bench 4.0でのスコアだ。Sonnet 5の10.3%に対し、Sonnet 5.5は70.6%を記録しており、前世代から劇的な改善が見られる。また、Sonnet 5.5はスクリーンショットのみを使用してポケモン赤をクリアした初のSonnetモデルとされており、長期的なタスク処理能力と画像理解能力の高さが示されている。
🤝 コラボレーション性能の向上#
Opus 5.5と同様に、Sonnet 5.5は前世代モデルよりも明確な文章を生成するとされており、早期テスターからはSonnet 5よりも「より良い協働パートナー」として評価されているという。
🔐 アライメントと安全性#
自動化された行動監査において、Sonnet 5.5はアライメント(AIの目標や価値観の整合性)の大部分の指標でSonnet 5と同等以上の結果を示している。また、サイバーセキュリティ能力がOpus 5と同等レベルに達したことから、Sonnet系列として初めてサイバーセーフガードが適用されるモデルとなった。生物学的なセーフガードはSonnet 5と同一の水準が維持されている。これらのセーフガードはハイリスクなリクエストの狭い範囲を対象としており、通常のソフトウェア開発やライフサイエンス分野の業務には影響しないと説明されている。
注目ポイント:コストパフォーマンスの圧倒的な改善#
Anthropicの評価によれば、Sonnet 5.5をLow〜Medium effortで動作させた場合、Sonnet 5の最高スコアをタスクあたりコストの約10分の1で上回るベンチマークが複数存在する。また、FrontierCode v1.1のメインセットでは、High effortでGPT-6 Solの最高スコアに匹敵する性能を、タスクあたりコストの約5分の1で達成したとしている(詳細な比較条件については元記事のシステムカードを参照)。
まとめ#
Claude Sonnet 5.5は、速度・コスト・性能のバランスを大幅に改善した実用寄りのモデルだ。価格はSonnet 5と据え置きながらも、処理効率の向上によって実質的なコスト削減を実現し、日常的な業務タスクからエージェント型コーディングまで幅広くカバーする。
筆者の見解: Terminal-Bench 4.0での10.3%→70.6%という劇的なスコア改善は、単なるインクリメンタルなアップデートを超えた質的変化を示唆している。Sonnetシリーズが従来の「中位モデル」という位置づけから、実用面でOpus級に近いモデルへと進化しつつある点は、今後のAI活用戦略を考える上で見逃せないポイントだろう。




