AnthropicがClaude Sonnet 5.5を発表。コーディング性能とコスト効率を大幅向上
20秒でわかる内容解説
Anthropicが2026年9月28日、コーディング性能と処理速度を強化したClaude Sonnet 5.5を発表した。Sonnet 5と比較して30%以上の高速化と最大30%のコスト削減を実現し、Opus 5.5と拮抗するコストパフォーマンスを提供する。開発チームのコードレビューや日常タスクの自動化において、実務への適用が期待されるモデルである。
円換算は1ドル=157.12円(2026年9月29日、欧州中央銀行の参考レート)による概算で、日本での販売価格とは異なる。
コーディングベンチマークでSonnet 5を大幅上回る性能
Claude Sonnet 5.5は、Claude 5.5ファミリーの2番目のモデルとして提供を開始した。価格帯はSonnet 5と同じ100万トークンあたり入力2ドル(約314円)、出力10ドル(約1,570円)を維持する。キャッシュ読み込みは0.20ドル(約31円)でOpus 5.5と同額だ。処理速度は30%以上向上し、タスクあたりの消費トークン数が減るため、実質コストは最大30%削減される。
It’s a clear upgrade over Claude Sonnet 5, runs 30%+ faster, and costs up to 30% less for most work.
Claude Sonnet 5を明確に上回り、処理速度は30%以上速く、ほとんどの作業でコストが最大30%削減される。
コーディング能力の向上が特に顕著だ。エージェント型コーディング評価Terminal-Bench 4.0では、Sonnet 5の10.3%から70.6%へと大幅に跳ね上がった。Opus 5.5の66.4%を上回るスコアだが、Opus側は安全策により10%の試行が別のモデルに切り替わるFallback(safeguardsにより制限された際の切り替え仕組み)が発生したため、実力差は限定的と見られる。
thinking off(思考オフ)でSonnet 5を使用していたユーザーは、APIのthinking設定を新しいbetween_toolsに切り替える必要がある。アプリのデフォルト設定はMedium、プラットフォームはHighに設定される。AWS、Google Cloud、Microsoft Azureを含む全プラットフォームで利用可能だ。
写真ではSonnet 5.5が生成した400羽の鳥の群れをHTMLファイルで描画した例が示されている。
13件のSignalケースでSonnet 5.5とSonnet 5が捉えた既知のバグ件数を比較したグラフが写真にある。
| 項目 | 値 |
|---|---|
| 入力トークン | 2ドル(約314円)/100万 |
| 出力トークン | 10ドル(約1,570円)/100万 |
| Terminal-Bench 4.0 | 70.6% |
| GDPval-AA v2.1 | 1844 |
| CodeRabbit実測(13ケース) | 6件/13 |
| Fallback率(Terminal-Bench) | 1.5% |
CodeRabbit実測でレビュー精度と速度が両立
第三者ベンダーのCodeRabbitが実施したコードレビュー実測では、Sonnet 5.5の実務価値が裏付けられた。最も困難な13ケースのテストで、Sonnet 5.5は41.2%の精度で6件のバグを捉えた。Sonnet 5の4件から増加し、処理時間は約半分の5分27秒に短縮された。
リスト価格ベースでレビュー1件あたりのコストは0.47ドル(約74円)だ。写真ではSonnet 4からSonnet 5.5までのコードレビュー性能の推移を示すグラフがある。
Sonnetシリーズのレビュー性能は世代を重ねるごとに最適化されてきた。Sonnet 4.6は網羅性は高いが精度が29%と低く、Sonnet 5は精度を40%台に引き上げたものの検出件数が減少していた。Sonnet 5.5は初めて、精度を維持しながら検出カバレッジを回復させたモデルである。
44件のオープンソースプルリクエストに対する大規模テストでも、Sonnet 5.5の平均処理時間は6分33秒だった。Sonnet 5の13分31秒に対して約2倍の高速化を実現した。報告されるコメント数も111件とSonnet 5の146件を減らし、ノイズの少ないレビューが提供される。
コスト効率への評価とサイバー機能のFallback
Hacker Newsなどのコミュニティでは、Terminal-BenchなどのベンチマークでOpus 5.5と並ぶ性能を示した点や、コスト効率への評価が高い。特にエージェント型コーディングやコードレビューでの躍進が注目された。
In terms of benchmarks for agentic coding, it basically stacks up nearly 1:1 with Opus 5.5.
エージェント型コーディングのベンチマークでは、Opus 5.5とほぼ1対1で肩を並べる性能を示している。
一方、サイバーセキュリティ機能のsafeguardsが過度に厳しく、Fallbackが発生する点への批判も見られる。Sonnet 5.5はOpus 5.5と同様のサイバー機能を持ち、日常の開発では問題ないが、高リスクのセキュリティタスクではSonnet 5に切り替わる。生物学 safeguards はSonnet 5と同じ設定だ。認証プログラムに参加すれば高度な機能を使えるが、制限範囲が明確でないため実務への影響が懸念されている。
価格表の比較では、Sonnet 5.5の入力2ドル(約314円)、出力10ドル(約1,570円)はOpus 5.5の半分である。多くのユーザーは、高設定ではOpus 5.5の低設定とコストパフォーマンスが拮抗するため、Sonnet 5.5の具体的な最適ユースケースについて議論を続けている。
低コストモデルHaiku 5.5の登場とモデルラインナップの再編
AnthropicはClaude 5.5ファミリーの低コストモデルClaude Haiku 5.5を数週間以内に発表する予定だ。Haiku 5.5は高ボリュームでコスト敏感なアプリケーション向けに設計される。これにより、Sonnet 5.5の下部に低コスト層が補完され、用途に応じたモデル選択の幅が広がる。
過去のモデル名を見ると、Fableシリーズの存在が示唆されている。一部のベンチマークでFableの数値が省略されていることから、Sonnet 5.5の登場を機にFableの提供が終了する可能性がある。
It's interesting that in all their benchmarks, they omit Fable numbers and only focus on Opus, Sonnet, and OpenAI models.
すべてのベンチマークでFableの数値が省略され、Opus、Sonnet、OpenAIモデルのみが注目されているのは興味深い。
蒸留攻撃対策として思考抽出防止分類器(classifiers)が搭載され、アカウント間での会話移動時の挙動について説明するドキュメント記事が公開されている。今後はSonnet 5.5の実務適用例や、Opus 5.5との境界線がより明確になるだろう。
用語の注釈
- Fallback
- safeguardsで制限された際、別のモデルや結果に切り替えるバックアップ用の仕組み。(参考:【簡単解説!】フォールバックとは何か?バックアップ ...)
出典
- Sonnet 5.5(Hacker News) · 議論
- Claude Sonnet 5.5 for code review: More catches than Sonnet 5, in half the time(Hacker News) · 議論