· AI業界

Anthropicが最安高速小規模モデルClaude Haiku 5.5を発表し価格改定を実施

30秒でわかる内容解説

Anthropicは2026年10月7日、小規模モデルClaude Haiku 5.5をリリースした。10万トークン以下のリクエストで前モデル比最大90%の価格低下を実現し、エージェントワークの費用削減に直結する。Sonnet 5.5のキャッシュリード料金半減や、サブスクユーザー向け月次APIクレジット導入も同時に発表された。開発者は低コストで高速な推論を容易に組み込めるようになる。これにより実務での導入ハードルが下がり、大規模言語モデルの価格競争がさらに激化している。

円換算は1ドル=158.28円(2026年10月8日、欧州中央銀行の参考レート)による概算で、日本での販売価格とは異なる。

Claude Haiku 5.5の性能と価格体系

高頻度でコスト効率を重視するタスクを目的に設計された。要約やデータベースクエリ、分類リクエストなどの反復作業を安定して処理できる。コード生成のサブエージェントとしてもSonnet 5.5やOpus 5.5と組み合わせて活用できる。

性能面では、知識作業のベンチマークGDPval-AA v2.1で1620点を記録した。前モデルHaiku 4.5の735点を大幅に上回り、競合のGPT-6 Lunaの1437点とも互角以上の結果を示した。

価格体系は10万トークン単位で区切られた。10万トークン以下のリクエストでは前モデル比90%安くなり、超える場合は50%安くなった。キャッシュリードは0.01ドル(約2円)、キャッシュライトは0.125ドル(約20円)に設定された。

Haiku 5.5 (10万トークン以下) の価格体系
項目価格 (100万トークンあたり)
キャッシュリード$0.01(約2円)
キャッシュライト$0.125(約20円)
入力トークン$0.10(約16円)
出力トークン$0.50(約79円)

更新されたトークナイザーにより、タスク完了に必要なトークン数は前モデル比でやや増加した。それでも平均実行コストは約75%削減された。モデルの標準速度は史上最速であり、ライブカスタマーサポートやブラウザ操作などの速度敏感なタスクに適している。

2026年10月7日よりAWS、Google Cloud、Microsoft AzureおよびClaude Platformで提供が開始された。開発者はclaude-haiku-5-5のモデルIDでAPIを呼び出せる。調整可能なイフォート設定も導入され、コスト優先か知能優先かをユーザーが選べるようになった。

OSWorld 2.1のオフラインサブセットでは72.4%の成功率を示し、Haiku 4.5の15.7%を大きく引き離した。Humanity’s Last Examでもツール使用時で57.4%を記録した。

Sonnet 5.5のキャッシュ料金半減とSDK更新

Anthropicはモデルレンジ全体の価値向上を目的に、Sonnet 5.5のキャッシュリード料金を見直した。100万トークンあたり0.20ドル(約32円)から0.10ドル(約16円)へ半減した。

キャッシュリードはモデルのトークン消費量の大きな割合を占める。この値下げにより、一般的なエージェントワークでのSonnet 5.5の実行コストは約20%削減された。

複雑なエージェントコードタスクではSonnet 5.5やOpus 5.5が依然として適している。Terminal-Bench 4.0ではSonnet 5.5が70.6%の成功率を示し、Haiku 5.5の39.2%を凌駕した。

一方でHaiku 5.5は、以前はコストが障壁となっていた圧縮や要約、サブエージェントワークに最適化された。FrontierCode 1.1では両モデルが46.4%と42.4%で拮抗した。用途に応じてモデルを使い分ける戦略が明確になった。

開発者向けにはPythonとTypeScriptのSDKが更新され、コンピュータ操作とブラウザ操作がベータ版としてサポートされた。Haiku 5.5の速度と価格の組み合わせは、これらの新機能に特に適している。前モデルHaiku 4.5では90%のリクエストが10万トークン以下の範囲に収まっていた。この傾向が続く限り、新価格体系は多くの開発者に恩恵をもたらす。

コミュニティの反応と価格区切りへの議論

コミュニティからは価格改定と性能向上を評価する声が多い。Sonnetのキャッシュリード料金半減やMax、Team向け月次APIクレジット導入は特に好評だ。

The monthly API credits for Max plan seems fantastic, especially considering Haiku pricing.

Maxプランの月次APIクレジットはHaikuの価格を考慮すると素晴らしい。

10万トークン単位の価格区切りについては意見が分かれている。一般的な生成や分類タスクには価値があるが、エージェント利用時にすぐに上限を超えると指摘する声もある。

新モデルのトークン使用量が前モデル比で増加しているため、実質的なコストメリットが実際のワークフローでどの程度維持されるかは未確定だ。調整機能により使用量がさらに増える可能性も懸念されている。

一方、GPT-6 Lunaや他モデルとの比較では堅調な性能を示すと評価する意見が多数を占める。10万トークン以下のリクエストが前モデルの90%を占めていた背景を考慮すると、この価格戦略は実用的な範囲内だとする見方もある。

100kトークン以下の価格帯は、OpenAIのDecide APIやJevモデルとの競争に有利な戦略だとする分析もある。一部のユーザーは、Haiku 4.5がコンテキストを3メッセージで追えなかったため敬遠されていたと振り返る。今回の更新により、実際のワークフローで置き換えられる可能性が高まったと評価している。

MaxとTeam向け月次クレジット配布とセーフティ

Claude MaxとTeamのサブスクライバー向けに、月次APIクレジットが提供される。Max 5xユーザーには月100ドル(約1万5,800円)、Max 20xユーザーには200ドル(約3万1,700円)が支給される。Teamサブスクライバーには最大500ドル(約7万9,100円)がユーザー間でプールされる。

これらのクレジットはツールの構築やエージェント開発を支援するために設計された。Claude Platform上の全モデルで利用可能であり、サブスクリプション料金の追加負担なく新機能を実験できる。

セーフティ面では、ハッキングテストや攻撃者が多用する技法をブロックする一方、防御系のタスクはSonnet 5.5より広く許可された。生命科学分野では有害と判断されるリクエストを制限し、検証プログラムへの申請で範囲を拡大できる。

今週中にもクレジット配布が開始され、開発者は追加費用なしでAI機能を配信できるようになる。Max 5xやMax 20xはサブスクリプションの階級を示す。クレジットはどのモデルでも利用でき、エージェント実験の敷居を下げる。セキュリティ対策では、脆弱性診断はブロックするが、防御系のコード生成は許可される。これらの仕様は、開発者のワークフローに合わせた柔軟な運用を可能にする。

出典