2026年10月7日(米国時間)、Anthropicは軽量モデルの新世代「Claude Haiku 5.5」を公開しました。最大の話題は価格です。API料金は入力100万トークンあたり0.10ドル、出力0.50ドルと、Haiku 4.5の10分の1(100Kトークン以下のリクエストの場合)まで下がりました。
一方で性能は大きく上がっており、PC操作のベンチマーク(OSWorld 2.1)ではHaiku 4.5の15.7%から72.4%へ伸びています。本記事では、Haiku 5.5の料金・性能・使えるプラン、Haiku 4.5やSonnet 5.5との違い、どんな用途に向くかを整理します。
Claude Haiku 5.5の要点
- 公開日:2026年10月7日(米国時間)。APIと主要クラウドで即日提供
- 料金:入力0.10ドル/出力0.50ドル(100万トークンあたり、100Kトークン以下)。Haiku 4.5比で平均約75%安い(Anthropic試算)
- 性能:Haiku 4.5から全面的に向上。一部のベンチマークではGPT-6 Lunaを上回る
- 新機能:Haikuクラスで初めて「effort(思考量)」を調整可能に
- 仕様:コンテキスト100万トークン、最大出力12.8万トークン、知識カットオフは2026年6月
- 向く用途:要約・分類・ルーティング・サブエージェント・リアルタイム対応など、大量かつ速度重視の処理
- 向かない用途:複雑なエージェント型コーディングはSonnet 5.5/Opus 5.5が推奨
同日にはSonnet 5.5のキャッシュ読み取り料金の半額化と、Max/Teamプラン向けの毎月のAPIクレジット付与も発表されています(後述)。
Claude Haiku 5.5とは
Claude Haiku 5.5は、Claudeのモデルラインナップのうち最も小さく速い「Haiku」系の最新版です。2026年9月に公開されたOpus 5.5、Sonnet 5.5に続く「5.5世代」の最後のモデルにあたります。
Anthropicは同モデルを「これまでで最も安く、最も速く、最も高性能な小型モデル」と位置づけています。想定している用途は、要約、会話履歴の圧縮(コンパクション)、データベースへの問い合わせ、分類、サブエージェント、ライブのカスタマーサポート、ブラウザ操作などです。
モデルIDは claude-haiku-5-5 です。
料金:Haiku 4.5の最大90%安
API料金は、1回のリクエストのプロンプト長が10万(100K)トークン以下か、それを超えるかで2段階に分かれています。
| 項目(100万トークンあたり) | Haiku 5.5(100K以下) | Haiku 5.5(100K超) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| 入力 | $0.10 | $0.50 | $1.00 | $2.00 |
| 出力 | $0.50 | $2.50 | $5.00 | $10.00 |
| キャッシュ読み取り | $0.01 | $0.05 | $0.10 | $0.10 |
| キャッシュ書き込み | $0.125 | $0.625 | $1.25 | $2.50 |
100K以下では90%安、100K超でも50%安です。バッチ処理を使えばさらに50%割引になります。
ただし注意点が1つあります。
Haiku 5.5では新しいトークナイザーが採用され、同じ入力テキストでもHaiku 4.5と比較してトークン数が約30%増加します。ただし、料金引き下げの効果が大きいため、Anthropicは平均約75%のコスト削減になるとしています。
競合の軽量モデルとの料金比較
| モデル | 入力 | 出力 | 備考 |
|---|---|---|---|
| Claude Haiku 5.5 | $0.10 | $0.50 | 100Kトークン超は$0.50/$2.50 |
| GPT-6 Luna(OpenAI) | $0.10 | $0.50 | 272Kトークン超で高い料金帯 |
| Gemini 3.5 Flash-Lite(Google) | $0.30 | $2.50 | 定額 |
(いずれも100万トークンあたりの標準料金。VentureBeat・MarkTechPostの2026年10月7日時点の比較による)
短いプロンプトではGPT-6 Lunaと同水準です。一方、10万〜27万トークン程度の長いプロンプトでは、上位料金帯に入る境目が早いHaiku 5.5の方が割高になる場合があります。長文を大量に投げる用途では、実際の入力長で試算してから選ぶのが安全です。
性能:Haiku 4.5から大幅に向上
Anthropicが公表したベンチマーク結果は次のとおりです(いずれもベンダー公表値)。
| ベンチマーク | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1(実務タスク) | 1620 | 735 | 1437 | 1840 |
| OSWorld 2.1 offline(PC操作) | 72.4% | 15.7% | 48.9% | 83.9% |
| Terminal-Bench 4.0(ターミナル操作) | 39.2% | 0.0% | 16.4% | 70.6% |
| FrontierCode 1.1 Main(コーディング) | 46.4% | — | 42.4% | 52.1% |
| Humanity’s Last Exam(ツールなし) | 45.9% | 10.2% | — | 56.9% |
| Humanity’s Last Exam(ツールあり) | 57.4% | 18.7% | — | 64.5% |
ポイントは次の3つです。
- Haiku 4.5からの伸びが非常に大きい:PC操作やターミナル操作など、エージェント的なタスクで別物と言えるほど向上しています。
- 同価格帯のGPT-6 Lunaを上回る項目が多い:公表された比較項目ではすべてLunaより高いスコアです。
- Sonnet 5.5との差はまだある:特にTerminal-Benchでは39.2%対70.6%と大きな差があり、Anthropic自身も複雑なエージェント型コーディングにはSonnet 5.5やOpus 5.5を推奨しています。
なお、VentureBeatによると、Terminal-Benchの39.2%はeffortを最大にした場合の数値で、既定のmediumでは約20%とされています。
採用企業からの報告として、Boxでは「Haiku 4.5より11ポイント高い精度を約半分のレイテンシで」、Asanaでは「タスク完了のレイテンシが30%以上短縮」といった声が紹介されています。
新機能:Haikuで初めて「effort」を調整可能に
Haiku 5.5は、Haikuクラスで初めてeffort(どれだけ考えるか)を調整できるモデルです。Low/Medium/High/Xhigh/Maxの段階があり、APIの既定値はmediumです。
- 分類やルーティングなど単純な処理 → Lowにして速さと安さを優先
- 少し込み入った推論やコード生成 → High以上にして精度を優先
というように、タスクごとにコストと賢さのバランスを選べます。思考は「適応型(adaptive)」で、必要なときだけ考える仕組みです。
開発者向けの注意点として、temperature・top_p・top_kに既定以外の値を指定すると400エラーになるとMarkTechPostが報じています。既存のHaiku 4.5向けコードを移行する際は、これらのパラメータを確認してください。
主な仕様
| 項目 | 内容 |
|---|---|
| モデルID | claude-haiku-5-5 |
| コンテキストウィンドウ | 100万トークン |
| 最大出力 | 12.8万トークン |
| 知識のカットオフ | 2026年6月 |
| 入力 | テキスト・画像 |
| 思考 | 適応型(effort既定値:medium) |
どこで使える?利用可能なプラン・サービス
Claude Haiku 5.5は、AnthropicのClaude APIをはじめ、Amazon Bedrock、Google Cloud、Microsoft Foundryなどの主要なクラウドサービスで利用できます。
ClaudeアプリやClaude Codeでの利用については、契約プランや提供状況によって、使用できるモデルやモデル選択方法が異なる場合があります。最新の対応状況はAnthropicの公式案内をご確認ください。
同時発表:Sonnet 5.5値下げとMax/TeamのAPIクレジット
Haiku 5.5と同時に、次の2つも発表されました。
Sonnet 5.5のキャッシュ読み取りが半額に
Sonnet 5.5のキャッシュ読み取り料金が、100万トークンあたり0.20ドルから0.10ドルに下がりました。Anthropicは、一般的なエージェント処理でSonnet 5.5のコストが約20%下がると見込んでいます。
Max/Teamプランに毎月APIクレジット
Claudeのサブスクリプション利用者に、Claude Platform(API)で使えるクレジットが毎月付与されます。
| プラン | 毎月のAPIクレジット |
|---|---|
| Max 5x | 100ドル |
| Max 20x | 200ドル |
| Team | 最大500ドル(ユーザー間で共有) |
クレジットはどのモデルにも使えます。公式発表では「今週中」に順次展開するとしています。サブスク利用者が自作ツールやスクリプトからAPIを試しやすくなる変更です。
Haiku 5.5・Sonnet 5.5・Opus 5.5の使い分け
| モデル | 向いている用途 |
|---|---|
| Haiku 5.5 | 大量の要約・分類・抽出、ルーティング、サブエージェント、チャットボット、ライブサポート、ブラウザ操作 |
| Sonnet 5.5 | 日常的な業務全般、標準的なコーディング、エージェント処理 |
| Opus 5.5 | 複雑なエージェント型コーディング、高度な調査・分析 |
Anthropicが推している使い方の1つが、大きいモデルとHaikuの組み合わせです。たとえば、Opus 5.5やSonnet 5.5が全体の計画を立て、Haiku 5.5のサブエージェントが資料からの数値抽出や要約などの細かい作業を並列で担当する、といった構成です。これにより、品質を保ちながら全体のコストと待ち時間を下げられます。
安全性面の変更点
Haiku 5.5は、Haiku 4.5と比べて不適切な振る舞いが大幅に減ったとされています。サイバーセキュリティ関連の制限はHaiku 4.5より厳しく(Sonnet 5.5よりは緩い)、防御的なタスクには対応する一方、ペネトレーションテストなど攻撃者の手法にあたる作業は標準ではブロックされます。業務上必要な組織は、Anthropicの検証プログラム(Cyber Verification Programなど)に申請する形になります。
まとめ
- Claude Haiku 5.5は2026年10月7日公開の最新軽量モデル
- API料金は入力0.10ドル/出力0.50ドルで、Haiku 4.5の最大90%安(平均約75%安)
- 性能はHaiku 4.5から大幅に向上し、同価格帯のGPT-6 Lunaを上回る項目が多い
- Haikuで初めてeffort調整に対応。用途に応じて速度と精度を選べる
- 複雑なコーディングは引き続きSonnet 5.5/Opus 5.5が推奨
- 同時にSonnet 5.5のキャッシュ料金半額化、Max/Team向けAPIクレジットも発表
APIで大量処理をしている場合は、Haiku 4.5からの移行だけで大きなコスト削減が見込めます。トークナイザーの変更やパラメータの制約があるため、本番切り替え前に実際のデータで料金と出力を確認しておくと安心です。
Sonnet 5.5の詳細は「Claude Sonnet 5.5とは?料金・性能・Opus 5.5との違いを解説」、最上位モデルについては「Claude Opus 5.5とは」もあわせてご覧ください。
