Claude Haiku 5.5は、Anthropicの現行モデルの中で最小かつ最速のモデルで、2026年10月7日にAPI ID claude-haiku-5-5としてリリースされました。料金は、10万トークンまでのプロンプトの場合、入力トークン100万あたり0.10ドル、出力トークン100万あたり0.50ドルです。10万トークンを超えるプロンプトの場合は、0.50ドル/2.50ドルです。発表記事でAnthropicは、Haiku 4.5と比較して平均で「実行コストが約75%削減される」と述べており、「これまでのモデルで最速」と呼んでいます。また、努力設定(effort setting)が導入された初のHaikuモデルであり、100万トークンのコンテキストウィンドウを備えています。
以下に、仕様、2段階料金、Haiku 4.5からの変更点、ベンチマーク、実行場所、切り替えを検討すべきユーザーについて、Haiku 5.5の料金詳細などのより深いガイドへのリンクとともに示します。この記事を読みながらモデルを呼び出すには、Apidogを使用すると、Messagesリクエストを送信し、環境変数にキーを保持し、トークン使用量とともにレスポンスを表示できます。
Claude Haiku 5.5の仕様概要
| 項目 | Claude Haiku 5.5 |
|---|---|
| リリース日 | 2026年10月7日 |
| モデルID (Claude API, Google Cloud, Microsoft Foundry, Claude Platform on AWS) | claude-haiku-5-5 (固定ID、日付サフィックスなし) |
| モデルID (Amazon Bedrock) | anthropic.claude-haiku-5-5 |
| コンテキストウィンドウ | 100万トークン (Haiku 4.5: 20万トークン) |
| 最大出力 | 12万8000トークン (Haiku 4.5: 6万4000トークン); バッチAPIではoutput-300k-2026-03-24ベータヘッダーで30万トークン |
| 思考(Thinking) | アダプティブのみ |
| 努力レベル(Effort levels) | low, medium (デフォルト), high, xhigh, max |
| 知識カットオフ | 2026年6月 |
| MTokあたりの価格 (10万トークンまでのプロンプト) | 入力0.10ドル、出力0.50ドル |
| MTokあたりの価格 (10万トークンを超えるプロンプト) | 入力0.50ドル、出力2.50ドル |
| 廃止 | 2027年10月7日より前ではない |
ClaudeのラインナップにおけるHaiku 5.5の位置付け
| モデル | MTokあたりの入力/出力 | デフォルトの努力レベル | レイテンシー |
|---|---|---|---|
| Claude Fable 5.1 | $10 / $50 | high | 遅い |
| Claude Opus 5.5 | $4 / $20 | medium | 中程度 |
| Claude Sonnet 5.5 | $2 / $10 | high | 速い |
| Claude Haiku 5.5 | 10万トークンまでのプロンプトで$0.10 / $0.50 | medium | 最速 |
これら4つのモデルはすべて、100万トークンのコンテキストウィンドウ、最大12万8000トークンの出力、および2026年6月の知識カットオフを共有しています。AnthropicはHaiku 5.5を、「分類、抽出、ルーティングなどの高ボリュームでレイテンシーに敏感なタスク」のほか、要約、ライブサポート、ブラウザ利用、Opus 5.5またはSonnet 5.5の下でのサブエージェント作業向けに構築しました。
速度に関する主張には注釈があります。各モデルの「標準速度では最速」ですが、Fast ModeのOpusよりは遅いとされています。Anthropicは1秒あたりのトークン数を公表していません。
Claude Haiku 5.5の料金
料金はプロンプトの長さに依存します。10万トークンを超えるプロンプトには、より高い料金が適用されます。

出典: Claude API料金。
「約75%削減」という数値は平均値です。10万トークンまでのプロンプトではHaiku 4.5より90%安く、それを超える場合は50%安くなります。Haiku 4.5のリクエストの90%は閾値以下でした。この数値には、同じテキストで約30%多くのトークンを生成する新しいトークナイザーによる影響がすでに考慮されています。
米国のみでの推論(inference_geo)は、すべてのトークンカテゴリで1.1倍のコストがかかります。キャッシュ可能なプロンプトの最小値は、Haiku 4.5の4,096トークンから512トークンに減少しました。
10万トークン未満の場合、表示価格はGPT-6 Lunaと完全に一致します(入力0.10ドル、出力0.50ドル、キャッシュ読み込み0.01ドル、キャッシュ書き込み0.125ドル)。ただし、閾値は異なります。Lunaの追加料金は入力27万2000トークンを超えると発生します。Haiku 5.5とGPT-6 Lunaの比較でその違いを詳しく解説しており、料金ガイドには計算例が掲載されています。
Haiku 4.5からの変更点
コンテキストウィンドウが5倍になり、最大出力が2倍になり、初めて努力(effort)制御が可能になりました。移行ガイドでは、Haiku 4.5向けに書かれたコードが動作しなくなる可能性があると警告しています。以下の5つの変更は400エラーを返します。
- 手動思考予算(Manual thinking budgets)。
thinking: {"type": "enabled", "budget_tokens": N}は失敗します。output_config.effortとともに{"type": "adaptive"}を使用してください。 - サンプリングパラメーター(Sampling parameters)。
temperature、top_p、top_kを削除してください。デフォルト以外のtemperatureまたはtop_pの値は失敗し、top_kの指定、あるいはtemperatureとtop_pの両方を送信することも失敗します。 - アシスタントによる事前入力(Assistant prefill)。 思考がオフであっても拒否されます。
- 古いコンピューター使用ツール(Old computer use tool)。 Claude APIおよびGoogle Cloudでは、
computer_toolset_20260801を使用してください。computer_20250124は失敗します。 - 編集された履歴(Edited history)。 返された思考ブロックの前に
system、tools、または以前のメッセージを変更すると失敗します。会話は追記のみにしてください。
その他の変更はエラーを発生させませんが、結果に影響を与えます。
- 思考表示(Thinking display)。 思考ブロックはデフォルトでは空で、署名のみが返されます。内容を読むには
"display": "summarized"を設定してください。 - トークンカウント(Token counts)。 同じテキストで約30%多くのトークンが生成されます。
max_tokensには思考も含まれます。 - 強制ツール使用(Forced tool use)。
anyまたは指定されたツールへのtool_choiceは引き続き機能しますが、レスポンスに思考ブロックは含まれません。 - 拒否(Refusals)。 安全性分類器は
stop_reason: "refusal"を返すことがあり、サーバー側のフォールバックはありません。 - 優先ティア(Priority Tier)。 Haiku 5.5ではサポートされていません。
APIでは、high以下の努力レベルで思考を無効にできます。xhighおよびmaxでは400エラーが返されます。Haiku 4.5は非推奨ではなく、引き続きアクティブとしてリストされています。Haiku 5.5 vs Haiku 4.5ガイドには、各修正前後のJSONが掲載されています。
Claude Haiku 5.5のベンチマーク
Haiku 5.5のスコアは、最大努力レベルでのもので、ほとんどが5回の試行の平均です。Artificial AnalysisがGDPval-AAとAA-Briefcaseを実行し、CognitionがFrontierCodeを実行しました。Anthropicは独自の実行でChartography(Surge AIベンチマーク)を評価しました。

3つのセルに注意して読み進めてください。FrontierCodeでは、Haikuは最大努力レベルで、Sonnet 5.5はxhigh努力レベルで比較されています。最大努力レベルでは、Sonnetは46.2%を記録し、Haikuの46.4%を下回りました。AnthropicはLunaのOSWorldスコアをOpenAIのAPI経由で実行し、LunaのTerminal-Benchスコアは公開リーダーボード(Codex CLI)から取得されています。そして、デフォルトのmedium努力レベルでは、Haiku 5.5はGDPval-AAで1277点、AA-Briefcaseで1372点を記録しました。
Anthropicは、Sonnet 5.5とOpus 5.5が「複雑なエージェントコーディングタスクには依然として優れた選択肢である」と述べています。2026年10月8日現在、独立したリーダーボードにはHaiku 5.5の結果はありませんでした。Cursorは、独自のCursorBenchで最大努力レベルで48.4%を報告しています。ベンチマーク詳細解説には、努力レベルごとのスコアとコストが掲載されています。
Claude Haiku 5.5を利用できる場所
| プラットフォーム | アクセス | 備考 |
|---|---|---|
| Claude API | claude-haiku-5-5 |
トークンごとの支払い |
| Amazon Bedrock | anthropic.claude-haiku-5-5 |
AWS Marketplace経由で請求 |
| Google Cloud, Microsoft Foundry, Claude Platform on AWS | claude-haiku-5-5 |
Claude APIと同じID |
| Claude.ai (ウェブ、iOS、Android) | モデルピッカー | Free、Pro、Max、Team、Enterpriseユーザーが選択可能 |
| Claude Code | /model claude-haiku-5-5 |
v2.1.293以降; 有料プラン |
| Vercel AI Gateway | anthropic/claude-haiku-5.5 |
$0.10 / $0.50から |
| Cursor | claude-haiku-5-5 |
Other Modelsプール |
2026年10月8日現在、OpenRouterには未掲載で、GitHub Copilotへの導入も発表されていませんでした。
無料プランでのチャットアクセスはAPIキーではありません。APIは、Anthropicが新規ユーザーにテスト用に提供する少額の無料クレジットを超えると従量課金制になります。MaxおよびTeamプランには、月間のAPIクレジットが含まれるようになりました(Max 5xで100ドル、Max 20xで200ドル、Teamでは最大500ドルのプール)。これらはClaude Codeには適用されません。無料アクセスガイドには、無料のものとそうでないものが記載されています。
Claude Codeでは、haikuエイリアスはAnthropic APIでのみHaiku 5.5を意味し、その他の場所ではHaiku 4.5を意味します。サブエージェントの設定については、Claude CodeでのHaiku 5.5をご覧ください。
Haiku 5.5に切り替えるべきユーザー
- Haiku 4.5を使用している場合: 5つの破壊的変更を修正した後、切り替えてください。Haiku 5.5は、両方にスコアがあるすべての比較項目でHaiku 4.5を上回り、かつリスト価格も低いです。
- シンプルで反復的なタスクにSonnetまたはOpusを使用している場合: 分類、抽出、要約、サブエージェントの作業でHaiku 5.5をテストしてください。複雑なエージェントコーディングには、より大きなモデルを使用し続けてください。
- プロンプトが頻繁に10万トークンを超える場合: 導入前に両方の料金体系を比較検討してください。閾値を超えると、入力コストはトークンあたり5倍になります。
- セキュリティ関連の作業を行う場合: Haiku 5.5のサイバーセキュリティ保護機能は、引き続きペネトレーションテストをブロックします。
Anthropicの発表記事では、Asanaがタスク完了時のレイテンシーが30%以上低減したと報告しており、BoxはHaiku 4.5より11ポイント高いスコアを約半分のレイテンシーで達成したと述べています。これらは顧客の主張であり、独立したテストではありません。
システムカードには、Anthropicの自動監査において、他のどのモデルよりも過剰に拒否(over-refused)したと記載されているため、自身のプロンプトで拒否率をテストしてください。
最初のHaiku 5.5リクエストを送信する
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive", "display": "summarized"},
"output_config": {"effort": "low"},
"messages": [
{"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."}
]
}'
サンプリングパラメーターと事前入力は含めないでください。レスポンスは思考ブロックから始まる可能性があるため、コンテンツブロックはtypeで読み取ってください。
Apidogで、curlコマンドを新しいリクエストとしてインポートし、キーをANTHROPIC_API_KEY環境変数に保存します。stop_reasonがrefusalまたはmax_tokensではないことをアサーションとして追加します。次に、リクエストをmediumで複製し、usageを比較して各努力レベルのコストを確認します。Haiku 5.5 APIガイドでは、キャッシング、バッチ処理、ストリーミングについて解説しており、キーが必要な場合はAnthropic APIキーガイドが役立ちます。
よくある質問
Claude Haiku 5.5はいつリリースされましたか? 2026年10月7日、Sonnet 5.5の9日後です。
Claude Haiku 5.5は無料ですか? Claude.aiチャットアプリでは、無料ユーザーが選択できます。APIは、新規ユーザー向けの少額のテストクレジットを除き、有料です。すべての無料利用方法をご覧ください。
Claude Haiku 5.5のコンテキストウィンドウはどれくらいですか? 100万トークンで、Messages APIでは最大12万8000トークンの出力が可能です。
Haiku 4.5は廃止されますか? まだです。引き続きアクティブとしてリストされており、2026年10月15日より前に廃止されることはありません。
次のステップ
今日実行している高ボリュームの作業(チケットのトリアージやドキュメントの要約など)を1つ選びます。それをclaude-haiku-5-5にlowとmediumの努力レベルで送信し、出力を確認し、現在のモデルと比較してusageを比較します。Apidogをダウンロードして、これらのリクエストとアサーションを1つのプロジェクトにまとめ、料金ガイドを使用してトークン数を月額請求に換算してください。
