Claude Haiku 5.5とHaiku 4.5の比較:変更点と破壊的変更の対処法

Haiku 5.5 対 Haiku 4.5: 最大10万トークンまで90%安価、100万コンテキスト、400番台を返す5つの破壊的変更。JSON修正の前後も内部で。

Medy Evrard

8 10月 2026

Claude Haiku 5.5とHaiku 4.5の比較:変更点と破壊的変更の対処法

Apidog エンタープライズ

オンプレミスデプロイ

SSO & RBAC

SOC 2 準拠

Apidog Enterpriseを見る

Claude Haiku 5.5(claude-haiku-5-5、2026年10月7日リリース)は、最大10万トークンまでのプロンプトに対してHaiku 4.5より90%安価(入力/出力100万トークンあたり$0.10/$0.50に対し$1/$5)。コンテキストウィンドウは20万トークンから100万トークンに拡張され、両方が記載されているすべてのローンチベンチマークで大幅に高いスコアを記録しています。ただし、4.5で機能していた5つのリクエスト形式が400エラーを返すようになり、エラーなしで応答とコストが変更される点が他にもいくつかあります。

以下に、並列比較表、変更前/変更後のJSONを含む各破壊的変更点、サイレント変更点、Apidog用のテスト計画を示します。詳細な仕様書については、Claude Haiku 5.5とはをご覧ください。古いモデルをまだ使用している場合は、Claude Haiku 4.5 APIガイドで説明しています。

ボタン

Haiku 4.5 と Haiku 5.5 の概要

Claude Haiku 4.5 Claude Haiku 5.5
モデルID (Claude API) claude-haiku-4-5-20251001 claude-haiku-5-5
コンテキスト / 最大出力 200K / 64K 1M / 128K
入力 / 出力 (MTokあたり) $1 / $5 10万トークンまでのプロンプトで$0.10 / $0.50; 超過分は$0.50 / $2.50
キャッシュ読み取り / 5分書き込み (MTokあたり) $0.10 / $1.25 10万トークンまで$0.01 / $0.125; 超過分は$0.05 / $0.625
バッチ入力 / 出力 (MTokあたり) $0.50 / $2.50 10万トークンまで$0.05 / $0.25; 超過分は$0.25 / $1.25
思考 手動 budget_tokens アダプティブのみ、デフォルトでオン
努力レベル なし low, medium (デフォルト), high, xhigh, max
最小キャッシュ可能プロンプト 4,096トークン 512トークン
トークナイザー 旧版 同じテキストで約30%多くのトークン
非デフォルトサンプリングパラメータ、プリフィル 受け入れられる 400エラー
プライオリティティア サポートされている サポートされていない
ステータス アクティブ、2026年10月15日以前の廃止なし アクティブ、2027年10月7日以前の廃止なし

Haiku 4.5は非推奨ではありません。モデルの非推奨ページでは、非推奨日なしでアクティブと記載されているため、ご自身のスケジュールで移行できます。両モデルのレート制限は同じです。

5つの破壊的変更点

これらはすべて、Haiku 4.5で動作するボディに対してHaiku 5.5で400エラーを返します。Haiku 5.5移行ガイドにすべて記載されています。

1. budget_tokensによる手動思考

Haiku 5.5はアダプティブ思考のみを実行します。固定予算は拒否されます。

// 変更前 (Haiku 4.5)
{
  "model": "claude-haiku-4-5-20251001",
  "max_tokens": 16000,
  "thinking": { "type": "enabled", "budget_tokens": 8000 },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

// 変更後 (Haiku 5.5)
{
  "model": "claude-haiku-5-5",
  "max_tokens": 16000,
  "thinking": { "type": "adaptive" },
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

今や「努力」がレバーです。4.5で小さな予算を使っていた場合は、より低い努力レベルを選択してください。thinking: {"type": "disabled"}を送信することは可能ですが、high以下の努力レベルでのみです。xhighやmaxでは400エラーになります。

2. サンプリングパラメータ

temperature、top_p、top_kを削除してください。許容される値はtemperature: 1とtop_p: 0.99のみです。top_p: 1、任意のtop_k、およびtemperatureとtop_pを一緒に送信することを含め、その他の値は400エラーになります。

// 変更前 (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "temperature": 0.2, "top_k": 40,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

// 変更後 (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

一貫した出力のために低い温度設定を使用していた場合は、その意図をプロンプト内に移動させてください。

3. アシスタントプリフィル

モデルが継続するための最後のアシスタントのターンは、思考がオフであっても拒否されます。messagesはユーザーのターンで終了してください。

// 変更前 (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." },
    { "role": "assistant", "content": "{\"sentiment\": \"" }
  ] }

// 変更後 (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "system": "Reply with only a JSON object. No preamble.",
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." }
  ] }

厳密なフォーマットについては、移行ガイドでは構造化出力、または分類用のenumフィールドを持つツールを推奨しています。

4. コンピュータ使用: computer_20250124からcomputer_toolset_20260801へ

Claude APIとGoogle Cloudでは、Haiku 5.5は新しいツールセットを介してのみコンピュータの使用をサポートします。computer-use-2025-01-24ベータヘッダーを削除し、fine-grained-tool-streaming-2025-05-14を送信している場合は、ツールセットと一緒に使用すると400エラーになるため削除してください。

// 変更前 (Haiku 4.5, ヘッダー anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
  "tools": [{ "type": "computer_20250124", "name": "computer",
              "display_width_px": 1280, "display_height_px": 800 }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

// 変更後 (Haiku 5.5, ベータヘッダーなし)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "tools": [{ "type": "computer_toolset_20260801" }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

エージェントループも変更されます。input.actionの代わりに、各tool_useブロックのnameとtoolset_nameに基づいてディスパッチし、結果にはtoolset_nameをエコーバックしてください。Haiku 5.5ではブラウザ使用ツール(browser_toolset_20260801)も利用可能になりますが、Haiku 4.5ではサポートされていません。詳細については、Claude Codeにおけるコンピュータ利用をご覧ください。

5. 思考ブロックの前の過去のターンを編集する

Haiku 5.5の思考ブロックは、その前に送信されたすべてが変更されていない場合にのみ有効です。system、tools、またはそれ以前のメッセージを変更してブロックを再送信すると、400エラーが発生します。Haiku 4.5ではこのチェックは行われませんでした。ここでは、ターン1で"system": "You are a billing agent."を送信し、ターン2でそれを編集しています。

// 変更前: 編集されたシステム + 再生された思考ブロック = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent. Be brief.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412." }
  ] }

// 変更後: 過去のターンは変更されず、新しい指示が追加される
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412. Be brief." }
  ] }

2026年8月31日00:00 UTCより前に作成されたアカウントでは、エラーはthinking.block_binding.prefix_mismatch_behaviorを設定したリクエストでのみ発生します。

エラーをスローしないサイレントな変更点

改善された点

これらは、Haiku 5.5を最大努力レベルで実行した場合のAnthropic報告数値です。Artificial AnalysisはGDPval-AAとAA-Briefcaseを独自に実施しました。

ベンチマーク Haiku 4.5 Haiku 5.5
GDPval-AA v2.1 (Elo) 735 1620
AA-Briefcase v1.1 (Elo) 614 1578
OSWorld 2.1, offline subset 15.7% 72.4%
Humanity’s Last Exam, with tools 18.7% 57.4%
Terminal-Bench 4.0 0.0% 39.2%
SWE-bench Multilingual 67.4% 83.7%
Chartography, no tools 6.4% 46.4%

Haiku 4.5のTerminal-Bench実行では、固定の63,999トークンの思考予算が使用されました。デフォルトのmedium努力レベルで、Haiku 5.5はGDPval-AAで1277点を記録し、Haiku 4.5を大幅に上回っています。Box社は、Haiku 4.5よりもレイテンシが約半分で、スコアが11ポイント高いと報告しています。全表はClaude Haiku 5.5ベンチマークをご覧ください。

Anthropicは依然として、複雑なエージェントコーディングにはSonnet 5.5とOpus 5.5の方が優れた選択肢であると位置づけています。Haiku 5.5は、分類、抽出、要約、圧縮、サブエージェント、ブラウザ利用をターゲットとしています。

コストに関して、AnthropicはHaiku 5.5が平均で約75%安価であると述べています。この数字は、10万トークンまで90%安価、それ以上で50%安価という価格を統合したものであり、新しいトークナイザーによる追加トークンもすでに相殺されています。ツール利用のシステムプロンプトもautoツール選択の場合で496トークンから286トークンに縮小されました。実例はClaude Haiku 5.5の価格設定をご覧ください。

Apidogで移行をテストする

Apidogで、https://api.anthropic.com/v1/messagesへの3つの保存済みリクエストを含む1つのプロジェクトを作成します。

  1. ベースライン: 現在のHaiku 4.5ボディ。ステータス200をアサート。
  2. 古いボディ、新しいモデル: modelのみをclaude-haiku-5-5に変更。ステータス400をアサート。発生した破壊的変更ごとにコピーを保持。
  3. 移行済み: 修正されたボディ。ステータス200、refusalまたはmax_tokensではないstop_reason、およびtypeで見つかったテキストブロックをアサート。

ANTHROPIC_API_KEYを環境変数として保存し、x-api-keyヘッダーで{{ANTHROPIC_API_KEY}}として参照し、anthropic-version: 2023-06-01を指定します。ベースラインと移行済みのリクエスト間でusage.input_tokensを比較し、ご自身のプロンプトでのトークナイザーの変更を確認してください。このセットをテストシナリオとして保存すれば、temperatureを再導入したチームメイトが本番環境ではなくテスト実行で失敗するようになります。リクエストの基本はClaude Haiku 5.5 APIの使い方にあります。

Claude Codeで作業している場合、/claude-api migrate this project to claude-haiku-5-5を実行すると、モデルIDの交換とパラメータの修正が適用され、チェックリストが表示されます。haikuエイリアスはAnthropic APIでのみHaiku 5.5に解決されることに注意してください。Claude CodeにおけるClaude Haiku 5.5をご覧ください。

よくある質問

Claude Haiku 4.5は非推奨ですか? いいえ。非推奨日はなくアクティブとされており、2026年10月15日以前に廃止されることはありません。

Haiku 4.5のリクエストがHaiku 5.5で400エラーを返すのはなぜですか? budget_tokens、temperature/top_p/top_k、アシスタントプリフィル、computer_20250124、または思考ブロック前の過去のターンへの編集がないか確認してください。これらが5つの破壊的変更点です。

長いプロンプトの場合、Haiku 5.5はHaiku 4.5より安いですか? はい。10万トークンを超える場合、100万トークンあたり$0.50/$2.50で、Haiku 4.5の$1/$5の半分です。Haiku 4.5は20万トークンを超えるプロンプトには対応できません。

すべてHaiku 5.5に切り替えるべきですか? 分類、抽出、サブエージェントの作業については、まずテストしてから移行してください。Haiku 5.5 vs GPT-6 Lunaで最も近い競合と比較してください。

次のステップ

Haiku 4.5のリクエストをHaiku 5.5の対応物と並べて保存し、400エラーを確認し、修正した後、移行済みのリクエストが通過したらトラフィックを移行してください。そのテストペアを構築するためにApidogをダウンロードしてください。

ApidogでAPIデザイン中心のアプローチを取る

APIの開発と利用をよりシンプルなことにする方法を発見できる