Claude Haiku 5.5 API の使い方

Claude Haiku 5.5 API ガイド: curl、Python、TypeScript での claude-haiku-5-5 を使った最初の呼び出し、さらに努力、思考、キャッシング、バッチ、拒否について。

INEZA Felin-Michel

INEZA Felin-Michel

8 10月 2026

Claude Haiku 5.5 API の使い方

Apidog エンタープライズ

オンプレミスデプロイ

SSO & RBAC

SOC 2 準拠

Apidog Enterpriseを見る

Claude Haiku 5.5 APIを使用するには、https://api.anthropic.com/v1/messagesに"model": "claude-haiku-5-5"、x-api-keyヘッダーにキー、anthropic-version: 2023-06-01を含めてPOSTリクエストを送信します。プロンプトが10万トークンまでの場合、入出力トークン100万あたり$0.10/$0.50かかり(それ以上は$0.50/$2.50)、最大100万トークンのコンテキストを読み取り、最大12万8千トークンを書き込み、適応的思考が有効なmediumエフォートがデフォルトです。

Anthropicは2026年10月7日にHaiku 5.5をリリースしました。これはエフォートレベルを持つ最初のHaikuです(Claude Haiku 5.5とはで仕様と位置付けを解説しています)。このガイドでは、curl、Python、TypeScriptでの最初の呼び出し、さらにエフォート、思考、キャッシング、バッチ、拒否、エージェントツールセットについて説明します。以下のすべてのリクエストはApidogで保存し、アサートできます。

button

Claude Haiku 5.5 API の概要

パラメータ Haiku 5.5 の動作
モデルID claude-haiku-5-5 (Bedrock: anthropic.claude-haiku-5-5); 別エイリアスなし
MTokあたりの価格 (10万トークンまでのプロンプト) 入力 $0.10、出力 $0.50、キャッシュ読み取り $0.01
MTokあたりの価格 (10万トークンを超えるプロンプト) 入力 $0.50、出力 $2.50、キャッシュ読み取り $0.05
コンテキスト / 最大出力 1M / 128K; output-300k-2026-03-24 ベータヘッダーを使用するバッチでは 300K
output_config.effort low、medium (デフォルト)、high、xhigh、max
thinking デフォルトでadaptive; disabled はhighエフォート以下のみ
thinking.display デフォルトでthinkingフィールドは空; summarized は読みやすいテキストを返す
temperature, top_p, top_k 非デフォルト値は400を返す
アシスタントプリフィル 思考がオフでも400を返す
キャッシュ可能な最小プロンプト 512トークン (Haiku 4.5では4,096)

出典: Haiku 5.5 モデルページおよびClaude API 料金ドキュメント。

Claude Haiku 5.5 API の最初の呼び出し

Claude Consoleでキーを作成し(Anthropic API キーガイドで手順が説明されています)、ANTHROPIC_API_KEYとしてエクスポートします。キーをコードに直接貼り付けないでください。次にこれを送信します。

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4096,
    "output_config": {"effort": "medium"},
    "thinking": {"type": "adaptive", "display": "summarized"},
    "messages": [{"role": "user", "content": "Classify this ticket as billing, bug, or feature request: The export button times out on large projects."}]
  }'

Python SDKは環境からANTHROPIC_API_KEYを取得します。

import anthropic

client = anthropic.Anthropic()
response = client.messages.create(
    model="claude-haiku-5-5",
    max_tokens=4096,
    output_config={"effort": "medium"},
    thinking={"type": "adaptive", "display": "summarized"},
    messages=[{"role": "user", "content": "Classify this ticket as billing, bug, or feature request: The export button times out on large projects."}],
)

for block in response.content:
    if block.type == "thinking":
        print("[thinking]", block.thinking)
    elif block.type == "text":
        print(block.text)
print(response.stop_reason, response.usage)

TypeScriptも同様の形式に従います。

import Anthropic from "@anthropic-ai/sdk";

const client = new Anthropic();
const response = await client.messages.create({
  model: "claude-haiku-5-5",
  max_tokens: 4096,
  output_config: { effort: "medium" },
  thinking: { type: "adaptive", display: "summarized" },
  messages: [
    { role: "user", content: "Classify this ticket as billing, bug, or feature request: The export button times out on large projects." },
  ],
});

for (const block of response.content) {
  if (block.type === "text") console.log(block.text);
}
console.log(response.stop_reason, response.usage);

このコードを機能させるには3つの習慣があります。応答がthinkingブロックで始まることがありcontent[0].textが壊れるため、コンテンツブロックはtypeで選択します。思考トークンもmax_tokensにカウントされるため、max_tokensには余裕を持たせてください。そして、リクエストボディをクリーンに保ちます。temperature、top_p、top_k、budget_tokens、アシスタントプリフィルは使用しません。これらはすべて、このモデルでは400エラーになります。古いコードを移行する場合は、Haiku 5.5 vs Haiku 4.5 ガイドに、変更前/変更後のJSONとともにすべての破壊的変更がリストされています。

エフォートレベルを選択する

output_config.effortで設定されるエフォートは、品質、レイテンシ、コストを調整する主要なダイヤルです。プロンプティングガイドでは、以下の出発点が示されています。

コスト曲線は急峻です。以下に、Anthropicのローンチチャートから得られたOSWorld 2.1(オフラインサブセット)の実行結果を、部分点スコアと試行あたりのコストとともに示します。

エフォート スコア 試行あたりのコスト
low 42.0% $0.0695
medium 53.3% $0.1257
high 61.3% $0.1827
xhigh 67.6% $0.2792
max 72.4% $0.6111

xhighからmaxに上げると、5点未満のスコア向上のためにコストが2倍以上になります。Haiku 5.5 ベンチマーク分析には、その他のエフォートごとのチャートが掲載されています。

一つ注意点があります。マルチターンチャットでxhighを使用すると、モデルが思考の全てを書き込み、目に見えるテキストなしでターンを終了する場合があります。ユーザーに表示する前に、空の応答がないか確認してください。

思考の制御

適応的思考はデフォルトでオンになっており、Haiku 4.5から2つの変更点があります。まず、デフォルトの表示ではテキストが非表示になります。各thinkingブロックは空のthinkingフィールドとsignatureのみを返します。ログやUIで読みやすい要約が必要な場合は、"display": "summarized"(最初の呼び出しの例のように)を設定します。思考を減らすにはエフォートを下げてください。モデルに直接回答するよう促しても、Anthropicのテストでは停止しませんでした。

次に、思考をオフにすることができますが、highエフォート以下の場合に限られます。

{
  "model": "claude-haiku-5-5",
  "max_tokens": 1024,
  "thinking": {"type": "disabled"},
  "output_config": {"effort": "low"},
  "messages": [{"role": "user", "content": "Extract the invoice number from: INV-2291, due Nov 3."}]
}

xhighまたはmaxでの同じボディは400エラーを返します。強制されたtool_choice(anyまたは指定されたツール)は受け入れられますが、応答はツール呼び出しから始まり、思考ブロックは含まれません。

マルチターンやエージェントのループでは、すべての思考ブロックをそのまま返し、履歴を追記のみに保ちます。返された思考ブロックの前にsystem、tools、または以前のmessagesを変更すると400エラーが返される可能性があり、思考ブロックはそれを生成したアカウント(またはそれにリンクされたアカウント)でのみ機能します。

プロンプトのキャッシュとバッチジョブ

キャッシュはHaiku 5.5が安価になる点です。10万トークンまでのプロンプトの場合、キャッシュ読み取りは100万トークンあたり$0.01で、新しい入力の$0.10と比較して安価です。5分間のキャッシュ書き込みは$0.125、1時間書き込みは$0.20です。キャッシュ可能な最小プロンプトはHaiku 4.5の4,096トークンから512トークンに減少し、短いシステムプロンプトやツールリストも対象となりました。安定したプレフィックスをcache_controlでマークします。

{
  "model": "claude-haiku-5-5",
  "max_tokens": 1024,
  "system": [{
    "type": "text",
    "text": "You are a support triage assistant. <long, stable policy text here>",
    "cache_control": {"type": "ephemeral"}
  }],
  "messages": [{"role": "user", "content": "Ticket: refund not received after 10 days."}]
}

リクエスト間でトップレベルのeffortを変更するとキャッシュが無効になりますが、メッセージごとのエフォート(ベータヘッダーmid-conversation-output-config-2026-07-01、Claude APIおよびGoogle Cloud)はキャッシュを保持します。プロンプトキャッシングのドキュメントにはTTLが記載されており、当社のプロンプトキャッシング解説ではその概念が説明されています。

待機可能な作業の場合、Message Batches APIは入出力を50%削減します。10万トークンまでのプロンプトでは$0.05/$0.25、それ以上では$0.25/$1.25です。バッチは、output-300k-2026-03-24ベータヘッダーを使用することで、30万出力トークンへの唯一の経路でもあります。

10万トークンのラインに注意してください。Anthropicの言葉を借りれば、「10万トークンを超えるプロンプトは高額な料金がかかります」。Haiku 5.5 料金ガイドでは、両方の側面について例を挙げて説明しています。

stop_reason「refusal」の処理

Haiku 5.5はリクエストを拒否できるセーフティ分類器を実行しており、サーバーサイドのフォールバックはありません。拒否されたリクエストはstop_reason: "refusal"を返します。カテゴリにはcyber、frontier_llm、bio、general_harmsがあります。Haiku 4.5から移行している場合、これらの拒否は新しいものです。同じリクエストを再度送信しても、通常は別の拒否が返されるため、やみくもにリトライしないでください。

def run(client, messages):
    response = client.messages.create(
        model="claude-haiku-5-5",
        max_tokens=4096,
        messages=messages,
    )
    if response.stop_reason == "refusal":
        details = getattr(response, "stop_details", None)
        category = getattr(details, "category", "unknown")
        log_refusal(category, messages)  # your logging
        return {"status": "refused", "category": category}
    text = "".join(b.text for b in response.content if b.type == "text")
    return {"status": "ok", "text": text}

contentを読み取る前にstop_reasonで分岐し、拒否されたリクエストはコード内で人間または別のモデルにルーティングします。cyberまたはbio分類器によってブロックされる正当なセキュリティまたはライフサイエンス関連の作業を行っているチームは、Anthropicのサイバー検証プログラムまたはライフサイエンス検証プログラムに申請できます。

コンピューター利用とブラウザー利用

Claude APIとGoogle Cloudでは、Haiku 5.5はcomputer_toolset_20260801ツールセットを通じてのみコンピューター利用をサポートしており、ベータヘッダーは不要です。computer_20250124を宣言すると400エラーが返されます。ブラウザー利用はbrowser_toolset_20260801を通じて行われますが、これはHaiku 4.5ではサポートされていません。PythonおよびTypeScript SDKは、リリース日に両方に対応するベータクラスを追加しました。メンバーツールについては、コンピューター利用ツールに関するドキュメントを参照してください。

レート制限

Haiku 5.5のレート制限はHaiku 4.5と同じです。Startティアでは1分あたり1,000リクエスト、2M入力トークン、400K出力トークン、Scaleティアでは最大10,000リクエスト、10M入力、2M出力です。Priority Tierはサポートされていません。429エラーの処理については、レート制限超過ガイドを参照してください。

ApidogでClaude Haiku 5.5 APIをテストする

保存されたリクエストを使用すると、エフォートの比較や拒否のデバッグを繰り返し行えます。Apidogでの設定方法は以下のとおりです。

  1. 環境を作成し、ANTHROPIC_API_KEYをシークレット変数として追加します。x-api-keyヘッダーで、anthropic-version: 2023-06-01およびcontent-type: application/jsonの隣に、{{ANTHROPIC_API_KEY}}として参照します。
  2. https://api.anthropic.com/v1/messagesへのPOSTリクエストを作成し、最初の呼び出しのボディを貼り付けて保存します。
  3. アサーションを追加します:ステータスが200、$.stop_reasonがend_turnに等しい、$.usage.output_tokensが0より大きい、$.content[*].typeがtextを含むこと。拒否または空のxhigh応答は、見過ごされることなくテストに失敗するようになります。
  4. リクエストをlow、high、xhigh、maxで4回複製し、フォルダーを実行します。自分のプロンプトに対するすべてのエフォートレベルのusageが得られます。
  5. キャッシュされたシステムプロンプトのバリアントを追加し、2回目の実行で$.usage.cache_read_input_tokensが0より大きいことをアサートします。

より広範なパターンについては、LLMアプリケーションのテストを参照してください。

よくある質問 (FAQ)

Claude Haiku 5.5のモデルIDは何ですか? Claude API、Google Cloud、Microsoft Foundry、およびAWS上のClaude Platformでは、claude-haiku-5-5であり、日付サフィックスや別個のエイリアスはありません。Amazon Bedrockではanthropic.claude-haiku-5-5です。

Claude Haiku 5.5 APIの無料版はありますか? 常時提供される無料ティアはありませんが、新しいAPIユーザーにはAPIをテストするための少額の無料クレジットが付与されます。無料のClaude.aiユーザーはチャットでHaiku 5.5を選択できますが、それはAPIキーではありません。MaxおよびTeamプランには、月額APIクレジットが含まれるようになりました。無料アクセスガイドでは、対象となるものと対象外のものが説明されています。

Haiku 4.5のリクエストが400エラーを返すのはなぜですか? budget_tokens、デフォルト以外のtemperatureまたはtop_p、top_kのいずれか、アシスタントプリフィル、または古いcomputer_20250124ツールがないか確認してください。これらが一般的な原因です。

Claude CodeでHaiku 5.5を使用できますか? はい、v2.1.293以降で可能です。Anthropic APIでは、haikuエイリアスはHaiku 5.5に解決されます。Claude CodeでのClaude Haiku 5.5を参照してください。

エージェントコーディングにはHaiku 5.5とSonnet 5.5のどちらを使うべきですか? Anthropicは、Sonnet 5.5とOpus 5.5が「複雑なエージェントコーディングタスクにはより良い選択肢のままである」と述べています。Haiku 5.5は、分類、要約、圧縮、サブエージェント、ブラウザ利用など、狭い範囲の作業に使用してください。

次のステップ

最初の呼び出しリクエストをmediumで送信し、次に自分のワークロードからのプロンプトに対してlowとhighで再実行し、usage.output_tokensと回答の品質を比較します。Apidogをダウンロードして、これら3つの実行をアサーションとともに保存することで、次のモデルリリース時にはフィールドを1つ変更するだけで済むようになります。

button

ApidogでAPIデザイン中心のアプローチを取る

APIの開発と利用をよりシンプルなことにする方法を発見できる