クロード ハイク 5.5 vs GPT-6 ルナ

Haiku 5.5対GPT-6 Luna:10万トークン未満での価格は0.10ドル/0.50ドルで同じだが、ロングプロンプトの段階、Anthropicのベンチマーク、労力あたりのコストデータは異なる。

Medy Evrard

8 10月 2026

クロード ハイク 5.5 vs GPT-6 ルナ

Apidog エンタープライズ

オンプレミスデプロイ

SSO & RBAC

SOC 2 準拠

Apidog Enterpriseを見る

Claude Haiku 5.5とGPT-6 Lunaは、リスト価格を共有しています。Haikuプロンプトが10万トークンまでの場合、入力/出力トークン100万あたり$0.10/$0.50で、両方ともキャッシュ読み取りは$0.01、キャッシュ書き込みは$0.125です。違いはその価格が適用される範囲です。Haiku 5.5は10万トークンを超えると$0.50/$2.50に移行します。一方Lunaは、27万2千入力トークンまでは基本料金を維持し、それ以降は入力が2倍、出力が1.5倍になります。Anthropicの発表テーブルでは、Haiku 5.5は共有されているすべての項目で高いスコアを出しています。Anthropic自身のコストチャートでは、LunaはGDPval-AAのすべての努力レベルでタスクあたりの費用が安く、OSWorldでは5つのうち4つで安価です。OSWorldのミディアムレベルでは、Haiku 5.5がわずかに安価です。

ボタン

以下に、価格、仕様、共有ベンチマークとそれらを実行した機関、努力レベルごとのコスト曲線、ワークロードによるルーティングを示します。各モデルの詳細については、Claude Haiku 5.5とは、GPT-6 Lunaとはをご覧ください。最後のセクションでは、Apidogで同じプロンプトを両モデルに送信します。

価格比較

100万トークンあたり Claude Haiku 5.5 GPT-6 Luna
入力、基本ティア $0.10 (プロンプト10万トークンまで) $0.10 (入力27万2千トークンまで)
出力、基本ティア $0.50 $0.50
キャッシュ読み取り、基本ティア $0.01 $0.01
キャッシュ書き込み、基本ティア $0.125 (5分) $0.125
上位ティア、入力 / 出力 $0.50 / $2.50 (10万超) $0.20 / $0.75 (27万2千超)
上位ティア、キャッシュ読み取り / 書き込み $0.05 / $0.625 キャッシュ料金2倍
バッチ $0.05 / $0.25 (10万まで); $0.25 / $1.25 (それ以上) 標準料金の50% (バッチおよびフレックス)

情報源:Anthropicの料金ドキュメントおよびOpenAIのGPT-6 Lunaモデルページ。OpenAIは27万2千トークンを超える「完全なリクエスト」を再料金設定します。Anthropicは「10万トークンを超えるプロンプトは高額な料金がかかる」と述べており、プロンプトの長さに応じてリクエストごとに課金されます。

10万トークン未満では、料金は完全に一致します。10万から27万2千トークンの間では、Haiku 5.5は入力と出力でLunaの5倍です。27万2千トークンを超えると、両者とも上位ティアになりますが、Lunaの方がまだ安価です。

Anthropicによると、Haiku 4.5のリクエストの約90%は10万トークンまでのプロンプトだったとのことです。もしあなたのトラフィックがそのようであれば、ほとんどの呼び出しはどちらのモデルでも同じ費用がかかります。詳細な計算はClaude Haiku 5.5の料金設定をご覧ください。

トークナイザーがしきい値を移動させる

あるモデルのトークンが、別のモデルのトークンと同じとは限りません。Anthropicによると、Haiku 5.5の更新されたトークナイザーは、同じテキストに対してHaiku 4.5よりも約30%多くのトークンを生成します。Hacker Newsの発表スレッドでは、あるコメント投稿者が「現代のClaudeの10万トークンは、現代のGPTトークンで約6万~6万5千に相当する」と推測しました。これはコミュニティの見積もりであり、ベンダーの数値ではありません。もしこれが正しいなら、Haikuの10万トークンのラインは、生の数値が示すよりもテキスト量としては早く到達することになります。両方のAPIでご自身のプロンプトをカウントし、それぞれのusageオブジェクトを読み取ってください。

仕様

Claude Haiku 5.5 GPT-6 Luna
APIモデルID claude-haiku-5-5 gpt-6-luna
コンテキストウィンドウ 100万トークン 1,050,000トークン
最大出力 12万8千トークン (ベータヘッダー付きバッチでは30万トークン) 128,000トークン
知識のカットオフ 2026年6月 2026年5月18日
努力レベル low, medium (デフォルト), high, xhigh, max none, low, medium (デフォルト), high, xhigh, max
思考オフ thinking: {"type": "disabled"} (high以下の努力レベル) none 推論努力
無料チャットアクセス 無料のClaude.aiユーザーが選択可能 ChatGPTデスクトップアプリの無料およびGoユーザー

両モデルともデフォルトはmediumです。Haiku 5.5ではパラメーターはoutput_config.effort、Lunaではreasoning.effortです。どちらの無料チャット経路もAPIキーではないため、スクリプト、CIジョブ、エージェントを駆動することはできません。Claude Haiku 5.5を無料で使う方法、GPT-6 Lunaを無料で使う方法をご覧ください。

ループ処理において、1つのキャッシュの違いが重要になります。Haiku 5.5では、リクエスト間でトップレベルのeffortを変更するとプロンプトキャッシュが無効になります。OpenAIによると、GPT-6モデルでは推論努力の変更によってキャッシュが壊れることはなくなったとのことです(GPT-6のプロンプトキャッシュ)。

ベンチマーク:Anthropicの表と、各Lunaセルの実行者

以下のすべての数値は、Anthropicの発表記事とそのシステムカードからのものです。Anthropicがこの表を作成しましたが、異なる関係者が異なる行を実行しました。Haiku 5.5の結果は最大努力レベルでのもので、ほとんどが5回の試行の平均です。

ベンチマーク Haiku 5.5 GPT-6 Luna Lunaセルの情報源
GDPval-AA v2.1 (Elo) 1620 1437 Artificial Analysisが独立して実行
AA-Briefcase v1.1 (Elo) 1578 1336 Artificial Analysisが独立して実行
OSWorld 2.1、オフラインサブセット 72.4% 48.9% AnthropicがOpenAIのAPI経由で同じ82タスクで実行
Terminal-Bench 4.0 39.2% 16.4% 公開リーダーボード、Codex CLIの最大努力
FrontierCode 1.1 (Main) 46.4% 42.4% Cognitionが実行 (Claude CodeのClaude、CodexのGPT)
Chartography、ツールなし 46.4% 29.1% Surge AIが公開報告

各行はベンチマーク名を共有していますが、ハーネスは共有していません。Terminal-Benchでは、Claude CodeのHaiku 5.5とCodex CLIのLunaが対決しています。OSWorldはAnthropicが同じタスクで両モデルを実行したため、最も制御されたものに近いですが、それでも競合モデルを1つのベンダーが実行している状態です。

独立した直接対決はまだ存在しません。2026年10月8日現在、Artificial AnalysisにはHaiku 5.5のページがなく、Vals、LMArena、SWE-bench、AiderでもHaiku 5.5の結果は見つかりませんでした。同日のAAのリーダーボードでは、GPT-6 Luna (max)がインテリジェンスインデックス38、1秒あたり129出力トークンと記載されています。Haiku 5.5の全結果は、Claude Haiku 5.5ベンチマークをご覧ください。

各努力レベルでの試行あたりのコスト

発表時の表では各モデルが最大レベルで示されています。Anthropicの発表ページでは、各努力レベルとコストの関係もプロットされており、Lunaについては2つのグラフで示されています。

OSWorld 2.1 (オフラインサブセット)、部分点スコア / 試行あたりのコスト:

努力レベル Haiku 5.5 GPT-6 Luna
Low 42.0% / $0.0695 19.2% / $0.038
Medium 53.3% / $0.1257 37.5% / $0.1261
High 61.3% / $0.1827 42.3% / $0.1435
Xhigh 67.6% / $0.2792 44.8% / $0.1672
Max 72.4% / $0.6111 48.9% / $0.205

GDPval-AA v2.1、Elo / タスクあたりのコスト:

努力レベル Haiku 5.5 GPT-6 Luna
Low 1125 / $0.01167 1036 / $0.0038
Medium 1277 / $0.03042 1262 / $0.02
High 1420 / $0.08938 1344 / $0.03
Xhigh 1513 / $0.26725 1364 / $0.05
Max 1620 / $0.86593 1437 / $0.09

LunaはGDPval-AAのすべての努力レベルで、OSWorldではlow、high、xhigh、maxでコストが安価です。OSWorldのmediumでは、Haiku 5.5がわずかに安価です ($0.1257 vs $0.1261)。Haiku 5.5はすべてのレベルで高いスコアを出しています。同額の支出で比較します。

つまり、コンピュータの使用においては、AnthropicのテストではHaiku 5.5の方が1ドルあたりのスコアが高くなります。知識労働においては、同額の支出であれば両者は近く、十分な性能でよい場合はLunaの低い費用が有利になります。

ルーティング:どのワークロードにどのモデルを

AnthropicはHaiku 5.5を「限定された範囲のタスク」向けに位置づけており、Sonnet 5.5とOpus 5.5は「複雑なエージェントコーディングタスクにはより良い選択肢である」と述べています。ここに挙げられた両モデルは、大量処理向けに構築されています。

ワークロード まず試すべきモデル 理由
10万トークン未満の分類、ルーティング、抽出 どちらでも可;両方テスト 価格は同じ;ラベルの精度で選択
長文Q&A、10万〜27万2千トークン GPT-6 Luna 基本料金が27万2千まで適用;Haiku 5.5は10万超で5倍
ブラウザおよびデスクトップの自動化 Claude Haiku 5.5 同コストでOSWorldスコアが高い
Opus 5.5またはSonnet 5.5のサブエージェント Claude Haiku 5.5 Claude Code model: haikuフロントマター (Anthropic API上のHaiku 5.5)
呼び出しあたりの最低コスト GPT-6 Luna 最低価格:lowレベルで$0.038 (OSWorld) および$0.0038 (GDPval-AA)
高努力レベルでの知識作業の下書き どちらでも可;両方テスト GDPval-AAで同額の支出ならEloスコア17差以内

サブエージェントにはClaude CodeにおけるClaude Haiku 5.5を、高QPSパイプライン用の高ボリュームAPIワークロードには高ボリュームAPIワークロード向けのGPT-6 Lunaを参照してください。Haiku 4.5から移行しますか?Haiku 5.5 vs Haiku 4.5では、新しく追加された5つの400エラーがリストされています。

Apidogで両方を並べてテスト

どちらが優れているかを決める直接対決は、あなたのプロンプトで実行されます。Apidogで、2つのリクエストと同一のプロンプトを持つ1つのプロジェクトを作成してください。

  1. ANTHROPIC_API_KEYとOpenAIキーを環境変数として保存します。
  2. 以下のHaiku 5.5リクエストを追加し、次に同じプロンプトと努力レベルでLunaリクエストを追加します。
  3. Haikuのstop_reasonが"refusal"でないこと (サーバーサイドのフォールバックがないため)、およびusageがトークン予算内に収まっていることを確認します。
  4. 両方をlow、medium、highの努力レベルで実行し、各レスポンスを保存してトークン、レイテンシ、出力を比較します。
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 2048,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [
      {"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error since this morning."}
    ]
  }'

temperature、top_p、top_kは省略してください。これらの非デフォルト値はHaiku 5.5で400エラーを返します。手順はClaude Haiku 5.5 APIの使い方をご覧ください。評価セットについては、LLMアプリケーションのテストを参照してください。

よくある質問

Claude Haiku 5.5とGPT-6 Lunaは同価格ですか? はい、Haikuプロンプトが10万トークンまでは同価格です:$0.10/$0.50、キャッシュ読み取り$0.01、キャッシュ書き込み$0.125。それ以上では、Haiku 5.5は$0.50/$2.50ですが、Lunaは27万2千トークンまで基本料金を維持します。

どちらのモデルがより高いスコアを出しますか? Haiku 5.5です。Anthropicの発表テーブルの共有されているすべての項目で高いスコアを出しています。Anthropicがそのテーブルを作成したものであり、独立した直接対決はまだ存在しません。

タスクあたりでより安価なのはどちらですか? 通常はLunaです。AnthropicのGDPval-AAチャートのすべての努力レベルで、またOSWorldの5つのうち4つで安価です(mediumではHaiku 5.5が$0.0004安価)。同額の支出では、OSWorldではHaiku 5.5がリードし、GDPval-AAでは僅差です。

どちらか無料で利用できますか? チャットのみです。無料のClaude.aiユーザーはHaiku 5.5を選択でき、ChatGPTデスクトップアプリの無料およびGoユーザーはLunaを利用できます。どちらもAPIキーは提供されません。Claude Haiku 5.5を無料で使う方法をご覧ください。

プロンプトの長さで選択し、その後テスト

まずプロンプトの長さを確認してください。10万トークン未満では価格は同じで、精度が決め手となります。Anthropicの数値ではHaiku 5.5が有利です。10万から27万2千トークンの間では、Lunaのしきい値がすべての呼び出しで費用を節約します。その後、実際の要求で両方を2つか3つの努力レベルで実行してください。Apidogをダウンロードし、両方のリクエストを1つのプロジェクトに入れ、usageの数値で判断しましょう。

ApidogでAPIデザイン中心のアプローチを取る

APIの開発と利用をよりシンプルなことにする方法を発見できる