Claude Haiku 5.5とGPT-6 Lunaは、リスト価格を共有しています。Haikuプロンプトが10万トークンまでの場合、入力/出力トークン100万あたり$0.10/$0.50で、両方ともキャッシュ読み取りは$0.01、キャッシュ書き込みは$0.125です。違いはその価格が適用される範囲です。Haiku 5.5は10万トークンを超えると$0.50/$2.50に移行します。一方Lunaは、27万2千入力トークンまでは基本料金を維持し、それ以降は入力が2倍、出力が1.5倍になります。Anthropicの発表テーブルでは、Haiku 5.5は共有されているすべての項目で高いスコアを出しています。Anthropic自身のコストチャートでは、LunaはGDPval-AAのすべての努力レベルでタスクあたりの費用が安く、OSWorldでは5つのうち4つで安価です。OSWorldのミディアムレベルでは、Haiku 5.5がわずかに安価です。
以下に、価格、仕様、共有ベンチマークとそれらを実行した機関、努力レベルごとのコスト曲線、ワークロードによるルーティングを示します。各モデルの詳細については、Claude Haiku 5.5とは、GPT-6 Lunaとはをご覧ください。最後のセクションでは、Apidogで同じプロンプトを両モデルに送信します。
価格比較
| 100万トークンあたり | Claude Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| 入力、基本ティア | $0.10 (プロンプト10万トークンまで) | $0.10 (入力27万2千トークンまで) |
| 出力、基本ティア | $0.50 | $0.50 |
| キャッシュ読み取り、基本ティア | $0.01 | $0.01 |
| キャッシュ書き込み、基本ティア | $0.125 (5分) | $0.125 |
| 上位ティア、入力 / 出力 | $0.50 / $2.50 (10万超) | $0.20 / $0.75 (27万2千超) |
| 上位ティア、キャッシュ読み取り / 書き込み | $0.05 / $0.625 | キャッシュ料金2倍 |
| バッチ | $0.05 / $0.25 (10万まで); $0.25 / $1.25 (それ以上) | 標準料金の50% (バッチおよびフレックス) |
情報源:Anthropicの料金ドキュメントおよびOpenAIのGPT-6 Lunaモデルページ。OpenAIは27万2千トークンを超える「完全なリクエスト」を再料金設定します。Anthropicは「10万トークンを超えるプロンプトは高額な料金がかかる」と述べており、プロンプトの長さに応じてリクエストごとに課金されます。
10万トークン未満では、料金は完全に一致します。10万から27万2千トークンの間では、Haiku 5.5は入力と出力でLunaの5倍です。27万2千トークンを超えると、両者とも上位ティアになりますが、Lunaの方がまだ安価です。
- 15万トークンのプロンプト、2千トークンの出力。 Haiku 5.5: 0.15 × $0.50 + 0.002 × $2.50 = $0.080。 Luna: 0.15 × $0.10 + 0.002 × $0.50 = $0.016。
- 30万トークンのプロンプト、2千トークンの出力。 Haiku 5.5: 0.30 × $0.50 + 0.002 × $2.50 = $0.155。 Luna: 0.30 × $0.20 + 0.002 × $0.75 = $0.0615。
Anthropicによると、Haiku 4.5のリクエストの約90%は10万トークンまでのプロンプトだったとのことです。もしあなたのトラフィックがそのようであれば、ほとんどの呼び出しはどちらのモデルでも同じ費用がかかります。詳細な計算はClaude Haiku 5.5の料金設定をご覧ください。
トークナイザーがしきい値を移動させる
あるモデルのトークンが、別のモデルのトークンと同じとは限りません。Anthropicによると、Haiku 5.5の更新されたトークナイザーは、同じテキストに対してHaiku 4.5よりも約30%多くのトークンを生成します。Hacker Newsの発表スレッドでは、あるコメント投稿者が「現代のClaudeの10万トークンは、現代のGPTトークンで約6万~6万5千に相当する」と推測しました。これはコミュニティの見積もりであり、ベンダーの数値ではありません。もしこれが正しいなら、Haikuの10万トークンのラインは、生の数値が示すよりもテキスト量としては早く到達することになります。両方のAPIでご自身のプロンプトをカウントし、それぞれのusageオブジェクトを読み取ってください。
仕様
| Claude Haiku 5.5 | GPT-6 Luna | |
|---|---|---|
| APIモデルID | claude-haiku-5-5 |
gpt-6-luna |
| コンテキストウィンドウ | 100万トークン | 1,050,000トークン |
| 最大出力 | 12万8千トークン (ベータヘッダー付きバッチでは30万トークン) | 128,000トークン |
| 知識のカットオフ | 2026年6月 | 2026年5月18日 |
| 努力レベル | low, medium (デフォルト), high, xhigh, max | none, low, medium (デフォルト), high, xhigh, max |
| 思考オフ | thinking: {"type": "disabled"} (high以下の努力レベル) |
none 推論努力 |
| 無料チャットアクセス | 無料のClaude.aiユーザーが選択可能 | ChatGPTデスクトップアプリの無料およびGoユーザー |
両モデルともデフォルトはmediumです。Haiku 5.5ではパラメーターはoutput_config.effort、Lunaではreasoning.effortです。どちらの無料チャット経路もAPIキーではないため、スクリプト、CIジョブ、エージェントを駆動することはできません。Claude Haiku 5.5を無料で使う方法、GPT-6 Lunaを無料で使う方法をご覧ください。
ループ処理において、1つのキャッシュの違いが重要になります。Haiku 5.5では、リクエスト間でトップレベルのeffortを変更するとプロンプトキャッシュが無効になります。OpenAIによると、GPT-6モデルでは推論努力の変更によってキャッシュが壊れることはなくなったとのことです(GPT-6のプロンプトキャッシュ)。
ベンチマーク:Anthropicの表と、各Lunaセルの実行者
以下のすべての数値は、Anthropicの発表記事とそのシステムカードからのものです。Anthropicがこの表を作成しましたが、異なる関係者が異なる行を実行しました。Haiku 5.5の結果は最大努力レベルでのもので、ほとんどが5回の試行の平均です。
| ベンチマーク | Haiku 5.5 | GPT-6 Luna | Lunaセルの情報源 |
|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 1620 | 1437 | Artificial Analysisが独立して実行 |
| AA-Briefcase v1.1 (Elo) | 1578 | 1336 | Artificial Analysisが独立して実行 |
| OSWorld 2.1、オフラインサブセット | 72.4% | 48.9% | AnthropicがOpenAIのAPI経由で同じ82タスクで実行 |
| Terminal-Bench 4.0 | 39.2% | 16.4% | 公開リーダーボード、Codex CLIの最大努力 |
| FrontierCode 1.1 (Main) | 46.4% | 42.4% | Cognitionが実行 (Claude CodeのClaude、CodexのGPT) |
| Chartography、ツールなし | 46.4% | 29.1% | Surge AIが公開報告 |
各行はベンチマーク名を共有していますが、ハーネスは共有していません。Terminal-Benchでは、Claude CodeのHaiku 5.5とCodex CLIのLunaが対決しています。OSWorldはAnthropicが同じタスクで両モデルを実行したため、最も制御されたものに近いですが、それでも競合モデルを1つのベンダーが実行している状態です。
独立した直接対決はまだ存在しません。2026年10月8日現在、Artificial AnalysisにはHaiku 5.5のページがなく、Vals、LMArena、SWE-bench、AiderでもHaiku 5.5の結果は見つかりませんでした。同日のAAのリーダーボードでは、GPT-6 Luna (max)がインテリジェンスインデックス38、1秒あたり129出力トークンと記載されています。Haiku 5.5の全結果は、Claude Haiku 5.5ベンチマークをご覧ください。
各努力レベルでの試行あたりのコスト
発表時の表では各モデルが最大レベルで示されています。Anthropicの発表ページでは、各努力レベルとコストの関係もプロットされており、Lunaについては2つのグラフで示されています。
OSWorld 2.1 (オフラインサブセット)、部分点スコア / 試行あたりのコスト:
| 努力レベル | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Low | 42.0% / $0.0695 | 19.2% / $0.038 |
| Medium | 53.3% / $0.1257 | 37.5% / $0.1261 |
| High | 61.3% / $0.1827 | 42.3% / $0.1435 |
| Xhigh | 67.6% / $0.2792 | 44.8% / $0.1672 |
| Max | 72.4% / $0.6111 | 48.9% / $0.205 |
GDPval-AA v2.1、Elo / タスクあたりのコスト:
| 努力レベル | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Low | 1125 / $0.01167 | 1036 / $0.0038 |
| Medium | 1277 / $0.03042 | 1262 / $0.02 |
| High | 1420 / $0.08938 | 1344 / $0.03 |
| Xhigh | 1513 / $0.26725 | 1364 / $0.05 |
| Max | 1620 / $0.86593 | 1437 / $0.09 |
LunaはGDPval-AAのすべての努力レベルで、OSWorldではlow、high、xhigh、maxでコストが安価です。OSWorldのmediumでは、Haiku 5.5がわずかに安価です ($0.1257 vs $0.1261)。Haiku 5.5はすべてのレベルで高いスコアを出しています。同額の支出で比較します。
- OSWorld: mediumレベルでは、Haiku 5.5は1試行あたり$0.1257、Lunaは$0.1261で、Haiku 5.5が53.3%のスコアに対しLunaは37.5%です。Haikuのmediumは、Lunaのmax (48.9%) よりも少ない費用で上回っています。
- GDPval-AA: Lunaのmax (1437, $0.09) とHaiku 5.5のhigh (1420, $0.08938) はほぼ同等の費用で、Eloスコアは17ポイント差です。
つまり、コンピュータの使用においては、AnthropicのテストではHaiku 5.5の方が1ドルあたりのスコアが高くなります。知識労働においては、同額の支出であれば両者は近く、十分な性能でよい場合はLunaの低い費用が有利になります。
ルーティング:どのワークロードにどのモデルを
AnthropicはHaiku 5.5を「限定された範囲のタスク」向けに位置づけており、Sonnet 5.5とOpus 5.5は「複雑なエージェントコーディングタスクにはより良い選択肢である」と述べています。ここに挙げられた両モデルは、大量処理向けに構築されています。
| ワークロード | まず試すべきモデル | 理由 |
|---|---|---|
| 10万トークン未満の分類、ルーティング、抽出 | どちらでも可;両方テスト | 価格は同じ;ラベルの精度で選択 |
| 長文Q&A、10万〜27万2千トークン | GPT-6 Luna | 基本料金が27万2千まで適用;Haiku 5.5は10万超で5倍 |
| ブラウザおよびデスクトップの自動化 | Claude Haiku 5.5 | 同コストでOSWorldスコアが高い |
| Opus 5.5またはSonnet 5.5のサブエージェント | Claude Haiku 5.5 | Claude Code model: haikuフロントマター (Anthropic API上のHaiku 5.5) |
| 呼び出しあたりの最低コスト | GPT-6 Luna | 最低価格:lowレベルで$0.038 (OSWorld) および$0.0038 (GDPval-AA) |
| 高努力レベルでの知識作業の下書き | どちらでも可;両方テスト | GDPval-AAで同額の支出ならEloスコア17差以内 |
サブエージェントにはClaude CodeにおけるClaude Haiku 5.5を、高QPSパイプライン用の高ボリュームAPIワークロードには高ボリュームAPIワークロード向けのGPT-6 Lunaを参照してください。Haiku 4.5から移行しますか?Haiku 5.5 vs Haiku 4.5では、新しく追加された5つの400エラーがリストされています。
Apidogで両方を並べてテスト
どちらが優れているかを決める直接対決は、あなたのプロンプトで実行されます。Apidogで、2つのリクエストと同一のプロンプトを持つ1つのプロジェクトを作成してください。
ANTHROPIC_API_KEYとOpenAIキーを環境変数として保存します。- 以下のHaiku 5.5リクエストを追加し、次に同じプロンプトと努力レベルでLunaリクエストを追加します。
- Haikuの
stop_reasonが"refusal"でないこと (サーバーサイドのフォールバックがないため)、およびusageがトークン予算内に収まっていることを確認します。 - 両方をlow、medium、highの努力レベルで実行し、各レスポンスを保存してトークン、レイテンシ、出力を比較します。
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 2048,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [
{"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error since this morning."}
]
}'
temperature、top_p、top_kは省略してください。これらの非デフォルト値はHaiku 5.5で400エラーを返します。手順はClaude Haiku 5.5 APIの使い方をご覧ください。評価セットについては、LLMアプリケーションのテストを参照してください。
よくある質問
Claude Haiku 5.5とGPT-6 Lunaは同価格ですか? はい、Haikuプロンプトが10万トークンまでは同価格です:$0.10/$0.50、キャッシュ読み取り$0.01、キャッシュ書き込み$0.125。それ以上では、Haiku 5.5は$0.50/$2.50ですが、Lunaは27万2千トークンまで基本料金を維持します。
どちらのモデルがより高いスコアを出しますか? Haiku 5.5です。Anthropicの発表テーブルの共有されているすべての項目で高いスコアを出しています。Anthropicがそのテーブルを作成したものであり、独立した直接対決はまだ存在しません。
タスクあたりでより安価なのはどちらですか? 通常はLunaです。AnthropicのGDPval-AAチャートのすべての努力レベルで、またOSWorldの5つのうち4つで安価です(mediumではHaiku 5.5が$0.0004安価)。同額の支出では、OSWorldではHaiku 5.5がリードし、GDPval-AAでは僅差です。
どちらか無料で利用できますか? チャットのみです。無料のClaude.aiユーザーはHaiku 5.5を選択でき、ChatGPTデスクトップアプリの無料およびGoユーザーはLunaを利用できます。どちらもAPIキーは提供されません。Claude Haiku 5.5を無料で使う方法をご覧ください。
プロンプトの長さで選択し、その後テスト
まずプロンプトの長さを確認してください。10万トークン未満では価格は同じで、精度が決め手となります。Anthropicの数値ではHaiku 5.5が有利です。10万から27万2千トークンの間では、Lunaのしきい値がすべての呼び出しで費用を節約します。その後、実際の要求で両方を2つか3つの努力レベルで実行してください。Apidogをダウンロードし、両方のリクエストを1つのプロジェクトに入れ、usageの数値で判断しましょう。
