Grok 4.7を呼び出すには、https://api.x.ai/v1/responsesに"model": "grok-4.7"とxAIキーをBearerトークンとして含むPOSTリクエストを送信してください。20万トークン未満のプロンプトの場合、料金は入力トークン100万あたり2ドル、キャッシュされた入力トークン100万あたり0.50ドル、出力トークン100万あたり6ドルで、50万トークンのコンテキストウィンドウを持ちます。SpaceXAI(旧xAI)は2026年9月21日にGrok 4.6と同じ価格でリリースしたため、ほとんどの既存のインテグレーションでは、アップグレードは一行の変更で済みます。
ボタン
以下に、最初のリクエスト、推論の労力とそれが料金に与える影響、暗号化された推論、キャッシュ、ストリーミング、ツール、レート制限、そしてApidogでの再利用可能なテスト設定について説明します。モデルの背景については、Grok 4.7とは何か、そして何が変わったかをお読みください。公式リファレンスは、xAIドキュメントのGrok 4.7ページです。
Grok 4.7 APIの概要
| プロパティ | 値 |
|---|---|
| モデルID | grok-4.7 |
| エンドポイント | POST https://api.x.ai/v1/responses (Chat Completionsはレガシーエンドポイントとして引き続き利用可能) |
| コンテキストウィンドウ | 500,000トークン |
| 出力制限 | xAIによる記載なし |
| 入力 / キャッシュ / 出力 (20万トークン未満) | 100万トークンあたり $2.00 / $0.50 / $6.00 |
| 入力 / キャッシュ / 出力 (20万トークン以上) | 100万トークンあたり $4.00 / $1.00 / $12.00 |
| 推論の労力 | low、medium、high (デフォルト)、xhigh |
| 入力 | テキストと画像 (JPGまたはPNG、最大20 MiB) |
| ツール | 関数呼び出し、Web検索、X検索、コード実行 |
| 知識カットオフ | 2026年5月 |
| バッチAPI | 非サポート |
Step 1: キーを取得してクレジットをロードする
console.x.aiでアカウントを作成し、クレジットをロード(APIはプリペイド)して、キーを生成します。弊社のGrok APIキーガイドは、コンソール画面を詳しく説明しています。キーはコードから分離して保管してください。
export XAI_API_KEY="your-key-here"
Step 2: 最初のリクエストを作成する
Responses APIは主要なエンドポイントであり、xAIドキュメントのすべての例で使用されています。
curl https://api.x.ai/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $XAI_API_KEY" \
-d '{
"model": "grok-4.7",
"input": "Review this function for bugs: function median(a){a.sort();return a[a.length/2]}"
}'
APIはOpenAI SDKで動作します。クライアントをxAIのベースURLに向け、responses.createを呼び出します。
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.XAI_API_KEY,
baseURL: "https://api.x.ai/v1",
});
const response = await client.responses.create({
model: "grok-4.7",
reasoning: { effort: "medium" },
input: [
{ role: "system", content: "You are a senior backend reviewer." },
{ role: "user", content: "Find the bug in: function median(a){a.sort();return a[a.length/2]}" },
],
});
console.log(response.output_text);
他のクライアントを好む場合、同じモデルはxAIのPython SDK(xai_sdk)ではgrok-4.7、Vercel AI SDKではxai.responses('grok-4.7')、LiteLLMではxai/grok-4.7です。互換性に関する2つの注意点:xAIは現在、Chat Completionsをレガシーエンドポイントと位置付けており、そのAnthropic SDK互換性は完全に非推奨となっています。新しいコードは/v1/responsesをターゲットにすべきです。
Step 3: 推論の労力を選択する
Grok 4.7は常に推論を行います。それをオフにすることはできませんが、Responses APIのreasoning.effort(xAI SDKではreasoning_effort)で思考の強度を制御できます。lowは遅延に敏感なツール呼び出し、mediumは分析と長いコンテキスト、high(デフォルト)は複雑な多段階問題、xhighは応答時間よりも品質が重視される場合に使用します。
この設定は、請求額に最も大きく影響します。SpaceXAIのリリースぺージでは、労力レベルごとのCursorBench 4.0の結果が公開されており、その差は広範です。
| 労力 | CursorBench 4.0 | タスクあたりの平均コスト | タスクあたりの平均出力トークン数 |
|---|---|---|---|
| low | 33.1% | $1.58 | 15,677 |
| medium | 41.6% | $3.49 | 36,683 |
| high | 43.9% | $4.69 | 56,382 |
| xhigh | 46.3% | $6.01 | 70,141 |
lowからxhighに移行すると13.2ポイント向上しますが、モデルが約4.5倍の出力トークンを生成するため、タスクあたりのコストは約3.8倍になります。最初はmediumから始め、テストで追加の品質が重要であると示された場合にのみ、より高いレベルに移行してください。
もう1つの制約:推論モデルはpresencePenalty、frequencyPenalty、stopを拒否します。古いラッパーがこれらのいずれかを送信した場合、リクエストはエラーを返します。
Step 4: 複数ターンの呼び出しで暗号化された推論を処理する
これは、最も驚く可能性のある動作変更です。Responses APIでは、grok-4.7はincludeリストで要求されていない場合でも、常にreasoning.encrypted_contentを返します。推論を読み取ることはできませんが、それを引き継ぐことはできます。
複数ターンの会話の場合、前の応答からの推論項目を、次のリクエストのinputで変更せずに渡してください。これにより、モデルの推論はターン間でそのまま維持されます。これらの項目を編集したり、切り詰めたり、並べ替えたりしないでください。コードが次のターンを構築する前にoutput配列をmessage項目にフィルタリングしている場合、Grok 4.7が返されることを期待するコンテキストが破棄されることになります。Chat Completionsの動作は変更されていません。
Step 5: キャッシュを有効活用する
キャッシュされた入力は、新しい入力の100万トークンあたり2ドルに対して0.50ドルで、75%の割引です。注意点としては、キャッシュヒットには、リクエストが既にプレフィックスを保持しているサーバーに到達する必要があります。SpaceXAIは、Responses API呼び出しでprompt_cache_key(またはChat Completionsでx-grok-conv-idヘッダー)を設定することを「強く推奨」しています。これにより、会話のリクエストが同じサーバーにルーティングされます。これがないと、xAIは、キャッシュが効いていないサーバーで全額の入力料金を支払うことがよくあると警告しています。
再利用のためにプロンプトの順序を決定します。システムプロンプト、ツールスキーマ、参照ドキュメントを最初に置き、新しいユーザーメッセージを最後にします。先頭近くの何かが変更されると、プレフィックスが壊れ、割引も失われます。
Step 6: レスポンスをストリーミングする
最後に1つのJSONボディを受け取るのではなく、サーバー送信イベントを受け取るには"stream": trueを追加します。推論は常にオンであるため、モデルは最初の回答トークンが生成されるまでにしばらく考えることができ、ストリーミングではない呼び出しはハングアップしているように見えたり、短いHTTPタイムアウトを引き起こしたりする可能性があります。Grok 4.7は推論の要約をストリーミングするため、モデルが考えている間に進行状況を表示できます。
関数呼び出しは例外です。xAIドキュメントによると、関数呼び出しは単一のチャンクで完全に到着します。デルタから引数を組み立てるのではなく、そのチャンクが到着したときに解析してください。SSE経由でストリーミングするLLM APIのテストに関するガイドでは、Apidogで生のイベントシーケンスを検査する方法を示しています。
Step 7: ツールを追加する
関数呼び出しはResponses APIのツール形式を使用します。関数を記述すると、Grokはfunction_call項目を返し、それを実行し、一致するcall_idを含むfunction_call_outputを返送します。
curl https://api.x.ai/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $XAI_API_KEY" \
-d '{
"model": "grok-4.7",
"input": [{"role": "user", "content": "Has order 10482 shipped yet?"}],
"tools": [{
"type": "function",
"name": "get_order_status",
"description": "Look up the fulfillment status of an order",
"parameters": {
"type": "object",
"properties": { "order_id": {"type": "string"} },
"required": ["order_id"]
}
}]
}'
構造化出力もサポートされているため、最終的な回答をJSONスキーマに保持できます。
サーバーサイドツールはxAI側で実行されます。{"type": "web_search"}、X検索、コード実行です。これらはトークンに加えて課金されます。Web検索は1,000回呼び出しあたり5ドル、X検索は1,000投稿あたり5ドル、コード実行は1,000回呼び出しあたり5ドルで、毎ターン検索するエージェントは毎ターンその料金を支払います。Web検索はallowed_domainsとexcluded_domains(それぞれ最大5つ)を受け入れます。検索ツールがない場合、Grok 4.7にはライブデータがなく、その知識は2026年5月で止まります。
20万トークンの料金の壁に注意する
料金表に2つの行があるのには理由があります。プロンプトが20万トークンに達すると、リクエスト全体が高いレートで課金されます。入力4ドル、キャッシュ1ドル、出力12ドルです。単にその上限を超えたトークンだけが高くなるわけではありません。
19万トークンのプロンプトと4,000トークンの回答の場合、コストは約0.40ドルです。同じ回答でも21万トークンのプロンプトの場合、コストは約0.89ドルになります。入力が約10%増えるだけで、請求額は2倍以上になります。
送信前にトークンをカウントし、会話が上限に近づいたら履歴を要約し、長いエージェントループにはxAIのコンテキスト圧縮を使用してください。50万トークンのウィンドウの安い部分は20万トークンで終了します。
レート制限と429エラー
制限は累積支出に応じてスケールし、Grok 4.6のものと一致します。
| ティア (累積支出) | 1秒あたりのリクエスト数 | 1分あたりのトークン数 |
|---|---|---|
| T0 ($0) | 150 | 50M |
| T1 ($50) | 172 | 53M |
| T2 ($250) | 208 | 60M |
| T3 ($1,000) | 312 | 74M |
| T4 ($5,000) | 500 | 100M |
キャッシュされたトークンも1分あたりのトークン数にカウントされます。超過するとHTTP 429エラーが発生します。エンドポイントを繰り返し叩くのではなく、指数関数的バックオフとジッターで再試行してください。弊社のレート制限超過エラーに関するガイドでパターンを説明しています。
Grok 4.6からの移行
ほとんどのインテグレーションには1つの変更が必要です。grok-4.6がgrok-4.7になります。価格、コンテキストウィンドウ、レート制限、労力レベルは同じです。本番環境のトラフィックを移行する前に、以下の3つの項目を再テストしてください。
- 複数ターン処理。 コードが暗号化された推論項目を元のまま返すことを確認してください。
- タスクあたりのトークン数。 新しい、より大規模な基盤モデルは、同じトークンあたりのレートであっても、タスクにかかるトークン数を変更します。実際のプロンプトを測定してください。
- 労力マッピング。 Cursorのドキュメントによると、労力レベルはGrok 4.6よりも明確に分離されているため、
mediumで調整されたルートは異なる動作をする可能性があります。
変更されていないすべての項目については、弊社のGrok 4.6 APIガイドが引き続き有効です。2つの注意点:https://us.api.x.ai/v1は10%のプレミアムで推論を米国に維持し、Grok 4.7 Fast(2倍の価格)はCursorとGrok Buildのみで利用可能であり、パブリックAPIでは利用できません。
ApidogでGrok 4.7 APIをテストする
労力レベルを比較したり、アップグレードを確認したりする場合、シェル履歴に残るcURLコマンドよりも、保存され、繰り返し実行可能なリクエストの方が優れています。
- Apidogで、
base_urlをhttps://api.x.ai/v1に設定し、XAI_API_KEYを秘密変数として保存した**環境を作成**します。必要であれば、米国エンドポイント用の2番目の環境を追加してください。 - **リクエストを保存します。**
POST {{base_url}}/responsesにAuthorization: Bearer {{XAI_API_KEY}}ヘッダーとボディに実際のプロンプトを含めます。 - **アサーションを追加します。** ステータスが200、
modelがgrok-4.7、usageが存在し、outputがmessage項目を含むことを確認します。これらは、アプリケーションが気付く前に、誤ったキー、誤ったモデルID、または変更された応答形状を検出します。 - **労力レベルごと(**
low、medium、high、xhigh)にクローンを作成し、4つを1つのテストシナリオとして実行します。これにより、ベンチマークではなく、自身のプロンプトに対する応答時間とトークン使用量を並べて確認できます。 - 応答形状が安定したら**エンドポイントをモック**し、クレジットを消費することなくフロントエンド作業を続行できるようにします。
次のモデルがリリースされたら、1つの変数を変更して再実行します。Apidogをダウンロードして設定してください。
FAQ
Grok 4.7のモデルIDは何ですか? grok-4.7です。パートナープラットフォームでは、spacexai/grok-4.7 (Vercel AI Gateway) およびx-ai/grok-4.7 (OpenRouter) です。
Grok 4.7 APIの料金はいくらですか? 20万トークン未満のプロンプトの場合、入力トークン100万あたり2ドル、キャッシュ済み0.50ドル、出力6ドルです。20万トークン以上ではその2倍になります。4.7にはバッチ割引はありません。
推論をオフにできますか? いいえ。最速で最も安価なレスポンスを得るには、lowの労力を使用してください。
無料のGrok 4.7 APIはありますか? xAIのAPIはプリペイドクレジットで動作します。Grok 4.7を無料で利用する方法に関するガイドでは、存在する無料ルートについて説明しています。
Grok 4.7はGPT-6 SolおよびClaude Opus 5.5と比較してどうですか? 3つの中で最も出力価格が低く、両ベンダーが報告するコーディングベンチマークではOpus 5.5に劣ります。3者比較で数値を確認できます。
保存された1つのリクエストから始める
上記のcURLリクエストを送信し、Apidogにアサーションと労力レベルシナリオとともに保存します。これにより、トラフィックを移行する前に、自身のプロンプトに対するタスクあたりのベースラインコストが得られます。デフォルトの労力レベルを選択するには、次にGrok 4.7ベンチマークの内訳をお読みください。
