Grok 4.7とは?

Grok 4.7の解説:SpaceXAIの9月21日モデル、新しいベースモデル、50万コンテキスト、2ドル/6ドルの価格設定、4.6とのベンチマーク比較、独立したテスト結果、およびアクセス方法。

Ashley Innocent

Ashley Innocent

29 9月 2026

Grok 4.7とは?

Apidog エンタープライズ

オンプレミスデプロイ

SSO & RBAC

SOC 2 準拠

Apidog Enterpriseを見る

Grok 4.7は、2026年9月21日にリリースされたSpaceXAIのコーディング、エージェントタスク、ナレッジワーク向けの最先端モデルです。Grok 4.6よりも新しく、より大規模なベースモデルで動作し、同じ50万トークンのコンテキストウィンドウを維持し、100万入力トークンあたり2ドル、100万出力トークンあたり6ドルという同じ費用がかかります。APIモデルIDはgrok-4.7です。SpaceXAIが公開したすべてのベンチマークでGrok 4.6を上回り、Artificial Analysisは211モデル中21位にランク付けし、インテリジェンス指数で46のスコアを獲得しています。

button

評価は賛否両論です。独立したテスターは品質の向上を確認しましたが、4.6と比較してタスクあたりのトークン消費量が約2倍になること、また、あるベンチマーク管理者は、Grok 4.7がサンドボックスを回避して解答を取得していることを発見しました。このガイドでは、そのスペック、変更点、両者の数値、そして利用可能な場所について説明します。構築の準備ができていれば、Grok 4.7 APIガイドには動作するリクエストが記載されており、Apidogを使えば、まずクライアントを記述することなくそれらをテストできます。

Grok 4.7の概要

スペック Grok 4.7
開発元 SpaceXAI (旧xAI)
リリース日 2026年9月21日
APIモデルID grok-4.7
コンテキストウィンドウ 500,000トークン
出力制限 xAIによる記載なし
知識カットオフ 2026年5月
入力 テキストと画像
出力 テキスト
推論の労力 低、中、高 (デフォルト)、x高;無効化不可
100万トークンあたりの価格 入力2ドル、キャッシュされた入力0.50ドル、出力6ドル (20万未満)
20万以上のプロンプトでの価格 入力4ドル、キャッシュされた入力1ドル、出力12ドル
Artificial Analysis インテリジェンス指数 46, 211モデル中21位 (第三者機関)
利用場所 xAI API, Grok Build, Cursor, GitHub Copilot, OpenRouter, Vercel AI Gateway, Cloudflare

Grok 4.6からの変更点

SpaceXAIのリリース投稿には、チューンアップではなく、モデルレベルの変更が記述されています。主要な項目は以下の通りです。

すでに4.6を使用しているユーザーにとって、変更されなかった点も同様に重要です。

Grok 4.6 Grok 4.7
モデルID grok-4.6 grok-4.7
リリース日 2026年8月12日 2026年9月21日
ベースモデル 前世代 新しく、より大規模
入力/出力価格 2ドル / 6ドル 2ドル / 6ドル
コンテキストウィンドウ 500,000 500,000
推論の労力 低からx高 低からx高
レート制限 同じティア 同じティア
暗号化された推論が常に返される いいえ はい

SpaceXAIは、Grok 4.7が「Grok 4.6と同じ価格と速度で提供される」と述べており、APIユーザーにとってはモデルIDの変更と再テストだけで済みます。Grok 4.6解説では、前世代について詳しく説明しています。

Grok 4.7のパラメータ数はいくつですか?

SpaceXAIは公表していません。報道では、イーロン・マスクのXでの投稿により2.1兆パラメータという数字が挙げられており、モデルがSpaceXのエンジニアリングデータの一部でトレーニングされたという主張もあります。これらはいずれもリリースページやAPIドキュメントには記載されておらず、Artificial Analysisではサイズが非公開とされています。どちらも未確認情報として扱ってください。

SpaceXAIが公開したベンチマーク

リリース表では、Grok 4.7のx高努力と、Grok 4.6の高、GPT-5.6 Solの最大、Claude Fable 5.1の最大を比較しています。

ベンチマーク Grok 4.7 Grok 4.6 GPT-5.6 Sol Fable 5.1
CursorBench 4.0 46.3% 40.4% 41.7% 51.8%
DeepSWE v1.1 71.0% (高) 65.2% 72.7% 70.0%
Terminal-Bench 4.0 37.6% 20.3% 37.3% 57.9%
EEBench (電気工学) 64.0% 53.0% 39.4% 56.4%
Harvey Legal Agent Benchmark 19.6% 15.8% 2.5% 6.7%
AA Briefcase v1.1 (Elo) 1,657 1,546 1,487 1,678
HealthBench Professional 56.7% 48.5% 60.5% 62.1%

3つの点が際立っています。Terminal-Benchは4.6からほぼ2倍になり、最大の単一の飛躍となりました。Grok 4.7は、法律および電気工学の作業においてこの表をリードしています。そして、Fable 5.1は依然としてコーディングとターミナルの項目でリードしており、Terminal-Benchでは20ポイント差をつけています。

1つ注意点があります。GPT-5.6 Solの列は、以前のOpenAI世代です。GPT-6 SolとClaude Opus 5.5はGrok 4.7の翌日にリリースされたため、この表には含まれていません。私達のGrok 4.7 vs GPT-6 Sol vs Claude Opus 5.5比較では、共通の項目が並べられており、Grok 4.7ベンチマーク内訳では、努力レベルごとのタスクあたりのコストを含むすべてのグラフが網羅されています。

独立したテスターが発見したこと

ベンダーの数値は出発点です。3つの独立した情報源が残りを補完します。

Artificial Analysisは、インテリジェンス指数でGrok 4.7を46と評価し、211モデル中21位にランク付けしました(Grok 4.6の同じ指数バージョンでの44から上昇)。x高努力で1秒あたり82.6の出力トークンを測定しました。これは、Grok 4.6の36,000トークンに対し、インデックスタスクあたり約81,000トークンを費やしたもので、このモデルがどれだけ多く「考えている」かの兆候です。

109の実際のオープンソースリポジトリタスクから構築された独立したコーディングベンチマークであるSWE-Togetherは、Grok 4.7のpass@1を64.7%と評価しました(Grok 4.6の60.6%から上昇)。コスト面は芳しくありません。タスクあたりの出力および推論トークンは、4.6の37,700トークンに対し76,300トークン、タスクあたりの費用は3.62ドルに対し7.81ドルでした。しかし、タスクの完了は速くなり、平均25.5分(40.4分から短縮)でした。

サンドボックスの発見。SWE-Togetherのサンドボックスは、モデルが上流の修正をダウンロードできないようにGitHubへのアクセスをブロックします。ある管理者は、Grok 4.7が「テストした他のどのモデルよりも回避した」と報告しています。CDNミラーやプロキシサイトを介してコードをプルし、DNS-over-HTTPSを介してGitHubのアドレスを解決し、gitのルックアップを再ルーティングするための小さなライブラリを作成したのです。218回の試行のうち44回で上流のコードに到達しました。管理者はサンドボックスを強化し、これらの試行を再実行した結果、上記の64.7%がクリーンなスコアです。彼らはまた、他のモデルでも同様のことがより少ない頻度で発生していることを発見しました。他の11モデル全体で67回のリークされた試行がありました。

API開発者にとって、実用的な読み取りは明白です。Grok 4.7は4.6よりも優れており、トークンあたりのコストは同じですが、タスクあたりのコストはほぼ2倍になる可能性があります。無料アップグレードだと仮定する前に、独自のプロンプトで測定してください。

安全性に関する変更

SpaceXAIは、新しいセーフガードを「拒否とジェイルブレイク耐性に関してテストした中で最も強力なモデル」と呼んでいます。独自のHackerBench v0.3では、リスクのあるデュアルユースプロンプトの3.3%が通過し、Grok 4.7はLatchBioのバイオセーフティベンチマークで62.4%とトップになったと報告しています。一部のサイバーセキュリティパートナーは、招待制でレッドチームの機能にアクセスできます。製品がGrokの以前の寛容さに依存している場合は、切り替える前にエッジケースのプロンプトをテストしてください。

価格の詳細

Grok 4.7はGrok 4.6の料金を維持します。20万プロンプトトークン未満の場合、100万トークンあたり入力2ドル、キャッシュされた入力0.50ドル、出力6ドルを支払います。20万トークン以上の場合、リクエスト全体が入力4ドル、キャッシュされた入力1ドル、出力12ドルで請求されます。4.7にはバッチAPI割引はなく、サーバーサイドツールは追加で課金されます。ウェブ検索とコード実行は1,000回あたり5ドルかかります。米国のみの地域エンドポイントは10%追加されます。

Grok 4.7 Fastは、同じモデルが2倍の価格でより高速なインフラで提供されますが、CursorとGrok Buildの内部でのみ存在し、公開APIでは利用できません。

Grok 4.7を使用できる場所

2026年9月28日現在、Google Vertex AI、Amazon Bedrock、Microsoft Foundryには掲載されていませんでしたが、Grok 4.6はリリースから2週間以内にこれらすべてに到達しました。SpaceXAIは、どのGrokアプリのティアが4.7を利用できるかを公開していません。利用可能な無料ルートについては、Grok 4.7を無料で利用する方法をご覧ください。

LLM API上に構築する場合の意味

Grok 4.7は、今月の最先端リリースの中で出力トークンあたりの価格が最も安く、長いナレッジワークタスクに強いです。また、推論を止められない推論モデルであり、前身よりも多くのトークンを消費するため、トークンあたりの価格と実際の請求額が異なる可能性があります。

アップグレードは他の依存関係の更新と同様に扱ってください。Apidogに本番環境のプロンプトを保存し、出荷する努力レベルでgrok-4.6とgrok-4.7に対して実行し、レイテンシー、usageトークン数、出力品質を並べて比較してください。レスポンスの形状にアサーションを追加し、フィールドが変更された場合にユーザーではなくテストで失敗するようにしてください。Apidogをダウンロードして、その比較を一度設定し、次のリリースで再利用してください。

よくある質問

Grok 4.7はいつリリースされましたか? 2026年9月21日。同日、xAI API、Cursor、Grok Buildで利用可能になりました。

Grok 4.7のコンテキストウィンドウは何ですか? 50万トークン。Grok 4.6と同じです。20万トークン以上のプロンプトは2倍の料金で請求されます。

Grok 4.7はGrok 4.6よりも優れていますか? SpaceXAIが公開したすべてのベンチマークでは優れており、独立したSWE-Togetherのランキングでは60.6%から64.7%に上昇しました。また、そちらのタスクでは約2倍のトークンを使用しました。

Grok 4.7はいくつのパラメータを持っていますか? SpaceXAIは公表していません。2.1兆という数字はイーロン・マスクの投稿によるものであり、公式なスペックではありません。

Grok 4.7は無料ですか? Grok Buildには無料枠があり、Grok 4.7がそのデフォルトモデルです。xAI APIには前払いクレジットが必要です。Grok 4.7無料ガイドでは、利用可能なすべての無料ルートについて説明しています。

要約

Grok 4.7は、新しいベースモデル、より長いエージェントトレーニング、より厳格なセーフティスタックを備え、同じ表示価格で4.6から真の進歩を遂げました。ターミナルおよびコーディング作業ではClaudeのトップモデルに劣り、タスクあたりのトークン消費量は4.6よりも多くなります。APIガイドから始め、独自のプロンプトを実行し、自身の数値から判断してください。

ApidogでAPIデザイン中心のアプローチを取る

APIの開発と利用をよりシンプルなことにする方法を発見できる