xAIは現在SpaceXAIブランドで運営されており、2026年7月8日にGrok 4.5をリリースしました。同社はこれを「コーディング、エージェントタスク、および知識作業向けに構築されたSpaceXAIの最もスマートなモデル」と称しており、イーロン・マスクは「Opusクラスのモデルでありながら、より高速で、トークン効率が高く、低コスト」と売り込みました。
主な仕様は以下の通りです。入力トークン100万あたり2ドル、出力トークン100万あたり6ドル、50万トークンのコンテキストウィンドウ、1秒あたり80トークン。6月にSpaceXが買収に合意したAIコードエディターCursorからの実際の開発者セッションを組み込んだトレーニングも行われました。本日より、Grok Build、すべてのプランのCursor、およびxAI APIを通じて利用可能です。
このガイドでは、Grok 4.5とは何か、公開されている数値(xAIのマーケティングが強調しないものも含む)は何を意味するのか、そしてGrok 4.5の呼び出し方について説明します。アプリに組み込む前にエンドポイントをテストしたい場合は、Apidogを使用すると、クライアントコードを一行も書くことなく、grok-4.5にリクエストを送信したり、ストリーミング応答を検査したり、チーム向けにAPIをモックアップしたりできます。
Grok 4.5の概要
| 仕様 | 値 |
|---|---|
| モデルID | grok-4.5 (ドットに注意) |
| リリース日 | 2026年7月8日 |
| コンテキストウィンドウ | 500,000トークン |
| 入力料金 | 1Mトークンあたり2.00ドル |
| 出力料金 | 1Mトークンあたり6.00ドル |
| 速度 | 約80トークン/秒 |
| 利用可能場所 | Grok Build (デフォルト)、Cursor (全プラン)、xAI API |
| EUでの利用可否 | 未定; 2026年7月中旬に予定 |
| エンドポイント | https://api.x.ai/v1/responses |
この表の2つの詳細については、改めて注目すべき点があります。
まず、コンテキストウィンドウです。Grok 4.5は50万トークンのコンテキストで提供されますが、より古く安価なgrok-4.3は100万トークンを提供します。長文RAGや全リポジトリ分析がワークロードの場合、以前のモデルの方が多くを保持します。xAIは、コンテキストと引き換えに機能を選ぶと踏んでいます。

次に、EUに関する注意書きです。リリースページには、Grok 4.5が「SpaceXAI製品またはAPIコンソールでEUではまだ利用できません」と記載されており、7月中旬に利用可能になる予定です。ヨーロッパのユーザー向けに開発している場合は、そのギャップを考慮して計画を立ててください。
Grok 4.5の新機能
Cursorとの共同トレーニング
このリリースの決定的な事実:Grok 4.5は「Cursorと共同でトレーニングされました」。Cursor自身の発表によると、このエディターは「コードベースやソフトウェアツールとのユーザーインタラクション」を捉えた数兆ものトークンを提供しました。これは、モデルが静的なコードだけでなく、デバッグトレース、複数ファイルの編集、およびエージェントが誤った際に開発者が行った修正から学習したことを意味します。
これはほとんどのラボが使用するデータ戦略とは異なり、同意とプライバシーに関して正当な疑問を提起します。これらの点については、開発者にとってのCursorセッション学習の意味に関する関連記事で詳しく解説しています。
大規模な強化学習
xAIによると、このモデルは数万台のNVIDIA GB300 GPUでトレーニングされ、強化学習は「数万のタスクにわたり、多段階のソフトウェアエンジニアリングを中心に」行われました。トレーニングが続く間、スタックはエージェントロールアウトを非同期で数時間にわたって実行します。xAIの言葉を借りれば、目標は「トークンごとの知能」であり、長く回りくどい推論チェーンの代わりに、より少なく、よりスマートなトークンを目指しています。
コードだけでなくオフィスワークも
Grok 4.5は現在、Grok Buildのデフォルトモデルであり、xAIは発表の中で驚くほど多くの時間をスプレッドシートに費やしています。このモデルは、ウェブ調査を用いて複数シートのExcelモデルを構築し、ネイティブシェイプからPowerPoint図を作成し、xAIのOfficeプラグインを通じてWordで散文をドラフトします。Cursorはこれを「ソフトウェアエンジニアリング以上の目的で構築した初のモデル」と位置づけています。
ベンチマーク、正直な読み方
xAIは4つのコーディングベンチマークを公開しました。以下は、xAI自身のグラフでGrok 4.5を上回るモデルを含めた全体像です。
| ベンチマーク | Grok 4.5 | Opus 4.8 (最大) | GPT 5.5 (xhigh) | Fable (最大) |
|---|---|---|---|---|
| DeepSWE 1.0 (pass@1) | 62.0% | 55.75% | 64.31% | 66.1% |
| DeepSWE 1.1 | 53% | 59% | 67% | 70% |
| Terminal Bench 2.1 | 83.3% | 78.9% | 83.4% | 84.3% |
| SWE Bench Pro (resolve) | 64.7% | 69.2% | 58.6% | 80.4% |
3つの点が際立っています。
イーロン・マスクが比較対象として挙げたモデル、Claude Opus 4.8に対して、Grok 4.5は4つのうち2つで勝利しています。DeepSWE 1.0で約6ポイント、Terminal Benchで4.4ポイント上回りましたが、DeepSWE 1.1で6ポイント、SWE Bench Proで4.5ポイント劣っています。「Opusクラス」は妥当な表現です。「Opusに勝る」ではありません。Grok 4.5 vs Claude Opus 4.8で詳細な比較を行っています。
AnthropicのClaude Fable 5 (最大) は、xAI自身のページで示されているすべての4つのチャートでトップに立っています。xAIの誰もフロンティアの優位性を主張しておらず、チャートもそれを正直に示しています。Grok 4.5は最高の性能ではなく、コストと速度で競争しています。
出典は重要です。xAIは、競合他社の数値が「それぞれの開発者が公開したシステムカードまたはベンチマークリーダーボード」からのものであり、DeepSWE評価はDatacurveによって作成され、実行は外部の当事者によって行われたと述べています。これは純粋な自己申告よりも透明性が高いですが、本稿執筆時点ではGrok 4.5に関する完全に独立した第三者評価はまだありません。ベンチマーク詳細分析では、検証済みと未検証の情報を追跡しています。
トークン効率こそが本当の物語
リリースの中で最も興味深い数字は、ベンチマークスコアではありません。それは出力量です。SWE Bench Proにおいて、Grok 4.5は平均15,954の出力トークンを使用してタスクを解決します。Opus 4.8 (最大) は同じベンチマークで67,020を使用しており、これは約4.2倍多くなります。
出力トークンは100万トークンあたり6ドルで支払うものであり、1秒あたり80トークンで待つものです。トークンの4分の1でタスクを解決するモデルは、リーダーボードスコアには現れない形で、より安価で高速です。xAIは全体として「同等の主要モデルの約2倍のトークン効率」を主張しており、「半分のステップ数未満で」タスクを解決すると述べています。
ツール呼び出し全体で1回のセッションで数十万トークンを消費するエージェントワークロードの場合、これは表示価格よりもコスト計算を大きく変えます。Grok 4.5の料金体系の解説で数値を詳しく見ていきます。
Grok 4.5の利用開始方法
現在、4つの利用方法があり、そのうち3つは無料です。
- Grok Build。Grok 4.5はデフォルトモデルであり、xAIは「期間限定でGrok 4.5の無料利用」を提供しています。
- Cursor。デスクトップ、ウェブ、iOS、CLI、SDKのすべてのプランで利用可能で、最初の1週間は使用量が2倍になります。Cursorガイドでセットアップ手順をご確認ください。
- Grok CLI。
curl -fsSL https://x.ai/cli/install.sh | bashでインストールします。 - API。xAIコンソールからキーを取得し、レスポンスエンドポイントを呼び出します。
curl -s https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.5",
"input": "Summarize the breaking changes in this OpenAPI diff."
}'
ストリーミングとApidogベースのテストを含む完全なチュートリアルは、Grok 4.5 APIの使用方法にあります。探索中にAPIクレジットを消費したくない場合は、無料の利用方法がGrok 4.5を無料で利用する方法でカバーされています。
エンドポイントを呼び出すと、Apidogが統合の整合性を保つのに役立ちます。キーの環境変数を使用してリクエストを保存し、レスポンスフィールドをアサートし、実際のプロンプトでgrok-4.5とgrok-4.3のA/Bテストを行い、プロンプトを調整している間、フロントエンドチームがブロックされないようにレスポンスシェイプのモックアップを起動できます。Apidogを無料ダウンロードして、手順に従ってください。
2026年のモデル環境におけるGrok 4.5の位置づけ
Grok 4.5は、混雑したミッドフロンティアの層に位置付けられます。Claude Opus 4.8(入力100万トークンあたり5ドル / 出力100万トークンあたり25ドル)よりも安価で、Claude Fable 5よりもはるかに安価でありながら、コーディングベンチマークではOpusから数ポイント差に収まっています。GLM 5.2のようなオープンウェイトの競合モデルに対しては、公開されているコーディング評価では勝利しますが、トークンあたりのコストは高くなります。
その売り文句は「王冠」ではなく、「1ドル1秒あたりの知能」です。エージェントのスループットとAPI費用がボトルネックになっている場合、この売り文句は試す価値があります。最も困難な問題に対して最高の推論が必要な場合、xAIが公開した同じチャートは別のモデルを示唆しています。
追いかけるモデルの背景については、Claude Opus 4.8とは何か、そしてxAIがどのようにしてここに辿り着いたかをたどるGrok 4.1に関する以前の記事をご覧ください。
よくある質問 (FAQ)
Grok 4.5は無料で利用できますか? 期間限定で、Grok BuildとCursorでは無料です。API利用は100万トークンあたり2ドル/6ドルで有料です。現在のすべての無料利用方法は無料アクセスガイドに記載されています。
Grok 4.5のモデルIDは何ですか? grok-4.5(ドット付き)です。API呼び出しでgrok-4-5を使用すると、モデルが見つからないエラーが返されます。
Grok 4.5のコンテキストウィンドウは? 50万トークンです。古いgrok-4.3は100万トークンを提供しているため、新しさではなくワークロードで選択してください。
Grok 4.5はClaude Opus 4.8より優れていますか? xAIが公開した4つのベンチマークのうち2つで勝利し、残りの2つでは劣っています。Opusの入力料金の約40%で利用できます。高速で安価ではありますが、全体的に優れているわけではありません。
EUでGrok 4.5を使用できますか? まだです。xAIによると、製品およびAPIコンソール全体でのEUでの利用は2026年7月中旬に予定されています。
