Grok 4.5:xAI と Cursor が共同訓練したコーディングモデル、$2 起点
xAI が Grok 4.5 を発表。Cursor との共同訓練により実際のエンジニアリングタスクに照準を定め、API 価格は 100万 token あたり $2/$6。Cursor の全プランで利用可能です。


Grok 4.5:xAI と Cursor が共同訓練したコーディングモデル、$2 起点
xAI が Grok 4.5 を発表。Cursor との共同訓練により実際のエンジニアリングタスクに照準を定め、API 価格は 100万 token あたり $2/$6。Cursor の全プランで利用可能です。
7月8日、xAI は Grok 4.5 をリリースしました。Cursor と共同訓練したコーディングモデルです。今回のリリースの見どころは「また1つ汎用の大規模モデルが出た」ことではなく、xAI が Cursor の実際の開発者のコーディングデータを訓練セットに投入したことにあります。目標は非常に明確です。実際のエンジニアリングタスクを対象とし、かつ大規模導入できるほど安いコーディングモデルを作ることです。
中核となる位置づけ
Grok 4.5 は混合エキスパート(MoE)モデルで、コーディング、agent タスク、ナレッジワークに位置づけられています。xAI はリリースノートで2点を強調しています:
- 数万枚の NVIDIA GB300 GPU で訓練
- 訓練データに数兆 token の Cursor の実際のコーディングデータが含まれる
つまりこのモデルは、合成データや競技問題で訓練されたものではなく、開発者の IDE 内での実際のワークフローに直接整合しています。
実エンジニアリングタスクでの benchmark
複数のエンジニアリング系 benchmark で、Grok 4.5 の成績は次のとおりです(xAI 公式データ):
| Benchmark | Grok 4.5 | 比較(Fable/Claude Opus 4.8/GPT-5.5) |
|---|---|---|
| SWE Marathon(pass@1) | 29.0% | Opus 4.8 26.0% / Fable 24.0% |
| Terminal Bench 2.1 | 83.3% | Fable 84.3% / GPT-5.5 83.4% |
| SWE Bench Pro | 64.7% | Fable 80.4% / Opus 4.8 69.2% |
| DeepSWE 1.0 | 62.0% | Fable 66.1% / GPT-5.5 64.31% |
注意が必要な点:SWE Bench Pro や DeepSWE といった最もハードコアなエンジニアリング benchmark では、Grok 4.5 は依然として Fable 5(Anthropic)に後れを取っています。しかし SWE Marathon のような長いリンクのタスクでは、Opus 4.8 と Fable を上回りました。
💡 この数字の読み方:純粋に最強のコーディング能力を追うなら、Fable 5 / Claude 系が依然リードしています。Grok 4.5 の優位性は「費用対効果」です。同じ金額でより多くのタスクを走らせられます。
Token 効率:4.2倍
これが Grok 4.5 の最も硬いコスト優位です。SWE Bench Pro のタスクで:
- Grok 4.5:平均 15,954 個の出力 token
- Opus 4.8(max):平均 67,020 個の出力 token
つまり、Grok 4.5 が同じタスクを解くのに使う token は Opus 4.8 のおおよそ 1/4.2 です。より低い単価が重なるため、実際のコスト差はさらに拡大します。
価格
Grok 4.5 の API 価格:
- 入力:$2 / 100万 token
- 出力:$6 / 100万 token
モデル速度は 80 TPS(tokens per second)で、「速いモデル」の区分に属します。
サードパーティのコスト分析(the-decoder)は「1タスク解決あたりのコスト」で次のように計算しています:
- Grok 4.5(Grok Build):$2.49 / タスク
- GPT-5.5(Codex):$5.07 / タスク
- Fable 5(Claude Code):$11.80 / タスク
Grok 4.5 は GPT-5.5 のおよそ半分、Fable 5 の5分の1です。
使い方
Grok 4.5 は次のチャネルで利用可能です:
- Cursor:全プランで利用可能(xAI と Cursor の共同訓練の核心的な受益シーン)
- Grok Build:Grok 4.5 がデフォルトモデル、期間限定無料
- SpaceXAI コンソール:API key を直接使って呼び出し
# SpaceXAI API 経由で呼び出し(例。詳細は x.ai API ドキュメント参照)
# 1. x.ai コンソールで API key を作成
# 2. OpenAI 互換プロトコルで Grok 4.5 を呼び出し⚠️ 地域制限:リリース時点で、Grok 4.5 はまだ EU 域では利用できません(SpaceXAI 製品と API コンソールを含む)。7月中旬に開放予定です。
オフィス能力
コーディングに加え、Grok 4.5 は Grok Build 内で Office 系タスクも処理できます:
- Excel:複雑な財務/データモデルを構築し、シートを跨いで数式を使い、付箋コメントを残す
- PowerPoint:ネイティブ図形で複雑なチャートを作り、直感的なスライドをデザイン
- Word:明確な長文を書く
公式は Word、PowerPoint、Excel のプラグインを提供しています。
誰に向いているか
- Cursor ユーザー:全プランで無料利用可能で、移行コストはほぼゼロ
- コーディング agent を大規模導入するチーム:$2.49/タスクのコストで、大量の SWE 系作業の実行に適する
- 予算に敏感な開発者:token 効率4.2倍 + 低価格で、高頻度呼び出しに適する
- 極限のコーディング能力を追うユーザー:SWE Bench Pro などのハードコアタスクでは、引き続き Fable 5 / Claude が推奨