Grok 4.5:xAI と Cursor が共同訓練したコーディングモデル、$2 起点

·Toolin 編集部

xAI が Grok 4.5 を発表。Cursor との共同訓練により実際のエンジニアリングタスクに照準を定め、API 価格は 100万 token あたり $2/$6。Cursor の全プランで利用可能です。

Grok 4.5:xAI と Cursor が共同訓練したコーディングモデル、$2 起点

7月8日、xAI は Grok 4.5 をリリースしました。Cursor と共同訓練したコーディングモデルです。今回のリリースの見どころは「また1つ汎用の大規模モデルが出た」ことではなく、xAI が Cursor の実際の開発者のコーディングデータを訓練セットに投入したことにあります。目標は非常に明確です。実際のエンジニアリングタスクを対象とし、かつ大規模導入できるほど安いコーディングモデルを作ることです。

中核となる位置づけ

Grok 4.5 は混合エキスパート(MoE)モデルで、コーディング、agent タスク、ナレッジワークに位置づけられています。xAI はリリースノートで2点を強調しています:

  1. 数万枚の NVIDIA GB300 GPU で訓練
  2. 訓練データに数兆 token の Cursor の実際のコーディングデータが含まれる

つまりこのモデルは、合成データや競技問題で訓練されたものではなく、開発者の IDE 内での実際のワークフローに直接整合しています。

実エンジニアリングタスクでの benchmark

複数のエンジニアリング系 benchmark で、Grok 4.5 の成績は次のとおりです(xAI 公式データ):

BenchmarkGrok 4.5比較(Fable/Claude Opus 4.8/GPT-5.5)
SWE Marathon(pass@1)29.0%Opus 4.8 26.0% / Fable 24.0%
Terminal Bench 2.183.3%Fable 84.3% / GPT-5.5 83.4%
SWE Bench Pro64.7%Fable 80.4% / Opus 4.8 69.2%
DeepSWE 1.062.0%Fable 66.1% / GPT-5.5 64.31%

注意が必要な点:SWE Bench Pro や DeepSWE といった最もハードコアなエンジニアリング benchmark では、Grok 4.5 は依然として Fable 5(Anthropic)に後れを取っています。しかし SWE Marathon のような長いリンクのタスクでは、Opus 4.8 と Fable を上回りました。

💡 この数字の読み方:純粋に最強のコーディング能力を追うなら、Fable 5 / Claude 系が依然リードしています。Grok 4.5 の優位性は「費用対効果」です。同じ金額でより多くのタスクを走らせられます。

Token 効率:4.2倍

これが Grok 4.5 の最も硬いコスト優位です。SWE Bench Pro のタスクで:

  • Grok 4.5:平均 15,954 個の出力 token
  • Opus 4.8(max):平均 67,020 個の出力 token

つまり、Grok 4.5 が同じタスクを解くのに使う token は Opus 4.8 のおおよそ 1/4.2 です。より低い単価が重なるため、実際のコスト差はさらに拡大します。

価格

Grok 4.5 の API 価格:

  • 入力:$2 / 100万 token
  • 出力:$6 / 100万 token

モデル速度は 80 TPS(tokens per second)で、「速いモデル」の区分に属します。

サードパーティのコスト分析(the-decoder)は「1タスク解決あたりのコスト」で次のように計算しています:

  • Grok 4.5(Grok Build):$2.49 / タスク
  • GPT-5.5(Codex):$5.07 / タスク
  • Fable 5(Claude Code):$11.80 / タスク

Grok 4.5 は GPT-5.5 のおよそ半分、Fable 5 の5分の1です。

使い方

Grok 4.5 は次のチャネルで利用可能です:

  • Cursor:全プランで利用可能(xAI と Cursor の共同訓練の核心的な受益シーン)
  • Grok Build:Grok 4.5 がデフォルトモデル、期間限定無料
  • SpaceXAI コンソール:API key を直接使って呼び出し
# SpaceXAI API 経由で呼び出し(例。詳細は x.ai API ドキュメント参照)
# 1. x.ai コンソールで API key を作成
# 2. OpenAI 互換プロトコルで Grok 4.5 を呼び出し

⚠️ 地域制限:リリース時点で、Grok 4.5 はまだ EU 域では利用できません(SpaceXAI 製品と API コンソールを含む)。7月中旬に開放予定です。

オフィス能力

コーディングに加え、Grok 4.5 は Grok Build 内で Office 系タスクも処理できます:

  • Excel:複雑な財務/データモデルを構築し、シートを跨いで数式を使い、付箋コメントを残す
  • PowerPoint:ネイティブ図形で複雑なチャートを作り、直感的なスライドをデザイン
  • Word:明確な長文を書く

公式は Word、PowerPoint、Excel のプラグインを提供しています。

誰に向いているか

  • Cursor ユーザー:全プランで無料利用可能で、移行コストはほぼゼロ
  • コーディング agent を大規模導入するチーム:$2.49/タスクのコストで、大量の SWE 系作業の実行に適する
  • 予算に敏感な開発者:token 効率4.2倍 + 低価格で、高頻度呼び出しに適する
  • 極限のコーディング能力を追うユーザー:SWE Bench Pro などのハードコアタスクでは、引き続き Fable 5 / Claude が推奨

参考ソース