← 記事一覧に戻る

SpaceXAI(旧 xAI)が「Grok 4.7」を公開 料金は前の版と据え置きで、100万トークンあたり入力2ドル・出力6ドル

Grok 4.7 が公開された。料金は前の版の Grok 4.6 と同じ(100万トークンあたり入力2ドル・出力6ドル)で、コーディングと知識を使う仕事の性能を上げたとしている。月額プランについての記載は発表に無い。

  • 発表のページの日付は2026年9月21日。Grok 4.7 は、コーディングと知識を使う仕事では自社でいちばん性能の高いモデルで、難しい仕事に長く取り組み、自分の作業をより丁寧に確かめるとしている
  • 料金は前の版の Grok 4.6 と同じ(下の表)。100万トークンあたり入力2ドル・出力6ドルで、速さも同じだとしている
  • 前の版より大きな基盤モデルを使い、強化学習をより長く回した。何時間もかかる問題に重みを置いた、より難しい課題の組み合わせで学習させたとしている
  • 安全の仕組みを新しく組み直し、拒否とジェイルブレイクへの強さは自社が試した中でいちばん強いとしている。生物分野の安全性を測る LatchBio のベンチマークでは62.4%で首位だとしている。危険な使い方を扱う自社のベンチマーク HackerBench v0.3 では、危うい両用の指示を通した割合が3.3%だとしている
  • 使える場所は Cursor と Grok Build、Grok API、ほかの開発ツールやモデルの中継サービス・クラウド。月額プランの料金や利用上限についての記載は、この発表には無い
  • Grok を作る xAI は、2026年2月2日に SpaceX に買収された(同社の公式のお知らせ)。いまは公式サイトで会社名を「SpaceXAI」としており、この発表もその名前で出している

性能(SpaceXAI の発表。括弧内は数字を出したときの推論の設定)

ベンチマーク(何を測るか) Grok 4.7(xHigh) Grok 4.6(High) GPT-5.6 Sol(Max) Fable 5.1(Max)
CursorBench 4.0(長く続くコーディング) 46.3% 40.4% 41.7% 51.8%
DeepSWE v1.1(ソフトウェア開発) 71.0% 65.2% 72.7% 70.0%
EEBench(電気工学) 64.0% 53.0% 39.4% 56.4%
AA Briefcase v1.1(何時間もかかる事務の仕事、点数) 1,657 1,546 1,487 1,678
Terminal-Bench 4.0(何時間もかかるコマンドラインの作業) 37.6% 20.3% 37.3% 57.9%
Harvey Legal Agent Benchmark(法務の仕事) 19.6% 15.8% 2.5% 6.7%
HealthBench Professional(臨床の推論) 56.7% 48.5% 60.5% 62.1%

SpaceXAI が発表した数字。Grok 4.7 の DeepSWE v1.1 は、労力を高く設定したときの値だとしている。別の図では、専門職の仕事を測る GDPval の点数を Fable 5.1(max)1735、Grok 4.7(xhigh)1695、Grok 4.6(high)1605、GPT-6 Astra(max)1542 としている。

料金(100万トークンあたり)

Grok 4.7 Grok 4.6(前の版) Grok 4.7(今回) 前の版との差(計算)
入力 2ドル 2ドル 変わらない
出力 6ドル 6ドル 変わらない

出力の速さが2倍の版もあり、価格も2倍だとしている(計算すると入力4ドル・出力12ドル)。発表の紹介文にある「比べられるモデルの半分の値段で2倍速い」は、他社のモデルと比べたときの同社の主張。

確かめた一次資料

この記事は、上の一次資料の原文を読んで書いています。数字は原文のとおりで、計算した値はそう書いています。

ほかの記事を見る