xAIプロプライエタリ

Grok 4.7

このモデルを比較

xAIが2026年9月21日に公開したコーディングと知識ワーク特化の旗艦。Grok 4.6と同じ100万トークンあたり入力2ドル/出力6ドルの価格を維持しつつ、数時間かかる難易度の高いタスクへの強化学習を拡張し、自己検証、長文脈処理、Grok Botハーネスのネイティブ理解を向上させた。発表は安全を前面に出し、新安全スタックはLatchBio生物安全で62.4%、HackerBench v0.3で高リスク二重用途プロンプトの通過を3.3%に抑えるという。ベンチマークではClaude Fable 5.1との差を詰めたが届かず(46.3%対51.8%、38.0%対57.9%)、前身に対してはTerminal-Benchをほぼ倍増させるエージェント的飛躍を見せた。

シェア:XはてブLINE

パラメータ

非公開

コンテキスト長

500K

ライセンス

プロプライエタリ

リリース日

2026-09-21

API料金

入力料金(1Mトークンあたり)

$2

出力料金(1Mトークンあたり)

$6

課金モード: standard

強み

  • Terminal-Bench 4.0が20.3%から38.0%へ倍増し、Grok 4.6が最も弱かった領域をカバー
  • CursorBench 4.0で46.3%を$2/$6で提供し、Fable 5.1の$10/$50に対して大半の差を詰めつつ下回る
  • xAIによれば最も較正された安全機構で、LatchBio 62.4%、高リスク二重用途通過3.3%

弱み

  • コーディングとオフィス系ベンチの頂点ではなおClaudeに劣る(Fable 5.1はCursorBench 51.8%、Terminal-Bench 57.9%)
  • Grok 4.6と同単価のためトークン効率の向上はなく、高速化は倍額の高速版のみ
  • Grok Botハーネス理解がxAIの実行環境に紐付き、外部のオープンなツール群からは離れる

活用例

  • Terminal-Bench向上の長時間自律コーディング
  • CursorBench級のコードレビューとデバッグの量産
  • 生物安全・二重用途ゲートが要る規制・セキュリティ淡感領域

深度分析

コンテキスト

50万トークン

テキスト・画像入力、テキスト出力、出力長上限なし

API価格

入力2ドル/出力6ドル(100万単位)

20万トークン未満;それ以上は4ドル/12ドル。高速版は倍速・倍額

CursorBench 4.0

46.3%

Grok 4.6の40.4%、Claude Fable 5.1最大51.8%に対して(xAI公表)

Terminal-Bench 4.0

38.0%

Grok 4.6の20.3%から飛躍;Fable 5.1は57.9%(xAI公表)

EEBench

64.0%

Claude Fable 5.1の56.4%を上回る(xAI公表)

LatchBio生物安全

62.4%

新安全スタック;HackerBench v0.3で高リスク二重用途の通過は3.3%のみ

強み

  • エージェント的飛躍:Terminal-Bench 4.0が20.3%から38.0%へ倍増し、Grok 4.6が最も弱かった領域をカバー。
  • 低価格でのコーディング:46.3%のCursorBench 4.0を2ドル/6ドルで提供し、Fable 5.1の10ドル/50ドルと大半の差を詰めながら下回る。
  • xAIによればこれまでで最も較正された安全機構で、LatchBio生物安全62.4%、高リスク二重用途プロンプトの通過は3.3%のみ。

弱み

  • コーディングとオフィス系ベンチの頂点ではなおClaudeに劣る。Fable 5.1はCursorBench最大51.8%、Terminal-Bench 57.9%。
  • Grok 4.6と同単価のためトークンあたりの効率向上はなく、高速化は2倍の高速版(倍額)のみ。
  • Grok Botハーネスをネイティブに理解するため、xAIのエージェント実行環境に紐付き、オープンなツール群からは離れる。

競合比較

ModelArenaSWEGPQAPrice
Claude Fable 5.171.0%(DeepSWE v1.1 high)10ドル/50ドル(100万単位)
GPT-5.6 Sol94.6%(GPQA Diamond)5ドル/30ドル(100万単位)
Grok 4.665.2%(DeepSWE v1.1 high)2ドル/6ドル(100万単位)

Grok 4.7はxAIのコーディングと知識ワーク特化の旗艦で、2026年9月21日に公開された。Grok 4.6と同じ2ドル/6ドルの価格を維持しつつ、より難易度が高く数時間かかるタスクへの強化学習を拡張し、自己検証、長文脈処理、Grok Botハーネスのネイティブ理解を向上させた。発表は安全を前面に出した。xAIによれば新安全スタックはLatchBio生物安全で62.4%、HackerBench v0.3で高リスク二重用途プロンプトのうち通過するのは3.3%のみ。ベンチマークではClaude Fable 5.1との差を詰めたが届かず(46.3%対51.8%、38.0%対57.9%)、前身に対するエージェント的飛躍は明確。Cursor、Grok Build、Grok API、サードパーティ製ハーネスで提供され、50万トークン文脈と2倍速の高速版を持つ。

分析生成日: 2026-09-24