xAIが2026年9月21日に公開したコーディングと知識ワーク特化の旗艦。Grok 4.6と同じ100万トークンあたり入力2ドル/出力6ドルの価格を維持しつつ、数時間かかる難易度の高いタスクへの強化学習を拡張し、自己検証、長文脈処理、Grok Botハーネスのネイティブ理解を向上させた。発表は安全を前面に出し、新安全スタックはLatchBio生物安全で62.4%、HackerBench v0.3で高リスク二重用途プロンプトの通過を3.3%に抑えるという。ベンチマークではClaude Fable 5.1との差を詰めたが届かず(46.3%対51.8%、38.0%対57.9%)、前身に対してはTerminal-Benchをほぼ倍増させるエージェント的飛躍を見せた。
パラメータ
非公開
コンテキスト長
500K
ライセンス
プロプライエタリ
リリース日
2026-09-21
API料金
入力料金(1Mトークンあたり)
$2
出力料金(1Mトークンあたり)
$6
課金モード: standard
強み
- •Terminal-Bench 4.0が20.3%から38.0%へ倍増し、Grok 4.6が最も弱かった領域をカバー
- •CursorBench 4.0で46.3%を$2/$6で提供し、Fable 5.1の$10/$50に対して大半の差を詰めつつ下回る
- •xAIによれば最も較正された安全機構で、LatchBio 62.4%、高リスク二重用途通過3.3%
弱み
- •コーディングとオフィス系ベンチの頂点ではなおClaudeに劣る(Fable 5.1はCursorBench 51.8%、Terminal-Bench 57.9%)
- •Grok 4.6と同単価のためトークン効率の向上はなく、高速化は倍額の高速版のみ
- •Grok Botハーネス理解がxAIの実行環境に紐付き、外部のオープンなツール群からは離れる
活用例
- •Terminal-Bench向上の長時間自律コーディング
- •CursorBench級のコードレビューとデバッグの量産
- •生物安全・二重用途ゲートが要る規制・セキュリティ淡感領域
深度分析
コンテキスト
50万トークン
テキスト・画像入力、テキスト出力、出力長上限なし
API価格
入力2ドル/出力6ドル(100万単位)
20万トークン未満;それ以上は4ドル/12ドル。高速版は倍速・倍額
CursorBench 4.0
46.3%
Grok 4.6の40.4%、Claude Fable 5.1最大51.8%に対して(xAI公表)
Terminal-Bench 4.0
38.0%
Grok 4.6の20.3%から飛躍;Fable 5.1は57.9%(xAI公表)
EEBench
64.0%
Claude Fable 5.1の56.4%を上回る(xAI公表)
LatchBio生物安全
62.4%
新安全スタック;HackerBench v0.3で高リスク二重用途の通過は3.3%のみ
強み
- ・エージェント的飛躍:Terminal-Bench 4.0が20.3%から38.0%へ倍増し、Grok 4.6が最も弱かった領域をカバー。
- ・低価格でのコーディング:46.3%のCursorBench 4.0を2ドル/6ドルで提供し、Fable 5.1の10ドル/50ドルと大半の差を詰めながら下回る。
- ・xAIによればこれまでで最も較正された安全機構で、LatchBio生物安全62.4%、高リスク二重用途プロンプトの通過は3.3%のみ。
弱み
- ・コーディングとオフィス系ベンチの頂点ではなおClaudeに劣る。Fable 5.1はCursorBench最大51.8%、Terminal-Bench 57.9%。
- ・Grok 4.6と同単価のためトークンあたりの効率向上はなく、高速化は2倍の高速版(倍額)のみ。
- ・Grok Botハーネスをネイティブに理解するため、xAIのエージェント実行環境に紐付き、オープンなツール群からは離れる。
競合比較
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| Claude Fable 5.1 | — | 71.0%(DeepSWE v1.1 high) | — | 10ドル/50ドル(100万単位) |
| GPT-5.6 Sol | — | — | 94.6%(GPQA Diamond) | 5ドル/30ドル(100万単位) |
| Grok 4.6 | — | 65.2%(DeepSWE v1.1 high) | — | 2ドル/6ドル(100万単位) |
Grok 4.7はxAIのコーディングと知識ワーク特化の旗艦で、2026年9月21日に公開された。Grok 4.6と同じ2ドル/6ドルの価格を維持しつつ、より難易度が高く数時間かかるタスクへの強化学習を拡張し、自己検証、長文脈処理、Grok Botハーネスのネイティブ理解を向上させた。発表は安全を前面に出した。xAIによれば新安全スタックはLatchBio生物安全で62.4%、HackerBench v0.3で高リスク二重用途プロンプトのうち通過するのは3.3%のみ。ベンチマークではClaude Fable 5.1との差を詰めたが届かず(46.3%対51.8%、38.0%対57.9%)、前身に対するエージェント的飛躍は明確。Cursor、Grok Build、Grok API、サードパーティ製ハーネスで提供され、50万トークン文脈と2倍速の高速版を持つ。
分析生成日: 2026-09-24