xAI開発の最新高性能モデル。世界最高知能モデルとされる。ネイティブツール使用とリアルタイム検索統合。
パラメータ
5000
コンテキスト長
2000K
ライセンス
プロプライエタリ
リリース日
2026-05-17
ベンチマーク性能
AA インテリジェンス指数
—
LMArena Elo
—
Human-Like Evaluation
—
ARC-AGI-2
—
SWE-bench Verified
—
GPQA Diamond
—
MMLU-Pro
—
LiveCodeBench
—
AIME 2025
—
MATH-500
—
日本語性能
多言語対応モデルのうち、日本語処理に優れた性能を持つモデル。
API料金
このモデルのAPI料金情報は現在未公開です
強み
弱み
活用例
深度分析
人工分析知能指数
53
全体で5位、Grok 4.20より+4ポイント
GPQA Diamond
90.1%
ランク20位 (Easy Benchmarks)
τ²-Bench Telecom
98%
フロンティアモデルの中で1位
GDPval-AA (エージェント ELO)
1500
Grok 4.20より+321 ELO
入力価格
$1.25/1M tokens
Grok 4.20より約40%安い
コンテキストウィンドウ
1,000,000 tokens
主要な西側のクローズドモデルの中で最大
強み
- ・ネイティブのリアルタイムWeb検索とX(Twitter)検索統合 — ライブソーシャルデータアクセスを持つ唯一のフロンティアモデル
- ・業界をリードするエージェント性能: τ²-Bench Telecom (98%) と人工分析全知全能ベンチマーク (最低の幻覚率) で1位
- ・最も攻撃的なフロンティア層の価格設定: 1百万トークンあたり$1.25/$2.50、キャッシュ入力$0.20
弱み
- ・知能指数53は、生の推論とコーディングベンチマークでGPT-5.5 (60) とClaude Opus 4.7 (57) に遅れをとる
- ・セッション間の永続メモリなし — この価格帯ではChatGPTやClaudeと比較して大きなギャップ
- ・コンシューマーアクセスは月額$300のSuperGrok Heavyに制限;標準層の展開はまだ段階的で未完成
競合比較
| Model | GPQA | Price |
|---|---|---|
| GPT-5.5 (xhigh) | ~93%* | $5.00/$30.00 |
| Claude Opus 4.7 (max) | ~92%* | $15.00/$75.00 |
| Gemini 3.1 Pro Preview | ~91%* | $2.50/$15.00 |
Grok 4.3 Betaは、xAIが2026年4月17日に発売し(API GAは4月30日)、同社のこれまでで最もコスト効率の高いフロンティアモデルを表しています。人工分析知能指数で53ポイントを獲得し、Grok 4.20に比べ4ポイントの向上を見せました。入力価格は約40%、出力価格は約60%削減されました。このモデルの決定的な差別化要因は、ネイティブのサーバーサイドWeb検索とX(Twitter)検索統合であり、外部の検索パイプラインなしで、会話中にリアルタイムのソーシャルシグナル分析やライブデータ取得を可能にします。これにより、Grok 4.3は市場でユニークな位置を占めています:最もインテリジェントなモデルではありませんが、会話中に独立してライブソーシャルメディアデータにアクセスできる唯一のフロンティアクラスモデルです。
モデルのエージェント機能は大幅に改善され、特にGDPval-AAベンチマークではELOスコアが1500に321ポイント跳ね上がりました。xAIは、人工分析全知全能ベンチマーク(最低の幻覚率)、τ²-Bench Telecomベンチマーク(98%)、Vals AI Case LawおよびCorporate Financeベンチマークで1位を獲得したと主張しています。これらの結果に、ネイティブのビデオ入力(最大5分)、ネイティブのファイル生成(PDF、PPTX、XLSX)、そして100万トークンのコンテキストウィンドウが加わり、企業のエージェントワークフロー、ドキュメント集約型分析、リアルタイム研究タスクに強力な選択肢となります。
ただし、Grok 4.3の生のインテリジェンス天井は主要な競合他社に依然として下回っています。GPT-5.5 (xhigh) はインテリジェンス指数で60ポイントを獲得し、Claude Opus 4.7とGemini 3.1 Pro Previewはどちらも57ポイントです。最も困難な推論、コーディング、科学的タスクでは、これらのモデルが依然としてリードしています。Grok 4.3の戦略は明確です:純粋なベンチマーク優位性ではなく、価格対性能比とユニークなリアルタイムデータアクセスで競争します。攻撃的な$1.25/$2.50のAPI価格により、インテリジェンス対コストのパレートフロンティアに位置し、ライブデータ、長コンテキスト処理、スケールでのエージェントツール使用が必要なチームにとって魅力的な「第2のモデル」となります。
出典
- xAI launches Grok 4.3 with improved agentic performance and lower pricing
- Grok on Amazon Bedrock (Official xAI)
- Grok 4.3, reviewed — benchr
- Grok 4.3 Review: Video Input, File Generation, and a 40% API Price Cut — Fello AI
- Grok 4.3 Review: What's New in xAI's Latest Model — TechSifted
- Benchmarking Grok 4.3 on Amazon Bedrock Mantle vs. the xAI API — Loka Engineering (Medium)
- Grok 4.3 Beta Review 2026: Agentic Tools, Files & Spreadsheets Tested — The AI Journal
- Grok 4.3 (high) — Easy Benchmarks
- xAI rolls out Grok 4.3 beta for SuperGrok Heavy subscribers — PiunikaWeb
- Grok 4.3 vs ChatGPT 2026 — Linos NEWS
分析生成日: 2026-07-17