xAIプロプライエタリ

Grok 4.3 Beta (Early Access)

このモデルを比較

xAI開発の最新高性能モデル。世界最高知能モデルとされる。ネイティブツール使用とリアルタイム検索統合。

シェア:XはてブLINE

パラメータ

5000

コンテキスト長

2000K

ライセンス

プロプライエタリ

リリース日

2026-05-17

ベンチマーク性能

AA インテリジェンス指数

LMArena Elo

Human-Like Evaluation

ARC-AGI-2

SWE-bench Verified

GPQA Diamond

MMLU-Pro

LiveCodeBench

AIME 2025

MATH-500

日本語性能

高品質日本語

多言語対応モデルのうち、日本語処理に優れた性能を持つモデル。

API料金

このモデルのAPI料金情報は現在未公開です

強み

    弱み

      活用例

        深度分析

        人工分析知能指数

        53

        全体で5位、Grok 4.20より+4ポイント

        GPQA Diamond

        90.1%

        ランク20位 (Easy Benchmarks)

        τ²-Bench Telecom

        98%

        フロンティアモデルの中で1位

        GDPval-AA (エージェント ELO)

        1500

        Grok 4.20より+321 ELO

        入力価格

        $1.25/1M tokens

        Grok 4.20より約40%安い

        コンテキストウィンドウ

        1,000,000 tokens

        主要な西側のクローズドモデルの中で最大

        強み

        • ネイティブのリアルタイムWeb検索とX(Twitter)検索統合 — ライブソーシャルデータアクセスを持つ唯一のフロンティアモデル
        • 業界をリードするエージェント性能: τ²-Bench Telecom (98%) と人工分析全知全能ベンチマーク (最低の幻覚率) で1位
        • 最も攻撃的なフロンティア層の価格設定: 1百万トークンあたり$1.25/$2.50、キャッシュ入力$0.20

        弱み

        • 知能指数53は、生の推論とコーディングベンチマークでGPT-5.5 (60) とClaude Opus 4.7 (57) に遅れをとる
        • セッション間の永続メモリなし — この価格帯ではChatGPTやClaudeと比較して大きなギャップ
        • コンシューマーアクセスは月額$300のSuperGrok Heavyに制限;標準層の展開はまだ段階的で未完成

        競合比較

        ModelGPQAPrice
        GPT-5.5 (xhigh)~93%*$5.00/$30.00
        Claude Opus 4.7 (max)~92%*$15.00/$75.00
        Gemini 3.1 Pro Preview~91%*$2.50/$15.00

        Grok 4.3 Betaは、xAIが2026年4月17日に発売し(API GAは4月30日)、同社のこれまでで最もコスト効率の高いフロンティアモデルを表しています。人工分析知能指数で53ポイントを獲得し、Grok 4.20に比べ4ポイントの向上を見せました。入力価格は約40%、出力価格は約60%削減されました。このモデルの決定的な差別化要因は、ネイティブのサーバーサイドWeb検索とX(Twitter)検索統合であり、外部の検索パイプラインなしで、会話中にリアルタイムのソーシャルシグナル分析やライブデータ取得を可能にします。これにより、Grok 4.3は市場でユニークな位置を占めています:最もインテリジェントなモデルではありませんが、会話中に独立してライブソーシャルメディアデータにアクセスできる唯一のフロンティアクラスモデルです。

        モデルのエージェント機能は大幅に改善され、特にGDPval-AAベンチマークではELOスコアが1500に321ポイント跳ね上がりました。xAIは、人工分析全知全能ベンチマーク(最低の幻覚率)、τ²-Bench Telecomベンチマーク(98%)、Vals AI Case LawおよびCorporate Financeベンチマークで1位を獲得したと主張しています。これらの結果に、ネイティブのビデオ入力(最大5分)、ネイティブのファイル生成(PDF、PPTX、XLSX)、そして100万トークンのコンテキストウィンドウが加わり、企業のエージェントワークフロー、ドキュメント集約型分析、リアルタイム研究タスクに強力な選択肢となります。

        ただし、Grok 4.3の生のインテリジェンス天井は主要な競合他社に依然として下回っています。GPT-5.5 (xhigh) はインテリジェンス指数で60ポイントを獲得し、Claude Opus 4.7Gemini 3.1 Pro Previewはどちらも57ポイントです。最も困難な推論、コーディング、科学的タスクでは、これらのモデルが依然としてリードしています。Grok 4.3の戦略は明確です:純粋なベンチマーク優位性ではなく、価格対性能比とユニークなリアルタイムデータアクセスで競争します。攻撃的な$1.25/$2.50のAPI価格により、インテリジェンス対コストのパレートフロンティアに位置し、ライブデータ、長コンテキスト処理、スケールでのエージェントツール使用が必要なチームにとって魅力的な「第2のモデル」となります。

        分析生成日: 2026-07-17