GPT-6.1 Solは、OpenAIがDevDay 2026で公開したコスト最適化版ワークホース。Astra並みのエージェントコーディングとコンピュータ操作をAstraの約5分の1の価格で提供し、105万トークンの文脈窓を持つ。長時間稼働するエージェントとChatGPTサブスク基盤の既定エンジンとして位置づけられる。
パラメータ
TBA (OpenAI undisclosed; likely fine-tune/distill of GPT-6)
コンテキスト長
1.05M
ライセンス
Proprietary
リリース日
2026-09-29
ベンチマーク性能
AA インテリジェンス指数
52.0
LMArena Elo
—
Human-Like Evaluation
—
ARC-AGI-2
—
SWE-bench Verified
—
GPQA Diamond
—
MMLU-Pro
—
LiveCodeBench
—
AIME 2025
—
MATH-500
—
API料金
入力料金(1Mトークンあたり)
$2
出力料金(1Mトークンあたり)
$10
課金モード: per token
強み
- •Astra並みのエージェントコーディングを5分の1価格で
- •長時間エージェント実行向きの105万文脈
- •DeepSWEでAstraと同着しつつタスク単価は5分の1
- •低推理での事実誤り低下
弱み
- •明示的セーフティブロックを23.5%突破
- •総合指数はAstraやOpus 5.5に劣後
- •新規学習ではなく微調整/蒸留の可能性
- •Ultrafastは最大$300/M出力の乗数
活用例
- •長時間実行コードエージェントとリポジトリ全体処理
- •コスト重視のブラウザ/デスクトップ自動化
- •高価モデルの裏にある安価ルーティング層
深度分析
Artificial Analysis 知能指数
52
Astra(53)の1ポイント下、Claude Opus 5.5(58)の6ポイント下
文脈窓
105万トークン
出力最大12.8万トークン
価格(入力/キャッシュ/出力)
$2/$0.10/$10 per M
Astraの約5分の1のコスト
DeepSWE v1.1
Astraと同着
5分の1のコストでGPT-6 Solを6.4ポイント上回る
Terminal-Bench Science
$5.47/タスク
Opus 5.5の$23.21、Astraの$23.80に対して
強み
- ・エージェントコーディングとコンピュータ操作でAstra並みの能力を5分の1の価格で提供
- ・105万トークンの文脈と12.8万トークン出力が長いエージェント実行に向く
- ・DeepSWEでAstraと同着しつつタスク単価は5分の1
- ・低推理レベルでの事実誤りが11.4%から7.7%へ低下
弱み
- ・それでも明示的セーフティブロックを23.5%の確率で突破(GPT-6 Solの64.4%から低下、Astraの17.4%より高い)
- ・総合指数はAstraやOpus 5.5に劣後
- ・GPT-6 Solの1週間後に登場、新規学習ではなく微調整/蒸留の可能性(OpenAIは非公開)
- ・Ultrafastティアは有料の乗数(出力最大$300/M)
競合比較
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| GPT-6 Astra | 53 | n/a | n/a | $10/$50 per M |
| Claude Opus 5.5 | 58 | n/a | n/a | $10/$50 per M |
| GPT-6.1 Sol | 52 | Astraと同着(DeepSWE) | n/a | $2/$10 per M |
GPT-6.1 SolはDevDay 2026で登場したOpenAIのコスト重視ワークホース。Astra並みのエージェントコーディングを5分の1の価格で、105万トークンの文脈とともに提供する。同じ週に旗艦Astraをひっそり延期したOpenAIが、エージェントとサブスク基盤の押し上げに賭けるモデルがこれだ。
出典
分析生成日: 2026-10-01