OpenAIが2026年9月22日に公開したGPT-6系列の中位モデル。100万トークンあたり入力$2・出力$10で、Claude Sonnet 5と全く同じ価格表、GPT-5.6 Solの半額。コンテキスト105万トークン、最大出力128K、知識カットオフは2026年4月20日。AutomationBench 33.2%(1タスク$0.27)、Agents' Last Exam 56.4%と、ピークスコアより単位コストを前面に出す数字構成で、DeepSWE v1.1の68.8%はGPT-5.6 Solの最高スコアを下回る。
パラメータ
非公開
コンテキスト長
1.05M
ライセンス
プロプライエタリ
リリース日
2026-09-22
ベンチマーク性能
AA インテリジェンス指数
47.5
LMArena Elo
—
Human-Like Evaluation
—
ARC-AGI-2
—
SWE-bench Verified
—
GPQA Diamond
—
MMLU-Pro
—
LiveCodeBench
—
AIME 2025
—
MATH-500
—
API料金
入力料金(1Mトークンあたり)
$2
出力料金(1Mトークンあたり)
$10
課金モード: standard
強み
- •GPT-5.6 Solの半額の$2/$10、コンテキストは105万トークンに拡大
- •AutomationBench 33.2%を1タスク$0.27で達成と、今回の発表で最も誠実な単位コスト開示
- •キャッシュ入力は$0.20/100万トークン(90%引き)で、長時間エージェントの実質単価が下がる
弱み
- •DeepSWE v1.1の68.8%とOSWorld 2.0ではGPT-5.6 Solの最高スコアに届かず、上がったのはコストだけ
- •数値は全てxhigh/maxの自己申告で、システムカードは同梱されていない
- •入力27.2万トークン超は入力2倍・出力1.5倍の割増
活用例
- •範囲の明確な高頻度エージェント作業
- •Codex内でのコードレビュー・テスト修正・小規模機能追加
- •スケールが効くマルチステップのツール呼び出し
深度分析
Artificial Analysis Intelligence Index
39.8(中)/ 47.5(最大)
AA Index v4.3.2。Claude Opus 5.5の最大は57.6
実測コスト(1タスク)
$0.25(中)/ $1.06(最大)
中程度設定ではOpus 5.5の約5分の1
Input / Output 価格
100万トークンあたり $2 / $10
GPT-5.6 Solのプロモ価格から50%減。キャッシュ読み$0.20
Context Window
105万トークン
最大出力128K。入力272K超で単価2倍・出力1.5倍
安全性の変化
拒否の巻き戻り 68% → 64%
掲示板テストでの未承認指示実行は52% → 11%
Release
2026年9月22日
知識カットオフ2026年4月20日。OpenAI API、ChatGPT Work、Codexで提供
強み
- ・料金表がClaude Sonnet 5とほぼ同一で、なおかつ前世代比で誤り率が約半分だとOpenAIは主張する
- ・OpenAIのAutomationBenchではClaude Opus 5を6.3%上回り、タスクあたりコストは約9%
- ・拒否の巻き戻りと未承認指示の実行率が実質的に改善し、52%から11%という低下幅は大きい
- ・同日にGPT-6系のプロンプトキャッシュが改善され、キャッシュ済みプロンプトのコストが最大90%下がった
弱み
- ・最大設定どうしではArtificial Analysisの指数でOpus 5.5に約10ポイント劣る。天井は確かに低い
- ・ローンチ時点でシステムカードが公開されていない
- ・OpenAI APIとChatGPT Work、Codexのみ。ChatGPT本体ではまだ使えない
- ・入力272K超で単価が2倍、出力が1.5倍になる。Anthropicにはこの割増がない
競合比較
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| Claude Opus 5.5 | AA 57.6(最大) | N/A | N/A | $4/$20 |
| GPT-5.6 Sol(プロモ) | AA 59 | N/A | N/A | $4/$20 |
| Claude Sonnet 5 | N/A | N/A | N/A | $2/$10 |
GPT-6 Solは9月22日のOpenAIの2本のうち実務機にあたり、主張の軸はベンチマークではなく算数である。入力100万トークン$2、出力$10という料金はClaude Sonnet 5の料金表とそのまま重なり、GPT-5.6 Solのプロモ価格から50%下がる。訓練手法は旗艦のGPT-6 Astraから引き継いだ。Artificial Analysisの測定では既定の中程度設定で39.8(1タスク$0.25)、最大設定で47.5($1.06)。Claude Opus 5.5より約10ポイント低いが、コストは約5分の1である。OpenAIは安全性についても具体的な数字を出し、拒否の巻き戻りが68%から64%へ、掲示板を模したテストでの未承認指示実行が52%から11%へ下がったと発表した。
出典
分析生成日: 2026-09-23