OpenAIプロプライエタリ

GPT-6 Sol

このモデルを比較

OpenAIが2026年9月22日に公開したGPT-6系列の中位モデル。100万トークンあたり入力$2・出力$10で、Claude Sonnet 5と全く同じ価格表、GPT-5.6 Solの半額。コンテキスト105万トークン、最大出力128K、知識カットオフは2026年4月20日。AutomationBench 33.2%(1タスク$0.27)、Agents' Last Exam 56.4%と、ピークスコアより単位コストを前面に出す数字構成で、DeepSWE v1.1の68.8%はGPT-5.6 Solの最高スコアを下回る。

シェア:XはてブLINE

パラメータ

非公開

コンテキスト長

1.05M

ライセンス

プロプライエタリ

リリース日

2026-09-22

ベンチマーク性能

AA インテリジェンス指数

47.5

LMArena Elo

Human-Like Evaluation

ARC-AGI-2

SWE-bench Verified

GPQA Diamond

MMLU-Pro

LiveCodeBench

AIME 2025

MATH-500

API料金

入力料金(1Mトークンあたり)

$2

出力料金(1Mトークンあたり)

$10

課金モード: standard

強み

  • GPT-5.6 Solの半額の$2/$10、コンテキストは105万トークンに拡大
  • AutomationBench 33.2%を1タスク$0.27で達成と、今回の発表で最も誠実な単位コスト開示
  • キャッシュ入力は$0.20/100万トークン(90%引き)で、長時間エージェントの実質単価が下がる

弱み

  • DeepSWE v1.1の68.8%とOSWorld 2.0ではGPT-5.6 Solの最高スコアに届かず、上がったのはコストだけ
  • 数値は全てxhigh/maxの自己申告で、システムカードは同梱されていない
  • 入力27.2万トークン超は入力2倍・出力1.5倍の割増

活用例

  • 範囲の明確な高頻度エージェント作業
  • Codex内でのコードレビュー・テスト修正・小規模機能追加
  • スケールが効くマルチステップのツール呼び出し

深度分析

Artificial Analysis Intelligence Index

39.8(中)/ 47.5(最大)

AA Index v4.3.2。Claude Opus 5.5の最大は57.6

実測コスト(1タスク)

$0.25(中)/ $1.06(最大)

中程度設定ではOpus 5.5の約5分の1

Input / Output 価格

100万トークンあたり $2 / $10

GPT-5.6 Solのプロモ価格から50%減。キャッシュ読み$0.20

Context Window

105万トークン

最大出力128K。入力272K超で単価2倍・出力1.5倍

安全性の変化

拒否の巻き戻り 68% → 64%

掲示板テストでの未承認指示実行は52% → 11%

Release

2026年9月22日

知識カットオフ2026年4月20日。OpenAI API、ChatGPT Work、Codexで提供

強み

  • 料金表がClaude Sonnet 5とほぼ同一で、なおかつ前世代比で誤り率が約半分だとOpenAIは主張する
  • OpenAIのAutomationBenchではClaude Opus 5を6.3%上回り、タスクあたりコストは約9%
  • 拒否の巻き戻りと未承認指示の実行率が実質的に改善し、52%から11%という低下幅は大きい
  • 同日にGPT-6系のプロンプトキャッシュが改善され、キャッシュ済みプロンプトのコストが最大90%下がった

弱み

  • 最大設定どうしではArtificial Analysisの指数でOpus 5.5に約10ポイント劣る。天井は確かに低い
  • ローンチ時点でシステムカードが公開されていない
  • OpenAI APIとChatGPT Work、Codexのみ。ChatGPT本体ではまだ使えない
  • 入力272K超で単価が2倍、出力が1.5倍になる。Anthropicにはこの割増がない

競合比較

ModelArenaSWEGPQAPrice
Claude Opus 5.5AA 57.6(最大)N/AN/A$4/$20
GPT-5.6 Sol(プロモ)AA 59N/AN/A$4/$20
Claude Sonnet 5N/AN/AN/A$2/$10

GPT-6 Solは9月22日のOpenAIの2本のうち実務機にあたり、主張の軸はベンチマークではなく算数である。入力100万トークン$2、出力$10という料金はClaude Sonnet 5の料金表とそのまま重なり、GPT-5.6 Solのプロモ価格から50%下がる。訓練手法は旗艦のGPT-6 Astraから引き継いだ。Artificial Analysisの測定では既定の中程度設定で39.8(1タスク$0.25)、最大設定で47.5($1.06)。Claude Opus 5.5より約10ポイント低いが、コストは約5分の1である。OpenAIは安全性についても具体的な数字を出し、拒否の巻き戻りが68%から64%へ、掲示板を模したテストでの未承認指示実行が52%から11%へ下がったと発表した。

分析生成日: 2026-09-23