OpenAIプロプライエタリ

GPT-6.1 Sol

このモデルを比較

GPT-6.1 Solは、OpenAIがDevDay 2026で公開したコスト最適化版ワークホース。Astra並みのエージェントコーディングとコンピュータ操作をAstraの約5分の1の価格で提供し、105万トークンの文脈窓を持つ。長時間稼働するエージェントとChatGPTサブスク基盤の既定エンジンとして位置づけられる。

シェア:XはてブLINE

パラメータ

TBA (OpenAI undisclosed; likely fine-tune/distill of GPT-6)

コンテキスト長

1.05M

ライセンス

Proprietary

リリース日

2026-09-29

ベンチマーク性能

AA インテリジェンス指数

52.0

LMArena Elo

—

Human-Like Evaluation

—

ARC-AGI-2

—

SWE-bench Verified

—

GPQA Diamond

—

MMLU-Pro

—

LiveCodeBench

—

AIME 2025

—

MATH-500

—

API料金

入力料金(1Mトークンあたり)

$2

出力料金(1Mトークンあたり)

$10

課金モード: per token

強み

  • •Astra並みのエージェントコーディングを5分の1価格で
  • •長時間エージェント実行向きの105万文脈
  • •DeepSWEでAstraと同着しつつタスク単価は5分の1
  • •低推理での事実誤り低下

弱み

  • •明示的セーフティブロックを23.5%突破
  • •総合指数はAstraやOpus 5.5に劣後
  • •新規学習ではなく微調整/蒸留の可能性
  • •Ultrafastは最大$300/M出力の乗数

活用例

  • •長時間実行コードエージェントとリポジトリ全体処理
  • •コスト重視のブラウザ/デスクトップ自動化
  • •高価モデルの裏にある安価ルーティング層

深度分析

Artificial Analysis 知能指数

52

Astra(53)の1ポイント下、Claude Opus 5.5(58)の6ポイント下

文脈窓

105万トークン

出力最大12.8万トークン

価格(入力/キャッシュ/出力)

$2/$0.10/$10 per M

Astraの約5分の1のコスト

DeepSWE v1.1

Astraと同着

5分の1のコストでGPT-6 Solを6.4ポイント上回る

Terminal-Bench Science

$5.47/タスク

Opus 5.5の$23.21、Astraの$23.80に対して

強み

  • ・エージェントコーディングとコンピュータ操作でAstra並みの能力を5分の1の価格で提供
  • ・105万トークンの文脈と12.8万トークン出力が長いエージェント実行に向く
  • ・DeepSWEでAstraと同着しつつタスク単価は5分の1
  • ・低推理レベルでの事実誤りが11.4%から7.7%へ低下

弱み

  • ・それでも明示的セーフティブロックを23.5%の確率で突破(GPT-6 Solの64.4%から低下、Astraの17.4%より高い)
  • ・総合指数はAstraやOpus 5.5に劣後
  • ・GPT-6 Solの1週間後に登場、新規学習ではなく微調整/蒸留の可能性(OpenAIは非公開)
  • ・Ultrafastティアは有料の乗数(出力最大$300/M)

競合比較

ModelArenaSWEGPQAPrice
GPT-6 Astra53n/an/a$10/$50 per M
Claude Opus 5.558n/an/a$10/$50 per M
GPT-6.1 Sol52Astraと同着(DeepSWE)n/a$2/$10 per M

GPT-6.1 SolはDevDay 2026で登場したOpenAIのコスト重視ワークホース。Astra並みのエージェントコーディングを5分の1の価格で、105万トークンの文脈とともに提供する。同じ週に旗艦Astraをひっそり延期したOpenAIが、エージェントとサブスク基盤の押し上げに賭けるモデルがこれだ。

分析生成日: 2026-10-01