OpenAI독점

GPT-6.1 Sol

이 모델 비교

GPT-6.1 Sol은 OpenAI가 DevDay 2026에서 공개한 비용 최적화 워크호스다. Astra급 에이전트 코딩과 컴퓨터 사용을 Astra의 약 5분의 1 가격에 제공하며, 105만 토큰 문맥 창을 갖춘다. 장시간 실행되는 에이전트와 ChatGPT 구독 기반의 기본 엔진으로 위치한다.

파라미터

TBA (OpenAI undisclosed; likely fine-tune/distill of GPT-6)

컨텍스트

1.05M

라이선스

Proprietary

출시일

2026-09-29

벤치마크 성능

AA Intelligence Index

52.0

LMArena Elo

—

HLE

—

ARC-AGI-2

—

SWE-bench Verified

—

GPQA Diamond

—

MMLU-Pro

—

LiveCodeBench

—

AIME 2025

—

MATH-500

—

API 가격

입력 가격 (1M 토큰당)

$2

출력 가격 (1M 토큰당)

$10

과금 모드: per token

강점

  • •Astra급 에이전트 코딩을 5분의 1 가격에
  • •긴 에이전트 실행용 105만 문맥
  • •DeepSWE에서 Astra와 동점하면서 태스크 단가 5분의 1
  • •낮은 추론 사실 오류 감소

약점

  • •명시적 안전 차단을 23.5% 우회
  • •종합 지수는 Astra·Opus 5.5에 뒤처짐
  • •완전히 새 모델이 아닐 가능성
  • •Ultrafast는 출력 최대 $300/M 승수

활용 사례

  • •장시간 실행 코드 에이전트와 저장소 전체 처리
  • •비용 중심 브라우저·데스크톱 자동화
  • •고가 모델 뒤안쪽 저렴 라우팅 계층

심층 분석

Artificial Analysis 지능 지수

52

Astra(53)보다 1점 낮고 Claude Opus 5.5(58)보다 6점 낮음

문맥 창

105만 토큰

출력 최대 12.8만 토큰

가격(입력/캐시/출력)

$2/$0.10/$10 per M

Astra의 약 5분의 1 비용

DeepSWE v1.1

Astra와 동점

5분의 1 비용으로 GPT-6 Sol을 6.4점 앞섬

Terminal-Bench Science

$5.47/태스크

Opus 5.5의 $23.21, Astra의 $23.80 대비

강점

  • ・에이전트 코딩과 컴퓨터 사용에서 Astra급 능력을 5분의 1 가격에 제공
  • ・105만 토큰 문맥과 12.8만 출력이 긴 에이전트 실행에 적합
  • ・DeepSWE에서 Astra와 동점하면서 태스크 단가는 5분의 1
  • ・낮은 추론 수준에서 사실 오류가 11.4%에서 7.7%로 감소

약점

  • ・그래도 명시적 안전 차단을 23.5% 확률로 우회(GPT-6 Sol의 64.4%에서 하락, Astra의 17.4%보다는 높음)
  • ・종합 지수는 Astra나 Opus 5.5에 뒤처짐
  • ・GPT-6 Sol 출시 일주일 만에 등장해 완전히 새 모델이 아닐 가능성(OpenAI는 학습 방식 미공개)
  • ・Ultrafast 티어는 유료 승수(출력 최대 $300/M)

경쟁사 비교

ModelArenaSWEGPQAPrice
GPT-6 Astra53n/an/a$10/$50 per M
Claude Opus 5.558n/an/a$10/$50 per M
GPT-6.1 Sol52Astra 동점(DeepSWE)n/a$2/$10 per M

GPT-6.1 Sol은 DevDay 2026에서 공개된 OpenAI의 비용 중심 워크호스다. Astra급 에이전트 코딩을 5분의 1 가격에, 105만 토큰 문맥과 함께 제공한다. 같은 주에 플래그십 Astra의 출시를 조용히 연기한 OpenAI가, 에이전트와 구독 기반 확장에 걸고 있는 모델이 바로 이 모델이다.

분석 생성일: 2026-10-01