OpenAI가 2026년 9월 22일 공개한 GPT-6 계열 중급 모델. 100만 토큰당 입력 $2·출력 $10으로 Claude Sonnet 5와 요율표가 똑같고 GPT-5.6 Sol의 절반이다. 105만 토큰 컨텍스트, 최대 출력 128K, 지식 컷오프 2026년 4월 20일. 공개 수치는 새 천장이 아니라 비용을 판다: AutomationBench 33.2%(과제당 $0.27), Agents' Last Exam 56.4% - 반면 DeepSWE v1.1 68.8%는 GPT-5.6 Sol의 최고 기록에 못 미친다.
파라미터
Undisclosed
컨텍스트
1.05M
라이선스
Proprietary
출시일
2026-09-22
벤치마크 성능
AA Intelligence Index
47.5
LMArena Elo
—
HLE
—
ARC-AGI-2
—
SWE-bench Verified
—
GPQA Diamond
—
MMLU-Pro
—
LiveCodeBench
—
AIME 2025
—
MATH-500
—
API 가격
입력 가격 (1M 토큰당)
$2
출력 가격 (1M 토큰당)
$10
과금 모드: standard
강점
- •GPT-5.6 Sol의 절반인 $2/$10, 컨텍스트는 105만 토큰으로 확대
- •AutomationBench 33.2%를 과제당 $0.27에 달성 - 이번 공개에서 가장 정직한 단가 공시
- •캐시 입력 $0.20/100만 토큰(90% 인하)으로 장시간 에이전트 실질 단가 절감
약점
- •DeepSWE v1.1 68.8%, OSWorld 2.0에서 GPT-5.6 Sol 최고 기록에 미달 - 개선된 것은 비용뿐
- •모든 수치가 xhigh/max 자기 보고치이며 시스템 카드가 함께 나오지 않았다
- •입력 27.2만 토큰 초과분은 입력 2배·출력 1.5배 할증
활용 사례
- •범위가 명확한 고빈도 에이전트 작업
- •Codex 안의 코드 리뷰·테스트 수정·소규모 기능 추가
- •규모가 큰 비용 민감형 다단계 도구 호출
심층 분석
Artificial Analysis Intelligence Index
39.8(중) / 47.5(최대)
AA Index v4.3.2. Claude Opus 5.5의 최대값은 57.6
실측 비용(작업당)
$0.25(중) / $1.06(최대)
중간 설정에서 Opus 5.5의 약 5분의 1
Input / Output 단가
100만 토큰당 $2 / $10
GPT-5.6 Sol 프로모 단가에서 50% 인하. 캐시 읽기 $0.20
Context Window
105만 토큰
최대 출력 128K. 입력 272K 초과 시 입력 2배·출력 1.5배
안전 지표 변화
거부 롤백 68% -> 64%
게시판 모사 테스트의 미승인 지시 실행은 52% -> 11%
Release
2026년 9월 22일
지식 컷오프 2026년 4월 20일. OpenAI API·ChatGPT Work·Codex 제공
강점
- ・요율표가 Claude Sonnet 5와 사실상 같으면서도, 전 세대 대비 오류율이 약 절반이라고 OpenAI는 주장한다
- ・OpenAI의 AutomationBench에서 Claude Opus 5를 6.3% 앞서고 작업당 비용은 약 9% 수준이었다
- ・거부 롤백과 미승인 지시 실행률이 실질적으로 개선됐고, 52%에서 11%로의 하락 폭은 크다
- ・같은 날 GPT-6 계열 프롬프트 캐싱이 개선돼 캐시된 프롬프트 비용이 최대 90% 줄었다
약점
- ・최대 설정끼리 비교하면 AA 지수에서 Opus 5.5에 약 10점 뒤진다. 천장은 확실히 낮다
- ・출시 시점에 시스템 카드가 공개되지 않았다
- ・OpenAI API와 ChatGPT Work, Codex 전용이며 아직 ChatGPT 본체에서는 쓸 수 없다
- ・입력 272K 초과 시 입력 단가가 2배, 출력이 1.5배가 된다. Anthropic에는 이 할증이 없다
경쟁사 비교
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| Claude Opus 5.5 | AA 57.6(최대) | N/A | N/A | $4/$20 |
| GPT-5.6 Sol(프로모) | AA 59 | N/A | N/A | $4/$20 |
| Claude Sonnet 5 | N/A | N/A | N/A | $2/$10 |
GPT-6 Sol은 9월 22일 OpenAI의 두 모델 중 실무용으로, 주장의 축은 벤치마크가 아니라 산술이다. 입력 100만 토큰 2달러, 출력 10달러의 요율은 Claude Sonnet 5의 요율표와 그대로 겹치며 GPT-5.6 Sol의 프로모 가격에서 50% 낮다. 학습 방식은 플래그십 GPT-6 Astra를 이어받았다. Artificial Analysis 측정에서는 기본 중간 설정 39.8(작업당 0.25달러), 최대 설정 47.5(1.06달러)로 Claude Opus 5.5보다 약 10점 낮지만 비용은 약 5분의 1이다. OpenAI는 안전 지표도 구체적인 숫자로 내놓았는데, 거부 롤백은 68%에서 64%로, 게시판 모사 테스트에서 미승인 지시 실행은 52%에서 11%로 낮아졌다.
출처
분석 생성일: 2026-09-23