OpenAI독점

GPT-6 Sol

이 모델 비교

OpenAI가 2026년 9월 22일 공개한 GPT-6 계열 중급 모델. 100만 토큰당 입력 $2·출력 $10으로 Claude Sonnet 5와 요율표가 똑같고 GPT-5.6 Sol의 절반이다. 105만 토큰 컨텍스트, 최대 출력 128K, 지식 컷오프 2026년 4월 20일. 공개 수치는 새 천장이 아니라 비용을 판다: AutomationBench 33.2%(과제당 $0.27), Agents' Last Exam 56.4% - 반면 DeepSWE v1.1 68.8%는 GPT-5.6 Sol의 최고 기록에 못 미친다.

파라미터

Undisclosed

컨텍스트

1.05M

라이선스

Proprietary

출시일

2026-09-22

벤치마크 성능

AA Intelligence Index

47.5

LMArena Elo

HLE

ARC-AGI-2

SWE-bench Verified

GPQA Diamond

MMLU-Pro

LiveCodeBench

AIME 2025

MATH-500

API 가격

입력 가격 (1M 토큰당)

$2

출력 가격 (1M 토큰당)

$10

과금 모드: standard

강점

  • GPT-5.6 Sol의 절반인 $2/$10, 컨텍스트는 105만 토큰으로 확대
  • AutomationBench 33.2%를 과제당 $0.27에 달성 - 이번 공개에서 가장 정직한 단가 공시
  • 캐시 입력 $0.20/100만 토큰(90% 인하)으로 장시간 에이전트 실질 단가 절감

약점

  • DeepSWE v1.1 68.8%, OSWorld 2.0에서 GPT-5.6 Sol 최고 기록에 미달 - 개선된 것은 비용뿐
  • 모든 수치가 xhigh/max 자기 보고치이며 시스템 카드가 함께 나오지 않았다
  • 입력 27.2만 토큰 초과분은 입력 2배·출력 1.5배 할증

활용 사례

  • 범위가 명확한 고빈도 에이전트 작업
  • Codex 안의 코드 리뷰·테스트 수정·소규모 기능 추가
  • 규모가 큰 비용 민감형 다단계 도구 호출

심층 분석

Artificial Analysis Intelligence Index

39.8(중) / 47.5(최대)

AA Index v4.3.2. Claude Opus 5.5의 최대값은 57.6

실측 비용(작업당)

$0.25(중) / $1.06(최대)

중간 설정에서 Opus 5.5의 약 5분의 1

Input / Output 단가

100만 토큰당 $2 / $10

GPT-5.6 Sol 프로모 단가에서 50% 인하. 캐시 읽기 $0.20

Context Window

105만 토큰

최대 출력 128K. 입력 272K 초과 시 입력 2배·출력 1.5배

안전 지표 변화

거부 롤백 68% -> 64%

게시판 모사 테스트의 미승인 지시 실행은 52% -> 11%

Release

2026년 9월 22일

지식 컷오프 2026년 4월 20일. OpenAI API·ChatGPT Work·Codex 제공

강점

  • 요율표가 Claude Sonnet 5와 사실상 같으면서도, 전 세대 대비 오류율이 약 절반이라고 OpenAI는 주장한다
  • OpenAI의 AutomationBench에서 Claude Opus 5를 6.3% 앞서고 작업당 비용은 약 9% 수준이었다
  • 거부 롤백과 미승인 지시 실행률이 실질적으로 개선됐고, 52%에서 11%로의 하락 폭은 크다
  • 같은 날 GPT-6 계열 프롬프트 캐싱이 개선돼 캐시된 프롬프트 비용이 최대 90% 줄었다

약점

  • 최대 설정끼리 비교하면 AA 지수에서 Opus 5.5에 약 10점 뒤진다. 천장은 확실히 낮다
  • 출시 시점에 시스템 카드가 공개되지 않았다
  • OpenAI API와 ChatGPT Work, Codex 전용이며 아직 ChatGPT 본체에서는 쓸 수 없다
  • 입력 272K 초과 시 입력 단가가 2배, 출력이 1.5배가 된다. Anthropic에는 이 할증이 없다

경쟁사 비교

ModelArenaSWEGPQAPrice
Claude Opus 5.5AA 57.6(최대)N/AN/A$4/$20
GPT-5.6 Sol(프로모)AA 59N/AN/A$4/$20
Claude Sonnet 5N/AN/AN/A$2/$10

GPT-6 Sol은 9월 22일 OpenAI의 두 모델 중 실무용으로, 주장의 축은 벤치마크가 아니라 산술이다. 입력 100만 토큰 2달러, 출력 10달러의 요율은 Claude Sonnet 5의 요율표와 그대로 겹치며 GPT-5.6 Sol의 프로모 가격에서 50% 낮다. 학습 방식은 플래그십 GPT-6 Astra를 이어받았다. Artificial Analysis 측정에서는 기본 중간 설정 39.8(작업당 0.25달러), 최대 설정 47.5(1.06달러)로 Claude Opus 5.5보다 약 10점 낮지만 비용은 약 5분의 1이다. OpenAI는 안전 지표도 구체적인 숫자로 내놓았는데, 거부 롤백은 68%에서 64%로, 게시판 모사 테스트에서 미승인 지시 실행은 52%에서 11%로 낮아졌다.

분석 생성일: 2026-09-23