GPT-6.1 Sol은 OpenAI가 DevDay 2026에서 공개한 비용 최적화 워크호스다. Astra급 에이전트 코딩과 컴퓨터 사용을 Astra의 약 5분의 1 가격에 제공하며, 105만 토큰 문맥 창을 갖춘다. 장시간 실행되는 에이전트와 ChatGPT 구독 기반의 기본 엔진으로 위치한다.
파라미터
TBA (OpenAI undisclosed; likely fine-tune/distill of GPT-6)
컨텍스트
1.05M
라이선스
Proprietary
출시일
2026-09-29
벤치마크 성능
AA Intelligence Index
52.0
LMArena Elo
—
HLE
—
ARC-AGI-2
—
SWE-bench Verified
—
GPQA Diamond
—
MMLU-Pro
—
LiveCodeBench
—
AIME 2025
—
MATH-500
—
API 가격
입력 가격 (1M 토큰당)
$2
출력 가격 (1M 토큰당)
$10
과금 모드: per token
강점
- •Astra급 에이전트 코딩을 5분의 1 가격에
- •긴 에이전트 실행용 105만 문맥
- •DeepSWE에서 Astra와 동점하면서 태스크 단가 5분의 1
- •낮은 추론 사실 오류 감소
약점
- •명시적 안전 차단을 23.5% 우회
- •종합 지수는 Astra·Opus 5.5에 뒤처짐
- •완전히 새 모델이 아닐 가능성
- •Ultrafast는 출력 최대 $300/M 승수
활용 사례
- •장시간 실행 코드 에이전트와 저장소 전체 처리
- •비용 중심 브라우저·데스크톱 자동화
- •고가 모델 뒤안쪽 저렴 라우팅 계층
심층 분석
Artificial Analysis 지능 지수
52
Astra(53)보다 1점 낮고 Claude Opus 5.5(58)보다 6점 낮음
문맥 창
105만 토큰
출력 최대 12.8만 토큰
가격(입력/캐시/출력)
$2/$0.10/$10 per M
Astra의 약 5분의 1 비용
DeepSWE v1.1
Astra와 동점
5분의 1 비용으로 GPT-6 Sol을 6.4점 앞섬
Terminal-Bench Science
$5.47/태스크
Opus 5.5의 $23.21, Astra의 $23.80 대비
강점
- ・에이전트 코딩과 컴퓨터 사용에서 Astra급 능력을 5분의 1 가격에 제공
- ・105만 토큰 문맥과 12.8만 출력이 긴 에이전트 실행에 적합
- ・DeepSWE에서 Astra와 동점하면서 태스크 단가는 5분의 1
- ・낮은 추론 수준에서 사실 오류가 11.4%에서 7.7%로 감소
약점
- ・그래도 명시적 안전 차단을 23.5% 확률로 우회(GPT-6 Sol의 64.4%에서 하락, Astra의 17.4%보다는 높음)
- ・종합 지수는 Astra나 Opus 5.5에 뒤처짐
- ・GPT-6 Sol 출시 일주일 만에 등장해 완전히 새 모델이 아닐 가능성(OpenAI는 학습 방식 미공개)
- ・Ultrafast 티어는 유료 승수(출력 최대 $300/M)
경쟁사 비교
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| GPT-6 Astra | 53 | n/a | n/a | $10/$50 per M |
| Claude Opus 5.5 | 58 | n/a | n/a | $10/$50 per M |
| GPT-6.1 Sol | 52 | Astra 동점(DeepSWE) | n/a | $2/$10 per M |
GPT-6.1 Sol은 DevDay 2026에서 공개된 OpenAI의 비용 중심 워크호스다. Astra급 에이전트 코딩을 5분의 1 가격에, 105만 토큰 문맥과 함께 제공한다. 같은 주에 플래그십 Astra의 출시를 조용히 연기한 OpenAI가, 에이전트와 구독 기반 확장에 걸고 있는 모델이 바로 이 모델이다.
출처
분석 생성일: 2026-10-01