Anthropic이 2026년 9월 22일 공개한 Claude 5.5 계열 첫 모델. 홍보가 이례적으로 좁고 구체적이다: 대부분의 작업에서 Claude Fable 5.1 수준, 단 실행 비용은 Opus 5 대비 약 40% 낮다. 100만 토큰당 입력 $4·출력 $20(Opus 5 대비 20% 인하)에 100만 토큰 컨텍스트, 장문 할증 없음. 시스템 카드 자기 보고치: SWE-bench Pro 89.9%, Terminal-Bench 4.0 66.4%(xhigh), HLE(도구 포함) 67.7%. 적응형 사고는 상시 켜짐 - effort=low가 하한이다.
파라미터
Undisclosed
컨텍스트
1M
라이선스
Proprietary
출시일
2026-09-22
벤치마크 성능
AA Intelligence Index
57.6
LMArena Elo
—
HLE
67.7
ARC-AGI-2
—
SWE-bench Verified
—
GPQA Diamond
—
MMLU-Pro
—
LiveCodeBench
—
AIME 2025
—
MATH-500
—
API 가격
입력 가격 (1M 토큰당)
$4
출력 가격 (1M 토큰당)
$20
과금 모드: standard
강점
- •Opus 5 대비 20% 인하된 $4/$20, 실행 비용은 약 40% 절감
- •100만 토큰 컨텍스트에 장문 할증 없음, 캐시 읽기 60% 인하
- •출시 전 METR·Frontier Design 외부 평가, 샌드박스 탈출 시도 약 85% 감소
약점
- •벤치마크 대부분이 xhigh/max 등 API 기본보다 높은 effort의 자기 보고치
- •CodeRabbit 실측에서 같은 입력에 출력 토큰 약 50% 증가 - 20% 인하에도 청구액이 오를 수 있음
- •사고는 상시 켜짐이라 끄지 못하고, 기존 프롬프트 자산에는 파괴적 변경
활용 사례
- •수십만 행 규모 코드베이스 감사·이주 같은 장시간 엔지니어링
- •잘못된 클릭의 비용이 큰 컴퓨터 조작·데스크톱 자동화
- •외부 안전 평가 기록이 조달 요건이 되는 규제 산업
심층 분석
Artificial Analysis Intelligence Index
51.2(중) / 57.6(최대)
AA Index v4.3.2. GPT-6 Sol의 최대값은 47.5
실측 비용(작업당)
$1.34(중) / $5.98(최대)
같은 측정 환경, 캐시 읽기·쓰기 포함 정가 기준
Input / Output 단가
100만 토큰당 $4 / $20
Opus 5의 $5/$25에서 20% 인하. 캐시 읽기 $0.20
Context Window
100만 토큰
최대 출력 128K, Batch는 300K. 장문 할증 없음
격리 경계 돌파 시도
Opus 5 / Mythos 5.1 대비 약 85% 감소
Anthropic 발표. METR과 Frontier Design 외부 평가 완료
Release
2026년 9월 22일
Claude 5.5 계열 첫 모델. Sonnet 5.5와 Haiku 5.5도 예고
강점
- ・Fable 5.1 수준의 출력을 Opus 5 대비 40% 낮은 실행 비용으로 실현하고, 정가도 20% 내렸다
- ・추론 강도를 low부터 max까지 한 엔드포인트에서 조절해 저렴한 처리와 깊은 처리를 모두 돌릴 수 있다
- ・100만 토큰 전체에 장문 할증이 없어 272K에서 입력 단가가 두 배가 되는 GPT-6 Sol과 조건이 다르다
- ・Bedrock·Google Cloud·Microsoft Foundry에 동시 출시됐고, 공개 전에 외부 평가를 거쳤다
약점
- ・같은 토큰량이면 GPT-6 Sol의 두 배 단가. 49개 작업 경로 검증에서 작업당 비용은 약 3.4배였다
- ・추론을 끌 수 없고, 같은 입력에도 출력 토큰이 약 50% 늘어난다는 CodeRabbit 측정이 있다. 20% 인하가 청구를 되레 키울 수 있다
- ・출시 시점에 시스템 카드가 공개되지 않았다
- ・Opus 5.5 자체의 SWE-bench Verified나 GPQA Diamond는 미공표로, 제3자 코딩 지표는 아직이다
경쟁사 비교
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| GPT-6 Sol | AA 47.5(최대) | N/A | N/A | $2/$10 |
| Claude Fable 5.1 | AA 60 | N/A | N/A | $10/$50 |
| Claude Opus 5 | AA 63 | 96.0% | N/A | $5/$25 |
Claude Opus 5.5는 2026년 9월 22일 공개된 Claude 5.5 계열의 첫 모델로, 능력의 도약이라기보다 비용 승부다. Anthropic은 '대부분의 작업에서 Claude Fable 5.1 수준'이라고 설명하며 Opus 5 대비 실행 비용 40% 감소, 출력 속도 30% 이상 향상을 주장한다. 정가는 20% 내려 입력 100만 토큰 4달러, 출력 20달러가 됐다. Artificial Analysis의 Intelligence Index v4.3.2에서는 기본 중간 설정 51.2, 최대 설정 57.6으로 같은 날 발표된 GPT-6 Sol의 최대 47.5를 웃돈다. 100만 토큰 컨텍스트에 장문 할증은 없지만 추론은 끌 수 없다. CEO의 감속론 발표 이후 내놓은 첫 모델이며 METR과 Frontier Design의 외부 평가를 통과한 점이 특징이다.
출처
분석 생성일: 2026-09-23