Anthropic이 개발한 최고 성능 추론 모델입니다. 100만 토큰의 컨텍스트 윈도우와 12.8만 토큰 출력을 지원하며, 가장 복잡한 추론 태스크와 장시간 에이전트 작업에 최적화되어 있습니다.
파라미터
Undisclosed
컨텍스트
라이선스
Proprietary
출시일
2026-06-09
벤치마크 성능
AA Intelligence Index
—
LMArena Elo
—
HLE
—
ARC-AGI-2
—
SWE-bench Verified
—
GPQA Diamond
—
MMLU-Pro
—
LiveCodeBench
—
AIME 2025
—
MATH-500
—
일본어 처리 능력
Multilingual model with strong Japanese language processing capabilities.
API 가격
입력 가격 (1M 토큰당)
$5
출력 가격 (1M 토큰당)
$
과금 모드: standard
강점
약점
활용 사례
심층 분석
Artificial Analysis 인텔리전스 지수
64.9
전체 1위, 64점을 넘은 최초의 모델
SWE-bench Pro
80.3%
Opus 4.8(69.2%) 대비 +11.1점, GPT-5.5(58.6%) 대비 +21.7점
SWE-bench Verified
95.0%
Terminal-Bench 2.1
88.0%
HLE (도구 있음)
64.5%
입력/출력 가격
$10/$50 per 1M
Opus 4.8($5/$25)의 2배. 6/22까지 Pro·Max·Team·Enterprise에서 무료
강점
- ・공개된 Claude 모델 중 최강의 코딩·장거리 에이전틱 성능. SWE-bench Pro 80.3%로 Opus 4.8을 11점, GPT-5.5를 22점 앞서며 FrontierCode Diamond 29.3%로 Opus 4.8(13.4%)을 2배 이상 압도
- ・Artificial Analysis 인텔리전스 지수 64.9로 전체 1위 기록(최초 64점 돌파). Mythos 5와 동일 가중치라 95% 이상 세션에서 완전한 Mythos급 능력을 발휘
- ・실전 검증: Stripe가 5,000만 줄 루비 코드베이스를 하루 만에 전체 마이그레이션(수동 2개월→약 20시간, 약 60배 가속). 보조 프레임 없이 포켓몬 파이어레드를 화면만으로 클리어
약점
- ・Opus 4.8의 2배 가격($10/$50 per 1M). 대량 코딩 파이프라인에서 비용 대비 가치는 Sonnet 5나 DeepSeek V4 Pro에 밀림
- ・사이버·생물화학·모델 증류 관련 쿼리는 분류기가 Opus 4.8로 자동 폴백(세션의 약 5%). 복원 작업이나 합법적 보안 연구에서 갑작스러운 능력 저하 발생
- ・미국 수출 통제로 2026-06-12부터 06-30까지 19일간 전면 중단됐으며, 7/1 복귀 때 더 강한 분류기 적용으로 코딩 세션의 가짜 양성이 늘어남
경쟁사 비교
| Model | Arena | Price |
|---|---|---|
| Claude Opus 4.8 | N/A | $5/$25 per 1M |
| GPT-5.5 | N/A | $5/$30 per 1M |
| Claude Mythos 5 | N/A | 제한적 공개(Project Glasswing) |
Claude Fable 5는 2026년 6월 9일 출시된 Anthropic의 최초 일반 공개 'Mythos급' 모델로, Opus급 위에 위치하는 새로운 최상위 능력 계층이다. Fable 5와 제한 공개 모델 Mythos 5는 동일한 가중치를 공유하며, Fable 5는 사이버·생물화학·모델 증류 쿼리를 가로채 Opus 4.8로 라우팅하는 안전 분류기를 추가했다. 95% 이상 세션에서 분류기가 발동하지 않아 사실상 Mythos 5와 동일하게 동작한다.
벤치마크는 Anthropic이 공개 모델에 대해 발표한 것 중 최강이다. SWE-bench Pro 80.3%(Opus 4.8 대비 +11.1점, GPT-5.5 대비 +21.7점), SWE-bench Verified 95.0%, Terminal-Bench 2.1 88.0%, HLE(도구 있음) 64.5%, GPQA Diamond 94.5%를 기록했다. Artificial Analysis 인텔리전스 지수는 64.9로 전체 1위이며 64점을 넘은 최초의 모델이다.
가격은 입력 $10/백만 토큰, 출력 $50/백만 토큰으로 Opus 4.8의 2배이며, 6월 22일까지 Pro·Max·Team·Enterprise 구독에서 무료로 제공됐다. 실전 사례로 Stripe가 5,000만 줄 루비 코드베이스를 하루 만에 마이그레이션했으며, 외부 레드팀은 장기 에이전틱 작업에서 보편적 탈옥을 찾지 못했다. 가장 어렵고 정확도가 중요한 과제에는 여전히 Opus 4.8 폴백이나 더 저렴한 Sonnet 5가 비용 효율적일 수 있다.
출처
분석 생성일: 2026-08-04