Anthropic독점

Claude Fable 5

이 모델 비교

Anthropic이 개발한 최고 성능 추론 모델입니다. 100만 토큰의 컨텍스트 윈도우와 12.8만 토큰 출력을 지원하며, 가장 복잡한 추론 태스크와 장시간 에이전트 작업에 최적화되어 있습니다.

파라미터

Undisclosed

컨텍스트

라이선스

Proprietary

출시일

2026-06-09

벤치마크 성능

AA Intelligence Index

LMArena Elo

HLE

ARC-AGI-2

SWE-bench Verified

GPQA Diamond

MMLU-Pro

LiveCodeBench

AIME 2025

MATH-500

일본어 처리 능력

High-Quality JP

Multilingual model with strong Japanese language processing capabilities.

API 가격

입력 가격 (1M 토큰당)

$5

출력 가격 (1M 토큰당)

$

과금 모드: standard

강점

    약점

      활용 사례

        심층 분석

        Artificial Analysis 인텔리전스 지수

        64.9

        전체 1위, 64점을 넘은 최초의 모델

        SWE-bench Pro

        80.3%

        Opus 4.8(69.2%) 대비 +11.1점, GPT-5.5(58.6%) 대비 +21.7점

        SWE-bench Verified

        95.0%

        Terminal-Bench 2.1

        88.0%

        HLE (도구 있음)

        64.5%

        입력/출력 가격

        $10/$50 per 1M

        Opus 4.8($5/$25)의 2배. 6/22까지 Pro·Max·Team·Enterprise에서 무료

        강점

        • 공개된 Claude 모델 중 최강의 코딩·장거리 에이전틱 성능. SWE-bench Pro 80.3%로 Opus 4.8을 11점, GPT-5.5를 22점 앞서며 FrontierCode Diamond 29.3%로 Opus 4.8(13.4%)을 2배 이상 압도
        • Artificial Analysis 인텔리전스 지수 64.9로 전체 1위 기록(최초 64점 돌파). Mythos 5와 동일 가중치라 95% 이상 세션에서 완전한 Mythos급 능력을 발휘
        • 실전 검증: Stripe가 5,000만 줄 루비 코드베이스를 하루 만에 전체 마이그레이션(수동 2개월→약 20시간, 약 60배 가속). 보조 프레임 없이 포켓몬 파이어레드를 화면만으로 클리어

        약점

        • Opus 4.8의 2배 가격($10/$50 per 1M). 대량 코딩 파이프라인에서 비용 대비 가치는 Sonnet 5나 DeepSeek V4 Pro에 밀림
        • 사이버·생물화학·모델 증류 관련 쿼리는 분류기가 Opus 4.8로 자동 폴백(세션의 약 5%). 복원 작업이나 합법적 보안 연구에서 갑작스러운 능력 저하 발생
        • 미국 수출 통제로 2026-06-12부터 06-30까지 19일간 전면 중단됐으며, 7/1 복귀 때 더 강한 분류기 적용으로 코딩 세션의 가짜 양성이 늘어남

        경쟁사 비교

        ModelArenaPrice
        Claude Opus 4.8N/A$5/$25 per 1M
        GPT-5.5N/A$5/$30 per 1M
        Claude Mythos 5N/A제한적 공개(Project Glasswing)

        Claude Fable 5는 2026년 6월 9일 출시된 Anthropic의 최초 일반 공개 'Mythos급' 모델로, Opus급 위에 위치하는 새로운 최상위 능력 계층이다. Fable 5와 제한 공개 모델 Mythos 5는 동일한 가중치를 공유하며, Fable 5는 사이버·생물화학·모델 증류 쿼리를 가로채 Opus 4.8로 라우팅하는 안전 분류기를 추가했다. 95% 이상 세션에서 분류기가 발동하지 않아 사실상 Mythos 5와 동일하게 동작한다.

        벤치마크는 Anthropic이 공개 모델에 대해 발표한 것 중 최강이다. SWE-bench Pro 80.3%(Opus 4.8 대비 +11.1점, GPT-5.5 대비 +21.7점), SWE-bench Verified 95.0%, Terminal-Bench 2.1 88.0%, HLE(도구 있음) 64.5%, GPQA Diamond 94.5%를 기록했다. Artificial Analysis 인텔리전스 지수는 64.9로 전체 1위이며 64점을 넘은 최초의 모델이다.

        가격은 입력 $10/백만 토큰, 출력 $50/백만 토큰으로 Opus 4.8의 2배이며, 6월 22일까지 Pro·Max·Team·Enterprise 구독에서 무료로 제공됐다. 실전 사례로 Stripe가 5,000만 줄 루비 코드베이스를 하루 만에 마이그레이션했으며, 외부 레드팀은 장기 에이전틱 작업에서 보편적 탈옥을 찾지 못했다. 가장 어렵고 정확도가 중요한 과제에는 여전히 Opus 4.8 폴백이나 더 저렴한 Sonnet 5가 비용 효율적일 수 있다.

        분석 생성일: 2026-08-04