Anthropic독점

Claude Sonnet 5

이 모델 비교

Anthropic이 개발한 차세대 기반 모델입니다. 최신 학습 데이터와 아키텍처로 높은 성능을 실현합니다.

파라미터

Undisclosed

컨텍스트

1M

라이선스

Proprietary

출시일

2026-06-30

벤치마크 성능

AA Intelligence Index

LMArena Elo

HLE

ARC-AGI-2

SWE-bench Verified

GPQA Diamond

MMLU-Pro

LiveCodeBench

AIME 2025

MATH-500

일본어 처리 능력

High-Quality JP

Multilingual model with strong Japanese language processing capabilities.

API 가격

입력 가격 (1M 토큰당)

$2

출력 가격 (1M 토큰당)

$

과금 모드: standard

강점

    약점

      활용 사례

        심층 분석

        Artificial Analysis 인텔리전스 지수

        53

        전체 5위, GPT-5.5(xhigh) 및 Opus 4.8(max)보다 2~3점 뒤처짐

        SWE-bench Pro

        63.2%

        Sonnet 4.6(58.1%) 대비, Opus 4.8은 69.2%

        Terminal-Bench 2.1

        80.4%

        Opus 4.8(74.6%)을 앞섬. 4.6 대비 가장 큰 단일 상승폭

        OSWorld-Verified

        81.2%

        Sonnet 4.6(78.5%) 대비, Opus 4.8은 83.4%

        표준 입력 가격

        $3/백만 토큰

        8/31까지 신규가 $2/백만. Opus는 $5/백만

        표준 출력 가격

        $15/백만 토큰

        8/31까지 신규가 $10/백만. Opus는 $25/백만

        강점

        • Opus급 에이전틱 성능을 약 절반 비용으로 제공. Terminal-Bench 2.1에서는 Opus 4.8을 앞서고 지식 업무(GDPval-AA v2)에서는 동률을 이룸
        • 테스트된 모델 중 가장 강력한 프롬프트 인젝션 방어력(공격 성공률 0.19%), 가장 낮은 거짓 응답률(MASK 3.1%)
        • 최고 수준의 에이전틱 완수 능력: 사람의 추가 지시 없이 테스트 실행, 실패 원인 파악, 패치, 재실행을 스스로 수행

        약점

        • 갱신된 토크나이저가 동일 텍스트의 토큰 수를 1.0~1.35배 부풀려, 실제 비용이 표면적인 토큰 단가보다 높아질 수 있음
        • Opus 4.8이 가장 어려운 과제에서 확실히 앞섬: USAMO 올림피아드 수학 +17.2점, SWE-bench Pro +6.0점, HLE(도구 없음) +6.6점
        • 의도적으로 사이버 보안 역량을 낮춤. 면제 없이는 합법적인 보안 연구에도 적합하지 않은 강력한 안전장치가 기본 적용됨

        경쟁사 비교

        ModelArenaPrice
        Claude Opus 4.8N/A$5/$25 per 1M
        GPT-5.5N/A$5/$30 per 1M
        Gemini 3.5 FlashN/A구글 가격 기준

        Claude Sonnet 5는 2026년 6월 30일 출시된 Anthropic의 가장 에이전틱한 미드티어 모델로, 플래그십인 Opus 4.8과의 성능 격차를 크게 줄이면서 토큰당 약 절반 비용으로 제공된다. SWE-bench Pro에서 63.2%(Sonnet 4.6 대비 5.1점 상승), Terminal-Bench 2.1에서 80.4%(Opus 4.8의 74.6%를 실제로 앞섬), 지식 업무에서는 1618 GDPval-AA v2 Elo로 Opus 4.8과 동률을 기록했다. 갱신된 토크나이저는 동일 텍스트의 토큰 수를 최대 1.35배까지 늘릴 수 있어, Anthropic은 2026년 8월 31일까지 신규가 $2/$10 per 백만 토큰을 제공하고(이후 표준가 $3/$15 적용) 이를 통해 상쇄했다.

        이 모델의 결정적 특징은 신뢰할 수 있는 에이전틱 완수 능력이다. 초기 사용자들은 이전 Sonnet이 멈추거나 사람의 개입이 필요했던 다단계 코딩·디버깅·업무 자동화 과제를 끝까지 수행한다고 보고했다. low부터 max까지 5단계 노력 수준, 기본값 high의 적응형 사고, 100만 토큰 컨텍스트 윈도를 갖췄다. 안전성도 크게 개선되어 프롬프트 인젝션 공격 성공률 0.19%(최저), 아첨형 거짓 응답률 3.1%(최저)를 기록했다.

        Sonnet 5는 Claude Free·Pro 요금제의 기본 모델이 되었으며 Claude Code, Claude API, AWS Bedrock, Google Vertex AI, Microsoft Foundry, 그리고 Cursor·VS Code·GitHub Copilot 같은 서드파티 도구를 통해 이용 가능하다. 대다수 프로덕션 에이전틱 워크로드에서 Claude 라인업 내 최고의 가치를 제공하며, Opus 4.8은 가장 정확도가 중요한 과제와 사이버 연구 용도로 남겨둘 수 있다.

        분석 생성일: 2026-08-01