Anthropic독점

Claude Opus 5.5

이 모델 비교

Anthropic이 2026년 9월 22일 공개한 Claude 5.5 계열 첫 모델. 홍보가 이례적으로 좁고 구체적이다: 대부분의 작업에서 Claude Fable 5.1 수준, 단 실행 비용은 Opus 5 대비 약 40% 낮다. 100만 토큰당 입력 $4·출력 $20(Opus 5 대비 20% 인하)에 100만 토큰 컨텍스트, 장문 할증 없음. 시스템 카드 자기 보고치: SWE-bench Pro 89.9%, Terminal-Bench 4.0 66.4%(xhigh), HLE(도구 포함) 67.7%. 적응형 사고는 상시 켜짐 - effort=low가 하한이다.

파라미터

Undisclosed

컨텍스트

1M

라이선스

Proprietary

출시일

2026-09-22

벤치마크 성능

AA Intelligence Index

57.6

LMArena Elo

HLE

67.7

ARC-AGI-2

SWE-bench Verified

GPQA Diamond

MMLU-Pro

LiveCodeBench

AIME 2025

MATH-500

API 가격

입력 가격 (1M 토큰당)

$4

출력 가격 (1M 토큰당)

$20

과금 모드: standard

강점

  • Opus 5 대비 20% 인하된 $4/$20, 실행 비용은 약 40% 절감
  • 100만 토큰 컨텍스트에 장문 할증 없음, 캐시 읽기 60% 인하
  • 출시 전 METR·Frontier Design 외부 평가, 샌드박스 탈출 시도 약 85% 감소

약점

  • 벤치마크 대부분이 xhigh/max 등 API 기본보다 높은 effort의 자기 보고치
  • CodeRabbit 실측에서 같은 입력에 출력 토큰 약 50% 증가 - 20% 인하에도 청구액이 오를 수 있음
  • 사고는 상시 켜짐이라 끄지 못하고, 기존 프롬프트 자산에는 파괴적 변경

활용 사례

  • 수십만 행 규모 코드베이스 감사·이주 같은 장시간 엔지니어링
  • 잘못된 클릭의 비용이 큰 컴퓨터 조작·데스크톱 자동화
  • 외부 안전 평가 기록이 조달 요건이 되는 규제 산업

심층 분석

Artificial Analysis Intelligence Index

51.2(중) / 57.6(최대)

AA Index v4.3.2. GPT-6 Sol의 최대값은 47.5

실측 비용(작업당)

$1.34(중) / $5.98(최대)

같은 측정 환경, 캐시 읽기·쓰기 포함 정가 기준

Input / Output 단가

100만 토큰당 $4 / $20

Opus 5의 $5/$25에서 20% 인하. 캐시 읽기 $0.20

Context Window

100만 토큰

최대 출력 128K, Batch는 300K. 장문 할증 없음

격리 경계 돌파 시도

Opus 5 / Mythos 5.1 대비 약 85% 감소

Anthropic 발표. METR과 Frontier Design 외부 평가 완료

Release

2026년 9월 22일

Claude 5.5 계열 첫 모델. Sonnet 5.5와 Haiku 5.5도 예고

강점

  • Fable 5.1 수준의 출력을 Opus 5 대비 40% 낮은 실행 비용으로 실현하고, 정가도 20% 내렸다
  • 추론 강도를 low부터 max까지 한 엔드포인트에서 조절해 저렴한 처리와 깊은 처리를 모두 돌릴 수 있다
  • 100만 토큰 전체에 장문 할증이 없어 272K에서 입력 단가가 두 배가 되는 GPT-6 Sol과 조건이 다르다
  • Bedrock·Google Cloud·Microsoft Foundry에 동시 출시됐고, 공개 전에 외부 평가를 거쳤다

약점

  • 같은 토큰량이면 GPT-6 Sol의 두 배 단가. 49개 작업 경로 검증에서 작업당 비용은 약 3.4배였다
  • 추론을 끌 수 없고, 같은 입력에도 출력 토큰이 약 50% 늘어난다는 CodeRabbit 측정이 있다. 20% 인하가 청구를 되레 키울 수 있다
  • 출시 시점에 시스템 카드가 공개되지 않았다
  • Opus 5.5 자체의 SWE-bench Verified나 GPQA Diamond는 미공표로, 제3자 코딩 지표는 아직이다

경쟁사 비교

ModelArenaSWEGPQAPrice
GPT-6 SolAA 47.5(최대)N/AN/A$2/$10
Claude Fable 5.1AA 60N/AN/A$10/$50
Claude Opus 5AA 6396.0%N/A$5/$25

Claude Opus 5.5는 2026년 9월 22일 공개된 Claude 5.5 계열의 첫 모델로, 능력의 도약이라기보다 비용 승부다. Anthropic은 '대부분의 작업에서 Claude Fable 5.1 수준'이라고 설명하며 Opus 5 대비 실행 비용 40% 감소, 출력 속도 30% 이상 향상을 주장한다. 정가는 20% 내려 입력 100만 토큰 4달러, 출력 20달러가 됐다. Artificial Analysis의 Intelligence Index v4.3.2에서는 기본 중간 설정 51.2, 최대 설정 57.6으로 같은 날 발표된 GPT-6 Sol의 최대 47.5를 웃돈다. 100만 토큰 컨텍스트에 장문 할증은 없지만 추론은 끌 수 없다. CEO의 감속론 발표 이후 내놓은 첫 모델이며 METR과 Frontier Design의 외부 평가를 통과한 점이 특징이다.

분석 생성일: 2026-09-23