Anthropic독점

Claude Opus 4.7

이 모델 비교

Anthropic에서 개발한 고성능 기반 모델. 다양한 작업에 대응하며 균형 잡힌 성능을 제공합니다.

파라미터

Undisclosed

컨텍스트

라이선스

Proprietary

출시일

2026-04-16

일본어 처리 능력

High-Quality JP

Multilingual model with strong Japanese language processing capabilities.

API 가격

입력 가격 (1M 토큰당)

$2.5

출력 가격 (1M 토큰당)

$

과금 모드: standard

강점

    약점

      활용 사례

        심층 분석

        LMArena Elo

        1492

        WebDev Elo 1560, Vision Elo 1304

        SWE-bench Verified

        87.6%

        Opus 4.6(80.8%) 대비 상승

        SWE-bench Pro

        64.3%

        GPT-5.4(57.7%) 대비 +6.6점

        GPQA Diamond

        94.2%

        GPT-5.4(94.4%)와 사실상 동일

        입력/출력 가격

        $5 / $25 per 1M tokens

        Opus 4.6과 동일 요율, 새 토크나이저가 실비 10–35% 증가

        컨텍스트 윈도

        1M 입력 / 128K 출력

        최대 이미지 해상도 3.75MP(장변 2,576px)

        강점

        • 업계 최고 수준의 에이전틱 코딩: SWE-bench Verified 87.6%, Pro 64.3%로 광범위하게 공개된 모델 중 최상위
        • 3.3배 향상된 이미지 해상도(3.75MP)로 조밀한 스크린샷 분석, 다이어그램 추출, 컴퓨터 사용 에이전트 가능
        • MCP-Atlas 77.3%로 최강 멀티툴 오케스트레이션(GPT-5.4 대비 +9점), 복잡한 에이전트 파이프라인에 적합
        • 보고 전 자체 검증과 엄격한 지시 따르기로 장기 자율 작업의 신뢰성 향상

        약점

        • 장기 컨텍스트 검색 심각한 퇴보: MRCR v2 8-needle @1M에서 Opus 4.6의 78.3%→32.2%로 붕괴
        • 새 토크나이저가 단가 카드 불변에도 실제 비용을 10–35% 증가시킴
        • BrowseComp 79.3%로 퇴보, 웹 리서치에서 GPT-5.4(89.3%)·Gemini 3.1 Pro(85.9%)에 뒤처짐

        경쟁사 비교

        ModelArenaSWEGPQAPrice
        Claude Opus 4.7149287.6%94.2%$5/$25 per 1M tokens
        GPT-5.4출처 미공개84.1%94.4%미공개
        Gemini 3.1 Pro출처 미공개80.6%94.3%미공개

        Claude Opus 4.7은 2026년 4월 16일 출시된 Anthropic의 가장 강력한 범용 모델이자 Opus 4.6의 직접적인 업그레이드다. 에이전틱 소프트웨어 엔지니어링, 고정밀 비전 작업, 장기 자율 워크플로에 초점을 맞췄다. 보고 전 자체 검증, 엄격한 지시 따르기, 향상된 해상도 처리(3.75MP, 기존 1.15MP에서 상승), 멀티세션 에이전트용 파일 시스템 메모리를 도입했다. 가격은 백만 입력/출력 토큰당 $5/$25로 동결됐으나 새 토크나이저가 실질 비용을 10–35% 높인다.

        Opus 4.7은 SWE-bench Verified(87.6%), Pro(64.3%), MCP-Atlas(77.3%)에서 Anthropic 신기록을 세웠다. Cursor·Replit·Notion·Vercel 등 파트너 증언은 실제 프로덕션에서 작업 성공률 10–15% 향상과 일부 벤치마크에서 3배 많은 프로덕션 작업 해결을 확인했다. 'high'와 'max' 사이 새 'xhigh' 노력 단계와 비용 통제용 작업 예산(퍼블릭 베타)을 추가했다.

        단, 장기 컨텍스트 다바늘 검색이 MRCR v2에서 78.3%→32.2%로 붕괴했고 BrowseComp는 약 5점 퇴보했으며 새 토크나이저가 실비를 높였다. Anthropic은 미공개 Claude Mythos Preview보다 아래로 위치시키며, 프로젝트 글래스윙의 사이버 보안 안전장치를 탑재한 최초의 범용 공개 모델이라고 설명한다.

        분석 생성일: 2026-08-20