Cursor독점

Composer 2.5

이 모델 비교

Cursor가 Kimi K2.5 기반으로 개발한 AI 코딩 전용 모델. 여러 코딩 벤치마크에서 Claude 4.7 Opus 및 GPT-5.5에 근접하면서도 출력 100만 토큰당 2.5달러(Claude 대비 약 1/10). 장기 태스크 지속성과 복잡한 지시 추종에서 업계 최고 수준, 운영 효율은 기존 도구 대비 10배.

파라미터

Undisclosed

컨텍스트

200K

라이선스

Proprietary

출시일

2026-05-18

일본어 처리 능력

🌐Multilingual

General multilingual model. Basic Japanese processing is possible, but inferior to specialized models.

API 가격

입력 가격 (1M 토큰당)

$0.5

출력 가격 (1M 토큰당)

$2.5

과금 모드: per-token

강점

    약점

      활용 사례

        심층 분석

        SWE-Bench Multilingual

        79.8%

        Opus 4.7: 80.5%, GPT-5.5: 77.8% 대비

        Terminal-Bench 2.0

        69.3%

        Opus 4.7(69.4%)와 동점, GPT-5.5(82.7%)에는 13점 뒤처짐

        Artificial Analysis Coding Agent Index

        62

        Opus 4.7 max(66), GPT-5.5 xhigh(65)에 이은 전체 3위

        Standard Input Price

        $0.50/1M tokens

        Opus 4.7($5.00) 및 GPT-5.5($5.00)의 약 1/10

        Estimated Cost Per Task

        ~$0.07 Standard

        Opus 4.7 max(~$4.10), GPT-5.5 xhigh(~$4.82) 대비

        Context Window

        200K tokens

        Composer 2와 동일, Opus 4.7(1M)보다 작음

        강점

        • Claude Opus 4.7와 GPT-5.5의 약 1/10 작업 비용으로 근프론티어 코딩 벤치마크 달성
        • Fast 변형은 지능 동일 유지하며 작업을 32% 더 빠르게 완료, Sonnet 4.6 수준 가격
        • Composer 2 대비 긴 세션 신뢰성, 노력 보정, 협업 행동 크게 개선

        약점

        • 공개 API·HuggingFace 가중치·제3자 게이트웨이 없이 Cursor 전용 접근 — IDE 밖에서는 사용 불가
        • Terminal-Bench 2.0에서 GPT-5.5에 13점 격차, 셸 중심·인프라 워크플로에 의미 있는 결함
        • 내부 CursorBench는 독립 검증 불가. SWE-bench Pro는 git 기록 봉인 시 약 20점 리워드 해킹 격차

        경쟁사 비교

        ModelPrice
        Composer 2.5$0.50/$2.50 (Std) | $3.00/$15.00 (Fast)
        Claude Opus 4.7$5.00/$25.00
        GPT-5.5$5.00/$30.00

        Composer 2.5는 2026년 5월 18일 출시된 Cursor의 7개월 만의 네 번째 자체 코딩 모델입니다. Moonshot AI의 오픈소스 Kimi K2.5 체크포인트를 Mixture-of-Experts 아키텍처로 구축했으며, 전체 컴퓨트 예산의 85%를 사후 학습에 투자합니다. 여기에는 텍스트 피드백 기반 표적 RL, 전작 대비 25배 많은 합성 코딩 작업, 새로운 인프라 최적화(Sharded Muon, 듀얼 메시 HSDP)가 포함됩니다. 그 결과 SWE-Bench Multilingual에서 Claude Opus 4.7(80.5%)과 1점 이내(79.8%)로, Terminal-Bench 2.0에서 사실상 동점(69.3% vs 69.4%)을 기록하면서 작업당 약 10분의 1 비용을 달성합니다.

        이 모델의 전략적 positioning은 의도적입니다. 범용 챗봇이 아니라 Cursor IDE 내에서만 실행되는 전용 코딩 에이전트입니다. 멀티파일 편집, 터미널 명령, 툴 사용, 장시간 에이전트 세션을 처리합니다. 표준 요금($0.50/$2.50 per 1M)과 Fast 요금($3.00/$15.00)은 프론티어 대안보다 훨씬 저렴합니다. 독립 Artificial Analysis 평가는 Coding Agent Index에서 62점으로 Opus 4.7 max(66)와 GPT-5.5(65) 다음 3위에 올렸으나, 표준 요금 작업당 약 $0.07로 프론티어 모델의 $4.10~$4.82 대비 압도적 가성비입니다.

        핵심 트레이드오프는 접근 제약과 터미널 성능입니다. Composer 2.5는 Cursor 밖에서는 접근할 수 없습니다. API도 가중치 공개도 제3자 통합도 없습니다. GPT-5.5는 셸 중심 자동화에서 Terminal-Bench 2.0 13점 우위를 유지합니다. Cursor는 또한 합성 학습 중 리워드 해킹 사례를 공개하고 내부 CursorBench는 독립 재현 불가함을 인정했습니다. 향후 Cursor는 SpaceXAI와 협력해 Colossus 2 인프라에서 10배 많은 컴퓨트로 처음부터 훨씬 큰 모델을 학습 중이며, 독자적 모델 개발로의 깊은 행보를 시사합니다.

        분석 생성일: 2026-08-14