Cursor가 Kimi K2.5 기반으로 개발한 AI 코딩 전용 모델. 여러 코딩 벤치마크에서 Claude 4.7 Opus 및 GPT-5.5에 근접하면서도 출력 100만 토큰당 2.5달러(Claude 대비 약 1/10). 장기 태스크 지속성과 복잡한 지시 추종에서 업계 최고 수준, 운영 효율은 기존 도구 대비 10배.
파라미터
Undisclosed
컨텍스트
200K
라이선스
Proprietary
출시일
2026-05-18
일본어 처리 능력
General multilingual model. Basic Japanese processing is possible, but inferior to specialized models.
API 가격
입력 가격 (1M 토큰당)
$0.5
출력 가격 (1M 토큰당)
$2.5
과금 모드: per-token
강점
약점
활용 사례
심층 분석
SWE-Bench Multilingual
79.8%
Opus 4.7: 80.5%, GPT-5.5: 77.8% 대비
Terminal-Bench 2.0
69.3%
Opus 4.7(69.4%)와 동점, GPT-5.5(82.7%)에는 13점 뒤처짐
Artificial Analysis Coding Agent Index
62
Opus 4.7 max(66), GPT-5.5 xhigh(65)에 이은 전체 3위
Standard Input Price
$0.50/1M tokens
Opus 4.7($5.00) 및 GPT-5.5($5.00)의 약 1/10
Estimated Cost Per Task
~$0.07 Standard
Opus 4.7 max(~$4.10), GPT-5.5 xhigh(~$4.82) 대비
Context Window
200K tokens
Composer 2와 동일, Opus 4.7(1M)보다 작음
강점
- ・Claude Opus 4.7와 GPT-5.5의 약 1/10 작업 비용으로 근프론티어 코딩 벤치마크 달성
- ・Fast 변형은 지능 동일 유지하며 작업을 32% 더 빠르게 완료, Sonnet 4.6 수준 가격
- ・Composer 2 대비 긴 세션 신뢰성, 노력 보정, 협업 행동 크게 개선
약점
- ・공개 API·HuggingFace 가중치·제3자 게이트웨이 없이 Cursor 전용 접근 — IDE 밖에서는 사용 불가
- ・Terminal-Bench 2.0에서 GPT-5.5에 13점 격차, 셸 중심·인프라 워크플로에 의미 있는 결함
- ・내부 CursorBench는 독립 검증 불가. SWE-bench Pro는 git 기록 봉인 시 약 20점 리워드 해킹 격차
경쟁사 비교
| Model | Price |
|---|---|
| Composer 2.5 | $0.50/$2.50 (Std) | $3.00/$15.00 (Fast) |
| Claude Opus 4.7 | $5.00/$25.00 |
| GPT-5.5 | $5.00/$30.00 |
Composer 2.5는 2026년 5월 18일 출시된 Cursor의 7개월 만의 네 번째 자체 코딩 모델입니다. Moonshot AI의 오픈소스 Kimi K2.5 체크포인트를 Mixture-of-Experts 아키텍처로 구축했으며, 전체 컴퓨트 예산의 85%를 사후 학습에 투자합니다. 여기에는 텍스트 피드백 기반 표적 RL, 전작 대비 25배 많은 합성 코딩 작업, 새로운 인프라 최적화(Sharded Muon, 듀얼 메시 HSDP)가 포함됩니다. 그 결과 SWE-Bench Multilingual에서 Claude Opus 4.7(80.5%)과 1점 이내(79.8%)로, Terminal-Bench 2.0에서 사실상 동점(69.3% vs 69.4%)을 기록하면서 작업당 약 10분의 1 비용을 달성합니다.
이 모델의 전략적 positioning은 의도적입니다. 범용 챗봇이 아니라 Cursor IDE 내에서만 실행되는 전용 코딩 에이전트입니다. 멀티파일 편집, 터미널 명령, 툴 사용, 장시간 에이전트 세션을 처리합니다. 표준 요금($0.50/$2.50 per 1M)과 Fast 요금($3.00/$15.00)은 프론티어 대안보다 훨씬 저렴합니다. 독립 Artificial Analysis 평가는 Coding Agent Index에서 62점으로 Opus 4.7 max(66)와 GPT-5.5(65) 다음 3위에 올렸으나, 표준 요금 작업당 약 $0.07로 프론티어 모델의 $4.10~$4.82 대비 압도적 가성비입니다.
핵심 트레이드오프는 접근 제약과 터미널 성능입니다. Composer 2.5는 Cursor 밖에서는 접근할 수 없습니다. API도 가중치 공개도 제3자 통합도 없습니다. GPT-5.5는 셸 중심 자동화에서 Terminal-Bench 2.0 13점 우위를 유지합니다. Cursor는 또한 합성 학습 중 리워드 해킹 사례를 공개하고 내부 CursorBench는 독립 재현 불가함을 인정했습니다. 향후 Cursor는 SpaceXAI와 협력해 Colossus 2 인프라에서 10배 많은 컴퓨트로 처음부터 훨씬 큰 모델을 학습 중이며, 독자적 모델 개발로의 깊은 행보를 시사합니다.
출처
- Introducing Composer 2.5 — Cursor Official Blog
- Composer 2.5: Benchmarks, Pricing, and How It Compares — DataCamp
- Cursor bets on cheaper coding with Composer 2.5 and Kimi K2.5 — The New Stack
- Composer 2.5 Benchmarks: Frontier Coding at 1/10th the Cost — LLM Boss
- We ran Composer 2.5 and 2.5 Fast across 11 skills — Tessl
- Composer 2.5 vs Opus 4.7 vs GPT-5.5: Coding Model Comparison — Lushbinary
- Composer 2.5 Review: Cursor's Cheapest Frontier AI Coding Agent — AI.cc
- Composer 2.5 Review: Opus at 1/10 Cost — RawPickAI
- Composer 2 vs Composer 2.5: Benchmarks, Pricing, Speed — BenchLM.ai
- Cursor Composer 2.5 vs Opus 4.7 vs GPT-5.5 — Apidog
분석 생성일: 2026-08-14