Alibaba가 개발한 최신 에이전트 특화 모델. 고도의 에이전트 워크플로우와 추론 능력을 구현합니다.
파라미터
Undisclosed
컨텍스트
256K
라이선스
Proprietary
출시일
2026-05-20
일본어 처리 능력
Multilingual model with strong Japanese language processing capabilities.
API 가격
이 모델의 API 가격 정보는 현재 공개되지 않았습니다
강점
약점
활용 사례
심층 분석
Arena Elo
1460
전체 15위, 코딩 12위 (BenchLM 잠정 순위)
SWE-Bench Verified
77.7%
Qwen3.7-Max 80.4% 대비
ScreenSpot Pro (GUI 파악)
79.0
컴퓨터 사용 에이전트 최상위급
입력 가격
$0.40/1M 토큰
Qwen3.7-Max의 약 6분의 1
문맥 창
100만 토큰
텍스트·이미지·영상 공유
Terminal-Bench 2.0
70.3%
Qwen3.7-Max 69.7% 근소하게 앞서
강점
- ・뛰어난 GUI 파악력(ScreenSpot Pro 79.0)으로 브라우저 자동화와 컴퓨터 사용에 강함
- ・시각 인지·코드 생성·GUI/CLI 조작을 하나의 루프에 묶는 멀티모달 하이브리드 에이전트
- ・$0.40/1M 입력 토큰의 저가 tier면서 Max급 텍스트 성능에 근접
약점
- ・자체 호스팅과 커스터마이즈가 불가능한 독점 API 전용 모델, 오픈웨이트 없음
- ・순수 텍스트와 수학 벤치에서 근소하게 뒤처짐(예: SWE-Bench Verified 77.7% vs 80.4%)
- ・시각 토큰이 공유 100만 토큰 예산을 차지해 이미지·영상 중심 작업이 비싸짐
경쟁사 비교
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| Qwen3.7-Max | 1475 | 80.4% | 92.4% | $2.50/$7.50 |
| Claude Sonnet 4.6 | 1480 | ~77%(추정) | ~90%(추정) | $3/$15 |
| DeepSeek V4 Pro(Max) | 1485 | ~80%(추정) | ~91%(추정) | $1.50/$4.50 |
Qwen3.7-Plus는 알리바바의 플래그십 멀티모달 에이전트 모델로, 2026년 6월 텍스트 전용 Qwen3.7-Max의 시각 버전으로 출시됐다. Qwen3.7 백본 위에서 최상위급 GUI 파악(ScreenSpot Pro 79.0)과 하이브리드 GUI+CLI 에이전트 능력을 갖추어 스크린샷만으로 브라우저 탐색·UI 재구성·소프트웨어 개발을 끝까지 자동화한다. 시각 인지·코드 생성·도구 사용을 하나의 에이전트 루프에 합쳐 보고·생각·작성·실행·검증하는 닫힌 루프 실행이 가능하다.
가격은 입력 토큰 기준 Max의 약 6분의 1인 저가 멀티모달 tier로, 순수 텍스트 벤치에서는 Max에 살짝 뒤지거나 맞먹는다. 100만 토큰 문맥과 35시간 자율 실행 한도는 장기 에이전트 흐름을 받친다. 다만 오픈웨이트가 없어 규제·폐쇄망 환경에서는 채택이 제한될 수 있다. 알리바바가 서구 프런티어 모델에 맞서 화면 인식 자동화 시장을 저비용으로 공략하는 전략적 카드다.
출처
분석 생성일: 2026-09-22