Qwen3.8-Max는 Alibaba의 Qwen 시리즈 중 가장 크고 강력한 모델이다. 총 2.4조 개 파라미터의 MoE 구조로 토큰당 950억 개만 활성화하며, 2026년 8월 3일 API 공개에 이어 8월 12일 오픈 가중치(Qwen3.8-2.4T-A95B)를 배포했다. 100만 토큰 컨텍스트와 텍스트·이미지·비디오 멀티모달 입력을 갖추고 QwenCloud에서 100만 토큰당 $2/$6에 제공된다. 장기 에이전트형 코딩, 자율 연구, 제품 개발에 특화되어 있다.
파라미터
2.4T (95B active)
컨텍스트
1M
라이선스
Proprietary
출시일
2026-08-12
벤치마크 성능
AA Intelligence Index
—
LMArena Elo
—
HLE
—
ARC-AGI-2
—
SWE-bench Verified
74.2
GPQA Diamond
92.6
MMLU-Pro
88.6
LiveCodeBench
—
AIME 2025
—
MATH-500
93.5
API 가격
입력 가격 (1M 토큰당)
$2
출력 가격 (1M 토큰당)
$6
과금 모드: standard
강점
- •최초의 Max급 Qwen 모델로 오픈 가중치(Qwen3.8-2.4T-A95B) 배포
- •2.4조 개 파라미터 MoE이지만 토큰당 950억 개만 활성화해 서비스 비용이 낮음
- •100만 토큰 네이티브 컨텍스트와 멀티모달(텍스트·이미지·비디오) 입력
- •강력한 에이전트형 코딩: SWE-bench Verified 74.2%, PaperBench 93.0, Terminal-Bench 2.1 86.6(벤더 발표)
약점
- •호스팅 Max API는 오픈 가중치 배포에도 불구하고 여전히 독점적이며 속도 제한이 있음
- •교차 연구소 벤치마크 비교는 방향성만 제시함
- •데이터센터급 다운로드(~1.6TB 급)로 대부분 팀의 온프레미스 운용은 비현실적
활용 사례
- •장기 에이전트형 소프트웨어 개발(자율형 저장소 작업·PR 생성)
- •기업 지식 업무(재무 리서치·법무 컴플라이언스·문서 분석)
- •텍스트나 시각 프롬프트 기반 멀티모달 제품·디자인 시제품 제작
심층 분석
파라미터
2.4T (활성 95B)
MoE, 512 전문가, 토큰당 10 라우팅 + 1 공유
문맥 창
100만 토큰
네이티브 262,144, 최대 1,010,000까지 확장
입력 / 출력 가격
$2 / $6 per 1M
QwenCloud, 캐시 입력 $0.25/M
SWE-bench Verified
74.2%
벤더 보고, Fable 5 76.8% 대비
출시
2026년 8월 3일 (오픈 웨이트 8월 12일)
최초의 Max급 Qwen 오픈 웨이트
강점
- ・오픈 웨이트를 제공하는 최초의 Max급 Qwen 모델(Qwen3.8-2.4T-A95B), 최전선 규모 자체 호스팅 가능
- ・2.4조 파라미터 MoE가 토큰당 95B만 활성화해 밀집 최전선 모델 대비 서빙 비용 낮음
- ・100만 토큰 네이티브 문맥에 멀티모달(텍스트·이미지·비디오) 입력
- ・강력한 에이전트 코딩: SWE-bench Verified 74.2%, PaperBench 93.0, Terminal-Bench 2.1 86.6 (벤더 보고)
약점
- ・오픈 웨이트 출시에도 호스팅 Max API는 독점·속도 제한 유지
- ・교차 연구소 벤치마크 비교는 방향성 참고용, 일부 Qwen 자체 하니스는 신규
- ・데이터센터급 다운로드(약 1.6TB급)로 대부분 팀의 완전 로컬 배포는 비현실적
경쟁사 비교
| Model | Price |
|---|---|
| Claude Fable 5 (max) | $10/$50 |
| GPT-5.6 Sol (max) | $5/$30 |
| Kimi K3 | $3/$15 |
Qwen3.8-Max는 Alibaba의 가장 크고 강력한 Qwen 모델로, 토큰당 95B를 활성화하는 2.4조 파라미터 MoE다. 2026년 8월 3일 출시되고 8월 12일 오픈 웨이트가 뒤따르면서 100만 토큰 문맥, 네이티브 멀티모달 입력, 100만 토큰당 $2/$6 가격을 제공하며 장기 에이전트 코딩과 자율 연구를 겨냥한다.
출처
분석 생성일: 2026-08-19