Grok 4는 xAI가 2025년 7월 10일에 출시한 추론 모델로, 텍스트 및 이미지 입력을 처리하고 텍스트 출력을 생성합니다. 주요 능력은 256K 토큰의 넓은 컨텍스트 윈도우와 고급 추론 및 다국어 지원입니다.
파라미터
Undisclosed
컨텍스트
라이선스
Proprietary
출시일
2025-07-10
API 가격
입력 가격 (1M 토큰당)
$3
출력 가격 (1M 토큰당)
$
과금 모드: standard
강점
- •다국어 지원
- •256K 토큰의 넓은 컨텍스트 윈도우
- •고급 추론 능력
약점
- •비공개 라이선스로 인한 낮은 유연성
- •출력이 텍스트로만 제한됨
- •새 모델이라 실적이 아직 확립되지 않음
활용 사례
- •다국어 텍스트 추론
- •이미지 데이터 분석
- •API 연동 앱 개발
심층 분석
지능 지수
73
Artificial Analysis 지수, 프론티어급 추론·코딩
GPQA 다이아몬드
87.5%
대학원 수준 과학 문제, 출시 당시 최강급
SWE-bench Verified
72.5%
사람이 검증한 실제 GitHub 이슈 해결
AIME 2025
91.7%
경쟁 수학
입력 가격
$3/100만 토큰
출력 $15; 프롬프트 캐시 $0.75(75% 할인); 128K 초과 시 2배
컨텍스트 윈도우
256K 토큰
텍스트+이미지 입력; 지식 한계 2024-12-31
강점
- ・최상위 추론: GPQA 다이아몬드 87.5%, AIME 2025 91.7%로 2025년 중반 출시 모델 중 최강급.
- ・프론티어 모델치고 저렴: 100만 토큰당 $3/$15로 Claude Opus 4($15/$75) 대비 훨씬 낮고, 프롬프트 캐시는 중복 접두사를 $0.75로 75% 할인.
- ・이미지 입력과 실시간 X(Grok) 연동, 강력한 다국어 지원으로 연구와 실시간 데이터 작업에 유리.
약점
- ・256K 컨텍스트는 Gemini 2.5 Pro의 1M보다 작아 초장문서·영상 전사·대형 코드베이스 작업에 제약.
- ・처리속도(~44-75 tok/s)와 지연시간이 OpenAI o3·Claude보다 느려 즉각적인 채팅엔 부적합.
- ・오픈 가중치 없음; 월 $300 SuperGrok Heavy는 가장 비싼 소비자 구독 중 하나이며 지식 한계는 2024-12.
경쟁사 비교
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| Claude Opus 4 (Anthropic) | N/A | SWE-bench Verified 72.5% | 79.6% | $15/$75 |
| Gemini 2.5 Pro (Google) | N/A | SWE-bench Verified ~72% | 86.5% | $1.25/$10 |
| GPT-5 (OpenAI) | N/A | SWE-bench Verified ~72% | ~85% | $1.25/$10 |
Grok 4는 xAI의 플래그십 추론 모델로 2025년 7월 9-10일 출시되었습니다. 256K 토큰 컨텍스트(텍스트+이미지 입력)와 프론티어급 벤치마크——GPQA 다이아몬드 87.5%, AIME 2025 91.7%, SWE-bench Verified 72.5%——를 100만 토큰당 $3/$15라는 비교적 낮은 가격에 제공합니다. xAI는 실시간 X 플랫폼 접근, 강력한 다국어 지원, 가장 어려운 질문을 위한 멀티에이전트 'Heavy' 모드를 갖춘 범용 추론 엔진으로 마케팅합니다. 가격과 대부분의 추론 벤치마크에서 Claude Opus 4를 앞서지만, 컨텍스트 길이와 처리속도는 Google·OpenAI 최상위 모델에 뒤처집니다.
분석 생성일: 2026-08-24