xAI독점

Grok 4

이 모델 비교

Grok 4는 xAI가 2025년 7월 10일에 출시한 추론 모델로, 텍스트 및 이미지 입력을 처리하고 텍스트 출력을 생성합니다. 주요 능력은 256K 토큰의 넓은 컨텍스트 윈도우와 고급 추론 및 다국어 지원입니다.

파라미터

Undisclosed

컨텍스트

라이선스

Proprietary

출시일

2025-07-10

API 가격

입력 가격 (1M 토큰당)

$3

출력 가격 (1M 토큰당)

$

과금 모드: standard

강점

  • 다국어 지원
  • 256K 토큰의 넓은 컨텍스트 윈도우
  • 고급 추론 능력

약점

  • 비공개 라이선스로 인한 낮은 유연성
  • 출력이 텍스트로만 제한됨
  • 새 모델이라 실적이 아직 확립되지 않음

활용 사례

  • 다국어 텍스트 추론
  • 이미지 데이터 분석
  • API 연동 앱 개발

심층 분석

지능 지수

73

Artificial Analysis 지수, 프론티어급 추론·코딩

GPQA 다이아몬드

87.5%

대학원 수준 과학 문제, 출시 당시 최강급

SWE-bench Verified

72.5%

사람이 검증한 실제 GitHub 이슈 해결

AIME 2025

91.7%

경쟁 수학

입력 가격

$3/100만 토큰

출력 $15; 프롬프트 캐시 $0.75(75% 할인); 128K 초과 시 2배

컨텍스트 윈도우

256K 토큰

텍스트+이미지 입력; 지식 한계 2024-12-31

강점

  • 최상위 추론: GPQA 다이아몬드 87.5%, AIME 2025 91.7%로 2025년 중반 출시 모델 중 최강급.
  • 프론티어 모델치고 저렴: 100만 토큰당 $3/$15로 Claude Opus 4($15/$75) 대비 훨씬 낮고, 프롬프트 캐시는 중복 접두사를 $0.75로 75% 할인.
  • 이미지 입력과 실시간 X(Grok) 연동, 강력한 다국어 지원으로 연구와 실시간 데이터 작업에 유리.

약점

  • 256K 컨텍스트는 Gemini 2.5 Pro의 1M보다 작아 초장문서·영상 전사·대형 코드베이스 작업에 제약.
  • 처리속도(~44-75 tok/s)와 지연시간이 OpenAI o3·Claude보다 느려 즉각적인 채팅엔 부적합.
  • 오픈 가중치 없음; 월 $300 SuperGrok Heavy는 가장 비싼 소비자 구독 중 하나이며 지식 한계는 2024-12.

경쟁사 비교

ModelArenaSWEGPQAPrice
Claude Opus 4 (Anthropic)N/ASWE-bench Verified 72.5%79.6%$15/$75
Gemini 2.5 Pro (Google)N/ASWE-bench Verified ~72%86.5%$1.25/$10
GPT-5 (OpenAI)N/ASWE-bench Verified ~72%~85%$1.25/$10

Grok 4는 xAI의 플래그십 추론 모델로 2025년 7월 9-10일 출시되었습니다. 256K 토큰 컨텍스트(텍스트+이미지 입력)와 프론티어급 벤치마크——GPQA 다이아몬드 87.5%, AIME 2025 91.7%, SWE-bench Verified 72.5%——를 100만 토큰당 $3/$15라는 비교적 낮은 가격에 제공합니다. xAI는 실시간 X 플랫폼 접근, 강력한 다국어 지원, 가장 어려운 질문을 위한 멀티에이전트 'Heavy' 모드를 갖춘 범용 추론 엔진으로 마케팅합니다. 가격과 대부분의 추론 벤치마크에서 Claude Opus 4를 앞서지만, 컨텍스트 길이와 처리속도는 Google·OpenAI 최상위 모델에 뒤처집니다.

분석 생성일: 2026-08-24