xAI독점

Grok 4.7

이 모델 비교

xAI가 2026년 9월 21일 공개한 코딩·지식 작업 특화 기함. Grok 4.6과 같은 100만 토큰당 입력 $2·출력 $6 가격을 유지하면서 수 시간 걸리는 고난도 작업으로 강화학습을 확장해 자체 검증, 장문 맥락 처리, Grok Bot 에이전트 하니스 네이티브 이해를 개선했다. 출시는 안전을 전면에 내세웠는데, 새 안전 스택이 LatchBio 생물안전 62.4%를 상회하고 HackerBench v0.3에서 고위험 이중용도 프롬프트 통과율을 3.3%로 억제한다고 한다. 벤치마크에서는 Claude Fable 5.1과의 격차를 줄였으나 미치지 못했고(46.3% 대 51.8%, 38.0% 대 57.9%), 전작 대비 Terminal-Bench를 거의 2배로 늘리는 에이전트적 도약을 보였다.

파라미터

Undisclosed

컨텍스트

500K

라이선스

Proprietary

출시일

2026-09-21

API 가격

입력 가격 (1M 토큰당)

$2

출력 가격 (1M 토큰당)

$6

과금 모드: standard

강점

  • Terminal-Bench 4.0이 20.3%에서 38.0%로 2배 이상 증가해 Grok 4.6이 가장 약했던 영역을 보완
  • CursorBench 4.0 46.3%를 $2/$6에 제공, Fable 5.1의 $10/$50 대비 대부분의 격차를 좁히면서 비용은 5분의 1
  • xAI 발표 기준 가장 정밀 보정된 안전 기구: LatchBio 생물안전 62.4%, 고위험 이중용도 프롬프트 통과 3.3%

약점

  • 코딩·오피스 벤치 정상에서는 여전히 Claude에 뒤처짐(Fable 5.1은 CursorBench 51.8%, Terminal-Bench 57.9%)
  • Grok 4.6과 동일 단가라 토큰 효율 개선 없음, 2배 속도 향상은 배액 고속판뿐
  • Grok Bot 하니스 이해가 xAI 실행 환경에 종속되어 외부 오픈 도구 생태계와는 거리

활용 사례

  • Terminal-Bench 향상이 중요한 장시간 자율 코딩
  • CursorBench급 코드 리뷰와 디버깅 대량 처리
  • 생물안전·이중용도 게이팅이 필요한 규제·보안 민감 영역

심층 분석

컨텍스트

50만 토큰

텍스트·이미지 입력, 텍스트 출력, 출력 길이 상한 없음

API 가격

입력 2달러/출력 6달러(100만 단위)

20만 토큰 미만; 이상은 4/12달러. 고속 버전은 2배 속도·2배 가격

CursorBench 4.0

46.3%

Grok 4.6 40.4%, Claude Fable 5.1 최대 51.8% 대비(xAI 공개)

Terminal-Bench 4.0

38.0%

Grok 4.6 20.3%에서 도약; Fable 5.1은 57.9%(xAI 공개)

EEBench

64.0%

Claude Fable 5.1 56.4% 상회(xAI 공개)

LatchBio 생물안전

62.4%

신규 안전 스택; HackerBench v0.3에서 고위험 이중용도 통과 3.3%뿐

강점

  • 에이전트형 도약: Terminal-Bench 4.0이 20.3%에서 38.0%로 배가돼 Grok 4.6이 가장 약했던 영역을 메웠다.
  • 저렴한 코딩: CursorBench 4.0 46.3%를 2달러/6달러에 제공, Fable 5.1의 10달러/50달러와 대부분의 격차를 좁히며 밑돈다.
  • xAI에 따르면 가장 잘 맞춰진 안전 장치로 LatchBio 생물안전 62.4%, 고위험 이중용도 프롬프트 통과는 3.3%에 불과하다.

약점

  • 코딩·오피스 상위 벤치에서는 여전히 Claude에 밀린다. Fable 5.1은 CursorBench 최대 51.8%, Terminal-Bench 57.9%.
  • Grok 4.6과 동일 단가라 토큰당 효율 향상은 없으며, 속도 향은 2배 가격의 고속 버전뿐.
  • Grok Bot 하네스를 네이티브로 이해해 xAI 에이전트 실행 환경에 묶이고, 열린 도구 생태계 밖에서는 종속된다.

경쟁사 비교

ModelArenaSWEGPQAPrice
Claude Fable 5.171.0%(DeepSWE v1.1 high)100만당 10/50달러
GPT-5.6 Sol94.6%(GPQA Diamond)100만당 5/30달러
Grok 4.665.2%(DeepSWE v1.1 high)100만당 2/6달러

Grok 4.7은 xAI의 코딩·지식 작업 특화 기함으로 2026년 9월 21일 공개됐다. Grok 4.6과 같은 2달러/6달러 가격을 유지하면서 몇 시간 걸리는 더 어려운 작업으로 강화학습을 확장하고, 자체 검증·장문 맥락 처리·Grok Bot 하네스 네이티브 이해를 개선했다. 발표는 안전을 전면에 내세웠다. xAI에 따르면 신규 안전 스택은 LatchBio 생물안전 62.4%, HackerBench v0.3에서 고위험 이중용도 프롬프트 통과는 3.3%에 불과하다. 벤치마크에서 Claude Fable 5.1과의 격차를 좁혔으나 미치지 못했고(46.3% 대 51.8%, 38.0% 대 57.9%), 자사 전작 대비 에이전트형 도약은 분명하다. Cursor·Grok Build·Grok API·서드파티 하네스에서 제공되며 50만 토큰 문맥과 2배 속도 고속 버전을 갖췄다.

분석 생성일: 2026-09-24