xAI가 2026년 9월 21일 공개한 코딩·지식 작업 특화 기함. Grok 4.6과 같은 100만 토큰당 입력 $2·출력 $6 가격을 유지하면서 수 시간 걸리는 고난도 작업으로 강화학습을 확장해 자체 검증, 장문 맥락 처리, Grok Bot 에이전트 하니스 네이티브 이해를 개선했다. 출시는 안전을 전면에 내세웠는데, 새 안전 스택이 LatchBio 생물안전 62.4%를 상회하고 HackerBench v0.3에서 고위험 이중용도 프롬프트 통과율을 3.3%로 억제한다고 한다. 벤치마크에서는 Claude Fable 5.1과의 격차를 줄였으나 미치지 못했고(46.3% 대 51.8%, 38.0% 대 57.9%), 전작 대비 Terminal-Bench를 거의 2배로 늘리는 에이전트적 도약을 보였다.
파라미터
Undisclosed
컨텍스트
500K
라이선스
Proprietary
출시일
2026-09-21
API 가격
입력 가격 (1M 토큰당)
$2
출력 가격 (1M 토큰당)
$6
과금 모드: standard
강점
- •Terminal-Bench 4.0이 20.3%에서 38.0%로 2배 이상 증가해 Grok 4.6이 가장 약했던 영역을 보완
- •CursorBench 4.0 46.3%를 $2/$6에 제공, Fable 5.1의 $10/$50 대비 대부분의 격차를 좁히면서 비용은 5분의 1
- •xAI 발표 기준 가장 정밀 보정된 안전 기구: LatchBio 생물안전 62.4%, 고위험 이중용도 프롬프트 통과 3.3%
약점
- •코딩·오피스 벤치 정상에서는 여전히 Claude에 뒤처짐(Fable 5.1은 CursorBench 51.8%, Terminal-Bench 57.9%)
- •Grok 4.6과 동일 단가라 토큰 효율 개선 없음, 2배 속도 향상은 배액 고속판뿐
- •Grok Bot 하니스 이해가 xAI 실행 환경에 종속되어 외부 오픈 도구 생태계와는 거리
활용 사례
- •Terminal-Bench 향상이 중요한 장시간 자율 코딩
- •CursorBench급 코드 리뷰와 디버깅 대량 처리
- •생물안전·이중용도 게이팅이 필요한 규제·보안 민감 영역
심층 분석
컨텍스트
50만 토큰
텍스트·이미지 입력, 텍스트 출력, 출력 길이 상한 없음
API 가격
입력 2달러/출력 6달러(100만 단위)
20만 토큰 미만; 이상은 4/12달러. 고속 버전은 2배 속도·2배 가격
CursorBench 4.0
46.3%
Grok 4.6 40.4%, Claude Fable 5.1 최대 51.8% 대비(xAI 공개)
Terminal-Bench 4.0
38.0%
Grok 4.6 20.3%에서 도약; Fable 5.1은 57.9%(xAI 공개)
EEBench
64.0%
Claude Fable 5.1 56.4% 상회(xAI 공개)
LatchBio 생물안전
62.4%
신규 안전 스택; HackerBench v0.3에서 고위험 이중용도 통과 3.3%뿐
강점
- ・에이전트형 도약: Terminal-Bench 4.0이 20.3%에서 38.0%로 배가돼 Grok 4.6이 가장 약했던 영역을 메웠다.
- ・저렴한 코딩: CursorBench 4.0 46.3%를 2달러/6달러에 제공, Fable 5.1의 10달러/50달러와 대부분의 격차를 좁히며 밑돈다.
- ・xAI에 따르면 가장 잘 맞춰진 안전 장치로 LatchBio 생물안전 62.4%, 고위험 이중용도 프롬프트 통과는 3.3%에 불과하다.
약점
- ・코딩·오피스 상위 벤치에서는 여전히 Claude에 밀린다. Fable 5.1은 CursorBench 최대 51.8%, Terminal-Bench 57.9%.
- ・Grok 4.6과 동일 단가라 토큰당 효율 향상은 없으며, 속도 향은 2배 가격의 고속 버전뿐.
- ・Grok Bot 하네스를 네이티브로 이해해 xAI 에이전트 실행 환경에 묶이고, 열린 도구 생태계 밖에서는 종속된다.
경쟁사 비교
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| Claude Fable 5.1 | — | 71.0%(DeepSWE v1.1 high) | — | 100만당 10/50달러 |
| GPT-5.6 Sol | — | — | 94.6%(GPQA Diamond) | 100만당 5/30달러 |
| Grok 4.6 | — | 65.2%(DeepSWE v1.1 high) | — | 100만당 2/6달러 |
Grok 4.7은 xAI의 코딩·지식 작업 특화 기함으로 2026년 9월 21일 공개됐다. Grok 4.6과 같은 2달러/6달러 가격을 유지하면서 몇 시간 걸리는 더 어려운 작업으로 강화학습을 확장하고, 자체 검증·장문 맥락 처리·Grok Bot 하네스 네이티브 이해를 개선했다. 발표는 안전을 전면에 내세웠다. xAI에 따르면 신규 안전 스택은 LatchBio 생물안전 62.4%, HackerBench v0.3에서 고위험 이중용도 프롬프트 통과는 3.3%에 불과하다. 벤치마크에서 Claude Fable 5.1과의 격차를 좁혔으나 미치지 못했고(46.3% 대 51.8%, 38.0% 대 57.9%), 자사 전작 대비 에이전트형 도약은 분명하다. Cursor·Grok Build·Grok API·서드파티 하네스에서 제공되며 50만 토큰 문맥과 2배 속도 고속 버전을 갖췄다.
분석 생성일: 2026-09-24