Grok 4.7, 가격 그대로 두고 장시간 코딩 작업 성능 46.3%로 끌어올려

xAI가 Grok 4.7을 공개했다. 더 큰 베이스 모델과 장시간 과제 중심의 강화학습으로 어려운 코딩·지식 작업에서 성능이 크게 올랐다. CursorBench 4.0에서 46.3%를 기록해 Grok 4.6(40.4%)을 앞섰고, Terminal-Bench 4.0은 20.3%에서 38.0%로 뛰었다. 가격은 입력 100만 토큰당 2달러, 출력 6달러로 Grok 4.6과 동일하다. 새로운 안전 스택으로 위험한 사이버 작업 차단율도 3.3%에 그쳤다.
Grok 4.7은 지금까지 테스트한 모델 중 거부와 탈옥 저항에서 가장 강력하다.