SpaceXAI, 최고 성능 코딩 모델 Grok 4.5 공개

SpaceXAI가 Grok 4.5를 출시했다. 코딩, 에이전트 작업, 지식 작업에 특화된 이 모델은 DeepSWE 1.0, Terminal Bench 2.1 등 여러 벤치마크에서 경쟁 모델들을 앞서며, 특히 법률 에이전트 벤치마크에서 1위를 차지했다. Grok 4.5는 수만 개의 NVIDIA GB300 GPU로 훈련되었고, RL(강화학습)에 집중해 토큰 효율성을 2배 높였다. 초당 80토큰의 빠른 속도와 낮은 비용으로, SWE Bench Pro 작업당 평균 출력 토큰 수가 Opus 4.8 대비 4.2배 적다. 현재 Grok Build, Cursor, SpaceXAI 콘솔에서 API로 사용 가능하며, EU에서는 7월 중순 출시 예정이다.
Grok 4.5는 동급 최고 모델들보다 토큰 효율성이 약 2배 높아, 동일 작업을 절반 이하의 단계로 해결합니다.