Grok 4.7, 지능·성능·가격 전격 분석
Grok 4.7 Intelligence, Performance and Price Analysis
Artificial Analysis가 Grok 4.7(xhigh)의 지능, 성능, 가격을 분석했다. AA Intelligence Index v4.3.2는 10개 평가를 통합해 모델의 지능을 측정하며, Grok 4.7은 이 지수에서 경쟁 모델과 비교된다. 특히 지능 대비 비용, 작업당 출력 토큰, 캐시·입출력 가격 등 경제성 지표가 상세히 제시된다. 컨텍스트 윈도우와 할루시네이션 평가도 포함돼 실사용 관점의 종합 평가를 제공한다.
AA-Omniscience Index(높을수록 좋음)는 지식 신뢰성과 할루시네이션을 측정한다. 정답에는 보상을, 할루시네이션에는 페널티를 주며, 답변을 거부하는 경우에는 페널티가 없다. 점수는 -100에서 100까지이며, 0은 정답과 오답이 같은 수준임을, 음수는 오답이 정답보다 많음을 의미한다.