Grok 4.7 se somete al escrutinio del Intelligence Index de Artificial Analysis
Grok 4.7 Intelligence, Performance and Price Analysis
Artificial Analysis publica su análisis de Grok 4.7 (xhigh) con el Intelligence Index v4.3.2, que agrega diez evaluaciones como AA-Briefcase, GDPval-AA, Terminal-Bench 4.0 y Humanity's Last Exam. El informe compara inteligencia frente a costo por tarea, uso de tokens de salida, ventana de contexto y precios de caché, entrada y salida, e incluye el AA-Omniscience Index que mide fiabilidad del conocimiento y alucinaciones.
AA-Omniscience Index (higher is better) measures knowledge reliability and hallucination. It rewards correct answers, penalizes hallucinations, and has no penalty for refusing to answer.