Grok 4.7 se somete al escrutinio del Intelligence Index de Artificial Analysis

Grok 4.7 Intelligence, Performance and Price Analysis

Grok 4.7 se somete al escrutinio del Intelligence Index de Artificial Analysis

Artificial Analysis publica su análisis de Grok 4.7 (xhigh) con el Intelligence Index v4.3.2, que agrega diez evaluaciones como AA-Briefcase, GDPval-AA, Terminal-Bench 4.0 y Humanity's Last Exam. El informe compara inteligencia frente a costo por tarea, uso de tokens de salida, ventana de contexto y precios de caché, entrada y salida, e incluye el AA-Omniscience Index que mide fiabilidad del conocimiento y alucinaciones.

AA-Omniscience Index (higher is better) measures knowledge reliability and hallucination. It rewards correct answers, penalizes hallucinations, and has no penalty for refusing to answer.

Más de este día

2026-09-21