GLM-5.3 (max) lidera el índice de inteligencia de Artificial Analysis

GLM-5.3 Artificial Analysis Benchmarks

GLM-5.3 (max) lidera el índice de inteligencia de Artificial Analysis

Artificial Analysis ha publicado los resultados de referencia del modelo GLM-5.3 (max), que encabeza su Índice de Inteligencia v4.1.1. Este índice combina nueve evaluaciones, incluyendo GDPval-AA v2, Terminal-Bench v2.1 y GPQA Diamond, para medir razonamiento, conocimiento y uso de herramientas. El análisis también compara el coste por tarea y el número de tokens de salida, ofreciendo una visión detallada del rendimiento y precio del modelo.

El Índice de Inteligencia de Artificial Analysis v4.1.1 incorpora nueve evaluaciones: GDPval-AA v2, 𝜏³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience y AA-LCR.

Más de este día

2026-08-19