Claude Opus 5.5 domina el índice de inteligencia de Artificial Analysis, pero su coste por tarea se dispara

Claude Opus 5.5 Intelligence, Performance and Price Analysis

Claude Opus 5.5 domina el índice de inteligencia de Artificial Analysis, pero su coste por tarea se dispara

El índice de inteligencia v4.3.2 de Artificial Analysis evalúa Claude Opus 5.5 con diez pruebas que abarcan razonamiento documental, uso de terminal y conocimiento experto. El modelo destaca en inteligencia, aunque su coste ponderado por tarea y su consumo de tokens de salida lo sitúan lejos de la frontera de eficiencia. El análisis también compara el precio de caché, entrada y salida, y el tamaño de la ventana de contexto.

El índice AA-Omniscience premia las respuestas correctas, penaliza las alucinaciones y no penaliza negarse a responder.

Más de este día

2026-09-22