GLM-5.3 übertrifft Konkurrenz im Artificial-Analysis-Benchmark

GLM-5.3 Artificial Analysis Benchmarks

GLM-5.3 übertrifft Konkurrenz im Artificial-Analysis-Benchmark

Der Artificial Analysis Intelligence Index v4.1.1, der neun Bewertungen wie GDPval-AA v2, Terminal-Bench v2.1 und GPQA Diamond umfasst, zeigt, dass GLM-5.3 (max) führend ist. Der Index misst Intelligenz, Zuverlässigkeit und Halluzinationsrate. GLM-5.3 erzielt hohe Werte bei geringeren Kosten pro Aufgabe und überzeugt mit einem großen Kontextfenster. Die Analyse vergleicht Modelle nach Open Weights und proprietären Kriterien und bewertet Preis-Leistungs-Verhältnis sowie Token-Nutzung.

Der Artificial Analysis Intelligence Index v4.1.1 umfasst neun Bewertungen: GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience und AA-LCR.

Mehr von diesem Tag

2026-08-18