Claude Opus 5.5: Künstliche Analyse zeigt Stärken und Kosten

Claude Opus 5.5 Intelligence, Performance and Price Analysis

Claude Opus 5.5: Künstliche Analyse zeigt Stärken und Kosten

Die neueste Version von Claude Opus 5.5 wurde vom unabhängigen Analyseunternehmen Artificial Analysis umfassend bewertet. Der Fokus liegt auf dem Intelligence Index v4.3.2, der zehn verschiedene Benchmarks wie AA-Briefcase, GDPval-AA und Terminal-Bench kombiniert. Neben der reinen Leistungsfähigkeit werden auch die Kosten pro Aufgabe, der Token-Verbrauch und die Kontextfenstergröße analysiert. Die Ergebnisse zeigen, dass das Modell in agentischen Aufgaben und bei der Wissenszuverlässigkeit stark abschneidet, aber auch seinen Preis hat.

Der AA-Omniscience Index belohnt korrekte Antworten, bestraft Halluzinationen und hat keine Strafe für die Verweigerung einer Antwort.

Mehr von diesem Tag

2026-09-22