MiMo-V2.6-Pro: Wie viel Intelligenz kostet ein einziger Benchmark-Task?
MiMo-v2.6-Pro: Intelligence, Performance and Price Analysis
Artificial Analysis hat MiMo-V2.6-Pro durch seinen Intelligence Index v4.3.2 geschickt, der zehn Benchmarks von AA-Briefcase bis Humanity's Last Exam bündelt. Die Analyse vergleicht nicht nur die Intelligenz, sondern rechnet die Kosten pro Task in USD, den Token-Verbrauch, die Geschwindigkeit und die Latenz herunter – inklusive Open-Weights- und Openness-Index. Besonders spannend: die Preise für Cache-Hits, Input und Output pro Million Tokens.
Der AA-Omniscience Index belohnt korrekte Antworten, bestraft Halluzinationen und zieht keine Strafe für die Verweigerung einer Antwort in Betracht.