MiMo-v2.6-Pro: анализ интеллекта, производительности и цены
MiMo-v2.6-Pro: Intelligence, Performance and Price Analysis
Artificial Analysis опубликовал детальный разбор MiMo-v2.6-Pro: оценка по Intelligence Index v4.3.2 на основе десяти бенчмарков, включая AA-Briefcase, Terminal-Bench 4.0 и Humanity's Last Exam. Представлены метрики стоимости за задачу, потребления токенов, контекстного окна, скорости вывода и задержки. Отдельно показаны индексы открытости и галлюцинаций, а также сравнение цена-качество для выбора оптимального варианта.
AA-Omniscience Index (higher is better) measures knowledge reliability and hallucination. It rewards correct answers, penalizes hallucinations, and has no penalty for refusing to answer.