GLM-5.3-Flash: мощь и цена — анализ Artificial Analysis

GLM-5.3-Flash Intelligence, Performance and Price Analysis

GLM-5.3-Flash: мощь и цена — анализ Artificial Analysis

Artificial Analysis представила независимый анализ модели GLM-5.3-Flash от Zhipu AI. Модель оценивается по индексу интеллекта, включающему 9 бенчмарков, таких как GDPval-AA v2, Terminal-Bench v2.1 и Humanity's Last Exam. Показатели сравниваются с конкурентами по стоимости за задачу и количеству выходных токенов. Отдельно рассматриваются цены на кэш, входные и выходные токены, а также размер контекстного окна.

Индекс AA-Omniscience измеряет надежность знаний и галлюцинации: он вознаграждает правильные ответы, штрафует галлюцинации и не наказывает за отказ отвечать.
  1. smartbit

    Судя по этим цифрам, на мой взгляд, у Gemini ты получаешь скорость, за которую платишь.

    Интел- Стои- Ско-

    лект мость рость

    (lig) за (Tokens/

    ence задачу сек)

    Gemini 3.7 flash 56 0.40 338

    GLM 5.3 flash 57 0.09 49

    Коэффициент 1 4.4 6.9

    У меня есть подписка на оба, и я не вижу причин выбирать GLM 5.3 Flash.

  2. CGamesPlay

    Здесь несколько фактических ошибок о модели. Входные модальности указаны как только текст, но ключевая особенность — поддержка изображений. Длина контекста должна быть 1048576 (так же как и у GLM-5.3, тоже неверно указано на графиках).

    https://docs.z.ai/guides/vlm/glm-5.3-flash#model-api

  3. yipinwong

    Анализ всё ещё не убеждает меня перейти

    с gtp5.6-luna на GLM-5.3-flash, учитывая

    - стоимость за задачу $0.05 против $0.09

    - скорость 130 против 88

    - у GLM всего на 5 пунктов интеллекта больше: на этом этапе несколько пунктов бессмысленны для большинства моделей

    https://artificialanalysis.ai/models/comparisons/glm-5-3-fla...

    Пользуюсь Luna исключительно с момента снижения цены, и я очень доволен всеми задачами: от планирования, написания кода до других агентских задач. (просто меняю уровень мышления с low на ultra)

    ---

    кстати, я пробовал Ox Alpha, кодинг ощущается хорошо, но всё ещё недостаточно лучше, чтобы перейти на него.

  4. m_ke

    Так как же Anthropic и OpenAI собираются окупить триллионы, которые они планируют потратить?

  5. AnodicElegy

    Впечатляет. Оно вытеснило всё между собой и Sol xhigh из парето-фронтира. Не могу дождаться, чтобы попробовать.

Ещё за этот день

2026-08-26