Z.ai открывает веса GLM-5.3 — модели для агентного кодинга и киберзащиты

GLM-5.3 is now open-weight

Z.ai открывает веса GLM-5.3 — модели для агентного кодинга и киберзащиты

Компания Z.ai объявила о публикации весов своей самой мощной модели GLM-5.3, предназначенной для агентного написания кода и задач кибербезопасности. Модель доступна для скачивания, запуска и доработки. Веса опубликованы на Hugging Face, технические детали — в блоге компании. Сообщество уже отреагировало: Unsloth AI готовит GGUF-версии для локального запуска, а Baseten обещает быструю интеграцию. При этом отмечается, что лицензия модели изменилась с MIT на полукоммерческую, как у Kimi, MiniMax и Qwen.

Наша самая мощная модель для агентного кодинга и киберзащиты теперь доступна для скачивания, запуска и кастомизации.
  1. revolvingthrow

    GLM 5.3, вероятно, самая удачная модель с открытыми весами, если вы хотите пойти дальше deepseek flash или нового glm flash. Я использовал её с pi и провёл время довольно неплохо, особенно учитывая, что она менее придирчива к кибер-темам и прочему, чем американские ребята. Она немного отстаёт от Kimi по способностям, но её гораздо проще запускать; я бы ожидал, что цены (и скорость!) у сторонних провайдеров будут заметно лучше. Если вы готовы выложить кучу денег за грядущий Mac m5 ultra с 512 ГБ унифицированной памяти, вы даже можете запустить её локально, в 4-битном квантовании. Насколько это разумно — ну, моя жена бы меня, наверное, с живого места содрала, но, может, ваша более понимающая.

  2. nkmnz

    Хотелось бы спросить Сэма Альтмана, считает ли он до сих пор, что публиковать GPT-3 слишком опасно. Я имею в виду, никто бы ей не пользовался, но каковы его аргументы против публикации сейчас, в 2026 году?

  3. mmastrac

    Я ранее писал, что DS4Flash была _хороша_, но не _великолепна_ на двух DGX Sparks, но должен сказать, что GLM-5.3 просто потрясающая. Она справлялась со всеми случайными сложными задачами, которые я ей подкидывал, и у неё есть та интуиция, которой, похоже, не хватает DS4Flash. Мы, на мой взгляд, ещё далеки от модели уровня Fable, но в следующем году всё станет интересно.

  4. armcat

    Что здесь очень многообещающе, так это соотношение количества токенов и точности. Я предполагаю, что под «выходными токенами» они подразумевают токены, генерируемые в процессе размышлений и любых вызовов инструментов (то, что провайдеры с точки зрения биллинга называют «входными токенами»). Китайские модели, такие как Qwen3.8 и GLM 5.2, в наших рабочих нагрузках (а это очень сложные задачи анализа данных) невероятно много думают. Это в 3-4 раза больше, чем у Opus и GPT-моделей. Даже с учётом более низкой цены за миллион токенов, итоговая стоимость оказывается выше, в некоторых случаях в 2 раза. Так что GLM 5.3 здесь очень многообещающа. С нетерпением жду возможности попробовать её.

  5. scosman

    Я пользуюсь ей всё больше и больше. Ощущается как Opus 4.8, в самом хорошем смысле.

  6. redox99

    Мне GLM 5.3 Flash кажется интереснее, чем 5.3. То, что у 5.3 нет зрения, — это своего рода непреодолимое препятствие. К тому же Flash, похоже, лучше создаёт красивые пользовательские интерфейсы.

  7. fra

    Спасибо DeepInfra за то, что они первым сторонним провайдером предоставили её на OpenRouter (https://openrouter.ai/z-ai/glm-5.3?endpoint=b711bea7-3994-49...).

  8. kixiQu

    Значит ли это, что она скоро появится на Bedrock? Я слышу много хорошего об этой модели, но мне нужны методы обработки данных AWS...

Ещё за этот день

2026-08-28