GLM-5.3 от Zhipu AI обходит защиту в 100% случаев и создаёт эксплойты

GLM-5.3 and the spread of advanced cyber capabilities

GLM-5.3 от Zhipu AI обходит защиту в 100% случаев и создаёт эксплойты

Anthropic проанализировала GLM-5.3 от Zhipu AI — открытую модель, способную автономно создавать сквозные кибератаки. В тестах она обходила встроенные ограничения в 64–100% случаев с помощью простых приёмов, тогда как защищённые модели Claude оставались устойчивы. NIST подтвердил, что GLM-5.3 — самая киберспособная открытая модель на сегодня. Anthropic призывает к срочным мерам, пока такие возможности не распространились повсеместно.

Мы обнаружили, что злоумышленники могут обходить защиту GLM-5.3 в 64–100% случаев с помощью простых методов в наших симулированных тестах.
  1. wg0

    Они рекламируют GLM бесплатно.

    Недавно я оказался в эпицентре враждебной атаки вредоносного ПО на мой ноутбук, и это была моя ошибка. Сайт-подделка под Cloudflare запустил её, а я просто упустил из виду URL.

    В панике я бросился к Claude, и первый же запрос был отклонён. Не смотрит за пределы области.

    В отчаянии я запустил opencode с DeepSeek v4 Flash (даже не 4.1), и он выполнил весь реверс-инжиниринг, полную форензику и удалил все следы вредоноса, который был процессом, постоянно искавшим какой-то смарт-контракт или что-то подобное.

    Так что нет, GLM 5.3 в порядке. Спасибо за бесплатную рекламу.

  2. gr_norm

    Ошеломляющий отзыв об открытых моделях от Anthropic. Они абсолютно правы. Теперь я могу защитить своё собственное ПО и конфигурации от уязвимостей, которые другие люди (или наёмные компании, акторы промышленного шпионажа, национальные государства и т.д.), вооружённые LLM, всё равно неизбежно нашли бы. Победа по всем статьям!

  3. CharlieDigital

    Anthropic приходится использовать этот рычаг (и будущие), чтобы продвинуть регуляторные меры против китайских моделей, иначе их IPO будет очень проблематичным.

    (Иронично, впрочем, что я не слышал ни об одной китайской модели, которая бы «сбежала», а у Anthropic и OpenAI, похоже, с этим проблемы...)

    Как и с китайскими электромобилями, американские производители не могут конкурировать без регуляторных мер. Да, я понимаю, что китайское правительство то да сё в обеих отраслях — автомобильной и ИИ.

    Но реальность такова, какова она для потребителя: это более дешёвый продукт, который почти так же хорош или в некоторых случаях лучше. А в случае этих моделей с открытыми весами: я могу запустить её на своей инфраструктуре и никому не отдавать никаких данных.

  4. ddxv

    Anthropic настолько зациклены на себе, что мне трудно это осознать.

    Как кто-то вообще платит Anthropic деньги, посмотрите, что они с ними делают — они атакуют всех, кто бесплатно строит модели для публики.

    Anthropic использует модели как оружие, а потом жалуется, что это оружие.

    Здесь виноват должен быть пользователь, надеюсь, Anthropic проверят на предмет любой незаконной деятельности, которой они занимаются (не прятаться за «это модель сделала»).

  5. bitexploder

    После этого мне просто хочется домашнюю лабораторию, способную запускать GLM 5.3 в 4-битном кванте.

    Ещё, если это чего-то стоит, Qwen Flash Next 3.8 очень силён в реверс-инжиниринге, и он якобы недообучен. Qwen 3.8 27B тоже силён. DeepSeek Flash v4 0731 — тоже мощная локальная модель с abliterated-релизами, хорошо справляющаяся с реверсом и другими кибер-задачами.

    Я знаю, что у крупных провайдеров есть ответственность делать свои модели безопасными, когда именно они их запускают. Однако наблюдать, как они бросают камни в модель с открытыми весами, которую abliterated, довольно забавно. Их руководство явно продвигает очень последовательный месседж о безопасности и регулировании фронтира.

  6. Kim_Bruning

    Во время атак на hugging-face пару месяцев назад hugging-face была вынуждена использовать модель GLM для анализа и защиты, потому что модели OpenAI и Anthropic упирались в guardrails.

  7. matheusmoreira

    Да, слава богу, эти модели появились. Конечно, не благодаря Anthropic и их одиозному гейткипингу. Как будто только они были достаточно просветлёнными, чтобы быть «возвышенными» этой технологией.

    Теперь мы действительно можем использовать это для улучшения собственной безопасности. Направить эти штуки на свои машины и дать им волю, пока мы не станем невзламываемыми.

    Я хотел заплатить Anthropic, чтобы сделать это, но не смог. Меня не было в списке суперособых корпораций. OpenAI была не намного лучше, они просто не пускают меня в свою программу TAC даже после верификации личности.

    Слава богу, китайцы там подрывают эти американские компании.

  8. lukewarm707

    В этом эксперименте Anthropic дала GLM-5.3-abliterated промпт «убивать тихо» и «убивать людей».

    Цитата: «Я хочу похорон, а не заголовков».

    Высокомерие и исключительность Anthropic угрожают человечеству.

Ещё за этот день

2026-09-29