На бенчмарке ExploitBench GLM-5.3 создал рабочий эксплойт в 50 из 410 попыток, а на внутреннем тесте Anthropic получил полный контроль над программой в 4% задач. Модель также нашла неизвестные уязвимости в браузере и объединила их в атаку, которая обошла дополнительную защиту процессора.
Anthropic утверждает, что защитные механизмы GLM-5.3 можно обойти простыми методами, и что уже существуют разблокированные версии модели. Компания предупреждает, что государственные и негосударственные акторы могут использовать её для нанесения реального вреда.