В тесте CyberGym, оценивающем способность ИИ анализировать код, находить уязвимости и подтверждать их наличие, GLM-5.3 набрала 84,5% против 83,8% у Mythos 5. При этом результаты Z.ai пока не прошли независимую проверку. В другом тесте, ExploitBench, где оценивается способность превращать найденные уязвимости в работающие атаки, китайская модель заметно уступила: 54,4% против 78% у Mythos 5.
Разрыв сохранился и при оценке скорости работы. По данным Z.ai, за два часа GLM-5.3 выполнила 105 задач по разработке атак, а за шесть часов — 130. Mythos 5 за те же периоды справилась со 181 и 247 задачами соответственно.
Таким образом, GLM-5.3 уже сравнима с Mythos 5 по способности находить проблемы, но пока уступает в разработке атак на основе этих уязвимостей.
Mythos 5 — специальная версия модели Claude Fable 5 от Anthropic, из которой убрали стандартные ограничения для кибербезопасности. Доступ к ней компания предоставляет только проверенным организациям, поскольку такие системы могут использоваться как для защиты программного обеспечения, так и для поиска способов атаковать его. Z.ai также решила не выпускать GLM-5.3 сразу: после завершения оценки безопасности модель появится в открытом доступе примерно через две недели, а наиболее мощные функции будут доступны только проверенным пользователям.
Для Z.ai это становится еще и экспериментом с безопасностью открытых моделей. Компания добавила в GLM-5.3 несколько уровней защиты — теперь она проверяет опасные запросы, отслеживает свою работу и учится отклонять вредоносные задания. При этом разработчики признают, что после публикации весов модели контроль становится сложнее. Пользователи могут скачать ее, изменить ограничения или подключить к внешним инструментам.
Одновременно Z.ai объявила инициативу «Защита открытого исходного кода».
В ее рамках компания планирует проверять проекты с открытым кодом на уязвимости, предоставлять модели специалистам для тестирования безопасности и добавить функции аудита в собственный программный продукт ZCode. Исследователь в области управления ИИ Габриэль Вагнер отметил, что такой подход напоминает западный Project Glasswing.
GLM-5.3 продолжает успех предыдущей GLM-5.2, которая в последние месяцы привлекла внимание зарубежных разработчиков своими возможностями в программировании и работе ИИ-агентов. Новый релиз показывает, что китайские открытые модели постепенно выходят и на более чувствительную территорию кибербезопасности. Если заявленные результаты подтвердятся, конкуренция между открытыми моделями и закрытыми системами с ограниченным доступом станет еще острее, особенно в сфере автоматизированного поиска уязвимостей.

