Открытая китайская GLM-5.3 превзошла Mythos 5 в поиске уязвимостей

Но заявленные цифры пока не прошли независимую верификацию

1 мин.
Открытая китайская GLM-5.3 превзошла Mythos 5 в поиске уязвимостей

Компания Z.ai заявила, что её новая открытая модель GLM-5.3 практически догнала закрытую Mythos 5 от Anthropic, а в тесте на обнаружение уязвимостей даже опередила её. Изначально нейросеть проектировалась для программирования, а расширенные навыки в кибербезопасности приобрела уже после дообучения и применения методов обучения с подкреплением. Публичный релиз намечен на ближайшие недели, когда завершится внутренняя проверка безопасности.

По итогам испытания CyberGym, оценивающего умение ИИ анализировать исходный код, находить слабые места и верифицировать их наличие, GLM-5.3 набрала 84,5% против 83,8% у Mythos 5. Правда, заявленные Z.ai цифры пока не прошли независимую верификацию сторонними экспертами. Совсем иная картина сложилась в тесте ExploitBench, проверяющем способность превращать найденные бреши в рабочие эксплойты. Здесь китайская разработка уступила заметно — 54,4% против 78% у конкурента.
По подсчётам Z.ai, GLM-5.3 за два часа выполнила 105 задач по созданию атак, а за шесть часов — 130. Mythos 5 за те же временные отрезки закрыла 181 и 247 задач соответственно.

Получается, что китайская модель уже сопоставима с Mythos 5 в части поиска дефектов кода, но пока значительно проигрывает ей в автоматизированном создании эксплойтов на базе обнаруженных дыр.

Mythos 5 представляет собой узкоспециализированную модификацию Claude Fable 5 от Anthropic, у которой сняты штатные ограничения по кибербезопасной тематике. Доступ к системе Anthropic предоставляет только верифицированным организациям, поскольку подобные инструменты одинаково пригодны и для защиты программного обеспечения, и для поиска путей его взлома.

Z.ai также не намерена сразу выкладывать GLM-5.3 в свободный доступ. Публикация модели ожидается примерно через две недели после аудита безопасности, а самые продвинутые возможности достанутся лишь пользователям, прошедшим проверку.

Для самой Z.ai проект превратился в тест того, насколько защищёнными могут оставаться открытые модели. В GLM-5.3 встроили несколько барьеров. Система оценивает потенциально опасные запросы, отслеживает собственное поведение и обучена отклонять вредоносные задания.

Одновременно Z.ai объявила о запуске инициативы «Защита открытого исходного кода». Компания планирует сканировать open-source проекты на предмет уязвимостей, передавать модель исследователям для тестирования и внедрить аудиторские функции в собственный продукт ZCode. Специалист по управлению ИИ Габриэль Вагнер обратил внимание на сходство концепции с западным Project Glasswing.