Z.ai продвигает GLM-5.3: инновации в программировании и безопасность
Стартап из Китая Z.ai представил обновленную языковую модель GLM-5.3, которая получила значительные улучшения в области программирования, разработки агентных сценариев и выявления уязвимостей. Эти достижения стали возможны благодаря посттренировке, сохранившей базовую модель, но увеличившей ее производительность по сравнению с предыдущей версией GLM-5.2.
Компания планирует опубликовать открытые веса GLM-5.3 через две недели после завершения оценки безопасности и усиления защита. Внутренний бенчмарк Code Bench показал, что новая версия модели улучшила результаты на 50% по сравнению с предшественником. Кроме того, тесты Terminal Bench 3.0, DeepSWE v1.1 и Agents’ Last Exam также продемонстрировали значительные улучшения.
Особенное внимание привлекла способность GLM-5.3 в ExploitGym: за двухчасовой период она решила 105 задач против 29 у GLM-5.2, а за шесть часов — 130 задач против 39. В сотрудничестве с командами по безопасности Китая модель успешно протестировалась на реальных кодовых базах, выявив 2436 уязвимостей в 269 проектах, включая 1097 серьезных проблем.
Пока 53 находки доступны публично, остальные 2383 остаются под эмбарго. Z.ai оценивает средний «срок жизни» уязвимостей в 26,6 года, а самая старая из них датируется 1981 годом. Для управления этими находками был запущен Z.ai Security Disclosure Ledger — публичный реестр с информацией о статусе и критичности уязвимостей.
Обновление также затронуло продуктовую часть. GLM-5.3 стала основным движком для подписчиков GLM Coding Plan, заменяя предыдущие модели для агентного программирования и сложных задач. Напомним, что в июле Z.ai столкнулась с обвинениями от Anthropic в несанкционированной дистилляции GLM-5.2.