GLM-5.3 показал рост в кодинге и взломе
GLM-5.3 стал open-weight, при этом базовая модель у него та же, что у GLM-5.2 — весь прирост пришёл из post-training. Авторы заявляют 50% улучшение на их внутреннем Z.ai Code Bench и первое место среди open-weights на публичных бенчмарках вроде Terminal Bench 3.0 и Agents' Last Exam. Отдельно они подчёркивают, что модель неожиданно хорошо прокачалась в cyber-задачах: на CyberGym она SOTA по поиску уязвимостей, а на exploitation-бенчмарках больше чем вдвое обходит GLM-5.2.