Китайская Z.ai представила GLM-5.3i — новую флагманскую модель для программирования, агентных задач и кибербезопасности. Новую базовую модель не обучали: разработчики взяли ту же ~743B MoEi модель, что лежала в основе GLM-5.2, и существенно прокачали её посттренировкой — масштабированием RL на реальных задачах, включая оптимизацию тренировки самой модели.
Результат — резкий рост показателей в кодинге и особенно в кибербезопасности: модель приблизилась к закрытым лидерам рынка, а по ряду бенчмарков поиска уязвимостей их обошла. Именно из-за высоких кибервозможностей открытые веса пока не публикуются — компания проводит дополнительную проверку безопасности.
- DeepSWE выросла с 46,2% до 66,9%; на Terminal Bench 3.0 результат подскочил с 4,6 до 28,3 (по данным «Нейронавт»), Data Secrets оценивает этот скачок как ~x6
- На CyberGymi модель набрала 84,5% против 77,2% у GLM-5.2, слегка обойдя Fable 5 и GPT-5.6 Sol (по данным Futuris); Александр Горный уточняет, что в генерации эксплойтов Claude всё ещё сильно впереди
- ExploitBench: рост с 24,4% до 54,4%; в ExploitGym модель за два часа решила 105 задач против 29 у 5.2
- По заявлению Z.ai (эйай ньюз), с момента релиза GLM-5.2 модели компании нашли 2,5 тыс. уязвимостей, самой старой из которых 45 лет
- Хайтек+ сообщает, что GLM-5.3 обошла Mythos 5 от Anthropic в одном из тестов на поиск уязвимостей — расходится с обозначением конкурента как «Fable 5» в других источниках
- Появились три уровня мышления — low/high/max, при этом возможность полностью отключить размышления убрали; ZCode стал официальным харнессом для 5.3, чат-версия ещё не добавлена
- По данным AI Product, модель и раньше активно хостилась третьими сторонами — например, Mistral использует GLM для проекта «суверенного ИИ Европы» вместо собственного дообучения; автор иронично отмечает, что «Яндекс и Сбер скоро станут умнее»
Открытые веса GLM-5.3 обещают выложить через две недели после дополнительной проверки безопасности; пока модель доступна через GLM Coding Plan, ZCode и (по данным части источников) Claude Code и OpenCode, но не во всех случаях через API.
Это произошло: Анонимная модель Ox Alpha оказалась новой GLM от Z.ai (Zhipu AI) →
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖