← к умной ленте

Z.ai выпустила GLM-5.3 — с резким скачком в кибербезопасности за счёт масштабирования пост-тренинга

Китайская Z.ai представила GLM-5.3i — новую флагманскую модель для программирования, агентных задач и кибербезопасности. Новую базовую модель не обучали: разработчики взяли ту же ~743B MoEi модель, что лежала в основе GLM-5.2, и существенно прокачали её посттренировкой — масштабированием RL на реальных задачах, включая оптимизацию тренировки самой модели.

Результат — резкий рост показателей в кодинге и особенно в кибербезопасности: модель приблизилась к закрытым лидерам рынка, а по ряду бенчмарков поиска уязвимостей их обошла. Именно из-за высоких кибервозможностей открытые веса пока не публикуются — компания проводит дополнительную проверку безопасности.

743Bразмер базовой MoE-модели
84,5%результат на CyberGym
2,5 тыс.уязвимостей, найденных моделями Z.ai
  • DeepSWE выросла с 46,2% до 66,9%; на Terminal Bench 3.0 результат подскочил с 4,6 до 28,3 (по данным «Нейронавт»), Data Secrets оценивает этот скачок как ~x6
  • На CyberGymi модель набрала 84,5% против 77,2% у GLM-5.2, слегка обойдя Fable 5 и GPT-5.6 Sol (по данным Futuris); Александр Горный уточняет, что в генерации эксплойтов Claude всё ещё сильно впереди
  • ExploitBench: рост с 24,4% до 54,4%; в ExploitGym модель за два часа решила 105 задач против 29 у 5.2
  • По заявлению Z.ai (эйай ньюз), с момента релиза GLM-5.2 модели компании нашли 2,5 тыс. уязвимостей, самой старой из которых 45 лет
  • Хайтек+ сообщает, что GLM-5.3 обошла Mythos 5 от Anthropic в одном из тестов на поиск уязвимостей — расходится с обозначением конкурента как «Fable 5» в других источниках
  • Появились три уровня мышления — low/high/max, при этом возможность полностью отключить размышления убрали; ZCode стал официальным харнессом для 5.3, чат-версия ещё не добавлена
  • По данным AI Product, модель и раньше активно хостилась третьими сторонами — например, Mistral использует GLM для проекта «суверенного ИИ Европы» вместо собственного дообучения; автор иронично отмечает, что «Яндекс и Сбер скоро станут умнее»
Что дальше

Открытые веса GLM-5.3 обещают выложить через две недели после дополнительной проверки безопасности; пока модель доступна через GLM Coding Plan, ZCode и (по данным части источников) Claude Code и OpenCode, но не во всех случаях через API.

Это произошло: Анонимная модель Ox Alpha оказалась новой GLM от Z.ai (Zhipu AI) →

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖