Перейти к содержимому
·Технологии·14 августа 2026 г.·1 мин

Z.ai выпустила GLM-5.3: прирост за счет масштабирования RL и рост кибербзопасности

Z.ai представила GLM-5.3 — новую версию своей флагманской модели. Возможности выросли за счет масштабирования post-training и reinforcement learning: базовая модель при этом осталась той же, что использовалась в GLM-5.2.

Главный акцент разработчики сделали на обучении на реальных задачах. RL использовался не только для улучшения ответов модели, но и для практических инженерных сценариев, включая оптимизацию самого процесса тренировки. По словам команды Z.ai, такой подход дал заметный прирост в программировании и задачах, требующих длинных последовательностей действий. На внутреннем Code Bench модель якобы показывает примерно на 50% более высокий результат, чем GLM-5.2.

Это отрывок статьи. Полную версию читайте на сайте источника по ссылке ниже.

Habr