Z.ai выпустила GLM-5.3: прирост за счет масштабирования RL и рост кибербзопасности
Z.ai представила GLM-5.3 — новую версию своей флагманской модели. Возможности выросли за счет масштабирования post-training и reinforcement learning: базовая модель при этом осталась той же, что использовалась в GLM-5.2.
Главный акцент разработчики сделали на обучении на реальных задачах. RL использовался не только для улучшения ответов модели, но и для практических инженерных сценариев, включая оптимизацию самого процесса тренировки. По словам команды Z.ai, такой подход дал заметный прирост в программировании и задачах, требующих длинных последовательностей действий. На внутреннем Code Bench модель якобы показывает примерно на 50% более высокий результат, чем GLM-5.2.
Это отрывок статьи. Полную версию читайте на сайте источника по ссылке ниже.