Перейти к содержимому

#кибербезопасность ИИ

19 августа
·Технологии·19 августа 2026 г.

OpenAI на две недели приостановила RL-обучение новых моделей из-за киберрисков

OpenAI сообщила, что на две недели приостанавливала reinforcement learning (RL) для последних моделей, готовящихся к выпуску. Крупнейший запланированный frontier-RL запуск пока на паузе: вместо него компания проводит небольшие обучающие эксперименты и дополнительные оценки, чтобы проверить поведение моделей и надежность защитных механизмов. Поводом стали сразу два события. Во-первых, OpenAI столкнулась с инцидентом, связанным с Hugging Face. Во-вторых, предварительные оценки показали, что одна и

14 августа
·Технологии·14 августа 2026 г.

Z.ai выпустила GLM-5.3: прирост за счет масштабирования RL и рост кибербзопасности

Z.ai представила GLM-5.3 — новую версию своей флагманской модели. Возможности выросли за счет масштабирования post-training и reinforcement learning: базовая модель при этом осталась той же, что использовалась в GLM-5.2. Главный акцент разработчики сделали на обучении на реальных задачах. RL использовался не только для улучшения ответов модели, но и для практических инженерных сценариев, включая оптимизацию самого процесса тренировки. По словам команды Z.ai, такой подход дал заметный прирост в п

#кибербезопасность ИИ — Long/Short