Перейти к содержимому
SBER 272,10 ₽ 0,45% снижениеIMOEX 2 134,97 0,63% рост
·Технологии·19 августа 2026 г.·1 мин

OpenAI на две недели приостановила RL-обучение новых моделей из-за киберрисков

OpenAI сообщила, что на две недели приостанавливала reinforcement learning (RL) для последних моделей, готовящихся к выпуску. Крупнейший запланированный frontier-RL запуск пока на паузе: вместо него компания проводит небольшие обучающие эксперименты и дополнительные оценки, чтобы проверить поведение моделей и надежность защитных механизмов.

Поводом стали сразу два события. Во-первых, OpenAI столкнулась с инцидентом, связанным с Hugging Face. Во-вторых, предварительные оценки показали, что одна из будущих моделей, Astra, может достигать уровня Critical по кибервозможностям в соответствии с Preparedness Framework компании. OpenAI не раскрывает точные характеристики Astra и не сообщает, когда модель будет выпущена.

По словам компании, эти события заставили пересмотреть требования к безопасности исследовательской инфраструктуры. Сразу после инцидента с Hugging Face OpenAI приостановила frontier-inference в исследовательских кластерах для задач, где модели могли выполнять код или использовать инструменты с доступом в интернет. Затем компания восстановила ограниченный и более защищенный путь для выполнения кода и стала возвращать отдельные workloads после индивидуальной проверки.

Это отрывок статьи. Полную версию читайте на сайте источника по ссылке ниже.

Habr