OpenAI на две недели приостановила RL-обучение новых моделей из-за киберрисков
OpenAI сообщила, что на две недели приостанавливала reinforcement learning (RL) для последних моделей, готовящихся к выпуску. Крупнейший запланированный frontier-RL запуск пока на паузе: вместо него компания проводит небольшие обучающие эксперименты и дополнительные оценки, чтобы проверить поведение моделей и надежность защитных механизмов.
Поводом стали сразу два события. Во-первых, OpenAI столкнулась с инцидентом, связанным с Hugging Face. Во-вторых, предварительные оценки показали, что одна из будущих моделей, Astra, может достигать уровня Critical по кибервозможностям в соответствии с Preparedness Framework компании. OpenAI не раскрывает точные характеристики Astra и не сообщает, когда модель будет выпущена.
По словам компании, эти события заставили пересмотреть требования к безопасности исследовательской инфраструктуры. Сразу после инцидента с Hugging Face OpenAI приостановила frontier-inference в исследовательских кластерах для задач, где модели могли выполнять код или использовать инструменты с доступом в интернет. Затем компания восстановила ограниченный и более защищенный путь для выполнения кода и стала возвращать отдельные workloads после индивидуальной проверки.
Это отрывок статьи. Полную версию читайте на сайте источника по ссылке ниже.