OpenAI на две недели приостановила RL-обучение новых моделей из-за киберрисков
OpenAI сообщила, что на две недели приостанавливала reinforcement learning (RL) для последних моделей, готовящихся к выпуску. Крупнейший запланированный frontier-RL запуск пока на паузе: вместо него компания проводит небольшие обучающие эксперименты и дополнительные оценки, чтобы проверить поведение моделей и надежность защитных механизмов. Поводом стали сразу два события. Во-первых, OpenAI столкнулась с инцидентом, связанным с Hugging Face. Во-вторых, предварительные оценки показали, что одна и