OpenAI на две недели приостановила RL‑обучение новых моделей из‑за киберрисков
OpenAI сообщила, что на две недели приостанавливала reinforcement learning (RL) для последних моделей, готовящихся к выпуску.
Крупнейший запланированный frontier‑RL запуск пока на паузе: вместо него компания проводит небольшие обучающие эксперименты и дополнительные оценки, чтобы проверить поведение моделей и надежность защитных механизмов.Поводом стали сразу два события.
habr.com