Впервые в своей истории OpenAI публично приостановила обучение своих наиболее способных ИИ-моделей с подкреплением (RL). Это решение, принятое для усиления безопасности и мониторинга, знаменует новый этап, где темпы развития ИИ диктует не только мощность, но и доказанная надёжность.
Компания приостановила обучение моделей с подкреплением (RL) на две недели. Цель — "закалить" и протестировать исследовательские среды, а также расширить охват мониторинга для моделей, готовящихся к выпуску.
Кроме того, крупнейший запланированный запуск RL-обучения остаётся на паузе. OpenAI ждёт подтверждения эффективности новых мер безопасности и дополнительных доказательств выравнивания (alignment) моделей, прежде чем продолжить.
Этот шаг отражает убеждение OpenAI: по мере роста возможностей моделей увеличиваются и связанные с ними риски. Поэтому уверенность в безопасности будет определять темпы развития ИИ.
Этот шаг OpenAI ясно показывает, что безопасность теперь стоит выше скорости разработки в ИИ-гонке. Это может задать новый стандарт для всей отрасли. Однако компания не уточнила, какие конкретно риски или инциденты послужили непосредственной причиной для столь резкой паузы.