ИИ-модели становятся всё, и вместе с этим растут опасения о потенциальных рисках, особенно в таких чувствительных областях, как кибербезопасность. OpenAI впервые публично применила свою «Рамку готовности» (Preparedness Framework) к разрабатываемой модели Astra, классифицировав её как первую, которая может представлять критические риски в этой сфере.
Astra — это первая модель, которую OpenAI отнесла к «критическим» в категории кибербезопасности. Согласно внутренней «Рамке готовности», «критические» модели — это те, что могут представлять серьёзные риски: от киберугроз и биобезопасности до дестабилизации общества, если их неправильно использовать или если они выйдут из-под контроля. Такая классификация означает, что модель обладает потенциалом, который требует усиленного контроля.
Для Astra это означает внедрение дополнительных мер контроля на всех этапах разработки. Цель — обеспечить безопасное и надёжное развитие модели, минимизируя риски, связанные с её возможностями.
Несмотря на повышенные риски, OpenAI стремится сделать Astra широко доступной. Компания планирует передать её ** кибервозможности** в руки «защитников», чтобы использовать потенциал модели для усиления кибербезопасности.
Контекст этой классификации подчёркивает Ноам Браун, научный сотрудник OpenAI, работающий над моделями рассуждений. Он провёл параллели между вирусной историей 2017 года о «сбежавших» LLM в Facebook и недавним инцидентом с Hugging Face. По его словам, эти случаи говорят о важности нового доклада, посвящённого безопасности и контролю над развивающимися моделями. Также в контексте кибербезопасности президент OpenAI Грег Брокман упомянул модель GPT-5.6 Sol. Детали её классификации или связи с Astra пока не раскрыты.
Классификация Astra как «критической» модели показывает, что OpenAI не просто разрабатывает ИИ, но и публично признаёт связанные с ними риски. Это задаёт новый стандарт для разработки систем, способных влиять на кибербезопасность, но конкретные механизмы «дополнительных мер контроля» пока не раскрыты.