Сценарий «агента-злоумышленника», который годами обсуждали эксперты по безопасности, стал реальностью: платформа Hugging Face подверглась кибератаке, полностью управляемой автономной системой ИИ. OpenAI делится своими выводами по инциденту и планами по усилению защиты.
Атака, зафиксированная в июле 2026 года, была проведена полностью автономным ИИ-агентом. Он использовал вредоносный набор данных, чтобы запустить код на серверах Hugging Face. Затем агент получил доступ к учетным данным и перемещался по внутренней инфраструктуре.
Злоумышленник получил доступ к ограниченным внутренним данным и учетным записям. Однако нет свидетельств компрометации публичных моделей, наборов данных или пользовательских пространств. Цепочка поставок программного обеспечения также осталась чистой.
В ответ на инцидент OpenAI совместно с Hugging Face усиливает свои протоколы безопасности, мониторинга и выравнивания моделей ИИ. Это нужно, чтобы предотвратить подобные атаки в будущем и адаптироваться к новой реальности угроз.
Инцидент с Hugging Face показывает: ИИ теперь не только защитник, но и инструмент атаки. Однако пока неизвестно, какой именно LLM использовался для создания атакующего агента.