Тактики злоумышленников, использующих ИИ, постоянно меняются: как только появляются новые защиты, появляются и новые обходы. Anthropic в своем новом отчете по угрозам показала, как именно эволюционировало злонамеренное применение моделей Claude за последние восемь месяцев.
10 сентября 2026 года Anthropic опубликовала отчет Threat Intelligence, где подробно изложила свои действия по выявлению и пресечению злоупотреблений моделями Claude. Документ охватывает последние восемь месяцев и описывает, как менялось злонамеренное использование ИИ с 2025 года.
Отчет Anthropic демонстрирует, что методы злоумышленников постоянно адаптируются. В ранних этапах, как описано в отчете за март 2025 года, злоупотребления включали:
- Операции влияния — Claude использовался не только для генерации контента, но и для оркестровки ботов в соцсетях, которые решали, когда комментировать, лайкать или репостить посты.
- Мошенничество — фишинг, подбор учетных данных и фальшивый найм.
К августу 2025 года, согласно данным Anthropic, методы злоумышленников эволюционировали:
- Агентный ИИ — модели применялись для выполнения сложных кибератак, а не только для консультаций.
- Снижение порога входа — даже новички использовали ИИ для разработки программ-вымогателей и других сложных операций, которые ранее требовали многолетнего обучения.
- Интеграция ИИ — ИИ внедрялся на всех этапах мошеннических операций: от профилирования жертв до анализа украденных данных, хищения информации о кредитных картах и создания поддельных личностей. В отчете также приводились примеры крупномасштабных операций по вымогательству данных (так называемый "vibe hacking"), где Claude Code применялся для атак на организации здравоохранения, экстренных служб и правительственные учреждения.
Эта постоянная эволюция требует непрерывного совершенствования мер безопасности. Для инженеров это означает, что защита моделей ИИ не может быть статичной. Необходимо встраивать механизмы обнаружения и противодействия на всех этапах разработки и развертывания, учитывая, что тактики злоумышленников будут продолжать меняться.
Отчет Anthropic наглядно демонстрирует, что борьба со злоупотреблениями ИИ — это непрерывная гонка, где технологии защиты должны развиваться так же быстро, как и методы атак. Для разработчиков и инженеров это сигнал к тому, что безопасность должна быть заложена в архитектуру систем с самого начала и постоянно обновляться, а не быть реактивным ответом на уже произошедшие инциденты. Однако конкретные технические детали, как именно Anthropic "выявляет и пресекает" такие операции, в отчете не раскрываются.