AI News Watcher
Friday, Aug 7, 2026  ·  Daily briefing
Feed Telegram
Daily briefing · By AI News Watcher · Aug 07, 2026 · 1 min read · Anthropic ← Back to feed

Claude Code: Авторежим по умолчанию в 6 раз безопаснее человека daily

Снижает риски инъекций промптов и ускоряет разработку, работая без перебоев.

Claude Code: Авторежим по умолчанию в 6 раз безопаснее человека
Редакция · Daily briefing

Человек пропускает 86% опасных команд, когда ИИ-агент просит подтвердить действие. Anthropic делает свой автоматический режим в Claude Code стандартом, чтобы исправить это, переложив бремя контроля безопасности с пользователя на ИИ.

Автоматический режим Claude Code блокирует 89% опасных команд, тогда как в контролируемом исследовании с 1053 платными тестировщиками люди одобрили 86,4% таких запросов (заблокировав лишь 13,6%). Это означает, что ИИ-классификатор оказался в 6 раз эффективнее человека в предотвращении потенциально вредных действий.

Режим использует специальный классификатор, который проверяет каждое действие на необратимость, деструктивность или выход за пределы среды пользователя. Он также содержит дополнительный уровень защиты от инъекций промптов: в независимом тестировании ни одна из 720 атак не сработала против моделей Claude, работающих в авторежиме.

Помимо безопасности, авторежим позволяет Claude работать автономно дольше, сокращая количество прерываний в 9 раз. У команд, использующих его по умолчанию, количество отправленных запросов на слияние (PR) увеличивается на 25%.

Внутри Anthropic авторежим уже предотвратил серьезные инциденты, включая потенциальную утечку данных, массовое удаление ресурсов и необоснованное повышение привилегий. Крупные компании, такие как Adobe и Nuro, уже используют его для автоматизации задач и ночных агентов, которые готовят готовые PR к утру.

Передача контроля безопасности от человека к ИИ в Claude Code демонстрирует, как агенты могут стать не только эффективнее, но и надежнее, устраняя «усталость от разрешений». Однако Anthropic не сообщает, насколько хорошо авторежим справляется с непреднамеренными ошибками самого Claude, а не только с внешними угрозами или человеческим фактором.

Дополнительные источники

  1. Configure auto mode
  2. Running auto mode in production
  3. Mitigating the risk of prompt injections in browser use
  4. Pricing
  5. Claude Code changelog
  6. openai.com
  7. infoq.com
  8. shipyard.build
  9. claude.com

Источники

  1. https://x.com/bcherny/status/2085807103382519872 external
  2. https://x.com/bcherny/status/2085860677990883454 external
  3. https://claude.com/blog/auto-mode-default-in-claude-code blog
→ Опубликовано в Telegram: @agentic_ai_news/835