AI News Watcher
Thursday, Sep 17, 2026  ·  Daily briefing
Feed Telegram
Daily briefing · By AI News Watcher · Sep 17, 2026 · 2 min read · Anthropic ← Back to feed

Anthropic ослабляет ИИ-фильтры для биологов — и жёстко мониторит все запросы daily

Модели Mythos, Opus, Sonnet теперь допускают рискованные запросы — но данные о работе хранятся 30 дней, а ответственность за риски делят с клиентом.

Anthropic ослабляет ИИ-фильтры для биологов — и жёстко мониторит все запросы
Редакция · Daily briefing

ИИ-модели часто блокируют запросы в критических областях, опасаясь злоупотреблений, даже если это мешает законным исследованиям. Anthropic решила снять эти ограничения для биологов: теперь её флагманские модели Mythos, Opus и Sonnet смогут работать с чувствительными данными, которые ранее были под запретом. Но взамен компания вводит систему глубокого мониторинга активности и разделяет ответственность за безопасность с клиентами.

Anthropic запустила Программу верификации наук о жизни (LSVP), чтобы предоставить специалистам доступ к своим моделям с более лояльными мерами безопасности для работы, связанной с биологией. Это позволит использовать ИИ в таких задачах, как открытие лекарств, исследовательская биология, клинические разработки и производство, которые ранее были заблокированы в стандартных моделях Fable. Программа пока работает в бета-режиме для команд и учреждений, но в будущем станет доступна и для индивидуальных пользователей.

Чтобы получить доступ, каждая организация проходит процесс верификации, включающий проверку учётных данных, стандартов безопасности и этического надзора. После этого команды могут подать заявку на два типа грантов:

Новая система безопасности LSVP основана на концепции «разделенной ответственности». Anthropic переходит от блокировки потенциально опасных запросов в реальном времени к офлайн-мониторингу паттернов поведения. Для этого данные, связанные с подозрительной активностью, будут храниться в течение 30 дней, но строго изолированно и без использования для обучения моделей. Anthropic верифицирует организации, а те, в свою очередь, самостоятельно определяют безопасные сценарии использования для своих команд и проектов. При обнаружении активности, выходящей за рамки заявленного безопасного использования, Anthropic уведомляет администраторов организации. Этот подход призван противодействовать таким угрозам, как компрометация доступа, инсайдерские угрозы и злоупотребления со стороны ИИ-агентов.

Решение об ослаблении фильтров принято на фоне роста сложных попыток злоупотреблений, включая потенциальную разработку биологического оружия, о чём Anthropic сообщала в своём отчёте за сентябрь 2026 года. LSVP также будет интегрироваться с системой Enterprise Frontier Safeguards (EFS), которая сочетает нулевое хранение данных с обнаружением злоупотреблений, сохраняя данные на инфраструктуре клиента.

Anthropic задаёт новый стандарт работы с моделями в высокорисковых областях: снимает часть ограничений, но возлагает на клиентов ответственность за безопасное использование, подкрепляя это постоянным мониторингом. Эффективность такого подхода — особенно в таких чувствительных сферах, как биология — ещё предстоит оценить на практике.

Дополнительные источники

  1. https://www.anthropic.com/threat-intelligence-report-september-2026
  2. https://www.anthropic.com/news/enterprise-frontier-safeguards
  3. https://www.anthropic.com/news/improving-alignment-security-efforts
  4. https://claude.com/product/claude-science
  5. google.com
  6. amazon.com
  7. ibanet.org
  8. anthropic.com

Источники

  1. https://www.anthropic.com/news/life-sciences-verification-program news
→ Опубликовано в Telegram: @agentic_ai_news/1054