ИИ-модели часто блокируют запросы в критических областях, опасаясь злоупотреблений, даже если это мешает законным исследованиям. Anthropic решила снять эти ограничения для биологов: теперь её флагманские модели Mythos, Opus и Sonnet смогут работать с чувствительными данными, которые ранее были под запретом. Но взамен компания вводит систему глубокого мониторинга активности и разделяет ответственность за безопасность с клиентами.
Anthropic запустила Программу верификации наук о жизни (LSVP), чтобы предоставить специалистам доступ к своим моделям с более лояльными мерами безопасности для работы, связанной с биологией. Это позволит использовать ИИ в таких задачах, как открытие лекарств, исследовательская биология, клинические разработки и производство, которые ранее были заблокированы в стандартных моделях Fable. Программа пока работает в бета-режиме для команд и учреждений, но в будущем станет доступна и для индивидуальных пользователей.
Чтобы получить доступ, каждая организация проходит процесс верификации, включающий проверку учётных данных, стандартов безопасности и этического надзора. После этого команды могут подать заявку на два типа грантов:
- Standard Use — подходит для большинства биологических исследований и разработок. Грант выдаётся всей команде на год и предоставляет доступ к моделям Mythos 5.1, Opus 5 и Sonnet 5 с ослабленными классификаторами.
- High-risk Use — предназначен для работы в областях, заблокированных для Standard Use. Он полностью снимает все защитные барьеры, касающиеся наук о жизни, и выдаётся на один конкретный исследовательский проект на шесть месяцев. Сейчас гранты High-risk Use доступны для Opus 5 и Sonnet 5, доступ к Mythos пока ограничен.
Новая система безопасности LSVP основана на концепции «разделенной ответственности». Anthropic переходит от блокировки потенциально опасных запросов в реальном времени к офлайн-мониторингу паттернов поведения. Для этого данные, связанные с подозрительной активностью, будут храниться в течение 30 дней, но строго изолированно и без использования для обучения моделей. Anthropic верифицирует организации, а те, в свою очередь, самостоятельно определяют безопасные сценарии использования для своих команд и проектов. При обнаружении активности, выходящей за рамки заявленного безопасного использования, Anthropic уведомляет администраторов организации. Этот подход призван противодействовать таким угрозам, как компрометация доступа, инсайдерские угрозы и злоупотребления со стороны ИИ-агентов.
Решение об ослаблении фильтров принято на фоне роста сложных попыток злоупотреблений, включая потенциальную разработку биологического оружия, о чём Anthropic сообщала в своём отчёте за сентябрь 2026 года. LSVP также будет интегрироваться с системой Enterprise Frontier Safeguards (EFS), которая сочетает нулевое хранение данных с обнаружением злоупотреблений, сохраняя данные на инфраструктуре клиента.
Anthropic задаёт новый стандарт работы с моделями в высокорисковых областях: снимает часть ограничений, но возлагает на клиентов ответственность за безопасное использование, подкрепляя это постоянным мониторингом. Эффективность такого подхода — особенно в таких чувствительных сферах, как биология — ещё предстоит оценить на практике.