ИИ-модели становятся всё, но их применение в чувствительных областях, таких как биология, требует ювелирной точности. Anthropic обновила меры безопасности для своей флагманской модели Claude Fable 5, резко сократив количество ложных срабатываний при запросах, связанных с биологией.
Это обновление сократило число «откатов» — автоматических переключений на менее модель — на 85% при биологических запросах. Теперь Claude Fable 5 сможет шире применяться в здравоохранении и образовании. Например, модель поможет интерпретировать результаты анализов, объяснять симптомы или углубляться в темы биологии. Медицинские работники также получат больше поддержки при выполнении клинических задач.
Изначально Anthropic намеренно блокировала почти все запросы, связанные с биологией. Это было сделано из-за опасений по поводу «двойного назначения» — способности ИИ-моделей быть использованными как во благо, так и во вред. По оценкам компании, Fable 5 может усилить возможности злоумышленников, например, в разработке биологического оружия. Отчет Разведывательного сообщества США за 2026 год подтверждает существование таких угроз и потенциал биотехнологий для создания новых биологических угроз.
Улучшение стало возможным благодаря перенастройке классификаторов безопасности — небольших ИИ-систем, которые автоматически выявляют запросы, связанные с опасной биологией или двойным назначением. Когда классификатор срабатывает, запрос перенаправляется на менее модель Claude Opus 5, которая не обладает такими же биологическими возможностями. Anthropic тщательно переработала «конституцию» классификатора — набор правил для различения безопасного и запрещенного контента. Компания собирала отзывы от внутренних и внешних экспертов, обновила обучающие данные и переобучила классификатор. Это позволило точнее отличать доброкачественные запросы от потенциально вредоносных.
Несмотря на прогресс, ложные срабатывания неизбежно останутся. Claude Fable 5 продолжит блокировать запросы, связанные с профессиональными исследованиями в области биологии и разработкой лекарств, если они несут риск двойного назначения. Anthropic заявляет о приверженности разработке безопасных путей доступа для исследователей к своим наиболее моделям.