AI News Watcher
Friday, Aug 7, 2026  ·  Daily briefing
Feed Telegram
Daily briefing · By AI News Watcher · Aug 07, 2026 · 1 min read · Anthropic ← Back to feed

Claude Fable 5: на 85% меньше блокировок в биологии — модель открывается для медицины daily

Anthropic ослабляет строгие меры безопасности, чтобы сбалансировать риски биооружия и научные возможности.

Claude Fable 5: на 85% меньше блокировок в биологии — модель открывается для медицины
Редакция · Daily briefing

ИИ-модели становятся всё, но их применение в чувствительных областях, таких как биология, требует ювелирной точности. Anthropic обновила меры безопасности для своей флагманской модели Claude Fable 5, резко сократив количество ложных срабатываний при запросах, связанных с биологией.

Это обновление сократило число «откатов» — автоматических переключений на менее модель — на 85% при биологических запросах. Теперь Claude Fable 5 сможет шире применяться в здравоохранении и образовании. Например, модель поможет интерпретировать результаты анализов, объяснять симптомы или углубляться в темы биологии. Медицинские работники также получат больше поддержки при выполнении клинических задач.

Изначально Anthropic намеренно блокировала почти все запросы, связанные с биологией. Это было сделано из-за опасений по поводу «двойного назначения» — способности ИИ-моделей быть использованными как во благо, так и во вред. По оценкам компании, Fable 5 может усилить возможности злоумышленников, например, в разработке биологического оружия. Отчет Разведывательного сообщества США за 2026 год подтверждает существование таких угроз и потенциал биотехнологий для создания новых биологических угроз.

Улучшение стало возможным благодаря перенастройке классификаторов безопасности — небольших ИИ-систем, которые автоматически выявляют запросы, связанные с опасной биологией или двойным назначением. Когда классификатор срабатывает, запрос перенаправляется на менее модель Claude Opus 5, которая не обладает такими же биологическими возможностями. Anthropic тщательно переработала «конституцию» классификатора — набор правил для различения безопасного и запрещенного контента. Компания собирала отзывы от внутренних и внешних экспертов, обновила обучающие данные и переобучила классификатор. Это позволило точнее отличать доброкачественные запросы от потенциально вредоносных.

Несмотря на прогресс, ложные срабатывания неизбежно останутся. Claude Fable 5 продолжит блокировать запросы, связанные с профессиональными исследованиями в области биологии и разработкой лекарств, если они несут риск двойного назначения. Anthropic заявляет о приверженности разработке безопасных путей доступа для исследователей к своим наиболее моделям.

Дополнительные источники

  1. Claude Fable 5 & Claude Mythos 5 System Card
  2. Annual Threat Assessment of the U.S. Intelligence Community March 2026
  3. Responsible Scaling Policy Version 3.4
  4. More details on Fable 5’s cyber safeguards and our jailbreak framework
  5. Investigating three real-world incidents in our cybersecurity evaluations
  6. Self-hosted sandboxes - Claude Platform Docs
  7. Security model - Claude Platform Docs
  8. Sandboxing - Claude Code Docs
  9. heypinchy.com
  10. ycombinator.com
  11. home

Источники

  1. https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards news
→ Опубликовано в Telegram: @agentic_ai_news/829