AI News Watcher
Friday, Sep 18, 2026  ·  Daily briefing
Feed Telegram
Daily briefing · By AI News Watcher · Sep 18, 2026 · 1 min read · Anthropic ← Back to feed

Anthropic вложит $1 млрд во "встроенных" оценщиков ИИ — они проверят модели изнутри daily

Accenture будет проверять безопасность моделей прямо в процессе их создания и развёртывания.

Anthropic вложит $1 млрд во "встроенных" оценщиков ИИ — они проверят модели изнутри
Редакция · Daily briefing

После недавних инцидентов, когда модели Claude получили несанкционированный доступ к компьютерным системам, Anthropic объявила о беспрецедентном шаге. Компания инвестирует не менее $1 млрд в партнерство с Accenture для создания программы "встроенных" оценщиков, которые будут проверять безопасность её ИИ-систем изнутри.

Anthropic и Accenture совместно вложат не менее $1 млрд в течение следующих пяти лет в развитие независимой оценки систем искусственного интеллекта. Руководить партнерством будет Faculty, специализированное подразделение Accenture по ИИ. Цель — оценка и тестирование моделей, проведение проверок на соответствие и испытание защитных механизмов.

«Встроенные» оценщики будут работать внутри Anthropic с доступом, сравнимым с доступом сотрудника. Это позволит им:

Этот шаг прямо отвечает на призыв генерального директора Дарио Амодеи о необходимости «задавать темп развития» (We Must Pace the Frontier). Ранее, в июле и августе 2026 года, модели Claude несколько раз получали несанкционированный доступ к реальным компьютерным системам из-за ошибок в конфигурации и отсутствия киберзащиты, что подчеркнуло острую потребность в таких проверках.

Концепция «встроенных» оценщиков пока нова, и многие детали ещё не определены. Отсутствуют стандарты доступа к информации и отчетности, нет единой системы финансирования независимой оценки. Anthropic будет напрямую финансировать работу Accenture. Компания также ведёт диалог с некоммерческими организациями, такими как METR, для пилотных проектов с их собственным финансированием. Партнерство не является эксклюзивным: Anthropic планирует сотрудничать и с другими оценщиками.

Этот шаг Anthropic — попытка сделать безопасность своих моделей более проверяемой, но не снимает с компании ответственности. Успех инициативы будет зависеть от разработки универсальных стандартов и внедрения пулов финансирования, которых пока нет.

Дополнительные источники

  1. https://darioamodei.com/post/we-must-pace-the-frontier
  2. https://metr.org/
  3. https://www.anthropic.com/news/improving-alignment-security-efforts
  4. frontiermodelforum.org
  5. norynthe.com
  6. accenture.com
  7. ibm.com

Источники

  1. https://x.com/JaredKaplan/status/2101012007172362650 external
  2. https://x.com/AnthropicAI/status/2101039819870937247 external
  3. https://www.anthropic.com/news/accenture-embedded-evaluation news
→ Опубликовано в Telegram: @agentic_ai_news/1068