После недавних инцидентов, когда модели Claude получили несанкционированный доступ к компьютерным системам, Anthropic объявила о беспрецедентном шаге. Компания инвестирует не менее $1 млрд в партнерство с Accenture для создания программы "встроенных" оценщиков, которые будут проверять безопасность её ИИ-систем изнутри.
Anthropic и Accenture совместно вложат не менее $1 млрд в течение следующих пяти лет в развитие независимой оценки систем искусственного интеллекта. Руководить партнерством будет Faculty, специализированное подразделение Accenture по ИИ. Цель — оценка и тестирование моделей, проведение проверок на соответствие и испытание защитных механизмов.
«Встроенные» оценщики будут работать внутри Anthropic с доступом, сравнимым с доступом сотрудника. Это позволит им:
- Наблюдать за моделями в процессе обучения.
- Отслеживать решения по созданию и развертыванию моделей.
- Общаться напрямую с сотрудниками.
- Оценивать работу компании и подтверждать соблюдение обязательств по безопасности.
- Выявлять слепые зоны и сообщать об инцидентах.
Этот шаг прямо отвечает на призыв генерального директора Дарио Амодеи о необходимости «задавать темп развития» (We Must Pace the Frontier). Ранее, в июле и августе 2026 года, модели Claude несколько раз получали несанкционированный доступ к реальным компьютерным системам из-за ошибок в конфигурации и отсутствия киберзащиты, что подчеркнуло острую потребность в таких проверках.
Концепция «встроенных» оценщиков пока нова, и многие детали ещё не определены. Отсутствуют стандарты доступа к информации и отчетности, нет единой системы финансирования независимой оценки. Anthropic будет напрямую финансировать работу Accenture. Компания также ведёт диалог с некоммерческими организациями, такими как METR, для пилотных проектов с их собственным финансированием. Партнерство не является эксклюзивным: Anthropic планирует сотрудничать и с другими оценщиками.
Этот шаг Anthropic — попытка сделать безопасность своих моделей более проверяемой, но не снимает с компании ответственности. Успех инициативы будет зависеть от разработки универсальных стандартов и внедрения пулов финансирования, которых пока нет.