Anthropic привлечёт Accenture к независимой проверке рисков ИИ-моделей

29 сентября 202610 просмотров

За пять лет компании намерены вложить не менее $2 млрд в оценку передовых моделей, включая red-teaming и проверку защитных механизмов. Специалисты Accenture Faculty получат доступ к внутренним процессам Anthropic, чтобы выявлять уязвимости и оценивать выполнение обязательств по безопасности.

Anthropic привлечёт Accenture к независимой проверке рисков ИИ-моделей

Объём и назначение инвестиций

Anthropic и Accenture планируют вложить не менее $2 млрд за пять лет в независимую оценку, red-teaming и проверку безопасности передовых AI-моделей.

Каждая компания намерена направить не менее $1 млрд на развитие возможностей тестирования безопасности AI и надзора. Это планы инвестиций, а не подтверждение уже потраченных средств.

Ключевые ориентиры инициативы — минимальный заявленный объём, пятилетний период и направление вложений.

Как устроят независимую оценку

Партнёры выбрали подход embedded evaluation: независимые оценщики будут работать внутри Anthropic. Их доступ будет сопоставим с доступом сотрудников.

Оценщики смогут:

  • проверять работу компании и соблюдение её обязательств по безопасности;
  • выявлять слепые зоны и сообщать об инцидентах;
  • предоставлять общественности более информированную картину преимуществ и рисков.

Практический критерий такой проверки — не только участие внешних оценщиков, но и их доступ к работе компании.

Задачи Accenture Faculty

Специализированный AI-бизнес Accenture Faculty возглавит партнёрство. Он будет оценивать и проводить red-teaming моделей Anthropic.

В его задачи также войдут оценки соответствия и тестирование защитных механизмов моделей. Так обозначена конкретная рабочая зона Accenture Faculty внутри партнёрства.

Почему подход пока развивается

Anthropic называет embedded evaluation развивающейся областью. Компания обсуждает пилотные проекты с некоммерческой организацией-оценщиком METR и другими организациями.

Anthropic ожидает, что со временем в более широкой экосистеме оценки появятся общие стандарты. Партнёрство возникло на фоне усиливающегося внимания регуляторов, исследователей и бизнеса к защите более мощных моделей.

Общие стандарты здесь обозначены как ожидаемое направление, а не как уже достигнутый результат.

Часто задаваемые вопросы

Похожие материалы

Все материалы
Anthropic и Accenture: независимая оценка рисков ИИ