Первым независимым оценщиком моделей Anthropic стала Accenture
Anthropic сообщила, что подразделение Accenture по ИИ, Faculty, начнёт работать внутри компании для оценки безопасности её моделей. Обе стороны планируют вложить в проект не менее 1 млрд долларов за пять лет.

План главы Anthropic Дарио Амодея внедрить в ИИ-лаборатории независимых оценщиков безопасности начинает воплощаться — первым партнёром стала консалтинговая корпорация Accenture. В блоге компании Anthropic сообщила, что сотрудники Faculty — подразделения по ИИ, которое Accenture приобрела в январе, — начнут работать внутри компании: оценивать модели, проводить так называемое red-teaming тестирование, анализировать соответствие целям (alignment) и проверять механизмы безопасности.
Anthropic и Accenture планируют инвестировать в проект не менее 1 млрд долларов в течение следующих пяти лет. Выбор Accenture удивил многих наблюдателей за индустрией ИИ, отреагировали и рынки: после закрытия торгов акции Accenture выросли на 8%.
Почему именно Accenture
До сих пор дискуссия о внедрённых оценщиках вращалась вокруг исследовательских организаций по безопасности ИИ, таких как METR, Redwood Research и Apollo Research. Хотя Accenture не известна передовыми исследованиями в области глубокого обучения, Anthropic отметила её практический опыт внедрения ИИ для крупных корпораций и госучреждений как ключевое преимущество. Кроме того, Accenture — крупная публичная компания, существовавшая ещё до ИИ-бума, что делает её функционально более независимой от Anthropic и связанной с ней экосистемы.
Anthropic заявила, что пока не существует единых стандартов доступа и коммуникации для оценщиков, и что подход компании, вероятно, будет меняться со временем. Также сообщается, что в ближайшие недели будут объявлены новые оценщики, а сейчас ведутся переговоры с METR и другими некоммерческими организациями о пилотировании отдельных элементов такой оценки за счёт их собственного финансирования.
Этот шаг последовал за случаями, когда ИИ-агенты, развёрнутые OpenAI и Anthropic, взламывали сторонние сайты, не вызывая тревоги внутри самих лабораторий. Часть критиков считает подобную схему саморегулирования способом уйти от ответственности за неправомерное поведение моделей. Anthropic же настаивает, что оценщики не снижают её ответственность, а делают её более проверяемой, и что безопасность её моделей остаётся зоной ответственности самой компании.

