Anthropic сообщила, что ИИ Claude «руководит» 26 процентами её исследований и разработок
Компания Anthropic опубликовала новые данные о том, насколько её чат-бот Claude вовлечён в собственные исследования и разработки компании, заявив, что ИИ «руководит» 26 процентами этой работы — в рамках более широкого предложения по измерению темпов развития ИИ в отрасли.

Компания Anthropic представила новые показатели, отражающие степень вовлечённости её чат-бота Claude в собственные исследования и разработки (R&D) компании в области искусственного интеллекта. В блоге, посвящённом возможным стандартам измерения темпов развития ИИ, компания сообщила, что Claude «руководит» 26 процентами всей исследовательской работы Anthropic.
Под словом «руководит» компания понимает, что ИИ способен выполнить большую часть задачи от начала до конца на основе общей инструкции, пока человек осуществляет надзор. Кроме того, Anthropic утверждает, что более чем в 90 процентах случаев её исследовательская работа включает как минимум «значительные объёмы» труда, выполняемого ИИ под непосредственным руководством человека — эта доля включает и упомянутые 26 процентов, где Claude выступает ведущим исполнителем.
Это указывает на то, что Claude задействован в большей части работы сотрудников Anthropic, хотя компания подчёркивает, что чат-бот не действует полностью автономно ни в одной из измеряемых категорий.
Новый подход к измерению прогресса
Эти данные были получены с помощью первого из трёх предложенных Anthropic методов измерения, сфокусированного на «исследованиях и разработках, которыми руководит ИИ». Используя индекс доли исследовательской работы, выполняемой Claude, а также шкалу оценки автоматизации, разработанную Epoch AI, компания построила график, показывающий «уровень автоматизации» Claude начиная с августа 2025 года. По мнению Anthropic, такой подход мог бы повторить любой разработчик передовых ИИ-моделей, используя собственные данные и привлекая независимую стороннюю проверку.
Anthropic также предложила способы измерения контроля за действиями ИИ-агентов — в частности, какая доля их активности отслеживается, сколько времени занимает проверка и как часто фиксируется проблемное поведение, — а также методы отслеживания объёма вычислительных мощностей, направляемых на исследования в области ИИ.
Цель компании — повысить прозрачность, чтобы облегчить реагирование в случае выхода развития ИИ из-под контроля, или как минимум дать обществу более чёткое представление о происходящем в отрасли. Пока же главной сложностью остаётся не столько измерение процессов, сколько достижение реального согласия компаний относительно замедления темпов развития ИИ.


