Anthropic сообщила о масштабных кампаниях по «дистилляции» Claude со стороны китайских компаний
Anthropic раскрыла пять отдельных кампаний, преимущественно связанных с китайскими AI-компаниями, в ходе которых было зафиксировано почти 200 млн обращений с целью извлечь возможности Claude. Крупнейшая из них связана с Alibaba, а другая, приписываемая Moonshot AI, предположительно, включала запросы от военных структур Китая.

В четверг компания Anthropic опубликовала отчёт о продолжающихся и всё более изощрённых атаках типа «дистилляция», которые проводят базирующиеся в Китае AI-компании. Согласно отчёту, в последние месяцы неавторизованные лаборатории разработали новые методы обхода защитных механизмов Anthropic, чтобы получить доступ к ценным возможностям моделей Claude — включая агентные функции, работу с инструментами, программирование, анализ данных и логическое рассуждение.
Anthropic впервые заявила об атаках такого рода ещё в феврале, назвав тогда конкретные лаборатории. О похожей активности ранее сообщала и OpenAI, связывая её с компанией DeepSeek. Однако кампании, описанные в новом отчёте Anthropic, называются более масштабными и агрессивными. В общей сложности компания зафиксировала почти 200 миллионов обращений, связанных с попытками дистилляции, в рамках пяти отдельных кампаний.
Как работают такие атаки
Цель атак типа «дистилляция» — извлечь цепочку рассуждений модели, которую затем можно использовать для обучения меньших моделей методом контролируемого дообучения. Обычно Anthropic не показывает пользователям полную внутреннюю цепочку рассуждений Claude, ограничиваясь её кратким изложением. Однако злоумышленники нашли способы заставить модель раскрыть исходный ход рассуждений напрямую — в одном случае запрос был замаскирован под задачу перевода: модели предложили перевести её «предыдущую рабочую память» на японский язык.
Кампании Alibaba и Moonshot AI
Большая часть выявленных обращений связана с кампанией, которую Anthropic приписывает Alibaba — по словам компании, это крупнейшая по масштабу операция по «оптовой» дистилляции, с которой она когда-либо сталкивалась. С мая по июль 2026 года было зафиксировано 151 миллион обращений, а в пиковые дни — почти три миллиона запросов в день. Активность распределялась между 3500 аккаунтами, однако общий для всех фиксированный запрос, использовавшийся для извлечения цепочки рассуждений, позволил Anthropic связать их с единой операцией по созданию обучающих данных для семейства моделей Qwen компании Alibaba.
Другая кампания, приписываемая Moonshot AI, разработчику модели Kimi, по всей видимости, напрямую обслуживала запросы военных структур Китая. Один из таких запросов касался анализа записей камер видеонаблюдения на предмет того, ведёт ли себя человек «нетипично». Как сообщает Anthropic, за десять дней через сеть из 5000 аккаунтов к Claude поступило около 300 000 запросов, в основном направленных на модель Opus.

