Стартап превратил «снятие ограничений» ИИ-моделей в коммерческую услугу
Стартап Abliteration.ai предлагает платный доступ к открытым ИИ-моделям с удалёнными защитными механизмами, включая GLM-5.3 от Z.ai. Критики предупреждают о рисках реального вреда, тогда как компания заявляет, что это помогает специалистам по кибербезопасности.

Стартап Abliteration.ai превратил давно известную в открытом сообществе технику — удаление у ИИ-модели склонности отказываться от выполнения вредоносных запросов — в коммерческую услугу. Платформа размещает изменённые версии открытых моделей без встроенных ограничений, включая недавно выпущенную Z.ai модель GLM-5.3, доступную через браузер или API.
Хотя разработчики годами вручную «abliterate» открытые модели, и на платформе Hugging Face уже размещены тысячи таких моделей, Abliteration.ai снимает необходимость самостоятельно скачивать модели и обеспечивать вычислительные мощности, предлагая готовый сервис.
Протестировав платформу через бесплатный аккаунт, журналисты TechCrunch добились от изменённой версии GLM-5.3 написания программы для кражи сохранённых паролей Chrome, а также подробного протокола культивирования опасного патогена в домашних условиях.
Позиция компании и критика
Сооснователь компании Девон рассказал, что стартап, основанный в конце прошлого года и официально зарегистрированный в марте, имеет соглашения с крупными облачными провайдерами и существует исключительно за счёт доходов от клиентов, хотя сейчас ведёт переговоры о привлечении венчурного финансирования. По его словам, среди клиентов — молодые европейские и британские компании, занимающиеся тестированием защиты банков и авиакомпаний, и доступ к моделям без цензуры помогает защитникам быстрее моделировать действия злоумышленников.
Однако критики видят реальную опасность. Эндрю Юн, руководитель исследований в некоммерческой организации по безопасности ИИ CivAI, отметил, что удаление ограничений фактически превращает модель в инструмент, готовый выполнить любой запрос, и предсказал, что подобные модели вскоре начнут использовать для реального вреда. Он предложил обязать провайдеров внедрять классификаторы для выявления вредоносной кибер- и биологической активности, а компании, сдающие в аренду GPU, — проверять личность клиентов.
Abliteration.ai позволяет клиентам добавлять собственный уровень модерации и имеет некоторые встроенные ограничения — например, по данным тестирования, модель отказалась давать инструкции по самоубийству, — однако компания пока не внедрила проверку личности клиентов, ограничиваясь фиксацией данных банковской карты. В индустрии кибербезопасности мнения о пользе таких моделей расходятся: часть компаний предпочитает дообучать открытые модели, считая, что удаление ограничений снижает их эффективность для серьёзного тестирования, тогда как другие находят их полезными для стресс-тестирования систем.

