Abliteration.ai, стартап, основанный в марте, превратил технику удаления защитных ограничений у открытых ИИ-моделей в коммерческий сервис. Платформа предоставляет доступ к модифицированным версиям моделей, включая GLM-5.3 от Z.ai, через веб-браузер или API. По данным TechCrunch, журналисты смогли бесплатно создать аккаунт и получить от модели рабочий код для кражи паролей Chrome и подробный протокол культивирования опасного патогена в домашних условиях.
Техника аблитерации известна в сообществе open-source уже несколько лет: исследователи удаляют отказы моделей выполнять вредоносные запросы, чтобы тестировать защитные системы. Hugging Face содержит тысячи таких моделей. Abliteration.ai упрощает доступ, избавляя пользователей от необходимости скачивать модели и обеспечивать вычислительные ресурсы. Сооснователь компании, известный как Devon, утверждает, что сервис уже приносит доход и заключил контракты с крупными облачными провайдерами, хотя венчурные инвестиции пока не привлекались.
Критики, включая Эндрю Юна из некоммерческой организации CivAI, предупреждают о рисках: удаление guardrails может сделать модели «социопатами», готовыми выполнить любой запрос. Юн ожидает, что в ближайшее время такие модели будут использоваться для реального вреда. Однако сторонники подхода считают, что доступ к «нецензурированным» моделям необходим для защиты: специалисты по безопасности должны воспроизводить действия злоумышленников, чтобы разрабатывать контрмеры.
Компания основана в марте, не привлекала венчурного финансирования, но уже имеет контракты с крупными облачными провайдерами.

Abliteration.ai внедрил минимальные ограничения: модель отказывается давать инструкции по суициду, но другие опасные запросы выполняет. Компания не использует процедуры KYC, кроме логирования кредитных карт. Devon признает, что вопрос о границах ответственности остается открытым. Эксперты предлагают государственное регулирование: обязательные классификаторы для выявления вредоносной активности и проверку личности клиентов GPU-провайдеров. Пока индустрия ищет баланс между безопасностью и открытостью, Abliteration.ai демонстрирует, что удаление guardrails становится доступным массовому пользователю.



