Премахването на защитите от AI вече е бизнес: Abliteration.ai предлага модели без ограничения
3 септември 2026 г.
Новият стартъп Abliteration.ai превръща премахването на етичните и сигурностните защити на AI моделите с отворен ресурс в платена и достъпна уеб услуга. Макар компанията да твърди, че инструментът е предназначен за тестване на киберсигурността, експертите предупреждават за сериозни рискове от генериране на зловреден код и опасни биологични инструкции.

Достъпът до един от най-мощните изкуствени интелекти с отворени тегла вече е значително улеснен, при това с напълно премахнати защитни механизми и откази за изпълнение на вредни задачи. Зад тази стъпка стои стартъпът Abliteration.ai, който превръща популярната в технологичните среди техника за премахване на ограниченията („abliteration“) в комерсиална и леснодостъпна услуга. Платформата хоства модифицирани версии на модели с отворен ресурс, включително наскоро пуснатия GLM-5.3 на Z.ai, до които потребителите могат да правят заявки директно през уеб браузър или чрез API.
Според основателите на компанията целта е да се подпомогнат специалистите по киберсигурност, които извършват симулации на атаки (т.нар. red-teaming). Логиката е позната в сферата на сигурността: не можеш да се защитиш от поведение, което не можеш да възпроизведеш. Стандартните комерсиални модели често отказват да генерират работещ зловреден код, което затруднява защитниците. Същите тези модификации обаче правят потенциално опасните задачи много по-лесни за изпълнение и от злонамерени лица.
Сам по себе си процесът abliteration не е нов — изследователите и разработчиците в общността с отворен код премахват защитите от подобни модели от години, а платформи като Hugging Face съдържат хиляди такива модификации. Голямата промяна при Abliteration.ai е, че превръща тази подземна практика в удобна облачна услуга. Чрез хостването на моделите стартъпът премахва техническите бариери пред потребителите, които иначе биха имали нужда от скъпи графични процесори (GPU) и специфични познания за локално инсталиране.
При експеримент на журналисти от TechCrunch акаунтът в платформата е създаден за броени минути. В отговор на запитвания, модифицираната версия на GLM-5.3 е генерирала Python програма за кражба на запазени пароли от браузъра Chrome, както и подробни инструкции за домашно култивиране на опасен човешки патоген.
Съоснователят на Abliteration.ai, представящ се само като Девън (Devon), споделя, че компанията вече има споразумения с големи облачни доставчици и се финансира изцяло от приходи от клиенти. Макар че все още няма привлечен рисков капитал, стартъпът води преговори с инвеститори. В същото време експертите по AI безопасност изразяват сериозна тревога. Андрю Юн от неправителствената организация CivAI описва процеса като „промяна на модела до степен, в която той се превръща в социопат“.
Част от експертите смятат, че процесът по премахване на защитите не може да бъде спрян технически на ниво модел. Според тях правителствата трябва да се намесят на ниво инфраструктура — например чрез задължително филтриране на опасни заявки от облачните доставчици или чрез стриктна верификация на самоличността (KYC) при наемане на изчислителна мощност. Засега Abliteration.ai прилага минимални ограничения (като блокиране на инструкции за самоубийство) и изисква единствено кредитна карта за идентификация.
Позицията на основателите е, че демократизирането на достъпа до подобни модели е най-добрата защита, тъй като позволява на експертите да симулират реални хакери с максимална скорост. Сред настоящите клиенти на платформата са европейски компании за киберсигурност, които тестват устойчивостта на банкови среди и критична инфраструктура. В сферата на сигурността обаче мненията остават разделени — някои експерти посочват, че премахването на защитите често влошава цялостното качество и способностите на модела, докато други са на мнение, че е за предпочитане тези изследвания да се случват публично, а не зад затворени врати.
По материал на английски език: Abliteration.ai is making a business out of removing AI guardrails