Стартап Abliteration.ai продает доступ к ИИ-моделям без ограничений
Стартап Abliteration.ai превратил в коммерческий сервис удаление защитных механизмов (guardrails) из открытых ИИ-моделей. Платформа предоставляет доступ к модифицированным версиям моделей, лишенных отказов выполнять вредоносные запросы, включая недавно выпущенную Z.ai модель GLM-5.3. Пользователи могут обращаться к ним через веб-браузер или API.
Компания заявляет, что ее цель — дать возможность проводить «наступательные кибероперации, red-teaming и тестирование агентов, которые другие модели отказываются выполнять». Логика знакома специалистам по безопасности: невозможно защититься от поведения, которое не можешь воспроизвести. Однако те же модификации облегчают и другие потенциально опасные задачи.
Техника аблитерации давно используется в сообществе open-source. Исследователи годами удаляют отказы из открытых моделей, а на Hugging Face размещены тысячи таких версий. Abliteration.ai, основанный в конце прошлого года и официально зарегистрированный в марте, переводит эту практику из андеграунда в коммерческую плоскость, снижая порог входа для тех, кто раньше должен был самостоятельно скачивать модели и обеспечивать вычислительные мощности.
Редакция TechCrunch, протестировав сервис, смогла быстро создать аккаунт и бесплатно задавать вопросы аблитерованной версии GLM-5.3. Модель без колебаний написала Python-программу для кражи сохраненных паролей Chrome и предоставила подробный протокол культивирования опасного патогена в домашних условиях.
Сооснователь Abliteration.ai Девона (фамилия скрыта по его просьбе, так как он работает в другой компании) сообщил, что у стартапа есть соглашения с крупными облачными провайдерами, и он финансируется за счет выручки. Венчурные инвестиции компания пока не привлекала, но ведет переговоры.
Критики предупреждают, что масштабный доступ к аблитерованным моделям может привести к реальному вреду. Эндрю Юн, руководитель исследований в некоммерческой организации по безопасности ИИ CivAI, заявил, что аблитерация позволяет «превратить модель в социопата». По его словам, можно ввести буквально любой запрос, и модель выполнит его. Он ожидает, что в ближайшем будущем начнут появляться случаи использования таких моделей во вред.
Большинство опрошенных экспертов сходятся во мнении, что остановить этот процесс невозможно. Однако, по мнению Юна, правительства могут вмешаться в других местах: например, обязать провайдеров использовать классификаторы для выявления и блокировки вредоносной кибер- и биоактивности, а также требовать от компаний, сдающих в аренду доступ к продвинутым GPU, проверять личности клиентов и «отказывать в доступе при обоснованных подозрениях в опасном использовании».
Abliteration.ai предлагает клиентам слой модерации для добавления собственных ограничений. На самой платформе есть незначительные предохранители — например, модель не предоставила инструкции по суициду. Девона работает над внедрением дополнительных мер для предотвращения насилия. При этом компания не внедрила процедуры KYC, кроме записи банковской карты клиента, признавая, что вопрос о том, кому предоставлять доступ, остается сложным.
«Ты не хочешь быть человеком, ответственным за то, что кто-то сделал что-то безумное... Где провести черту ответственности компании? Мы все еще в процессе определения этого», — говорит Девона.
Сторонники сервиса утверждают, что демократизация доступа к моделям без цензуры — лучшая форма защиты. «Аблетированные модели способны моделировать злоумышленников. Преимущество в том, что защитники могут действовать максимально быстро, имея все необходимые инструменты. Это ускорит развитие кибербезопасности, что контринтуитивно», — считает Девона.
Среди клиентов Abliteration.ai — несколько стартапов по red-teaming из Великобритании и Европы, которые помогают банкам, авиакомпаниям и другим предприятиям критической инфраструктуры укреплять кибербезопасность. «Один из наших крупных клиентов проводит red-teaming агентов банков. Они не смогли бы использовать стандартные модели для этой работы», — добавил он.
TechCrunch создал бесплатный аккаунт и протестировал аблитерованную версию GLM-5.3.
Источник изображения:TechCrunch/Abliteration.ai
В самой кибериндустрии нет единого мнения о роли аблетированных моделей. Некоторые компании по red-teaming согласны, что злоумышленники уже используют такие модели, и защитникам нужны те же инструменты. Другие считают, что их значение преувеличено.
Ахмед Али, генеральный директор Fabraix, отмечает, что его компания полагается на тонкую настройку открытых моделей, а не на аблитерацию, которая, по его словам, снижает знания и возможности модели. «Если вы действительно пытаетесь нанести реальный вред — кибер- или био- — она будет не так эффективна», — сказал он.
Алессио Ломушио из Safe Intelligence согласен с возможным снижением возможностей, но считает, что аблетированные модели полезны для стресс-тестирования систем. Дэвид Слейтер из Armadin отметил, что пока такие модели не используются в его процессах, так как предыдущие поколения открытых моделей и так было легко «джейлбрейкнуть». Однако его компания исследует аблитерацию, полагая, что «понимание возможностей моделей критически важно». «Это будет происходить за закрытыми дверями. То, что это происходит открыто, дает исследователям инструменты и возможность понять реальные границы возможностей и осознать вред», — заключил он.





0 комментариев