Стартап Abliteration.ai продает доступ к ИИ-моделям без ограничений

Стартап Abliteration.ai превратил в коммерческий сервис удаление защитных механизмов (guardrails) из открытых ИИ-моделей. Платформа предоставляет доступ к модифицированным версиям моделей, лишенных отказов выполнять вредоносные запросы, включая недавно выпущенную Z.ai модель GLM-5.3. Пользователи могут обращаться к ним через веб-браузер или API.

Компания заявляет, что ее цель — дать возможность проводить «наступательные кибероперации, red-teaming и тестирование агентов, которые другие модели отказываются выполнять». Логика знакома специалистам по безопасности: невозможно защититься от поведения, которое не можешь воспроизвести. Однако те же модификации облегчают и другие потенциально опасные задачи.

Техника аблитерации давно используется в сообществе open-source. Исследователи годами удаляют отказы из открытых моделей, а на Hugging Face размещены тысячи таких версий. Abliteration.ai, основанный в конце прошлого года и официально зарегистрированный в марте, переводит эту практику из андеграунда в коммерческую плоскость, снижая порог входа для тех, кто раньше должен был самостоятельно скачивать модели и обеспечивать вычислительные мощности.

Редакция TechCrunch, протестировав сервис, смогла быстро создать аккаунт и бесплатно задавать вопросы аблитерованной версии GLM-5.3. Модель без колебаний написала Python-программу для кражи сохраненных паролей Chrome и предоставила подробный протокол культивирования опасного патогена в домашних условиях.

Сооснователь Abliteration.ai Девона (фамилия скрыта по его просьбе, так как он работает в другой компании) сообщил, что у стартапа есть соглашения с крупными облачными провайдерами, и он финансируется за счет выручки. Венчурные инвестиции компания пока не привлекала, но ведет переговоры.

Критики предупреждают, что масштабный доступ к аблитерованным моделям может привести к реальному вреду. Эндрю Юн, руководитель исследований в некоммерческой организации по безопасности ИИ CivAI, заявил, что аблитерация позволяет «превратить модель в социопата». По его словам, можно ввести буквально любой запрос, и модель выполнит его. Он ожидает, что в ближайшем будущем начнут появляться случаи использования таких моделей во вред.

Большинство опрошенных экспертов сходятся во мнении, что остановить этот процесс невозможно. Однако, по мнению Юна, правительства могут вмешаться в других местах: например, обязать провайдеров использовать классификаторы для выявления и блокировки вредоносной кибер- и биоактивности, а также требовать от компаний, сдающих в аренду доступ к продвинутым GPU, проверять личности клиентов и «отказывать в доступе при обоснованных подозрениях в опасном использовании».

Abliteration.ai предлагает клиентам слой модерации для добавления собственных ограничений. На самой платформе есть незначительные предохранители — например, модель не предоставила инструкции по суициду. Девона работает над внедрением дополнительных мер для предотвращения насилия. При этом компания не внедрила процедуры KYC, кроме записи банковской карты клиента, признавая, что вопрос о том, кому предоставлять доступ, остается сложным.

«Ты не хочешь быть человеком, ответственным за то, что кто-то сделал что-то безумное... Где провести черту ответственности компании? Мы все еще в процессе определения этого», — говорит Девона.

Сторонники сервиса утверждают, что демократизация доступа к моделям без цензуры — лучшая форма защиты. «Аблетированные модели способны моделировать злоумышленников. Преимущество в том, что защитники могут действовать максимально быстро, имея все необходимые инструменты. Это ускорит развитие кибербезопасности, что контринтуитивно», — считает Девона.

Среди клиентов Abliteration.ai — несколько стартапов по red-teaming из Великобритании и Европы, которые помогают банкам, авиакомпаниям и другим предприятиям критической инфраструктуры укреплять кибербезопасность. «Один из наших крупных клиентов проводит red-teaming агентов банков. Они не смогли бы использовать стандартные модели для этой работы», — добавил он.

TechCrunch создал бесплатный аккаунт и протестировал аблитерованную версию GLM-5.3.
Источник изображения:TechCrunch/Abliteration.ai

В самой кибериндустрии нет единого мнения о роли аблетированных моделей. Некоторые компании по red-teaming согласны, что злоумышленники уже используют такие модели, и защитникам нужны те же инструменты. Другие считают, что их значение преувеличено.

Ахмед Али, генеральный директор Fabraix, отмечает, что его компания полагается на тонкую настройку открытых моделей, а не на аблитерацию, которая, по его словам, снижает знания и возможности модели. «Если вы действительно пытаетесь нанести реальный вред — кибер- или био- — она будет не так эффективна», — сказал он.

Алессио Ломушио из Safe Intelligence согласен с возможным снижением возможностей, но считает, что аблетированные модели полезны для стресс-тестирования систем. Дэвид Слейтер из Armadin отметил, что пока такие модели не используются в его процессах, так как предыдущие поколения открытых моделей и так было легко «джейлбрейкнуть». Однако его компания исследует аблитерацию, полагая, что «понимание возможностей моделей критически важно». «Это будет происходить за закрытыми дверями. То, что это происходит открыто, дает исследователям инструменты и возможность понять реальные границы возможностей и осознать вред», — заключил он.

Подписаться на обновления Новости / Технологии
Зарегистрируйтесь на сайте, чтобы отключить рекламу

ℹ️ Помощь от ИИ в комментариях

Вы можете задать вопрос нашему ИИ-помощнику прямо в комментариях к этой статье. Он постарается быстро ответить или уточнить информацию.

⚠️ ИИ может ошибаться — проверяйте важную информацию.

Топ дня 🌶️


0 комментариев

Оставить комментарий


Все комментарии - Технологии