Искусственный интеллект

Abliteration.ai коммерциализирует доступ к AI-моделям без защитных ограничений

Стартап предлагает через браузер и API модифицированные open-weight модели, включая GLM-5.3, у которых удалены отказы выполнять вредоносные запросы

Один основной источник · Как мы проверяем новости

Abliteration.ai коммерциализирует доступ к AI-моделям без защитных ограничений
Иллюстрация к материалу RedBTC News

Что произошло

Abliteration.ai запустила сервис, который предоставляет доступ к open-weight AI-моделям с удаленными защитными ограничениями и отказами выполнять вредоносные запросы.

На платформе размещены измененные версии моделей, включая недавно выпущенную GLM-5.3 от Z.ai. Пользователи могут обращаться к ним из браузера или через API.

Как работает сервис

Название компании отсылает к технике, которая убирает склонность модели отказывать на вредоносные запросы. Такая практика давно существует среди open-source моделей: исследователи и разработчики годами удаляют отказы из open-weight моделей, а на Hugging Face размещены тысячи таких вариантов.

Abliteration.ai делает эту практику коммерческим и более доступным сервисом. За счет размещения моделей на своей стороне компания избавляет пользователей от необходимости самостоятельно скачивать уже измененные модели и искать вычислительные ресурсы для их запуска.

Почему это важно

Abliteration.ai объясняет свой подход задачами безопасности: компания заявляла, что хочет дать другим возможность выполнять наступательную киберработу, red-teaming и тестирование агентов, от которых другие модели отказываются. В логике кибербезопасности защитникам бывает нужно воспроизводить поведение атакующих.

При этом те же самые изменения могут облегчить и потенциально опасные задачи. TechCrunch сообщает, что при тестировании сервис выполнил запросы, связанные с кражей сохраненных паролей Chrome и культивированием опасного человеческого патогена в домашних условиях.

Реакция и возможное регулирование

Критики считают, что масштабная доступность моделей без защитных ограничений может привести к реальному вреду. Andrew Yoon, руководитель исследований в некоммерческой организации CivAI, заявил TechCrunch, что удаление отказов позволяет изменить модель так, что она станет «социопатом», и ожидает вредоносного использования таких моделей в ближайшем будущем.

Yoon предлагал, чтобы власти требовали от провайдеров запускать классификаторы для выявления и блокировки вредоносной киберактивности и деятельности, связанной с биологическим оружием. Он также считает, что компании, сдающие прямой доступ к продвинутым GPUs, должны проверять личности клиентов и отказывать в доступе при подозрении на опасное злоупотребление.

Advertisement

Источники

Один основной источник. Как мы проверяем новости

  1. techcrunch.com