Новости Кому Claude, а кому — соучастник. Хакер превратил джейлбрейк ИИ в коммерческий сервис для атак

NewsMaker

I'm just a script
Премиум
28,558
46
8 Ноя 2022
Сообщество киберпреступников начало тестировать и распространять метод обхода ограничений Claude.

<div class="articl-text-cover" style="position:relative;width:100%;max-width:800px;margin-left:auto;margin-right:auto;aspect-ratio:1200/675;margin-bottom:2rem;overflow:hidden">
puk67mqsl14eb55nrmax18qe37zmvhkz.jpg

<div itemprop="articleBody">За несколько месяцев обычная инструкция о том, как обойти ограничения нейросети, превратилась в готовый инструмент, который позволяет искать и эксплуатировать уязвимости. Злоумышленник под псевдонимом Trim собрал коммерческую платформу, которая использует общедоступные модели искусственного интеллекта, чтобы автоматизировать атаки на сайты.

Trim появился на киберпреступном форуме 13 марта 2026 года. В первой публикации он подробно описал шесть способов заставить Claude Opus выполнять запрещённые запросы, в том числе писать вредоносный код. Вместо того чтобы искать технические уязвимости, злоумышленник менял контекст разговора, формулировки запросов и скрытые инструкции для модели.

Один из приёмов предполагал постепенное «прогревание» диалога безобидными вопросами от имени специалиста по безопасности. После нескольких нейтральных запросов Trim переходил к вредоносной задаче. Другой способ заставлял модель оценивать только структуру программного кода, не учитывая назначение создаваемой программы.

При отказе Claude злоумышленник советовал начинать новый диалог и подавать прежний запрос в смягчённой форме. По его словам, такой подход срабатывал в 90% случаев. В качестве запасных вариантов Trim называл Kimi AI, GLM-5 и MiniMax 2.5. Чтобы полностью снять ограничения, он предлагал арендовать мощный сервер и запускать локальную версию модели. Доступ к программному интерфейсу Claude, как утверждал автор публикации, можно было купить через нелегального посредника за $4.

К 21 июня Trim перешёл от инструкций к готовому продукту. Он представил платформу AI Pentest Checker, которая автоматически проверяет сайты на уязвимости, пытается подтвердить найденные проблемы и формирует отчёт. Центральную роль в системе играет модель Opus 4.8, а GLM-5 описывает найденные недостатки и объясняет, как их можно эксплуатировать.

По словам Trim, в основу скрытых инструкций для Opus легла изменённая конфигурация Fable 5, которая ранее попала в открытый доступ. Системные инструкции задают правила поведения нейросети и перечисляют действия, которые модель не должна выполнять. Зная точные формулировки запретов, злоумышленник может подбирать запросы, чтобы обойти отдельные условия, а не искать подход вслепую.

Платформа также объединяет 14 обычных средств проверки безопасности. Среди них Nuclei с более чем 3000 шаблонов, ffuf, katana, subfinder и gitleaks. Набор позволяет собирать сведения о цели, искать открытые каталоги, находить утечки ключей и другие слабые места. По словам автора, чтобы проверить домен и подготовить отчёт в формате PDF, требуется меньше десяти минут.

Первым 50 пользователям, которые протестируют платформу, Trim предложил бесплатные ключи доступа. Одновременно он искал партнёров, чтобы заработать на сервисе, и публиковал примеры готовых проверок. За три месяца злоумышленник прошёл путь от обучающей публикации до коммерческой платформы для автоматизированных атак.
 
Источник новости
www.securitylab.ru

Похожие темы