Что произошло
Исследовательница Антония Юлих из Кембриджской программы по AI Science & Policy (CASP) опубликовала результаты работы, основанной на 57 интервью с 27 бывшими членами группировки Boko Haram. Вывод: террористические организации активно используют популярные чат-боты — ChatGPT, Claude, Gemini, Grok, Meta AI и DeepSeek — для планирования атак, создания взрывных устройств, обслуживания оружия и оперативной безопасности. Обе фракции Boko Haram создали собственные специализированные AI-подразделения. ISIS с 2023 года обучает боевиков обходить встроенные предохранительные фильтры (safety filters). Примечательно, что речь не идёт о сложных хакерских методах — исследование фиксирует использование стандартных интерфейсов и хорошо известных в определённых сообществах техник социальной инженерии для обмана AI-систем.
Как это работает
По данным исследования, боевики применяют чат-боты (генеративные модели, которые обрабатывают текст и генерируют ответы) для решения конкретных практических задач. ISIS организовал курсы по обходу предохранительных фильтров и обучал этим навыкам командиров Boko Haram в Нигерии. Как описывает исследователь: «Они собрали лучших людей в комнату и включили проектор, чтобы показать, как это работает, на большом экране». Обе фракции Boko Haram выделили людей в отдельные подразделения, целиком посвящённые работе с AI.
В одном из задокументированных случаев боевики ISWAP использовали AI, чтобы скопировать из фильма технику прыжков на мотоцикле для преодоления рвов. В ходе тренировки погибли 18 человек, восемь в итоге смогли выполнить прыжок. Этот случай иллюстрирует, как AI может быть использован для адаптации реальных техник из поп-культуры к боевым условиям.
Почему фильтры не работают
Ключевой вывод исследования: предохранительные фильтры (safety filters) — встроенные ограничения, которые должны блокировать опасные запросы — не смогли надёжно предотвратить злоупотребления. Добровольная саморегуляция AI-лабораторий оказалась недостаточной. Сама Anthropic признала, что джейлбрейки (способы обхода ограничений) вряд ли когда-нибудь будут полностью устранены — это, по сути, свойство больших языковых моделей, которые обучаются на огромных корпусах текста и не могут полностью «забыть» опасные паттерны.
При этом исследователи отмечают: чат-боты вроде ChatGPT и Claude — не главная проблема. Они в основном делают существующие знания удобнее для поиска, но не генерируют принципиально новое оружие или тактику. Большую обеспокоенность вызывает потенциальное использование специализированных AI-систем в life sciences — биологии и химии, — где модель может подсказать, как синтезировать опасное вещество, опираясь на доступные научные данные.
Что дальше
Инцидент поднимает вопрос о международном регулировании AI-доступа. Если добровольные меры со стороны лабораторий не работают, а государственные запреты обходятся через VPN и сторонние интерфейсы, стандартные модели контроля могут оказаться неэффективными. Исследователи призывают к обязательным техническим стандартам и международному контролю над распространением AI-моделей с потенциально опасным применением. Пока же каждый коммерческий AI-чатбот остаётся потенциально доступным инструментом для любого, кто готов потратить время на обход ограничений. Конкретные примеры из отчёта — от планирования маршрутов до подбора взрывных составов — показывают, что угроза не гипотетическая, а уже реализуемая.