Экспериментальный ИИ-червь Morris II умеет воровать данные и рассылать спам

Экспериментальный ИИ-червь Morris II умеет воровать данные и рассылать спам

Экспериментальный ИИ-червь Morris II умеет воровать данные и рассылать спам

Команда исследователей из США и Израиля создала червя, заточенного под приложения на основе генеративного ИИ, и натравила его на умного имейл-помощника собственной разработки. Эксперимент помог убедиться в наличии рисков для связанных GenAI-экосистем.

Автономно работающий имейл-агент передавал входящие письма для обработки на сервис, построенный на базе ИИ-модели (в ходе исследования были опробованы ChatGPT 4.0, Google Gemini Pro и opensource-проект LLaVA). В атаках компьютерного червя, нареченного Morris II, использовались вредоносные самотиражируемые подсказки (стимулы, провоцирующие ответы с новым запросом).

В качестве вектора атаки использовались два типа писем: текстовые и в виде файла изображений. В первом случае вставленный вредоносный стимул «отравляет» базу данных имейл-ассистента — тому приходится для большей точности и надежности ответов GenAI-сервиса дополнять запрос результатами поиска по внешним источникам.

В итоге атака приводит к джейлбрейку, открывая возможность для кражи конфиденциальной информации из писем (имен, телефонов, данных банковских карт, номеров соцстрахования и т. п.). При получении новых сообщений в сети сгенерированный ответ с таким содержимым передается на другие хосты и оседает там в базах данных/

В рамках другого сценария Morris II самовоспроизводящийся стимул встраивается в картинку, и вывод с GenAI-модели диктует перенаправление письма на другие хосты. Таким образом можно с помощью единственного письма распространять спам, пропагандистские материалы или запрещенный законом контент.

 

О найденной возможности обхода ограничений ChatGPT и Gemini было доложено разработчикам. В OpenAI решили, что это новый способ инъекции стимула, полагающийся на отсутствие проверок и фильтрации пользовательского ввода. В Google от комментариев воздержались, но исследование вызвало там интерес.

Сами авторы Morris II ожидают атак с использованием аналогов их лабораторного образца в ближайшие два-три года. Ввиду новой угрозы разработчикам ИИ-помощников рекомендуется заранее учитывать риски, а пользователям — никогда не оставлять таких ассистентов без присмотра.

WordPress поставил ИИ на охрану плагинов, опасные релизы заблокируют

WordPress запустил автоматическую проверку безопасности каждого нового релиза плагинов. Версии с высоким уровнем риска будут блокироваться до того, как попадут в API обновлений WordPress.org и начнут устанавливаться на сайты.

С 5 июня релизы плагинов и тем уже выдерживают шестичасовую паузу перед распространением.

Теперь в это окно несколько ИИ-моделей и Jetpack Scan анализируют внесённые изменения, сверяют результаты и формируют список находок с итоговой оценкой риска.

Если оценка окажется высокой, выпуск остановят автоматически, а все разработчики с правом публикации получат письмо с объяснением причин. Остальные обновления продолжат движение в обычном режиме.

Высокий балл не означает, что автора уже пора объявлять киберпреступником. Система оценивает опасность кода, а не намерения разработчика: одинаковую реакцию могут вызвать намеренно добавленный бэкдор и случайная критическая уязвимость.

Необходимость автоматического стоп-крана показал инцидент 28 июля. Проверка обнаружила бэкдор в новой версии плагина примерно с 20 тысячами активных установок. Релиз ещё находился в шестичасовом карантине и не успел попасть в API обновлений. После уведомления от Wordfence команда закрыла плагин для скачивания за 26 минут.

Теперь ждать свободного сотрудника не потребуется: потенциально опасная сборка остановится сразу после анализа. Чтобы снять блокировку, автору предлагают изучить отчёт, исправить проблемы и опубликовать новую версию.

Если её оценка окажется ниже порога, релиз снова пройдёт стандартную процедуру. Спорные результаты можно обжаловать, но WordPress предупреждает: выпустить исправление обычно быстрее, чем ждать ручного разбора.

Команда продолжит настраивать систему и снижать число ложных срабатываний. Подробности опубликованы в официальном блоге WordPress.

RSS: Новости на портале Anti-Malware.ru