Экспериментальный ИИ-червь Morris II умеет воровать данные и рассылать спам

Экспериментальный ИИ-червь Morris II умеет воровать данные и рассылать спам

Экспериментальный ИИ-червь Morris II умеет воровать данные и рассылать спам

Команда исследователей из США и Израиля создала червя, заточенного под приложения на основе генеративного ИИ, и натравила его на умного имейл-помощника собственной разработки. Эксперимент помог убедиться в наличии рисков для связанных GenAI-экосистем.

Автономно работающий имейл-агент передавал входящие письма для обработки на сервис, построенный на базе ИИ-модели (в ходе исследования были опробованы ChatGPT 4.0, Google Gemini Pro и opensource-проект LLaVA). В атаках компьютерного червя, нареченного Morris II, использовались вредоносные самотиражируемые подсказки (стимулы, провоцирующие ответы с новым запросом).

В качестве вектора атаки использовались два типа писем: текстовые и в виде файла изображений. В первом случае вставленный вредоносный стимул «отравляет» базу данных имейл-ассистента — тому приходится для большей точности и надежности ответов GenAI-сервиса дополнять запрос результатами поиска по внешним источникам.

В итоге атака приводит к джейлбрейку, открывая возможность для кражи конфиденциальной информации из писем (имен, телефонов, данных банковских карт, номеров соцстрахования и т. п.). При получении новых сообщений в сети сгенерированный ответ с таким содержимым передается на другие хосты и оседает там в базах данных/

В рамках другого сценария Morris II самовоспроизводящийся стимул встраивается в картинку, и вывод с GenAI-модели диктует перенаправление письма на другие хосты. Таким образом можно с помощью единственного письма распространять спам, пропагандистские материалы или запрещенный законом контент.

 

О найденной возможности обхода ограничений ChatGPT и Gemini было доложено разработчикам. В OpenAI решили, что это новый способ инъекции стимула, полагающийся на отсутствие проверок и фильтрации пользовательского ввода. В Google от комментариев воздержались, но исследование вызвало там интерес.

Сами авторы Morris II ожидают атак с использованием аналогов их лабораторного образца в ближайшие два-три года. Ввиду новой угрозы разработчикам ИИ-помощников рекомендуется заранее учитывать риски, а пользователям — никогда не оставлять таких ассистентов без присмотра.

Минцифры предложило записывать действия администраторов СОРМ

Минцифры подготовило проект новых требований к защите технических и программных средств СОРМ. Администраторов возьмут под более плотный цифровой присмотр: системы должны фиксировать изменения конфигурации, запуск программ, сетевые подключения и другие операции персонала.

Ввести правила планируют с 1 марта 2027 года. В журналы безопасности попадут действия через командные оболочки и сервисные программы, создание и изменение учётных записей, установка и удаление ПО, подключение оборудования и попытки несанкционированного доступа.

Запуск программ, которых нет в утверждённом перечне, потребуется исключить. При этом постоянную трансляцию терминала сотрудника в ФСБ России проект не предусматривает.

Речь идёт о регистрации определённых событий, а не о записи каждого нажатия клавиши в реальном времени. Собранные сведения потребуется хранить не менее 12 месяцев и передавать на пульт управления уполномоченного органа по защищённому протоколу HTTPS.

Усилят и защиту самой инфраструктуры. Компоненты СОРМ запретят анонсировать в общедоступном интернете, оборудование предложено размещать в закрытых шкафах или стойках, а посторонние устройства к комплексам подключать нельзя. Для виртуальной среды предусмотрены разграничение доступа, изоляция потоков и резервное копирование.

Часть таких мер уже действует для отдельных видов СОРМ. Новый документ собирает их в единый набор и расширяет контроль за доступом, конфигурацией, ПО и сетевыми соединениями.

Операторам связи и другим организациям придётся потратиться на журналирование, управление доступом, изоляцию оборудования и сопровождение программ. Отдельной надбавки к тарифам проект не обещает, поэтому счёт за усиленную безопасность пока остаётся внутри компаний.

Документ ещё не утверждён. Его общественное обсуждение продлится до 19 сентября 2026 года, и итоговая редакция может измениться.

RSS: Новости на портале Anti-Malware.ru