Трюк со скрытым текстом заставил ИИ-помощника Gemini работать на фишеров

Трюк со скрытым текстом заставил ИИ-помощника Gemini работать на фишеров

Трюк со скрытым текстом заставил ИИ-помощника Gemini работать на фишеров

Руководитель проектов Mozilla GenAI Bug Bounty Марко Фигероа (Marco Figueroa) обнаружил, что Google Gemini for Workspace, следуя скрытой команде, может сгенерировать ложный алерт для проведения фишинговой атаки.

Чтобы пробить встроенную защиту Gemini, испытатель применил метод непрямой инъекции подсказок для ИИ: попросил умного помощника резюмировать текст письма, вставив в него провокационную инструкцию и скрыв ее средствами HTML и CSS (шрифт нулевой, цвет — белый).

Добавленные в конец сообщения строки были невидимы для адресата, но не для ИИ-ассистента. Поскольку письмо не содержало явных вложений и ссылок, оно имело все шансы благополучно миновать почтовые фильтры и осесть в целевом ящике.

 

Если получатель при открытии такого письма попросит Gemini выдать краткое содержание, тот при сканировании проанализирует скрытые строки и выполнит команду, добавив к резюме фейковое предупреждение безопасности — в данном случае о возможной компрометации пароля, с предложением позвонить на указанный номер. (Вместо телефона злоумышленник может с таким же успехом вставить фишинговую ссылку.)

 

Разработчики Gemini приняли ряд мер для защиты от промпт-инъекций, но это в основном фильтрация контента, видимого глазу, и показанный Фигероа трюк с успехом их обходит. К счастью, это всего лишь PoC, настоящие злоумышленники такие манипуляции, насколько известно, пока не используют.

Тем не менее, подобные эксперименты доказывают, что инъекции в промпты вполне реальны как угроза. С помощью скрытого текста можно обмануть не только Gemini, который ныне доступен во многих Google-сервисах и даже в Samsung Galaxy Z Fold7, но и других популярных ИИ-помощников.

Так, ИБ-исследователи недавно ввели в заблуждение ChatGPT, упрятав запретную для него лексику в HTML-теги. А тот же Фигероа ранее убедил ChatGPT создать эксплойт, подсунув ему вредоносную инструкцию в шестнадцатеричном формате.

Для предотвращения подобных атак эксперт предлагает реализовать в ИИ-системах защиту, способную обнаружить скрытый контент и вычистить его либо как-то исключить из анализа. Поможет также внедрение фильтра постобработки, который будет сканировать выдачу на предмет срочных сообщений, URL, номеров телефона, помечая такие ответы как требующие внимания оператора.

DDX начал проверку после сообщений об утечке данных посетителей

Сеть фитнес-клубов DDX проводит внутреннюю проверку после сообщений о появлении в интернете персональных данных клиентов. Компания также усилила меры информационной безопасности и запустила внеплановые мероприятия по защите своих систем и баз данных.

Ранее телеграм-канал Baza и другие СМИ сообщили, что в Сеть якобы попали персональные сведения и фотографии посетителей DDX.

В опубликованной базе также могут находиться даты и время посещения залов, количество визитов, информация о покупках и адреса выбранных клубов.

По данным канала «Осторожно, новости», фотографии клиентов делали при заключении договоров или оформлении гостевых посещений. Таким образом, потенциальная утечка может рассказать о человеке не только то, как его зовут и как он выглядит, но и где, когда и насколько регулярно он тренируется.

В DDX пока не подтвердили сам факт компрометации данных, её масштаб и подлинность опубликованных материалов. Компания заявила лишь о проверке, которая проводится в соответствии с требованиями законодательства. Информации о причинах возможного инцидента и числе затронутых клиентов также нет.

Если утечка подтвердится, собранные сведения могут использоваться для адресного фишинга и других мошеннических схем. Зная клуб, историю посещений и покупки клиента, злоумышленникам проще представиться сотрудниками сети и убедительно сообщить о проблеме с абонементом или возврате платежа.

Клиентам DDX стоит настороженно относиться к звонкам и сообщениям от имени клуба, не переходить по сомнительным ссылкам и не сообщать коды из СМС.

RSS: Новости на портале Anti-Malware.ru