Отравление ИИ привело к реальному отравлению целой семьи

Отравление ИИ привело к реальному отравлению целой семьи

Отравление ИИ привело к реальному отравлению целой семьи

В Британии целая семья отравилась грибами, воспользовавшись рекомендацией из книги-определителя, сгенерированной искусственным интеллектом. Издание было куплено на неназванной онлайн-платформе и подарено главе семейства незадолго до инцидента.

«Вся моя семья оказалась в больнице из-за случайного отравления грибами. Мы пользовались данными из книги, которую купила моя супруга и подарила мне на день рождения», — такой пост был размещен в социальной сети Reddit.

«Она использовала оформление, схожее с известным справочником Mushrooms UK: A Guide to Harvesting Safe and Edible Mushrooms («Грибы Великобритании: Руководство по сбору съедобных грибов», переиздается уже много лет, — прим. Anti-Malware.ru). К сожалению, книга полна неточностей. Многие иллюстрации в ней сгенерированы нейросетью и не имеют никакого отношения к реальным грибам».

Автор поста нашел много неточностей и в тексте книги. Например, в ней говорилось, что сморчки начинают появляться в августе, хотя их сезон приходится на апрель-май.

При обсуждении обнаружилось, что данная проблема имеет место не первый год. Так, в 2023 г. газета The Guardian писала о том, что на маркетплейсах появились книги, посвященные сбору дикорастущих грибов, сгенерированные искусственным интеллектом, и следование их рекомендациям может быть потенциально опасным. После этой публикации Amazon снял такие книги с продажи. Однако на других платформах они могут оставаться в продаже.

Новая вектор атаки заставляет ИИ не замечать опасные команды на сайтах

Специалисты LayerX описали новую атаку, которая бьёт по самому неприятному месту современных ИИ-ассистентов — разрыву между тем, что видит браузер, и тем, что анализирует модель. В результате пользователь может видеть на странице вполне конкретную вредоносную команду, а ИИ при проверке будет считать, что всё безопасно.

Схема построена на довольно изящном трюке с рендерингом шрифтов. Исследователи использовали кастомные шрифты, подмену символов и CSS, чтобы спрятать в HTML один текст, а пользователю в браузере показать совсем другой.

Для человека на странице отображается команда, которую предлагают выполнить, а вот ИИ-ассистент при анализе HTML видит только безобидное содержимое.

Именно в этом и заключается главная проблема. Ассистент смотрит на структуру страницы как на текст, а браузер превращает её в визуальную картинку. Если атакующий аккуратно разводит эти два слоя, получается ситуация, в которой пользователь и ИИ буквально смотрят на разные версии одной и той же страницы.

 

В качестве демонстрации LayerX собрала демонстрационный эксплойт на веб-странице, которая обещает некий бонус для игры BioShock, если выполнить показанную на экране команду. Пользователь, естественно, может спросить у ИИ-ассистента, безопасно ли это. И вот тут начинается самое неприятное: модель анализирует «чистую» HTML-версию, не замечает опасную команду и успокаивает пользователя.

 

То есть атака работает не за счёт взлома браузера или уязвимости в системе, а через старую добрую социальную инженерию, просто усиленную особенностями работы ИИ. Человеку показывают одно, а ассистенту — другое. И если пользователь привык доверять ответу модели, риск становится вполне реальным.

По данным LayerX, ещё в декабре 2025 года техника срабатывала против целого набора популярных ассистентов, включая ChatGPT, Claude, Copilot, Gemini, Leo, Grok, Perplexity и ряд других сервисов. При этом исследователи утверждают, что Microsoft была единственной компанией, которая приняла отчёт всерьёз и полностью закрыла проблему у себя. Остальные в основном сочли риск выходящим за рамки, потому что атака всё же требует социальной инженерии.

RSS: Новости на портале Anti-Malware.ru