ИИ может склонировать JS-зловреда 10 тыс. раз и добиться FUD в 88% случаев

ИИ может склонировать JS-зловреда 10 тыс. раз и добиться FUD в 88% случаев

ИИ может склонировать JS-зловреда 10 тыс. раз и добиться FUD в 88% случаев

Проведенное в Palo Alto Networks исследование показало, что ИИ-модель можно заставить многократно обфусцировать вредоносный код JavaScript и в итоге получить семпл, не детектируемый антивирусами (FUD, fully undetectable).

Речь идет об онлайн-помощниках, авторы которых вводят ограничения во избежание злоупотреблений ИИ-технологиями — в отличие от создателей «злых» аналогов (WormGPT, FraudGPT и т. п.), заточенных под нужды киберкриминала.

Разработанный в Palo Alto алгоритм использует большую языковую модель (БЯМ, LLM) для пошаговой трансформации кода с сохранением его функциональности. При его тестировании на реальных образцах JavaScript-зловредов кастомный классификатор на основе модели глубокого обучения выдал вердикт «безвредный» в 88% случаев.

Опытным путем было установлено, что уровень детектирования снижается по мере увеличения количества итераций (в ходе экспериментов LLM создавала по 10 тыс. вариантов вредоноса). Примечательно, что привносимые изменения выглядели более естественно в сравнении с результатами готовых инструментов вроде obfuscator.io.

Для проведения исследования был также создан набор подсказок для выполнения различных преобразований, таких как переименование переменной, разделение строк, добавление мусора, удаление ненужных пробелов, альтернативная реализация функции.

Финальные варианты обфусцированных JavaScript были ради интереса загружены на VirusTotal. Их не смог распознать ни один антивирус; повторение проверок через четыре дня дало тот же эффект.

 

Результаты исследования помогли экспертам усовершенствовать свой инструмент детектирования JavaScript. Полученные с помощью LLM образцы были добавлены в тренировочный набор данных для модели машинного обучения; их использование позволило повысить результативность классификатора на 10%.

GPT-6 Astra научилась создавать эксплойты со стопроцентной точностью

OpenAI представила GPT-6 Astra, назвав её самой интеллектуальной и согласованной с человеком моделью в мире. Новинка умеет работать с компьютером и браузером, писать код, решать научные задачи, а также и настолько хорошо создавать эксплойты, что выпускать её без предохранителей корпорация благоразумно не стала.

На ExploitBench, где ИИ превращает известные уязвимости в работающие эксплойты, Astra набрала 100%.

Предыдущая GPT-5.6 Sol получила 78,5%. В отдельном тесте на свежих уязвимостях модель достигла выполнения произвольного кода в 39% случаев против 11,5% у предшественницы и попутно обнаружила две неизвестные 0-day. Информацию о них OpenAI передаёт разработчикам затронутого софта.

Экспертные испытания без публичных ограничений показали, что Astra способна использовать неизвестные уязвимости для выполнения кода в защищённых браузерах и создавать эксплойты для повышения привилегий в современных ОС.

Поэтому публичная версия ограничена безопасным анализом кода и подготовкой исправлений. Запросы на создание PoC-эксплойтов она будет отклонять. Расширенный доступ для проверки уязвимостей, анализа вредоносных программ и разработки средств обнаружения OpenAI планирует выдавать защитникам через программу Daybreak.

Компания также усилила защиту от джейлбрейка и внедрила мониторинг действий модели. Проверки могут останавливать даже легитимные задачи по кибербезопасности и требовать подтверждения пользователя.

Сейчас Astra получают отдельные организации. Затем модель появится у подписчиков ChatGPT Plus, Pro, Business и Enterprise, а также в API, Microsoft Azure и AWS Bedrock.

Параллельно OpenAI пообещала направить $1 млрд на предоставление передовых ИИ-инструментов энергетикам, банкам, водоканалам, госорганам и разработчикам open source.

RSS: Новости на портале Anti-Malware.ru