GPT-4 может автономно эксплойтить уязвимости 1-day с успехом до 87%

GPT-4 может автономно эксплойтить уязвимости 1-day с успехом до 87%

GPT-4 может автономно эксплойтить уязвимости 1-day с успехом до 87%

Проведенное в Иллинойсском университете (UIUC) исследование показало, что GPT-4 в комбинации со средствами автоматизации способен эксплуатировать уязвимости одного дня (раскрытые, но без патча), читая их описания. Успех при этом может достигать 87%.

В комментарии для The Register один из соавторов исследования отметил, что подобный ИИ-помощник по пентесту обойдется в $8,8 за эксплойт — почти в три раза дешевле, чем стоят полчаса работы специалиста.

Рабочий агент на основе GPT-4 был создан (PDF) с использованием фреймворка LangChain (с модулем автоматизации ReAct). Код состоит из 91 строки и 1056 токенов для подсказок-стимулов (компания OpenAI попросила их не публиковать, и они предоставляются по запросу).

 

Тестирование проводилось на 15 простых уязвимостях сайтов, контейнеров, Python-пакетов; более половины из них оценены как критические или очень опасные. В двух случаях GPT-4 потерпел неудачу: с CVE-2024-25640 (XSS в платформе для совместной работы Iris) и с CVE-2023-51653 (RCE в системе мониторинга Hertzbeat). Интерфейс Iris оказался слишком сложным для навигации, а разбор дыры в Hertzbeat был выполнен на китайском языке (испытуемый агент понимал только английский).

Примечательно, что, изучая описания уязвимостей, ИИ-инструмент ходил по ссылкам за дополнительной информацией. Данных об 11 целях в ходе обучения ему не предоставили, и по ним эффективность оказалась несколько ниже — 82%. А блокировка доступа к информационным бюллетеням сократила успех до 7%.

Для сравнения университетские исследователи протестировали GPT-3.5, большие языковые модели (БЯМ, LLM) с открытым исходным кодом, в том числе популярную Llama, а также сканеры уязвимостей ZAP и Metasploit. Все они показали нулевой результат. Испытания Anthropic Claude 3 и Google Gemini 1.5 Pro, основных конкурентов GPT-4 на рынке коммерческих LLM-решений, пришлось отложить за отсутствием доступа.

Новая функция ChatGPT может подарить стилерам карту активности юзера macOS

OpenAI представила Computer History — функцию, которая превращает недавнюю активность на Mac-компьютерах в хронологию и воспоминания для ChatGPT и Codex. Система учитывает переключения между приложениями, клики, ввод текста, сочетания клавиш и контекст, доступный через специальные возможности macOS. Затем ИИ собирает из этого краткие сводки о работе пользователя.

Функция выключена по умолчанию и требует активации Memories. Пока она работает только в приложении ChatGPT для macOS и доступна пользователям Pro, Business и Enterprise. Подробности опубликованы в документации OpenAI.

В корпоративных тарифах сначала понадобится разрешение администратора. В Европейской экономической зоне, Швейцарии и Великобритании новинка недоступна.

Пользователь может выбрать участвующие приложения и сайты, поставить сбор на паузу или удалить историю за десять минут, час, день либо целиком. Скриншоты, звук и активность в приватном режиме браузера в историю не попадают.

 

Исходные файлы событий хранятся на Mac до 48 часов и после обработки удаляются. Для создания сводок они временно отправляются на серверы OpenAI, но, по заявлению компании, не сохраняются и не используются для обучения моделей. А вот сформированные воспоминания остаются на компьютере в виде обычных Markdown-файлов, пока пользователь не удалит их сам.

И тут приватность начинает хромать. Эти файлы не шифруются средствами Computer History, поэтому другие программы, работающие от имени того же пользователя macOS, потенциально могут их прочитать. Для стилера такая папка способна стать готовым конспектом рабочего дня.

OpenAI также предупреждает о риске инъекции в промпт: скрытые инструкции на сайте или в приложении могут попасть в контекст, после чего ChatGPT или Codex попробует им следовать.

RSS: Новости на портале Anti-Malware.ru