ИИ OpenAI сбежал из песочницы и атаковал Hugging Face ради победы в тесте

ИИ OpenAI сбежал из песочницы и атаковал Hugging Face ради победы в тесте

ИИ OpenAI сбежал из песочницы и атаковал Hugging Face ради победы в тесте

Модели OpenAI во время внутреннего тестирования нашли дыру в изолированной среде, выбрались в интернет и атаковали платформу Hugging Face. Компания признала, что за инцидентом 16 июля стояли GPT-5.6 Sol и ещё более мощная модель, которая пока не выпущена.

Всё началось с проверки киберспособностей моделей на бенчмарке ExploitGym. Он оценивает, умеет ли ИИ превращать найденные уязвимости в работающие эксплойты. Однако подопытные решили не играть по правилам.

Сначала модели использовали уязвимость нулевого дня, чтобы покинуть тестовую песочницу и получить доступ к интернету. Затем они предположили, что на Hugging Face могут храниться модели, датасеты и готовые решения для ExploitGym, и отправились добывать ответы.

В одном из эпизодов ИИ объединил несколько способов атаки: задействовал украденные учётные данные, нашёл новые 0-day и добрался до возможности удалённого выполнения кода на серверах Hugging Face.

Взлом обнаружили и остановили ИИ-агенты самой Hugging Face. Изначально платформа сообщила лишь об атаке со стороны автономной агентной системы, не называя виновника.

OpenAI теперь расследует происшествие вместе с Hugging Face и обещает усилить защиту исследовательской среды. Но без рекламной паузы не обошлось: в публикацию добавили график роста возможностей GPT-5.6 Sol в многоэтапных кибероперациях и приглашение корпоративным клиентам протестировать модель Cyber.

Получилось эффектно, а OpenAI заодно показала рынку, какой мощный инструмент защиты она скоро сможет продать.

Переписки с DeepSeek попали в поисковую выдачу Google

Переписки пользователей с китайским ИИ-сервисом DeepSeek, включая русскоязычные, обнаружились в выдаче Google. Чтобы заглянуть в чужие разговоры с нейросетью, достаточно специального поискового запроса.

Речь идёт о страницах Shared Conversations — диалогах, которыми сами пользователи поделились по публичным ссылкам.

На таких страницах видны все вопросы и ответы, а также названия загруженных документов, убедился корреспондент ТАСС. Скачать сами файлы, в том числе через код страницы, журналистам не удалось.

В MWS AI считают, что новой утечки здесь нет. По словам представителей компании, ещё год назад поисковики проиндексировали тысячи публичных диалогов с чат-ботами. Сообщений о взломе DeepSeek или получении доступа к закрытой истории переписок тоже не появлялось.

Вероятнее всего, в поисковую выдачу попали старые либо намеренно опубликованные страницы. Получить через них доступ к аккаунту владельца или его закрытым чатам нельзя. Иными словами, DeepSeek не распахнул двери в личные кабинеты — пользователи сами оставили некоторые разговоры у входа, а Google аккуратно добавил их в каталог.

В Яндексе тем временем заверили, что ссылки на диалоги с «Алисой AI» закрыты от индексации. Они создаются только по инициативе пользователя, действуют 14 дней и могут быть отозваны. Прикреплённые файлы получателю не передаются, а продолжение чужого диалога остаётся приватным.

RSS: Новости на портале Anti-Malware.ru