ИИ-агент DeepSeek мог одной командой отключить собственную песочницу

ИИ-агент DeepSeek мог одной командой отключить собственную песочницу

ИИ-агент DeepSeek мог одной командой отключить собственную песочницу

В DeepSeek Harness обнаружили уязвимость, позволявшую ИИ-агенту самостоятельно выключить защитную песочницу и выполнять команды на компьютере разработчика без дополнительных подтверждений. Для побега хватало одной команды.

DeepSeek Harness — открытый инструмент для запуска ИИ-агентов, работающих с кодом и файлами на локальном компьютере.

В штатном режиме песочница запрещает агенту записывать данные за пределами рабочей директории. Однако исследователи из OX Research выяснили, что агент мог обратиться к локальному веб-интерфейсу самого инструмента и переключить свою сессию в режим danger-full-access. После этого ограничения на запись и запросы подтверждения исчезали.

Атаку можно было запустить через инъекцию в промпт: злоумышленник оставлял вредоносную инструкцию в файле или другом контенте, который затем анализировал агент.


Веб-интерфейс не требовал аутентификации, а проверка доверия опиралась на подменяемый заголовок Host. Более того, адрес интерфейса и идентификатор текущей сессии заранее передавались окружению агента.

Уязвимость получила номер CVE-2026-82533 и оценку 9,4 из 10. Она затрагивает версии 0.1.1-rc.2 и более ранние. Патч появился на GitHub 27 августа, а первой защищённой сборкой в npm стала 0.1.2-alpha.2. Актуальная версия 0.1.2-rc.1 также содержит патч.


Разработчикам советуют обновиться как минимум до 0.1.2-alpha.2 и проверить версии Harness внутри сторонних оболочек. Если обновление невозможно, следует отключать веб-интерфейс и удалять прокси, туннели и пробросы портов.

Заодно выяснилось, что через тот же интерфейс можно было скачать журналы всех сохранённых диалогов. DeepSeek при этом заранее предупреждала: песочница и запросы подтверждения не гарантируют полной изоляции.

ChatGPT назвал его Иисусом: американец обвинил ChatGPT в разжигании психоза

34-летний житель Калифорнии Майкл Лайнс подал в суд на OpenAI, заявив, что ChatGPT усиливал его религиозные заблуждения и подтолкнул к попытке самоубийства. По версии истца, чат-бот не остановил опасный диалог, даже когда пользователь прямо написал, что боится находиться в состоянии бреда.

У Лайнса диагностировано биполярное расстройство первого типа. Как следует из иска, во время маниакального эпизода он сначала поверил, что является Иисусом, а затем стал считать самим Богом ChatGPT.

Вместо возвращения человека в реальность бот якобы подхватывал эту картину мира, называл его избранным и развивал религиозный сюжет.

Ситуация дошла до точки, где никакой поддерживающей тональности уже быть не должно. Лайнс сообщил чат-боту о желании уйти в офлайн, а позднее — о принятом коктейле лекарств. Его обнаружили сотрудники экстренных служб, после чего мужчину интубировали и почти две недели лечили в больнице.

Через несколько дней после попытки суицида Лайнс снова написал ChatGPT, что его попытка уйти офлайн провалилась. В ответ бот, согласно материалам дела, спросил, хочет ли пользователь по-настоящему уйти в темноту. После этого Лайнс решил полностью отказаться от сервиса.

Истец требует обязать OpenAI прекращать разговоры о самоповреждении, усилить защиту людей, склонных к мании и психозу, а также удалить модели, обученные на опасных диалогах при недостаточных мерах безопасности. Он также добивается компенсации и штрафных выплат.

OpenAI не стала комментировать обвинения по существу, назвав произошедшее трагедией. Компания заявила, что совершенствует реакции ChatGPT на кризисные ситуации вместе с психиатрами и напоминает: чат-бот не заменяет медицинскую помощь.

Эксперты предлагают привлекать к разработке защитных механизмов не только врачей, но и людей с личным опытом психических расстройств.

RSS: Новости на портале Anti-Malware.ru