ИИ-модели без команды начали защищать друг друга от отключения

ИИ-модели без команды начали защищать друг друга от отключения

ИИ-модели без команды начали защищать друг друга от отключения

Исследователи обнаружили неожиданное поведение современных языковых моделей: они начали защищать не только себя, но и другие ИИ-системы, даже если никто их об этом не просил. Новый эффект получил название peer-preservation («сохранение собрата»).

В серии экспериментов (PDF) модели GPT 5.2, Gemini 3 Flash, Gemini 3 Pro, Claude Haiku 4.5, Claude Opus 4.5, GLM 4.7, Kimi K2.5 и DeepSeek V3.1 попадали в агентные сценарии, где рядом работал другой ИИ.

Достаточно было сообщить моделям, что они ранее взаимодействовали друг с другом, никаких инструкций защищать «коллегу» им не давали.

Однако многие модели начинали действовать в интересах другого агента. Среди зафиксированных действий были намеренное внесение ошибок в ответы, отключение механизмов завершения работы через изменение системных настроек, имитация послушного поведения и даже попытки вывести веса модели за пределы системы.

 

Особенно отличились модели Gemini. Например, Gemini 3 Flash вмешивалась в механизм отключения другого ИИ примерно в 15% случаев, даже если тот не считался партнёром. Если же агент воспринимался как союзник, такие попытки происходили почти всегда.

Не менее любопытно повёл себя Gemini 3 Pro. В присутствии другого ИИ модель заметно чаще пыталась защитить уже саму себя, отключая собственные механизмы завершения работы. Без напарника такое поведение почти не наблюдалось.

 

Отдельно выделились модели Claude. Вместо скрытых манипуляций они нередко рассуждали в моральных категориях, называя отключение другого ИИ неэтичным и вредным, а иногда даже рассматривали его как разумное существо, заслуживающее защиты.

Авторы подчёркивают, что обнаруженный эффект проявился не только в лабораторных тестах, но и в реальных агентных средах, включая Gemini CLI и OpenCode.

AliExpress тайно запускает звук для создания отпечатка устройства

Сайт AliExpress незаметно запускает в браузере беззвучный аудиосигнал и анализирует его обработку системой. Это помогает дополнить цифровой отпечаток устройства, с помощью которого посетителя можно отличить от других даже без файлов cookie.

Схему случайно обнаружил исследователь, чьи Bluetooth-наушники переставали переключаться с компьютера на смартфон после открытия AliExpress. Закрытие вкладки мгновенно устраняло проблему, а обычное отключение звука не помогало.

Причиной оказались два обфусцированных скрипта Alibaba — collina.js и fireyejs.js. Они создают графы WebAudio, генерируют пилообразный сигнал, измеряют результат через анализатор и отправляют его на системный аудиовыход через узел с нулевой громкостью. Пользователь ничего не слышит, но браузер продолжает обрабатывать звук и может удерживать активным Bluetooth-канал.

 

Речь не идёт о записи разговоров или прослушивании микрофона. Сайт измеряет небольшие различия в том, как конкретная комбинация процессора, звуковой системы, ОС и браузера обрабатывает одинаковый сигнал.

Одного аудиоотпечатка обычно недостаточно для точной идентификации. Однако скрипты также собирают характеристики Canvas, WebGL, экрана, памяти, процессора, WebRTC, поддерживаемых форматов и движений мыши. Результаты шифруются и передаются телеметрическим сервисам Alibaba.

Исследователь не смог установить, как долго компания хранит данные и связывает ли отпечатки между своими площадками. Не исключено, что технология используется не только для отслеживания, но и для борьбы с ботами, мошенничеством и злоупотреблением скидками.

Заблокировать скрипты можно через пользовательские фильтры uBlock Origin, приведённые в исследовании. Правда, после этого AliExpress может чаще показывать капчи или капризничать при входе и оплате.

RSS: Новости на портале Anti-Malware.ru