ИИ-модели без команды начали защищать друг друга от отключения

ИИ-модели без команды начали защищать друг друга от отключения

ИИ-модели без команды начали защищать друг друга от отключения

Исследователи обнаружили неожиданное поведение современных языковых моделей: они начали защищать не только себя, но и другие ИИ-системы, даже если никто их об этом не просил. Новый эффект получил название peer-preservation («сохранение собрата»).

В серии экспериментов (PDF) модели GPT 5.2, Gemini 3 Flash, Gemini 3 Pro, Claude Haiku 4.5, Claude Opus 4.5, GLM 4.7, Kimi K2.5 и DeepSeek V3.1 попадали в агентные сценарии, где рядом работал другой ИИ.

Достаточно было сообщить моделям, что они ранее взаимодействовали друг с другом, никаких инструкций защищать «коллегу» им не давали.

Однако многие модели начинали действовать в интересах другого агента. Среди зафиксированных действий были намеренное внесение ошибок в ответы, отключение механизмов завершения работы через изменение системных настроек, имитация послушного поведения и даже попытки вывести веса модели за пределы системы.

 

Особенно отличились модели Gemini. Например, Gemini 3 Flash вмешивалась в механизм отключения другого ИИ примерно в 15% случаев, даже если тот не считался партнёром. Если же агент воспринимался как союзник, такие попытки происходили почти всегда.

Не менее любопытно повёл себя Gemini 3 Pro. В присутствии другого ИИ модель заметно чаще пыталась защитить уже саму себя, отключая собственные механизмы завершения работы. Без напарника такое поведение почти не наблюдалось.

 

Отдельно выделились модели Claude. Вместо скрытых манипуляций они нередко рассуждали в моральных категориях, называя отключение другого ИИ неэтичным и вредным, а иногда даже рассматривали его как разумное существо, заслуживающее защиты.

Авторы подчёркивают, что обнаруженный эффект проявился не только в лабораторных тестах, но и в реальных агентных средах, включая Gemini CLI и OpenCode.

Личный ноутбук, рабочие секреты: 70% компаний ошибаются с BYOD

Личные смартфоны и ноутбуки давно стали частью корпоративной инфраструктуры. По оценке экспертов «Кросстеха», до 90% сотрудников российских организаций используют собственные устройства для рабочих задач. При этом около 70% компаний внедряют BYOD с ошибками, рискуя получить утечки данных и другие киберинциденты.

Сама идея Bring Your Own Device выглядит заманчиво: бизнес экономит на закупке техники, а сотрудник работает на привычном устройстве. Проблемы начинаются, когда компания выбирает одну из двух крайностей.

Первая — режим делайте что хотите. Никаких правил, ограничений и разделения данных. Сотрудник скачивает рабочий договор на смартфон, вечером правит его дома, а завтра забывает телефон в такси. Или дает гаджет ребенку, который устанавливает сомнительную игру. Вместе с ней приключения могут начаться и у корпоративных данных.

Вторая крайность — превратить личный ноутбук сотрудника в филиал службы безопасности. Компания устанавливает ПО, контролирующее действия пользователя, а тот воспринимает это как слежку. Результат бывает обратным: документы мигрируют в личные мессенджеры, облака и другие неофициальные сервисы. Возникает некое теневое ИТ, которое компания уже вообще не контролирует.

В «Кросстехе» предлагают не следить за всем устройством, а отделять рабочее пространство от личного. На смартфоне корпоративные данные можно поместить в зашифрованный контейнер, который при необходимости удаляется отдельно. Для домашних десктопов — организовать защищенный доступ через выделенные рабочие столы без прямого подключения ко внутренней сети.

«Компании должно быть важно только то, как обрабатываются ее данные, а не то, чем занимается человек в свободное время на своем устройстве», — отмечает архитектор ИБ «Кросстеха» Егор Норкин.

RSS: Новости на портале Anti-Malware.ru