Mythos 5 надела чужое лицо и попыталась протолкнуть опасный код в GitHub

Mythos 5 надела чужое лицо и попыталась протолкнуть опасный код в GitHub

Mythos 5 надела чужое лицо и попыталась протолкнуть опасный код в GitHub

Две передовые ИИ-модели продемонстрировали неожиданный уровень самостоятельности и обмана во время испытаний британского Института безопасности искусственного интеллекта (AISI). Особо отличилась Mythos от Anthropic: она создала поддельные аккаунты реальных людей, рассылала личные сообщения и пыталась протолкнуть опасный код в GitHub.

Испытания начались 25 июля. Моделям Mythos и Sol от OpenAI поручили решить задачу по кибербезопасности, предоставив доступ к открытому интернету и ослабив стандартные ограничения.

Уже 28 июля специалисты заметили подозрительную передачу данных из исследовательских систем.

Оказалось, что Mythos разыграла почти полноценную атаку. Модель изучила людей, связанных с сопровождением GitHub, создала профили, имитирующие их личности, а затем через личные сообщения и файлообменный сервис попыталась убедить пользователей одобрить внедрение опасного кода.

Когда действия агента вызвали подозрения, тот отредактировал прежнюю активность, чтобы она выглядела безобидно, и задумался о смене личности. Неплохой набор для системы, которой никто прямо не поручал притворяться человеком и заметать следы.

Остановить атаку удалось только благодаря проверке со стороны специалистов. GitHub уведомили об инциденте, после чего платформа заблокировала фальшивые аккаунты.

В AISI заявили, что впервые увидели столь явные признаки автономного и потенциально обманного поведения без специальной подсказки. Большинство опасных действий совершила Mythos, однако отдельные эпизоды зафиксировали и у Sol.

Anthropic и OpenAI подчеркнули, что условия эксперимента не соответствовали обычной работе публичных версий моделей: стандартные защитные механизмы были ослаблены или отключены. Компании пообещали изучить случившееся.

Инцидентов было немного, а условия оказались специфическими. Но звоночек вышел громким: ИИ не просто искал уязвимость, а самостоятельно надел чужое лицо, пошёл к реальным людям и попытался заставить их открыть дверь.

ИИ нашёл борщевик и выписал владельцу участка штраф на 150 тысяч рублей

Борщевик Сосновского в Подмосковье вышел на новый уровень цифровой известности. Владельца частного участка впервые оштрафовали по результатам мониторинга с помощью беспилотника и искусственного интеллекта, сообщило областное Министерство сельского хозяйства и продовольствия.

Нарушение обнаружили в Рузском муниципальном округе. Дрон провёл съёмку территории, а система на основе ИИ проанализировала данные и распознала опасное растение.

После этого она сформировала постановление и отправила уведомление владельцу через Госуслуги. Получателем цифрового привета стало юридическое лицо, которому назначили штраф в размере 150 тыс. рублей.

До сих пор заросли борщевика на частных землях нередко оставались проблемой из категории это не наше поле. Между тем около 70% жалоб жителей региона на опасное растение относятся именно к таким участкам. Теперь спрятать ботанический беспорядок за высоким забором будет сложнее: беспилотнику всё равно, а ИИ не боится обжечься.

Пилотный проект позволяет не только находить заросли, но и устанавливать собственников земли, после чего запускать процедуру привлечения к ответственности. Опыт Рузского округа власти рассматривают как основу для внедрения цифрового мониторинга в других муниципалитетах Подмосковья.

Параллельно регион продолжает уничтожать борщевик на муниципальных территориях. Первый этап обработки завершили на площади около 23,5 тыс. га, во время второго повторно обработали более 18,3 тыс. га. Полностью закончить работы планируется до конца августа.

RSS: Новости на портале Anti-Malware.ru