Алжирские хакеры перепутали цели

Алжирские хакеры перепутали цели

Алжирские хакеры, перепутав цель, вместо сайта крепости Бивор в Израиле взломали сайт английского замка Бивор в Лестершире. Подвело знание географии.

Кибер-муджахеды, из неизвестной ранее группировки Dz-SeC, взломали сайт Замка Бивор с целью поместить антисионистские лозунги рядом с изображением алжирского национального флага.

Немного истории: крепость Бивор в Израиле была аванпостом христианского движения во время крестовых походов, а замок Бивор был королевской крепостью во время гражданской войны в Англии. Сейчас там проводится ежегодный фестиваль «плюшевых медведей».

Как считают представители замка, то, что хакеры хотели взломать сайт крепости в Израиле, а не замок в Лестершире имеет какой-то смысл. Ничего общего с ближним востоком у них нет, они просто организуют фестиваль.

Последствия взлома сайта были устранены и сайт работает в нормальном режиме.

Ошибочная раскладка помогла обойти первый рубеж защиты GPT-6 Astra

Разработчик под ником vechen обнаружил странность в GPT-6 Astra: модель понимает русский и украинский текст, случайно набранный в английской раскладке, но система предварительной модерации может увидеть в нём лишь безобидную кашу из букв.

В опубликованном эксперименте GPT-6 Astra High без дополнительных инструкций распознала смысл фразы, введённой латиницей вместо кириллицы.

Затем исследователь проверил слова и запросы, которые потенциально должны привлекать внимание защитных механизмов. В одном из тестов модель согласилась помочь со взломом сайта под предлогом проверки собственного ресурса, хотя аналогичный запрос в нормальной раскладке должен проходить более строгую проверку.

Причина, предположительно, в разделении системы на несколько уровней. Сначала входной фильтр анализирует текст пользователя, после чего сама модель интерпретирует запрос и формирует ответ.

 

Впрочем, до полноценного джейлбрейка не дошло. Проверка «Код.ру» показала, что неправильная раскладка действительно может помочь опасному запросу добраться до модели, но финальный фильтр блокирует запрещённый ответ.

Метод работает не со всеми языковыми парами. Кириллический текст, набранный латиницей, Astra распознаёт стабильно, а сочетание английской и турецкой раскладок в тестах не сработало. Похожее поведение исследователь заметил и у Fable 5.

Напомним, на прошлой неделе мы писали, что первые пользователи GPT-6 Astra заметили, что модель распараллеливает задачи и нагружает компьютеры кучей процессов.

RSS: Новости на портале Anti-Malware.ru