Неизвестные взломали микроблог посла США и критикуют российские выборы

Неизвестные взломали микроблог посла США и критикуют российские выборы

...

Злоумышленники взломали микроблог посла США в Москве Майкла Макфола и от его имени публикуют сообщения о нелегитимности президентских выборов в России, сообщил РИА Новости представитель пресс-службы американского посольства.

В Twitter дипломата появилось сообщение о том, что "наблюдатели сообщают о большом количестве нарушений на участках по всей стране, это ставит под вопрос легитимность выборов".

"Заявление о нелегитимности выборов в РФ ложное. Господин посол этого не писал", - сказал собеседник агентства.
По его словам, сообщение было на русском языке, тогда как Макфол обычно пишет на английском, сообщает РИА новости.

Представитель посольства сообщил, что официальная реакция американского диппредставительства по этому поводу будет обнародована позже.

Макфол после прибытия в Москву встретился с рядом российских общественных деятелей и оппозиционеров. Сразу две думские фракции - "Единая Россия" и ЛДПР - осудили эту встречу на заседании Госдумы.

Ошибочная раскладка помогла обойти первый рубеж защиты GPT-6 Astra

Разработчик под ником vechen обнаружил странность в GPT-6 Astra: модель понимает русский и украинский текст, случайно набранный в английской раскладке, но система предварительной модерации может увидеть в нём лишь безобидную кашу из букв.

В опубликованном эксперименте GPT-6 Astra High без дополнительных инструкций распознала смысл фразы, введённой латиницей вместо кириллицы.

Затем исследователь проверил слова и запросы, которые потенциально должны привлекать внимание защитных механизмов. В одном из тестов модель согласилась помочь со взломом сайта под предлогом проверки собственного ресурса, хотя аналогичный запрос в нормальной раскладке должен проходить более строгую проверку.

Причина, предположительно, в разделении системы на несколько уровней. Сначала входной фильтр анализирует текст пользователя, после чего сама модель интерпретирует запрос и формирует ответ.

 

Впрочем, до полноценного джейлбрейка не дошло. Проверка «Код.ру» показала, что неправильная раскладка действительно может помочь опасному запросу добраться до модели, но финальный фильтр блокирует запрещённый ответ.

Метод работает не со всеми языковыми парами. Кириллический текст, набранный латиницей, Astra распознаёт стабильно, а сочетание английской и турецкой раскладок в тестах не сработало. Похожее поведение исследователь заметил и у Fable 5.

Напомним, на прошлой неделе мы писали, что первые пользователи GPT-6 Astra заметили, что модель распараллеливает задачи и нагружает компьютеры кучей процессов.

RSS: Новости на портале Anti-Malware.ru