Роскомнадзор тестирует систему мониторинга онлайн-изданий

Роскомнадзор тестирует систему мониторинга онлайн-изданий

Роскомнадзор начал тестирование системы автоматического мониторинга онлайн-изданий, которая должна заработать не позднее IV квартала текущего года. Об этом сообщил официальный представитель Роскомнадзора Вадим Ампелонский.

«Задача системы — поиск нецензурной брани в статьях и комментариях»,— сообщил он газете «Известия». Сегодня специалисты ведомства ищут запрещённую лексику в интернет-СМИ в ручном режиме.

Представитель ведомства добавил, что сейчас программа активно дорабатывается, функционировать в полную силу она начнёт до конца 2014 года. В данный момент специалисты составляют для неё список ключевых слов. Сначала настройки будут заданы только для поиска текстов и изображений, но не исключено, что в будущем она сможет работать с аудио и видео, сообщает russian.rt.com.

Полная стоимость создания системы оценивается в 25 млн рублей, отмечает издание. Пока программа не начала работать полноценно, специалисты Роскомнадзора в ручном режиме просматривают порядка 5 тыс. СМИ.

Вадим Ампелонский добавил, что идея системы мониторинга СМИ появилась давно. Ещё в апреле 2011 года Роскомнадзор объявил конкурс на создание системы поиска на сайтах СМИ материалов, содержащих пропаганду экстремизма, наркотиков и порнографии. Максимальная цена контракта составляла 15 млн рублей. Конкурс выиграла компания «ДатаЦентр», оценившая свою работу в 4,6 млн рублей. Однако представленное подрядчиком решение не устроило заказчика.

В феврале 2013 года Арбитражный суд Москвы постановил, что разработанный «ДатаЦентром» программно-аппаратный комплекс для мониторинга СМИ не соответствует техническому заданию и не может выполнять возложенные на него задачи. Ответчика обязали выплатить Роскомнадзору полученные 1,5 млн рублей. 

Ошибочная раскладка помогла обойти первый рубеж защиты GPT-6 Astra

Разработчик под ником vechen обнаружил странность в GPT-6 Astra: модель понимает русский и украинский текст, случайно набранный в английской раскладке, но система предварительной модерации может увидеть в нём лишь безобидную кашу из букв.

В опубликованном эксперименте GPT-6 Astra High без дополнительных инструкций распознала смысл фразы, введённой латиницей вместо кириллицы.

Затем исследователь проверил слова и запросы, которые потенциально должны привлекать внимание защитных механизмов. В одном из тестов модель согласилась помочь со взломом сайта под предлогом проверки собственного ресурса, хотя аналогичный запрос в нормальной раскладке должен проходить более строгую проверку.

Причина, предположительно, в разделении системы на несколько уровней. Сначала входной фильтр анализирует текст пользователя, после чего сама модель интерпретирует запрос и формирует ответ.

 

Впрочем, до полноценного джейлбрейка не дошло. Проверка «Код.ру» показала, что неправильная раскладка действительно может помочь опасному запросу добраться до модели, но финальный фильтр блокирует запрещённый ответ.

Метод работает не со всеми языковыми парами. Кириллический текст, набранный латиницей, Astra распознаёт стабильно, а сочетание английской и турецкой раскладок в тестах не сработало. Похожее поведение исследователь заметил и у Fable 5.

Напомним, на прошлой неделе мы писали, что первые пользователи GPT-6 Astra заметили, что модель распараллеливает задачи и нагружает компьютеры кучей процессов.

RSS: Новости на портале Anti-Malware.ru