Борцы с погромщиками вооружились технологией распознавания лиц

Борцы с погромщиками вооружились технологией распознавания лиц

Вслед за беспорядками, обрушившихся британскую столицу на выходных в сети появилась новая Google-группа называемая “London Riots Facial Recognition”. Как сообщает ресурс techcrunch.com, цель группы состоит в том, чтобы использовать технологии распознавания лиц, чтобы идентифицировать грабителей, которые попали в объективы фотокамер и затем засветились в интернете.

Группа тщательно обсуждает и координирует каждый свой шаг в темах, озаглавленных  "Вопросы этнических меньшинств" или "Законность - принцип №1". Участники группы также настаивают на использовании информации и изображений полученных только из легальных источников

Однако есть кое-что, вызывающее реальное беспокойство, а именно то, что какая кучка людей через сеть в режиме реального времени будет  пользоваться (а может быть и злоупотреблять?) технологией распознавания лиц, в особенности, если это все будет происходить не под контролем правоохранительных органов. Все вернется к  отнюдь не добрым традициям Средних Веков - к тому, что суд будет вершить толпа, только уже не костром и пытками, а алгоритмами и разнообразными прикладными интерфейсами.

Утром в новом топике прозвучало еще одна предложение, в котором человек предлагал свою помощь в написании инструментария, использующего Face.API, который поможет идентифицировать людей на снимках, опубликованных в  Facebook, Flickr и Twitter.  Для обеспечения более высокой точности распознавания преступников обсуждается даже использование прикладных интерфейсов программирования  Facebook Graph и Twitter  в комбинации с Face.com.

Очевидно, у нас ничего нет против отдаваемых под суд преступников, но одновременно с этим остаются определенные сомнения, связанные с подобной гражданской инициативой. Согласно обсуждению этого вопроса на Hacker News, этот метод может уличать людей, не участвовавших в погромах, но ставших свидетелями указанных событий, или просто в недобрый час пытавшихся добраться до дома. Являются ли их действия здесь законными, можно или нет использовать фотографии, выложенные в интернете, главный вопрос заключается в другом– хотим ли мы совместно вершить правосудие вот таким вот образом?

London Riots Facial Recognition”. Как сообщает ресурс techcrunch.com, цель группы состоит в том, чтобы использовать технологии распознавания лиц, чтобы идентифицировать грабителей, которые попали в объективы фотокамер и затем засветились в интернете." />

Бесплатный шрифт ShieldFont научился защищать сайты от сбора данных для ИИ

Публикация текста в интернете теперь означает не только встречу с читателями, но и незваный визит ИИ-ботов, которые могут утащить материал в обучающий датасет. Просьбу не заходить через robots.txt они соблюдают не всегда, поэтому создатели ShieldFont решили действовать хитрее: пустить скрейперы внутрь и подсунуть им убедительную чепуху.

Бесплатный шрифт разработали бразильское агентство Seneda & Abrucio и датская студия Playtype.

В браузере человек видит исходный текст, а бот при анализе кода получает другую версию. Для этого ShieldFont использует механизм замены глифов OpenType, но меняет не отдельные символы, а целые слова.

Подмена происходит не хаотично. Существительные заменяются существительными, глаголы прошедшего времени — такими же глаголами, а множественное число сохраняется. Словарь разделён на 250 групп с учётом частей речи и смысловых признаков. В результате шрифт переставляет примерно четверть слов, сохраняя грамматически приличный вид текста.

 

Это нужно, чтобы отравленная версия не вылетела из обучающего набора на первом же фильтре качества. Разработчики проверили её с помощью FineWeb-Edu: около 10% фрагментов, признанных качественными до защиты, прошли отбор и после неё. Текст оставался достаточно связным для сохранения, но уже врал по существу. В 55,8% протестированных отрывков факты не совпадали с оригиналом.

Непробиваемым щитом ShieldFont всё же не стал. Если сделать скриншот страницы и распознать надписи через OCR, исходный текст можно восстановить. Есть и проблема посерьёзнее: скринридеры для незрячих тоже считывают подменённые слова. Разработчики добавили бета-функцию для передачи им оригинального текста, но вопрос доступности пока полностью не закрыт.

Сейчас ShieldFont работает только с английским языком и бесплатно доступен на GitHub.

RSS: Новости на портале Anti-Malware.ru