Пермские ученые разработали фильтр для «враждебного» контента

Пермские ученые разработали фильтр для «враждебного» контента

Ученые Пермского государственного национального исследовательского университета (ПГНИУ) разработали программу для фильтрации в интернете противоправного контента — экстремистских и оскорбительных высказываний, сообщает пресс-служба вуза.

В настоящее время в рунете, по данным проведенного учеными анализа веб-текстов разных стран, господствует речевой терроризм. Чило таких нарушений в российском интернете гораздо выше, чем на форумах Германии и Польши. Так, около 26% комментариев в публичном секторе рунета содержат экстремистские или оскорбительные высказывания.

Аспирантка кафедры речевой коммуникации ПГНИУ Евгения Мехонина и ассистент этой кафедры Лиана Ермакова предложили инструмент фильтрации противоправного контента — инновационную программу FILTEX, с помощью которой любой пользователь сможет избавиться от противоправного контента в социальных сетях и блогах. Программа была разработана под руководством доктора филологических наук Владимира Салимовского и кандидата технических наук Даниила Курушина, сообщает digit.ru.

«Главное отличие FILTEX от других программ — технология распознавания противоправного контента. Мы используем подход известного профессора ПГНИУ Маргариты Николаевны Кожиной — подход системности речи. Он состоит в том, что на всех уровнях языка (лексическом, морфологическом, синтаксическом и других) можно выделить черты, признаки враждебности. Их можно формализовать при помощи математических методов, то есть представить в виде, понятном для машины», — приводятся в сообщении слова Мехониной.

Разработчики полагают, что этой программой можно будет воспользоваться как приложением в социальных сетях, а организации получат доступ к программе через веб-сервис. Потенциальные пользователи FILTEX — блогеры и политики, СМИ и другие организации, желающие очистить свои сайты от противоправных комментариев.

«В настоящее время у нас создан исследовательский прототип, пока нет интерфейса. Программа пока лишь помечает в тексте нужные части (противоправные высказывания). Планируется, что в будущем, по нашей задумке, программа будет, скорее всего, удалять такие предложения. Но мы будет учитывать и мнение пользователей, хотим, чтобы ее функции зависели от самой страницы, на которой она используется. То есть, чтобы были варианты: либо программа будет совсем удалять негативный текст, либо, к примеру, вообще не даст вводить его», — сказала РИА Новости Мехонина.

По ее словам, коллеги из пермского университета и других вузов страны работают в этом направлении, и уже есть подобные решения. Но никто ранее не использовал подход системности речи, а он наиболее полный. Уже весной лингвисты намерены подготовить первую пользовательскую версию разработки.

«Примерно к весне, к марту-апрелю, мы рассчитываем создать первую версию интерфейса программы, а к лету выйдем на контакт с провайдерами для продвижения разработки», — заключила Мехонина.

В настоящее время Евгения Мехонина и Лиана Ермакова уже получили свидетельства о регистрации интеллектуальной собственности на свою программу. 

 

Linux 7.1 может наконец сделать NTFS по-настоящему родной файловой системой

В Linux 7.1 намечается заметное обновление, которое особенно оценят те, кто живёт на два мира — Linux и Windows. В ядро уже влит новый драйвер NTFS, и это одна из самых важных, хотя и не самых громких, перемен в файловой подсистеме за последние годы. Сам Линус Торвальдс назвал это воскрешением NTFS.

Вся соль в том, что Linux наконец получает более современную встроенную поддержку NTFS — файловой системы, на которой по умолчанию живёт Windows.

До сих пор с ней всё было либо терпимо, либо просто неудобно: старый драйвер в ядре долгое время умел в основном читать NTFS-разделы, NTFS-3G работал через FUSE и проигрывал по скорости, а более новый NTFS3, хотя и был быстрее, за последние годы успел заработать репутацию решения без слишком активного развития.

Новый драйвер делает ставку не просто на поддержку NTFS, а на более нативную работу внутри самого ядра Linux. В документации ядра прямо сказано, что он обеспечивает полноценную поддержку чтения и записи, рассчитан на высокую производительность и использует современные механизмы вроде iomap и folio.

За разработкой стоит Намджэ Чон — тот же девелопер, который раньше занимался драйвером exFAT для Linux. По данным LKML, он работал над этим направлением около четырёх лет.

На бумаге всё выглядит очень бодро. В обсуждении патчей и публикациях о слиянии упоминается, что однопоточная запись стала быстрее примерно на 3–5%, многопоточная — на 35–110%, а монтирование 4-терабайтного диска ускорилось примерно в четыре раза по сравнению с NTFS3. Кроме того, новый драйвер уже проходит больше тестов xfstests, чем NTFS3: 326 против 273.

Правда, без оговорок тут не обошлось. Это всё-таки новый код, так что в первых релизах вполне возможны шероховатости, особенно в каких-то менее популярных особенностях NTFS. Да и сама NTFS остаётся файловой системой из мира Windows, так что полностью вести себя как ext4 или XFS под Linux она всё равно не начнёт. Но сам вектор выглядит приятным: в ядре Linux эту тему наконец решили делать всерьёз, а не по остаточному принципу.

RSS: Новости на портале Anti-Malware.ru