Бесплатный шрифт ShieldFont научился защищать сайты от сбора данных для ИИ

Бесплатный шрифт ShieldFont научился защищать сайты от сбора данных для ИИ

Бесплатный шрифт ShieldFont научился защищать сайты от сбора данных для ИИ

Публикация текста в интернете теперь означает не только встречу с читателями, но и незваный визит ИИ-ботов, которые могут утащить материал в обучающий датасет. Просьбу не заходить через robots.txt они соблюдают не всегда, поэтому создатели ShieldFont решили действовать хитрее: пустить скрейперы внутрь и подсунуть им убедительную чепуху.

Бесплатный шрифт разработали бразильское агентство Seneda & Abrucio и датская студия Playtype.

В браузере человек видит исходный текст, а бот при анализе кода получает другую версию. Для этого ShieldFont использует механизм замены глифов OpenType, но меняет не отдельные символы, а целые слова.

Подмена происходит не хаотично. Существительные заменяются существительными, глаголы прошедшего времени — такими же глаголами, а множественное число сохраняется. Словарь разделён на 250 групп с учётом частей речи и смысловых признаков. В результате шрифт переставляет примерно четверть слов, сохраняя грамматически приличный вид текста.

 

Это нужно, чтобы отравленная версия не вылетела из обучающего набора на первом же фильтре качества. Разработчики проверили её с помощью FineWeb-Edu: около 10% фрагментов, признанных качественными до защиты, прошли отбор и после неё. Текст оставался достаточно связным для сохранения, но уже врал по существу. В 55,8% протестированных отрывков факты не совпадали с оригиналом.

Непробиваемым щитом ShieldFont всё же не стал. Если сделать скриншот страницы и распознать надписи через OCR, исходный текст можно восстановить. Есть и проблема посерьёзнее: скринридеры для незрячих тоже считывают подменённые слова. Разработчики добавили бета-функцию для передачи им оригинального текста, но вопрос доступности пока полностью не закрыт.

Сейчас ShieldFont работает только с английским языком и бесплатно доступен на GitHub.

Yandex Cloud поможет «СОГАЗу» и «Ингосстраху» оценивать киберриски

«СОГАЗ» и «Ингосстрах» вместе с Yandex B2B Tech запустили программы киберстрахования для бизнеса. Страховщики отвечают за финансовую защиту, а Yandex Cloud проверяет облачную инфраструктуру клиента и помогает понять, на каких условиях ему можно выдать полис.

Оценка проводится с помощью Yandex Security Deck. Сервис автоматически анализирует облачные ресурсы, приложения и данные: ищет открытые внутренние сведения, избыточные права пользователей, риски утечек и возможной компрометации инфраструктуры.

Обнаруженные проблемы собираются в одном интерфейсе и ранжируются по приоритету. Результаты получает сам клиент. Он может передать отчёт страховой компании, которая использует его при расчёте условий полиса. Если проверка обнаружит серьёзные дыры, Yandex Cloud предложит способы их закрыть.

Такой подход должен заменить традиционную анкету, которую бизнес заполняет вручную. Бумага, как известно, терпит всё: в ней можно забыть лишнего администратора или не заметить открытое хранилище. Автоматическая проверка показывает актуальное состояние облачной инфраструктуры и даёт страховщику больше данных для оценки риска.

Интерес к киберстрахованию тем временем растёт. По данным «СОГАЗа», за первое полугодие 2026 года совокупный объём страховой защиты от киберрисков, запрошенной клиентами компании, удвоился год к году и превысил 12 млрд рублей.

В результате бизнесу предлагают комплект из трёх деталей: диагностики, технической защиты и компенсации ущерба при инциденте. Страховщики получают более точную картину рисков, а клиент — шанс узнать о дыре в облаке до того, как её найдут злоумышленники. Потому что страховой полис — вещь полезная, но незакрытый бакет он всё-таки не починит.

RSS: Новости на портале Anti-Malware.ru