SearchInform усилила защиту от кражи данных паспортов и банковских карт

SearchInform усилила защиту от кражи данных паспортов и банковских карт

SearchInform усилила защиту от кражи данных паспортов и банковских карт

Компания SearchInform расширила функциональность DLP-системы «Контур информационной безопасности» с помощью технологий распознавания текстов компании ABBYY. Благодаря нововведению, система способна точнее определить в цифровом потоке изображения паспортов, банковских карт, других конфиденциальных документов и данных. 

Новый инструмент, основанный на технологии оптического распознавания текстов (OCR), самостоятельно классифицирует файлы, выделяя среди них персональные данные, которые циркулируют внутри компании. Встроенные классификаторы ABBYY помогают определить любые другие документы установленных образцов: водительские удостоверения, служебные пропуска, дипломы об образовании и др. 

По оценке аналитиков SearchInform, объем сканированных копий в среднем составляет около 30% всех документов. К примеру, в госсекторе сканированные копии составляют около 41,5% документов, в ритейле – 17%, в сфере услуг – 23%, а в банках и телеком-сфере приближаются к 45%. Технология OCR контролирует движение электронных версий документов в корпоративной сети и снижает риск утечек информации.

Раньше DLP-система SearchInform была по умолчанию оснащена технологией OCR другого производителя. Сейчас в модуле SearchServer в качестве движка полнотекстового распознавания используется ABBYY FineReader Engine. Технологии распознавания текстов и алгоритмы классификации изображений компании ABBYY уменьшают необходимость ручной обработки за счет автоматического определения типов персональных данных. Такой способ позволяет провести ретроспективный анализ.

«ABBYY FineReader Engine отличается большой точностью распознавания текста, в чем мы убедились, проведя ряд собственных тестов, – сравнили решение ABBYY и другого разработчика.  ABBYY совершает на 10-12% меньше ошибок при распознании обычного текста и на 30% меньше в работе со сложными изображениями», – прокомментировал Иван Мершков, технический директор SearchInform.

Алгоритмы ABBYY по максимуму используют возможности современных процессоров. Некоторые задачи ABBYY выполняет в 3-4 раза быстрее стандартного OCR, повышая качество распознавания. Разница заметна при обработке многостраничных документов или изображений высокого разрешения. На практике это означает, что в компании повышается защита от профессиональных инсайдеров, которые знакомы с механизмами работы DLP-систем и основательно прячут документы.

«Компаниям крайне важно контролировать данные, связанные с коммерческой тайной или конфиденциальной информацией клиентов. Возможность автоматически выявлять критически важные для бизнеса данные даже в потоке изображений стала неотъемлемой частью современных DLP-систем. С помощью возможностей решения ABBYY, интегрированного в систему SearchInform, компании могут еще эффективнее предотвращать утечки в формате изображений», – отметил Дмитрий Шушкин, заместитель генерального директора ABBYY Россия.

Зачем Яндекс Go создал отдельный язык для расчёта стоимости поездок

Цена поездки в Яндекс Go — это не расстояние, умноженное на минуты и километры. В расчёт вмешиваются геозоны, спрос, скидки, платные дороги, дополнительные остановки и требования вроде перевозки кота, велосипеда или лыж. Чтобы управлять этим хозяйством без бесконечных деплоев, разработчики вынесли алгоритм ценообразования из кода сервиса в собственный язык.

Как объяснили разработчики в статье на Хабре, прайсинг работает не только при заказе машины.

Он пересчитывает стоимость при смене маршрута или способа оплаты, завершении поездки, обращении в поддержку и проверке данных аналитиками. Цена при этом может быть фиксированной, интервальной или считаться по таксометру.

 

Сначала сервисы параллельно собирают параметры поездки: тарифную категорию, геозоны, скидки, повышенный спрос и дополнительные услуги. Зависимости между источниками выстраиваются в граф, а запросы выполняются асинхронно на базе userver. Если некритичный источник не ответил, весь расчёт не падает.

 

Сам алгоритм раньше можно было бы держать в C++, но он меняется в среднем дважды в неделю. Выкатка сервиса на 50 подов занимает около 40 минут, а лес динамических конфигов быстро превратил бы код в музей условных операторов.

Поэтому Яндекс разработал собственный DSL. В нём есть условия, функции, неизменяемые значения и fold вместо циклов. Правила собираются в последовательную цепочку: каждое преобразование получает текущую цену и параметры, а возвращает новый результат с метаданными. Грамматику описали через ANTLR 4, а верификатор Z3 проверяет, что программа не выдаст некорректную цену.

 

Теперь изменение алгоритма не требует пересборки сервиса, ошибочную версию можно быстро откатить, а каждый расчёт — воспроизвести по входным данным и промежуточным результатам.

 

В итоге прайсинг превратился в отдельную платформу, которой уже пользуются Такси, Доставка и сервис зарядки электромобилей.

RSS: Новости на портале Anti-Malware.ru