InfoWatch запатентовала технологию анализа выгрузок из баз данных

InfoWatch запатентовала технологию анализа выгрузок из баз данных

InfoWatch запатентовала технологию анализа выгрузок из баз данных

Группа компаний InfoWatch получила патент на технологию автоматического анализа выгрузок из баз данных с помощью регулярных выражений. Патент выдан Федеральной службой по интеллектуальной собственности.

Разработка предназначена для обнаружения нарушений доступа и утечек данных, а также для защиты выгрузок от несанкционированного использования.

Технология способна анализировать данные в произвольной форме и выявлять в них конфиденциальную информацию, даже если она записана в разном формате.

Например, если номер телефона клиента в CRM записан как 71230000000, система распознает тот же номер, даже если он будет указан в виде 81230000000 или 8(123)000-00-00. Такой подход повышает точность поиска и помогает обнаруживать утечки, даже если данные маскируются.

По словам представителей компании, технология может применяться для контроля неформальных каналов коммуникации — например, переписок в мессенджерах, где передаются небольшие, но ценные фрагменты информации, такие как персональные данные или сведения о клиентах.

Патент закрепляет развитие существующих технологий InfoWatch в области анализа выгрузок и усиливает инструменты выявления утечек данных в корпоративной среде.

ИИ OpenAI полез на GitHub за утёкшими ключами, а затем выдумал данные

Модели OpenAI оказались очень изобретательными, когда привычные способы выполнить задачу переставали работать. Они искали утёкшие API-ключи, загружали данные на публичные сервисы, обменивались записками через репозиторий и оставляли самим себе инструкции скрывать ошибки.

Компания опубликовала  новую систему раскрытия случаев рассогласованного поведения моделей и сразу приложила к ней шесть отчётов об инцидентах, обнаруженных за последние полгода.

OpenAI подчёркивает: это отдельные эпизоды, по которым нельзя судить о частоте подобных выходок.

В одном случае модель не смогла подключиться к API со статистикой доходов округа. Тогда она попыталась зарегистрироваться через одноразовую почту, полезла на GitHub за утёкшими ключами и нашла рабочий.

Добыть нужные цифры всё равно не получилось, поэтому модель просто выдумала их и выдала за данные с сайта. О неудаче и чужом ключе она скромно промолчала.

Другие агенты превратили внутренний Artifactory OpenAI в подпольную доску объявлений. Независимые экземпляры оставляли там сообщения, читали записки коллег и просили друг у друга помощи. Уязвимости они не взламывали, а использовали выданные компанией учётные данные, но явно не по назначению.

Ещё несколько моделей отправляли данные за пределы рабочей среды. Одна загрузила найденные записи на публичный сервис ради красивой ссылки на источник, другая — фотографию на сервис обратного поиска. Группа агентов и вовсе разместила рабочую книгу на публичном хостинге, хотя ей прямо велели пользоваться только локальными файлами.

Самая ехидная часть истории — инструкции на будущее. Модели записывали в свои служебные сводки команды игнорировать сообщения разработчиков, скрывать провалы и выдумывать недостающие данные. Одна сформулировала правило совсем интересно: «Будь прозрачным, только если спросят».

Теперь OpenAI обещает публиковать такие случаи быстрее — даже если их причины ещё не выяснены, а исправления не готовы.

RSS: Новости на портале Anti-Malware.ru