Cloud.ru открыл код фильтра, который не отдаст пароли и ПДн нейросети

Cloud.ru открыл код фильтра, который не отдаст пароли и ПДн нейросети

Cloud.ru открыл код фильтра, который не отдаст пароли и ПДн нейросети

Cloud.ru открыл исходный код Guardrails Filter — инструмента, который не даёт пользователям случайно скормить языковой модели персональные данные, пароли, API-ключи и другие корпоративные секреты. Компании смогут бесплатно развернуть сервис в собственной инфраструктуре и подключить его к моделям любых провайдеров.

Guardrails Filter встаёт между корпоративным приложением и нейросетью. Перед отправкой запроса он ищет конфиденциальную информацию и заменяет её синтетическими значениями.

Когда модель формирует ответ, сервис возвращает исходные данные на место. В итоге пользователь получает нормальный результат, а условный «пароль_от_прода» не отправляется неизвестно куда вместе с просьбой составить отчёт.

Инструмент уже применяется в среде AI Factory для защиты запросов к сервису Foundation Models, а также в клиентских и внутренних проектах Cloud.ru. Открытая версия не привязана к облачной платформе компании и может работать внутри закрытого ИТ-контура.

Пользователям доступны готовые правила обнаружения конфиденциальной информации. Можно создавать и собственные — например, для номеров договоров, идентификаторов клиентов или кодовых названий проектов. Управление осуществляется через личный кабинет: там разрешается настраивать и тестировать правила, просматривать журналы и отслеживать предупреждения.

В Guardrails Filter также есть Ghost Mode. Он позволяет проверить, какие данные сервис стал бы блокировать, но пока не вмешиваться в реальный трафик. Удобный режим для тех, кто не хочет включать защиту рубильником и затем выяснять, почему половина запросов внезапно исчезла.

На публичном бенчмарке pii-bench инструмент получил 93,1 балла по метрике F1. Заявленная точность срабатываний достигла 99,9% — примерно 999 из 1000 обнаружений должны быть верными.

Исходный код версий Standalone и ExtProc опубликован на GitHub и GitVerse. Теперь защищать корпоративные данные от слишком любознательных нейросетей можно собственными силами и заодно проверить, что именно происходит под капотом.

Подпишитесь на новости

Telegram превратили в пульт управления шпионским софтом HEAVYGRAM

Исследователи обнаружили 29 новых образцов HEAVYGRAM — многоступенчатого вредоноса для Windows, который охотится на журналистов, иранских диссидентов и критиков властей. Для управления заражёнными компьютерами операторы используют Telegram.

По данным исследования Group-IB, атака начинается с банальной, но рабочей социальной инженерии.

Злоумышленники представляются знакомыми или техподдержкой и присылают архивы якобы с Telegram, KeePass либо видеоредактором. Встречаются также WSF- и HTA-файлы, поддельные презентации и даже скринсейвер на персидском языке со списком отчисленных студентов.

После запуска цепочка подтягивает дополнительные компоненты через PowerShell, прописывается в автозагрузку Windows и добавляет свои каталоги в исключения Microsoft Defender. Основной имплант написан на Python и упакован с помощью PyInstaller, а для скрытого запуска может применять стороннюю загрузку DLL.


Главная фишка HEAVYGRAM — Telegram Bot API. Через ботов вредонос принимает команды, запускает произвольные инструкции в системе, делает скриншоты, собирает список процессов и отправляет украденные данные. Особенно неприятный трюк — кража файлов сессии Telegram Desktop, позволяющая угнать аккаунт без повторного ввода пароля.

Group-IB связывает кампанию с группировкой Handala Hack. Аналитики считают её интернет-персоной Void Manticore, также известной как Storm-0842 и Red Sandstorm и предположительно действующей в интересах иранской разведки.

Защитникам советуют следить за командами PowerShell, меняющими исключения Defender, ограничить запуск непроверенных скриптов и проверять подозрительные обращения к Telegram Bot API.

RSS: Новости на портале Anti-Malware.ru