Минцифры приступило к разработке порядка сбора датасетов у бизнеса

Минцифры приступило к разработке порядка сбора датасетов у бизнеса

Минцифры приступило к разработке порядка сбора датасетов у бизнеса

Минцифры в рамках реализации требований закона об обезличивании персональных данных начало работу над регламентацией порядка сбора властями таких датасетов у бизнес-структур. Перечень оснований уже находится на стадии черновика.

По данным «Коммерсанта», документ вышел 30 октября. Речь идет о черновике распоряжения правительства, которое устанавливает перечень оснований для запроса ведомствами данных у компаний.

Всего их шесть, в том числе чрезвычайные ситуации природного и техногенного характера, а также социальные исследования для нужд госуправления.

Требование для компаний передавать правительству наборы обезличенных данных содержит закон 233-ФЗ о порядке оборота обезличенных персональных данных.

Бизнес также получит возможность анализировать собранные датасеты, не покидая периметра государственной системы, где они хранятся. Однако их выгрузка запрещена.

Пресс-служба Ассоциации больших данных в комментарии для «Коммерсанта» увидела в нынешней редакции проекта распоряжения риски избыточных затрат на широкий спектр запросов и компрометации данных клиентов операторов персональных данных:

«Процедура запросов и цели/методы объединения данных должны быть конкретизированы для каждого конкретного случая и проходить процедуры оценки риска деобезличивания и обсуждений с участием специалистов в области обезличивания и бизнес-сообщества».

Эксперты, которых опросило издание, также указывали на риски: правительство будет иметь право запрашивать у бизнеса любые данные. Нормативная база же должна устанавливать четкие правила игры с учетом интересов всех сторон.

В самом Минцифры заверили «КоммерсантЪ», что черновик от 30 октября не является итоговой версией и он будет серьезно доработан. Кроме того, представители ведомства пообещали сделать так, чтобы реализация требований не привела к значительным затратам для бизнеса.

Зачем Яндекс Go создал отдельный язык для расчёта стоимости поездок

Цена поездки в Яндекс Go — это не расстояние, умноженное на минуты и километры. В расчёт вмешиваются геозоны, спрос, скидки, платные дороги, дополнительные остановки и требования вроде перевозки кота, велосипеда или лыж. Чтобы управлять этим хозяйством без бесконечных деплоев, разработчики вынесли алгоритм ценообразования из кода сервиса в собственный язык.

Как объяснили разработчики в статье на Хабре, прайсинг работает не только при заказе машины.

Он пересчитывает стоимость при смене маршрута или способа оплаты, завершении поездки, обращении в поддержку и проверке данных аналитиками. Цена при этом может быть фиксированной, интервальной или считаться по таксометру.

 

Сначала сервисы параллельно собирают параметры поездки: тарифную категорию, геозоны, скидки, повышенный спрос и дополнительные услуги. Зависимости между источниками выстраиваются в граф, а запросы выполняются асинхронно на базе userver. Если некритичный источник не ответил, весь расчёт не падает.

 

Сам алгоритм раньше можно было бы держать в C++, но он меняется в среднем дважды в неделю. Выкатка сервиса на 50 подов занимает около 40 минут, а лес динамических конфигов быстро превратил бы код в музей условных операторов.

Поэтому Яндекс разработал собственный DSL. В нём есть условия, функции, неизменяемые значения и fold вместо циклов. Правила собираются в последовательную цепочку: каждое преобразование получает текущую цену и параметры, а возвращает новый результат с метаданными. Грамматику описали через ANTLR 4, а верификатор Z3 проверяет, что программа не выдаст некорректную цену.

 

Теперь изменение алгоритма не требует пересборки сервиса, ошибочную версию можно быстро откатить, а каждый расчёт — воспроизвести по входным данным и промежуточным результатам.

 

В итоге прайсинг превратился в отдельную платформу, которой уже пользуются Такси, Доставка и сервис зарядки электромобилей.

RSS: Новости на портале Anti-Malware.ru