Google начала удалять персональные данные из поисковика

Google начала удалять персональные данные из поисковика

Google вчера заявила о том, что начала удалять из своего поискового индекса персональные данные европейцев в рамках недавно вступившего в силу закона о «праве быть забытым». Соответствующий закон был принят в Брюсселе еще в мае. В компании сообщили о том, что инженеры Google минувшей ночью обновили технологическую систему поддержки поисковика, что позволило удалять персональные электронные адреса из индекса, а также имена людей.

В Google говорят, что компания пока обработала «небольшое количество» заявок. В начале июня интернет-гигант сообщил о том, что Google получила более 41 000 запросов на удаление ссылок, связанных с персональной информацией жителей Европейского Союза. Это число набежало за три недели, прошедших с момента принятия Европейским судом директивы о так называемом «праве быть забытым». 13 мая суд обязал Google удалить ссылки на заметку в испанской газете, где говорилось об уголовном процессе в отношении местного 58-летнего юриста. Ранее газета признала недостоверность информации и аннулировала статью, сообщает cybersecurity.ru.

А вот у Google информация в поисковом индексе осталась. Суд счел, что интернет-гигант нарушает право на тайну частной жизни и потребовал удаления ссылок. В ответ на запрос в Google была создана специальная веб-страница с формой, воспользовавшись которой частное лицо может указать ссылки. Норма работает только в Евросоюзе. Ранее в Google сообщили, что компания получила 12 000 запросов всего за первые сутки.

В Брюсселе заявили, что 41 000 запросов — это «хорошее число» и что ведомство в целом удовлетворено тем, как Google работает в данном направлении. Питер Гастингс, глава EDPS (European Data Protection Supervisor), говорит что он приветствует действия Google и считает, что подобным образом итернет-поисковик «станет ближе к потребителю и будет лучше учитывать его нужды». Впрочем, и в самой Европе нет единства о том, что нужно сделать чтобы удалять данные.

В Google говорят, что для запроса на удаление данных о себе пользователь должен предоставить свое полное имя, адрес, телефон и фото, так как в противном случае компанию захлестнет волна поддельных запросов. Немецкий комиссар по безопасности данных Йоханнес Каспар говорит, что компания Google убирает ссылки на пользовательские данные, но в обмен на это получает кладезь персональной информации о самих пользователей из их же рук, что вызывает определенные опасения.

Бигтех в России просит открыть обезличенные данные граждан для обучения ИИ

Российскому ИИ не хватает данных, а закон, по мнению бигтеха, держит их под замком. Ассоциация больших данных, в которую входят «Авито», «Сбер», «Ростелеком», «Яндекс», HH и VK, попросила Минцифры упростить использование обезличенной персональной информации для разработки и обучения нейросетей.

Сейчас любое алгоритмическое преобразование персональных данных считается обезличиванием.

Даже если технология практически исключает возможность установить личность человека, полученный массив всё равно остаётся персональными данными со всеми сопутствующими ограничениями. Защита вроде бы сработала, а юридический хвост никуда не делся.

АБД, по данным КоммерсантЪ, предлагает выделить технологии повышения приватности — Privacy Enhancing Technologies, или PETs — в отдельную категорию. Они позволяют обрабатывать, передавать и хранить информацию без раскрытия личности. Если риск идентификации равен нулю или составляет малые доли процента, такие данные предлагается использовать для ИИ без согласия граждан.

Обработка при этом должна проходить в России, российскими компаниями и только для разработки, обучения и применения ИИ. Кроме того, ассоциация предлагает ввести доверенных посредников — аккредитованные организации, которые будут хранить обезличенные массивы и предоставлять к ним доступ. Данные также хотят разделить на бесплатные, необходимые для исполнения закона, и платные — для коммерческих задач.

Участники рынка объясняют инициативу просто: российских датасетов мало, а большая их часть заперта внутри крупных экосистем. Собственные и партнёрские массивы уже не закрывают аппетиты современных моделей, особенно специализированных корпоративных решений.

Альтернативой остаются синтетические данные — искусственно созданные наборы без сведений о реальных людях. Но полностью заменить ими отраслевую статистику, поведенческие закономерности и другие ценные выборки получится не всегда.

Теперь мяч у Минцифры, которое на обращение пока не ответило. Бигтех тем временем даёт понять: без свежих данных российский ИИ далеко не уедет, сколько вычислительных мощностей ему ни подбрасывай.

RSS: Новости на портале Anti-Malware.ru