В 2020 году утекло около 100 млн персональных данных россиян

В 2020 году утекло около 100 млн персональных данных россиян

В 2020 году утекло около 100 млн персональных данных россиян

По данным исследователей из компании InfoWatch, за 2020 год в Сеть слили около 100 миллионов записей персональных данных и платёжной информации россиян. В отчёте специалисты назвали наиболее частых виновников утечек и обозначили долю умышленной компрометации сведений.

Как объяснили сотрудники InfoWatch, чаще всего в утечках данных граждан виноваты сотрудники компаний (80% случаев). При этом доля умышленной компрометации информации со стороны персонала подросла, теперь она занимает приблизительно три четверти подобных инцидентов.

По словам исследователей, за год в России утекло около 100 млн записей данных россиян, в мировом масштабе эта цифра гораздо больше — в районе 11 млрд записей. Таким образом, российские утечки составляют лишь около 1% от глобальных сливов информации.

В России при этом утечками больше других отличились сферы высоких технологий и финансов, а также государственный сектор. Глобальная картина не сильно отличается — на первом и втором месте сферы высоких технологий и здравоохранения, замыкает тройку госсектор.

В InfoWatch указали, что удалённая работа, организованная сплошь и рядом в период пандемии, не могла не сказаться на утечках информации — они ушли в серую зону и не фиксировались защитными системами.

На «удалёнке» сотрудники использовали незащищённые личные компьютеры и маршрутизаторы, чем добавили несколько векторов утечки данных.

Права авторов при обучении ИИ уточнят в подзаконных актах осенью

Новый закон о поддержке развития искусственного интеллекта не отменяет Гражданский кодекс и не превращает произведения авторов в бесплатный корм для нейросетей. Об этом заявила советник президента России Елена Ямпольская. Закон, подписанный президентом 26 июля, разрешает использовать общедоступные и правомерно опубликованные материалы для обучения российских алгоритмов ИИ.

Однако правообладатель может закрыть свои работы от такой обработки техническими средствами. Бесконтрольно загружать в модели всё, до чего дотянулся парсер, нельзя.

Как именно будет работать этот механизм, пока предстоит решить. Подзаконные акты, по данным «Ведомостей», начнут появляться осенью. При их подготовке власти обещают учесть опасения творческих отраслей, представители которых предупреждали об обесценивании интеллектуальной собственности.

Эксперты тем временем предлагают несколько способов помирить нейросети с авторами. Среди них — отказ от использования произведений по требованию правообладателя, коллективное лицензирование и отчисление части прибыли ИИ-продуктов в компенсационный фонд.

В РАНХиГС считают, что разработчиков генеративных моделей стоит обязать вести закрытые реестры обучающих данных и показывать их регуляторам. Так можно будет понять, чьи произведения попали в датасет, не раскрывая коммерческую тайну.

Юрист Михаил Семенов предлагает разделять сценарии. Если модель копирует голос актёра, манеру художника или тексты конкретного писателя, потребуется прямой договор и выплаты. При массовом обучении на миллиардах материалов искать каждого автора нереально — здесь пригодился бы аналог авторского общества для ИИ.

В отрасли есть и более жёсткий взгляд: чрезмерные ограничения могут ударить и по экономике, и по культуре. Поэтому властям предстоит настроить систему так, чтобы модели не остались голодными, а авторы — с красивым обещанием вместо денег.

RSS: Новости на портале Anti-Malware.ru