Microsoft подтвердила возможную утечку данных клиентов поддержки

Microsoft подтвердила возможную утечку данных клиентов поддержки

Microsoft подтвердила возможную утечку данных клиентов поддержки

Microsoft рассказала о возможной утечке информации из базы данных поддержки клиентов. По словам корпорации, инцидент произошёл в декабре 2019 года. Из-за ошибки сотрудников база находилась в Сети незащищенной с 5 по 31 декабря.

В своём блоге техногигант объяснил, что в БД хранились обезличенные аналитические данные.

Первым на проблему обратил внимание известный исследователь в области кибербезопасности Боб Дьяченко. Он же сообщил Microsoft об открытой БД.

Кластер из пяти серверов Elasticsearch — именно в таком виде существовала база данных клиентской поддержки. Как правило, такая технология применяется для упрощения операций поиска. Все пять серверов хранили одни и те же данные, то есть были зеркалами друг друга.

В общей сумме в БД присутствовали 250 миллионов записей, содержащих следующую информацию: адреса электронной почты, IP-адреса, детали обращения в поддержку. В Microsoft утверждают, что в большинстве записей не было персональных данных пользователей.

В качестве меры предосторожности корпорация уведомит всех затронутых пользователей, однако техногигант подчеркнул, что никаких доказательств использования этой информации в злонамеренных целях нет.

По словам Дьяченко, Microsoft закрыла доступ к базе данных в тот же день, когда он сообщил о проблеме.

Зарубежные нейросети тайком учили на сотнях песен Басты, Билана и Лазарева

Российские артисты незаметно отправились обучать нейросети, сотни их песен нашли в открытых зарубежных датасетах. И нет, разрешения у правообладателей, похоже, никто не спрашивал. Аналитики Национальной федерации музыкальной индустрии изучили базы Laion-Disco-12M и Sleeping-D 9M через проект AI Watchdog журнала The Atlantic.

В них хранятся миллионы композиций с YouTube, а во втором наборе — ещё и тексты с Genius, пишут «Ведомости».

Главным преподавателем для ИИ оказался Баста: в датасетах нашли 193 и 104 его трека. Следом идут Feduk — 150 и 91 композиция, Сергей Лазарев — 144 и 118, Дима Билан — 140 и 119, а также группа «Звери» — 135 и 41. В списке засветились Леонид Агутин, Егор Крид, Ваня Дмитриенко и другие исполнители. Туда же попали десятки видеороликов с участием российских артистов.

Само наличие песни в базе ещё не доказывает, что конкретная нейросеть действительно на ней училась. Но вероятность такого сценария The Atlantic оценивает как высокую.

Представители музыкальной индустрии утверждают, что ни зарубежные, ни российские разработчики ИИ за лицензиями к ним не обращались. Рассуждения, видимо, были такие: если контент лежит в открытом интернете, значит, его будто бы можно молча забрать в учебник для алгоритма. Иногда источником могут становиться и пиратские площадки.

Тем временем легальные сделки на мировом рынке уже появляются: Warner Music договорилась с Suno, а Universal Music Group — с Udio. Но пока это редкие исключения.

По оценке НИУ ВШЭ, совокупные потери авторов и правообладателей из-за генеративного контента за 2025-2030 годы могут достигнуть 1 трлн рублей. Российская музыкальная индустрия теперь требует прозрачного лицензирования.

RSS: Новости на портале Anti-Malware.ru