И снова СДЭК: в даркнет выложили базу данных транспортной компании

И снова СДЭК: в даркнет выложили базу данных транспортной компании

И снова СДЭК: в даркнет выложили базу данных транспортной компании

Новая порция содержит три файла. В открытый доступ слили минимум 330 тысяч клиентов экспресс-доставки. Дамп одного документа совсем свежий, его сделали 5 июля.

В базе имена, телефоны, почтовые и электронные адреса, треки доставки и пункты самовывоза.

Про очередной слив СДЭКа накануне вечером написал Telegram-канал “Утечки информации”. Свободно скачать можно три файла.

Первый client.csv содержит полную информацию о 330 тыс. клиентов: фамилии получателя, электронки, название компании-отправителя и даже пункт самовывоза.

Второй файл contragent.csv сдаёт контрагентов СДЭКа. 30 тыс. строк с информацией о “физиках” и компаниях на русском и английском языках, телефоны, адреса и треки обновлений. Именно этот файл, судя по датам, был скопирован 5 июля.

Третий документ phone.csv касается телефонов и идентификаторов отправителя / получателя. Данные связаны с первым файлом. После удаления дублей остается почти 25 млн телефонных номеров.

Первая утечка у СДЭКа случилась в феврале. В сеть попали две таблицы с ФИО, телефонами и адресами: один файл содержал 460 млн строк, второй — 820 млн. Оператор подтвердил потерю данных, обвинив хакеров во взломе системы. Клиенты СДЭКа подали на компанию в суд и требуют компенсации. В мае база экспресс-доставки пополнила и карту утечек Яндекс.Еды, ГИБДД, Билайн и Wildberries.

Напомним, Минцифры сейчас дорабатывает законопроект о штрафах за утечки. По первому “сливу” предлагают установить фиксированную ставку, за второй прокол — оборотный штраф. Деньги могут пойти в Фонд, который будет выплачивать компенсации пострадавшим.

Зарубежные нейросети тайком учили на сотнях песен Басты, Билана и Лазарева

Российские артисты незаметно отправились обучать нейросети, сотни их песен нашли в открытых зарубежных датасетах. И нет, разрешения у правообладателей, похоже, никто не спрашивал. Аналитики Национальной федерации музыкальной индустрии изучили базы Laion-Disco-12M и Sleeping-D 9M через проект AI Watchdog журнала The Atlantic.

В них хранятся миллионы композиций с YouTube, а во втором наборе — ещё и тексты с Genius, пишут «Ведомости».

Главным преподавателем для ИИ оказался Баста: в датасетах нашли 193 и 104 его трека. Следом идут Feduk — 150 и 91 композиция, Сергей Лазарев — 144 и 118, Дима Билан — 140 и 119, а также группа «Звери» — 135 и 41. В списке засветились Леонид Агутин, Егор Крид, Ваня Дмитриенко и другие исполнители. Туда же попали десятки видеороликов с участием российских артистов.

Само наличие песни в базе ещё не доказывает, что конкретная нейросеть действительно на ней училась. Но вероятность такого сценария The Atlantic оценивает как высокую.

Представители музыкальной индустрии утверждают, что ни зарубежные, ни российские разработчики ИИ за лицензиями к ним не обращались. Рассуждения, видимо, были такие: если контент лежит в открытом интернете, значит, его будто бы можно молча забрать в учебник для алгоритма. Иногда источником могут становиться и пиратские площадки.

Тем временем легальные сделки на мировом рынке уже появляются: Warner Music договорилась с Suno, а Universal Music Group — с Udio. Но пока это редкие исключения.

По оценке НИУ ВШЭ, совокупные потери авторов и правообладателей из-за генеративного контента за 2025-2030 годы могут достигнуть 1 трлн рублей. Российская музыкальная индустрия теперь требует прозрачного лицензирования.

RSS: Новости на портале Anti-Malware.ru