В Сеть попали данные Яндекс.Практикум, включая Яндекс ID

В Сеть попали данные Яндекс.Практикум, включая Яндекс ID

В Сеть попали данные Яндекс.Практикум, включая Яндекс ID

Информация об очередном сливе появилась накануне вечером. Образовательный сервис подтвердил утечку. В компании заявляют, что платежные данные и пароли пользователей не пострадали.

Первым о слитой базе сервиса Яндекс.Практикум, как и в последних подобных случаях, написал Telegram-канал «Утечки информации». Позднее эту информацию официально подтвердили в компании:

«Мы проводим внутреннее расследование и проверяем актуальность данных, — заявили в пресс-службе. — Никакие платежные данные или пароли пользователей не скомпрометированы».

Файл с фамилиями, адресами электронной почты и номерами телефонов содержит 300 тысяч строк. Ашот Оганесян из “Утечек” пишет: фрагмент слитой базы содержит Яндекс ID, уникальный идентификатор для входа в единый аккаунт всех сервисов компании.

Яндекс.Практикум — международная платформа онлайн-образования, запущенная три года назад. Обучение проходит в собственной технологической среде. Сервис предлагает курсы по ИТ для новичков и продвинутых специалистов.

Последние два месяца стали пиковыми для сливов ПДн многочисленных сервисов. Мы писали о персональном антирекорде мая — за 30 дней в даркнет попало 50 баз. Сценарий примерно один: сначала про утечку пишет Telegram-канал, затем её официально подтверждает компания. Так было с данными образовательного портала GeekBrains и службы доставки Delivery Club. Утверждается, что ко взлому причастен один и тот же источник.

Зарубежные нейросети тайком учили на сотнях песен Басты, Билана и Лазарева

Российские артисты незаметно отправились обучать нейросети, сотни их песен нашли в открытых зарубежных датасетах. И нет, разрешения у правообладателей, похоже, никто не спрашивал. Аналитики Национальной федерации музыкальной индустрии изучили базы Laion-Disco-12M и Sleeping-D 9M через проект AI Watchdog журнала The Atlantic.

В них хранятся миллионы композиций с YouTube, а во втором наборе — ещё и тексты с Genius, пишут «Ведомости».

Главным преподавателем для ИИ оказался Баста: в датасетах нашли 193 и 104 его трека. Следом идут Feduk — 150 и 91 композиция, Сергей Лазарев — 144 и 118, Дима Билан — 140 и 119, а также группа «Звери» — 135 и 41. В списке засветились Леонид Агутин, Егор Крид, Ваня Дмитриенко и другие исполнители. Туда же попали десятки видеороликов с участием российских артистов.

Само наличие песни в базе ещё не доказывает, что конкретная нейросеть действительно на ней училась. Но вероятность такого сценария The Atlantic оценивает как высокую.

Представители музыкальной индустрии утверждают, что ни зарубежные, ни российские разработчики ИИ за лицензиями к ним не обращались. Рассуждения, видимо, были такие: если контент лежит в открытом интернете, значит, его будто бы можно молча забрать в учебник для алгоритма. Иногда источником могут становиться и пиратские площадки.

Тем временем легальные сделки на мировом рынке уже появляются: Warner Music договорилась с Suno, а Universal Music Group — с Udio. Но пока это редкие исключения.

По оценке НИУ ВШЭ, совокупные потери авторов и правообладателей из-за генеративного контента за 2025-2030 годы могут достигнуть 1 трлн рублей. Российская музыкальная индустрия теперь требует прозрачного лицензирования.

RSS: Новости на портале Anti-Malware.ru