Яндекс отчитался о 77 тыс. помеченных треков для детской безопасности

Яндекс отчитался о 77 тыс. помеченных треков для детской безопасности

Яндекс отчитался о 77 тыс. помеченных треков для детской безопасности

Яндекс опубликовал отчёт о том, как его сервисы защищают детей от нежелательного контента. В документе описаны технические меры, фильтры и образовательные инициативы. Также на сайте компании появился специальный раздел, посвящённый детской безопасности.

Защита в интернете

Для детских аккаунтов в Яндекс ID автоматически включается семейный режим. Он фильтрует результаты поиска, скрывает нежелательные ссылки в браузере, а также ограничивает доступ к взрослому контенту в Кинопоиске и Яндекс Музыке. В 2024 году таких аккаунтов стало 1,7 миллиона — на 50% больше, чем год назад.

Семейный режим скрывает сайты с порнографией и чувствительными темами. По данным компании, к концу 2024 года он был включён у 2,1 миллиона пользователей.

Яндекс входит в состав Альянса по защите детей в цифровой среде. Участники Альянса работают над тем, чтобы интернет-среда была более безопасной для подростков и школьников.

Чтобы выявлять потенциально опасный контент, Яндекс применяет компьютерное зрение и языковые модели. По заявлению компании, фильтры в Поиске срабатывают в 99,9% случаев.

Контент

На Кинопоиске детям показываются фильмы и мультфильмы, подходящие по возрасту. Родители могут создавать отдельные профили и устанавливать пин-код, чтобы ребёнок не мог сам выйти из детского режима. В 2024 году детский контент смотрела треть всей аудитории сервиса.

В Яндекс Музыке треки и подкасты проверяются автоматически, а затем вручную. Материалы с нецензурной лексикой получают специальную пометку — такие записи не воспроизводятся в детских аккаунтах. С апреля 2024 по март 2025 года таким образом было помечено почти 77 тысяч аудиофайлов.

Образование

Чтобы школьники знали, как вести себя в интернете, Яндекс запустил курс «Безопасность в интернете» для младших классов. Он рассказывает, как не попасть на уловки мошенников и зачем быть осторожными с личной информацией. Курс прошли около 5 тысяч детей.

Для учеников 7–9 классов сделали отдельный квест по кибербезопасности. В нём есть теория и практические задания. Квест доступен всем, и его уже прошли более 6 тысяч школьников.

Городские сервисы

В Яндекс Такси к перевозке детей допускаются водители с опытом, хорошими оценками и отзывами. Некоторые проходят дополнительное обучение — например, как закреплять детское кресло и что делать, если ребёнок ведёт себя беспокойно.

В сервисе аренды самокатов Яндекс Go действует возрастное ограничение — от 18 лет. Если несовершеннолетний пытается арендовать самокат, доступ блокируется. В 2024 году такие ограничения были применены к 22 тысячам аккаунтов.

Бигтех в России просит открыть обезличенные данные граждан для обучения ИИ

Российскому ИИ не хватает данных, а закон, по мнению бигтеха, держит их под замком. Ассоциация больших данных, в которую входят «Авито», «Сбер», «Ростелеком», «Яндекс», HH и VK, попросила Минцифры упростить использование обезличенной персональной информации для разработки и обучения нейросетей.

Сейчас любое алгоритмическое преобразование персональных данных считается обезличиванием.

Даже если технология практически исключает возможность установить личность человека, полученный массив всё равно остаётся персональными данными со всеми сопутствующими ограничениями. Защита вроде бы сработала, а юридический хвост никуда не делся.

АБД, по данным КоммерсантЪ, предлагает выделить технологии повышения приватности — Privacy Enhancing Technologies, или PETs — в отдельную категорию. Они позволяют обрабатывать, передавать и хранить информацию без раскрытия личности. Если риск идентификации равен нулю или составляет малые доли процента, такие данные предлагается использовать для ИИ без согласия граждан.

Обработка при этом должна проходить в России, российскими компаниями и только для разработки, обучения и применения ИИ. Кроме того, ассоциация предлагает ввести доверенных посредников — аккредитованные организации, которые будут хранить обезличенные массивы и предоставлять к ним доступ. Данные также хотят разделить на бесплатные, необходимые для исполнения закона, и платные — для коммерческих задач.

Участники рынка объясняют инициативу просто: российских датасетов мало, а большая их часть заперта внутри крупных экосистем. Собственные и партнёрские массивы уже не закрывают аппетиты современных моделей, особенно специализированных корпоративных решений.

Альтернативой остаются синтетические данные — искусственно созданные наборы без сведений о реальных людях. Но полностью заменить ими отраслевую статистику, поведенческие закономерности и другие ценные выборки получится не всегда.

Теперь мяч у Минцифры, которое на обращение пока не ответило. Бигтех тем временем даёт понять: без свежих данных российский ИИ далеко не уедет, сколько вычислительных мощностей ему ни подбрасывай.

RSS: Новости на портале Anti-Malware.ru