«Яндекс» призывает государство выработать политику раскрытия данных

«Яндекс» призывает государство выработать политику раскрытия данных

Крупная российская интернет-компания «Яндекс» призывает государство выработать единую политику раскрытия данных, накапливаемых в своей работе различными госорганами, сообщил журналистам глава компании Аркадий Волож в кулуарах форума «Открытые инновации».

«Куча данных производится во всех местах. Есть министерства, есть ГИБДД, есть трамвайные и троллейбусные парки... Пускай все данные, которые они в своей работе генерируют, пусть они выкладывают куда-нибудь для всех в общем формате», — сказал Волож.

По его мнению, государство должно стимулировать этот процесс, а также выработать общепринятые стандарты для представления и обеспечения доступности постоянно обновляемых данных.

«Яндекс», накопивший большой опыт в сборе и систематизации разнородной информации, готов участвовать в выработке этих общих форматов.

«Вместо того чтобы строить сложные иерархические системы госуслуг, которые наверно хороши где-то в своей области, лучше открыть данные и дать к ним доступ частному бизнесу», — говорит Волож.

По словам главы «Яндекса», он уже выступал с этим предложением на экспертном совете в Минкомсвязи, и оно было принято в работу.

Волож приводит в пример опыт других стран, где общедоступные данные, собранные государством, становятся основой для многих полезных сервисов. По его словам, открытый доступ к данным госорганов создаст условия для появления компаний, которые будут доносить полезную информацию до десятков миллионов людей.

Гендиректор «Яндекса» сказал, что идея общего доступа к данным требует обсуждения на «серьезном техническом уровне», отметив, что его компания готова в этом участвовать.

Читайте далее: http://www.digit.ru/state/20121101/396230483.html#ixzz2AxEuFa7N

Крупная российская интернет-компания «Яндекс» призывает государство выработать единую политику раскрытия данных, накапливаемых в своей работе различными госорганами, сообщил журналистам глава компании Аркадий Волож в кулуарах форума «Открытые инновации»." />

Бигтех в России просит открыть обезличенные данные граждан для обучения ИИ

Российскому ИИ не хватает данных, а закон, по мнению бигтеха, держит их под замком. Ассоциация больших данных, в которую входят «Авито», «Сбер», «Ростелеком», «Яндекс», HH и VK, попросила Минцифры упростить использование обезличенной персональной информации для разработки и обучения нейросетей.

Сейчас любое алгоритмическое преобразование персональных данных считается обезличиванием.

Даже если технология практически исключает возможность установить личность человека, полученный массив всё равно остаётся персональными данными со всеми сопутствующими ограничениями. Защита вроде бы сработала, а юридический хвост никуда не делся.

АБД, по данным КоммерсантЪ, предлагает выделить технологии повышения приватности — Privacy Enhancing Technologies, или PETs — в отдельную категорию. Они позволяют обрабатывать, передавать и хранить информацию без раскрытия личности. Если риск идентификации равен нулю или составляет малые доли процента, такие данные предлагается использовать для ИИ без согласия граждан.

Обработка при этом должна проходить в России, российскими компаниями и только для разработки, обучения и применения ИИ. Кроме того, ассоциация предлагает ввести доверенных посредников — аккредитованные организации, которые будут хранить обезличенные массивы и предоставлять к ним доступ. Данные также хотят разделить на бесплатные, необходимые для исполнения закона, и платные — для коммерческих задач.

Участники рынка объясняют инициативу просто: российских датасетов мало, а большая их часть заперта внутри крупных экосистем. Собственные и партнёрские массивы уже не закрывают аппетиты современных моделей, особенно специализированных корпоративных решений.

Альтернативой остаются синтетические данные — искусственно созданные наборы без сведений о реальных людях. Но полностью заменить ими отраслевую статистику, поведенческие закономерности и другие ценные выборки получится не всегда.

Теперь мяч у Минцифры, которое на обращение пока не ответило. Бигтех тем временем даёт понять: без свежих данных российский ИИ далеко не уедет, сколько вычислительных мощностей ему ни подбрасывай.

RSS: Новости на портале Anti-Malware.ru