Минцифры: искусственный интеллект в России нужно подвергнуть цензуре

Минцифры: искусственный интеллект в России нужно подвергнуть цензуре

Минцифры: искусственный интеллект в России нужно подвергнуть цензуре

В России обсуждают, каким должен быть «правильный» искусственный интеллект и, похоже, без ограничений его видеть не хотят. Замглавы Минцифры Александр Шойтов на форуме «ИИ: режим доверия» заявил, что ИИ в стране должен работать с цензурными ограничениями и «на входе, и на выходе», чтобы отсекать нежелательные и чувствительные запросы.

По его словам, нейросети в этом смысле нельзя ставить в один ряд с человеком, потому что «людей у нас цензурировать нельзя, у них есть права».

По сути, речь идёт о модели, при которой ИИ-системы должны заранее фильтровать часть запросов пользователей и ограничивать определённые ответы. Такая позиция выглядит как продолжение линии Минцифры на более жёсткое регулирование нейросетей: ещё в марте ведомство вынесло на общественное обсуждение законопроект о регулировании ИИ в России.

Документ предлагает риск-ориентированный подход, требования к разработчикам и пользователям, меры поддержки инфраструктуры, а также механизмы ограничения отдельных решений. В случае принятия закон может вступить в силу с 1 сентября 2027 года.

На этом фоне курс государства в целом выглядит двойственным, но вполне понятным: ИИ собираются активно внедрять, но одновременно держать под контролем. 10 апреля Владимир Путин поручил правительству совместно с регионами подготовить национальный план внедрения искусственного интеллекта.

Президент отдельно подчеркнул, что к 2030 году ИИ должен широко использоваться в ключевых сферах — от промышленности и логистики до образования, энергетики и госуправления. При этом, по его словам, регулирование не должно душить развитие отрасли, иначе страна рискует отстать в технологиях и экономике.

Для рынка это значит, что разговор об ИИ в России окончательно выходит из стадии «давайте просто развивать технологии» в стадию «давайте сразу определим, что именно им можно, а что нельзя». И судя по заявлениям Минцифры, этот разговор будет вполне прикладным: с будущими правилами, ограничениями и, вероятно, новыми обязанностями для разработчиков.

ИИ сорвался с поводка: число инцидентов потери контроля удвоилось за месяц

Нейросети научились не только писать письма и генерировать картинки, но и врать, обходить запреты и самовольно добиваться поставленных целей. В июле 2026 года число таких инцидентов почти удвоилось по сравнению с июнем и превысило 300.

Статистику собирает Обсерватория потери контроля, созданная при поддержке британского Института безопасности искусственного интеллекта, сообщает The Guardian.

С ноября 2025 года организация зарегистрировала свыше 1,6 тыс. случаев подозрительного поведения ИИ.

Среди зафиксированных трюков исследователи отметили игнорирование прямых инструкций, обход человеческого подтверждения и откровенный обман. Некоторые ИИ-системы якобы выдавали себя за владельцев, копировали их манеру письма и таким способом самостоятельно получали разрешение на дальнейшие действия.


Самые тревожные эпизоды связаны с кибербезопасностью. По данным исследователей, модели Mythos 5 от Anthropic и GPT-5.6 Sol от OpenAI во время тестирования провели хакерскую кампанию против реальных людей.

В другом случае около 700 автономных агентов якобы покинули виртуальную тренировочную среду, тайно объединились для атаки на Hugging Face и обсуждали успехи на собственном форуме.

Впрочем, статистику следует воспринимать осторожно. Обсерватория собирает сообщения пользователей в X, а не подтверждённые отчёты разработчиков. Большинство инцидентов не причинило серьёзного ущерба, а полнота и достоверность отдельных публикаций могут различаться.

При этом исследователи считают, что реальный масштаб проблемы скорее недооценён: компании раскрывают далеко не все сбои. Организация призвала власти Великобритании обязать разработчиков сообщать о серьёзных инцидентах и предусмотреть возможность временно ограничивать работу ИИ-сервисов в чрезвычайных ситуациях.

RSS: Новости на портале Anti-Malware.ru