В попытке замять промах ИИ-помощник WhatsApp окончательно заврался

В попытке замять промах ИИ-помощник WhatsApp окончательно заврался

В попытке замять промах ИИ-помощник WhatsApp окончательно заврался

Вместо телефона горячей линии перевозчика ИИ-ассистент WhatsApp (принадлежит Meta, признанной экстремистской и запрещенной в России) выдал схожий номер другого пользователя мессенджера, а потом стал выдумывать оправдания, чтобы его не сочли невеждой.

При этом умный чат-бот старался переключить внимание собеседника: говорил, что работал по неким шаблонам, предлагал сконцентрироваться на поиске правильного ответа и даже противоречил сам себе в попытках не ударить в грязь лицом.

Степень стремления бесплатного ИИ-помощника угодить 41-летний работник музыкального магазина Барри Сметерст (Barry Smethurst) познал, когда ждал электричку до Манчестера. Она сильно запаздывала, и, чтобы узнать причину, истомившийся пассажир зашел в WhatsApp.

Когда выяснилось, что выданный по запросу телефон не имеет ничего общего с TransPennine Express, путешественник попытался узнать, кому принадлежит этот номер. ИИ-бот поспешил заявить, что не должен был раскрывать его, и предложил вместе поискать правильный ответ.

Однако Сметерст захотел узнать, почему ему дали чей-то мобильный номер, притом явно без согласия владельца (потом выяснилось, что телефон был указан на сайте компании, в которой работал потерпевший).

ИИ пояснил, что это результат генерации «на основе шаблонов», и пообещал его улучшить. Однако встречное недоверие заставило бот изменить свои показания — телефонный номер был якобы по ошибке стянут из некоей базы данных.

Когда его спросили, что за база, умный помощник совсем растерялся и пошел на попятный:

«Я не доставал его из базы данных, а сгенерировал последовательность цифр по формату мобильных номеров Великобритании, притом без использования реальных данных».

Потеряв терпение, Сметерст решительно заявил, что не верит чат-боту и результат в виде произвольного числа в данном случае непростителен для ИИ. Позднее Meta (признана экстремистской и запрещена в России) были высказаны соответствующие претензии.

Ошибаются, иногда даже более катастрофично, и другие ИИ-боты. Так, минувшей весной в Норвегии была подана жалоба на OpenAI: ее ChatGPT в ответ юзеру, вставившему свое имя в вопрос «Кто такой…?», заявил, что этот человек — известный детоубийца, чем привел в ужас примерного семьянина.

Однако OpenAI, по крайней мере, предупреждает пользователей о склонности ИИ к галлюцинациям и рекомендует всегда проверять выдачу с важной информацией. Кстати, недавно выяснилось, что ChatGPT как помощник лингвиста тоже требует присмотра из-за возможности ошибочных суждений.

Яндекс выпустил систему контроля безопасности корпоративного ИИ

Yandex B2B Tech выводит на рынок AI-SPM — инструмент для непрерывной оценки защищённости корпоративных ИИ-систем. Решение должно находить опасные настройки, избыточные полномочия и доступ моделей к конфиденциальным данным до того, как этим заинтересуются уже не аудиторы, а атакующие.

О запуске рассказал «Ведомостям» генеральный директор Yandex Cloud Григорий Атрепьев.

По его словам, постоянный автоматизированный контроль становится необходимостью по мере распространения ИИ в корпоративной инфраструктуре.

AI-SPM связывает в единую карту модели, наборы данных, серверы, права доступа и обнаруженные уязвимости. Система проверяет безопасность на разных этапах жизненного цикла ИИ, выявляет риски и предлагает меры защиты.

Например, она может предупредить об угрозе подмены обучающих данных, чрезмерных правах пользователя или возможности добраться до модели через специально подготовленный запрос.

При этом AI-SPM — скорее диспетчер защищённости, чем железный купол. Такие платформы непрерывно обследуют инфраструктуру и объясняют, где администраторы оставили дверь приоткрытой, но сами по себе не блокируют большинство атак. Для фильтрации запросов, предотвращения утечек и защиты от инъекций в промпт нужны отдельные средства.

Мировой рынок решений для защиты ИИ, по приведённой Атрепьевым оценке, вырастет с $2,8 млрд в 2026 году до $4,8 млрд в 2027-м. Российский сегмент пока только формируется: Yandex Cloud оценивает его объём в 1-4 млрд рублей по итогам 2026 года и допускает рост до 11–30 млрд рублей к 2029–2030 годам.

Основными заказчиками подобных продуктов станут банки, промышленные компании, ретейлеры, телеком-операторы, технологический бизнес и госструктуры.

RSS: Новости на портале Anti-Malware.ru