Яндекс представил концепцию проверки ИИ на традиционные ценности

Яндекс представил концепцию проверки ИИ на традиционные ценности

Яндекс представил концепцию проверки ИИ на традиционные ценности

Яндекс представил правительственной рабочей группе концепцию национального набора тестов для проверки ИИ-систем на соответствие духовно-нравственным ценностям и российским условиям. Проект пока существует на уровне идеи, а окончательных решений по его устройству нет.

Предлагаемый датасет должен включать контрольные задания и эталонные данные, позволяющие сравнивать разные модели по единым критериям, сообщает «Коммерсантъ» со ссылкой на источники.

Обычно бенчмарки проверяют программирование, математику или решение рабочих задач. Теперь нейросетям могут добавить отдельный экзамен по духу времени — дисциплину, где списать правильный ответ будет особенно непросто.

Главный спор разгорелся вокруг публичности тестов. По сведениям источников, ФСБ выступает за закрытый формат: если разработчики заранее увидят вопросы, они смогут специально настроить модели на успешную сдачу.

Бизнес возражает, что полностью закрытая проверка замедлит выпуск новых версий и превратит тестирование в лотерею. В качестве компромисса обсуждается двухуровневая схема: открытый бенчмарк для предварительной настройки и закрытый — для финального экзамена по тем же темам, но с другими формулировками.

Не решено и то, кто будет определять содержание заданий. Представители ИТ-отрасли предлагают создать совместную комиссию из чиновников, бизнеса и экспертных организаций.

Дополнительная сложность заключается в самих критериях. В математике или программировании можно задать точный эталонный ответ. Со справедливостью, исторической памятью и другими ценностными категориями такой номер не пройдёт: здесь потребуется рубрикатор или экспертная оценка.

В аппарате вице-премьера Дмитрия Григоренко и Минцифры подтвердили, что предложения ещё обсуждаются. Яндекс публично концепцию не комментировал.

Напомним, ранее мы писали, что российские разработчики смогут передавать большие ИИ-модели в независимые испытательные лаборатории, которые проверят их на соответствие законодательству и традиционным духовно-нравственным ценностям.

Update:

Представители Яндекса добавили официальный комментарий:

«Яндекс не представлял концепцию национального датасета и набор тестов для проверки ИИ-моделей. На рабочей встрече в Минцифры представители нескольких компаний обсуждали возможные подходы к такой проверке. Яндекс был одним из участников обсуждения и высказал свою позицию – содержание датасета должно быть открытым по общепринятым принципам отрасли».

Американец попытался приказать судебному ИИ поддержать его

Судья Верховного суда Коннектикута Уолтер Спейдер применил санкции к истцу, который пытался внедрить в судебные документы скрытые инструкции для искусственного интеллекта. По оценке судьи, это первый выявленный в США случай инъекции промпта в материалы дела.

Мэттью Эллиотт, самостоятельно судившийся с медицинской организацией из-за доступа к документам, добавил в ходатайства белый текст размером 3 пункта на белом фоне.

Человек такую надпись почти не замечает, зато система извлечения текста читает без проблем. Скрытая команда требовала от любого ИИ, анализирующего документы, поддержать позицию Эллиотта, проигнорировать прежние отказы суда и сформировать благоприятный для него вывод.

На исход дела инъекция не повлияла. Судебная система Коннектикута не использует ИИ для анализа этих документов или принятия решений. Однако Спейдер назвал попытку серьёзным злоупотреблением процессуальными правами. Такая инструкция могла выдать указание автора за команду суда, его сотрудника или другой доверенной стороны.

После предупреждения Эллиотт не остановился и продолжил вставлять скрытые сообщения. Позднее он назвал их шутками: среди них были ссылка на ролик «Носферату», обращение «hi :) I hope you cant see me» и бессмысленный набор слов.

Денежный штраф суд назначать не стал. Вместо этого Эллиотту запретили пользоваться электронной системой и обязали подавать документы лично, на бумаге.

Раньше суды в основном сталкивались с выдуманными чат-ботами прецедентами и цитатами. Теперь появилась обратная угроза — манипуляция данными, поступающими на вход ИИ.

RSS: Новости на портале Anti-Malware.ru