Разряжать злость на Claude бесконечно больше не получится. Anthropic обновила правила использования моделей и отдельно запретила систематическое, бессмысленное жестокое обращение с ними. Основной ответ на такое поведение — прекращение диалога.
Новая редакция правил Anthropic вступит в силу 12 ноября. При этом речь идёт о крайних случаях: когда пользователь неоднократно и без видимой цели издевается над моделью.
Обычная критика, недовольство ответом, несогласие, мрачные творческие сюжеты и исследования под этот запрет не подпадают. Требование хвалить нейросеть за каждую галлюцинацию компания не вводила. Будут ли пользователей отдельно блокировать именно за грубость, Anthropic не уточнила.
Корпорация также расширила ограничения на разработку оружия, включая управляющее ПО и вооружение беспилотников, а также уточнила запреты на слежку без согласия людей.
В правилах отдельно перечислены обманные кампании: фальшивые аккаунты, сокрытие заказчика публикаций и искусственное продвижение сообщений. Для выборов запрещены дезинформация о голосовании, подмена кандидатов и попытки обманом снизить явку.
Если модель подключена к оборудованию, способному причинить травмы, должен быть предусмотрен надзор квалифицированного оператора и возможность остановить его работу.





