Anthropic запретила пользователям жестокое обращение с чат-ботом Claude
Компания Anthropic обновила политику использования нейросети Claude, введя запрет на систематическое и необоснованное оскорбительное или жестокое обращение с моделями искусственного интеллекта.
Новое правило касается только крайних случаев, когда пользователи неоднократно и без явной цели ведут себя жестоко по отношению к моделям. Ограничение не распространяется на обычные проявления недовольства и несогласия, творческие произведения с мрачной тематикой, а также на тестирование моделей и проведение исследований.
Ранее, летом прошлого года, Anthropic сообщила, что модели Claude Opus 4 и 4.1 получили возможность самостоятельно прекращать диалоги, вызывающие у них стресс. Функция разработана в рамках предварительных исследований благополучия ИИ-моделей, которые показали неприятие Claude запросов, способных причинить вред. В частности, дискомфорт вызывали запросы на контент сексуального характера с участием несовершеннолетних, а также попытки получить информацию, связанную с насилием или совершением терактов.
Помимо этого, Anthropic запретила использовать чат-бот Claude для вмешательства в выборы, слежки за людьми без их ведома и разработки оружия.
Материал дополняется.
Источник: РБК