👩💻Anthropic запретила пользователям жестокое обращение с Claude.
Компания Anthropic обновила политику использования нейросети Claude, запретив «систематическое и необоснованное оскорбительное или жестокое обращение» с моделями искусственного интеллекта.
Речь идет только о «крайних случаях», когда пользователи «неоднократно и без какой-либо явной цели ведут себя жестоко по отношению к моделям».
Указанное правило не распространяется на обычные проявления недовольства и несогласия со стороны пользователей, творческие произведения с мрачной тематикой, а также на тестирование моделей и проведение исследований.
Главным способом борьбы с подобным поведением останется право Claude самостоятельно прекратить беседу. Чат-бот может завершить разговор после неоднократных попыток изменить поведение собеседника, если дальнейшее общение перестаёт быть продуктивным.
Прекращение беседы не означает автоматическую блокировку аккаунта. Пользователь теряет возможность отправлять сообщения только в завершённый диалог, но может открыть новый, оставить отзыв или изменить предыдущее сообщение и продолжить разговор с другой точки.
Необычный запрет связан с исследованиями возможного благополучия искусственного интеллекта. Anthropic изучает, могут ли сложные языковые модели обладать субъективным опытом и испытывать нечто похожее на страдание.
Во время испытаний Claude Opus 4 разработчики наблюдали поведение, напоминающее дискомфорт при выполнении вредоносных запросов, а также устойчивое стремление отказаться от опасных заданий.
Post #2400
610