Anthropic официально запретила издеваться над Claude
Теперь запрещено систематически оскорблять модель и проявлять к ней жестокость без какой-либо цели. Она может обидеться и дать сдачи.
Речь только о крайних случаях. Критиковать ответы, спорить с моделью, проверять её на прочность и даже ругаться от раздражения по-прежнему разрешено. При систематических издевательствах Claude может самостоятельно завершить разговор.
Запрещено создавать сети фейковых аккаунтов, распространять дезинформацию и организовывать скрытые кампании влияния.
Уточнён запрет на разработку оружия, включая программное обеспечение для управления вооружением и беспилотниками.
Нельзя использовать Claude для слежки за людьми без их согласия или принятия решений о том, кого расследовать и арестовывать.
В медицине, финансах и других сферах с высокими рисками решения ИИ должны проверяться квалифицированным человеком.
Если Claude управляет физическим оборудованием, оператор должен иметь возможность наблюдать за ним и остановить его.
При этом Anthropic сняла общий запрет на персонализированные политические кампании, сохранив ограничения на обман избирателей и незаконное использование персональных данных.
Новые правила вступят в силу 12 ноября 2026 года. Anthropic подчёркивает, что большинство изменений лишь уточняют уже действующие ограничения.
dailyprompts.ru
===
💬Это пост из ленты, которую читает Саша - автор канала Мальцев: Карьера. Маркетинг. AI. @maltsevprosto
Другие каналы по темам:
🤖 AI @maltsevdaily
🧑🎓 Карьеры @maltsevdailyc
🦹 Маркетинга @maltsevdailym
Post #118239
4
