Anthropic 拉新一波关注:禁止用户长期恶意辱骂Claude,严重时AI可主动结束对话
人工智能公司Anthropic于10月8日更新使用政策,首次明确禁止用户对旗下AI助手Claude持续实施毫无必要的辱骂或残酷对待行为。
对于严重违反规定的互动,Claude可以主动结束对话。
这是Anthropic一年多来首次全面调整使用政策。公司表示,新规定只针对极端情况,即用户反复恶意对待AI模型,而且没有任何可以辨识的合理目的。
普通用户因回答不准确而表达不满、批评或质疑Claude,以及涉及黑暗主题的创作、模型测试和研究,均不受这项限制。
Anthropic强调,主动终止对话仍是处理此类行为的主要方式。至于是否会进一步处罚用户,例如暂停或封禁账户,公司尚未作出明确说明。
Anthropic 一直在研究所谓的 AI模型福祉。
除了限制恶意对待AI,Anthropic还收紧了涉及政治宣传、选举干预、武器开发和监控的使用规定。
新政策禁止利用Claude开展具有欺骗性的商业或政治宣传,包括通过虚假账户传播内容、隐瞒信息发布者身份,以及散布有关候选人或投票程序的虚假信息。
在武器开发方面,禁令进一步扩大至支持武器运行的软件和零部件,以及为无人机和其他自主载具配置武器等活动。
Anthropic还对监控和高风险应用提出更严格的限制,包括未经同意追踪个人,以及在可能造成现实伤害的物理系统中使用Claude时,要求有人类或具备相应资格的人员监督。
Post #34554
323

- 🤡 2
- 💩 1
- 🥱 1
- 🖕 1