Anthropic 禁止对 Claude 进行虐待
Anthropic bans 'abusive or cruel behavior' towards Claude

Anthropic 更新了使用政策,首次明确禁止用户对 Claude 实施“持续且无必要的虐待或残忍行为”。这一举措源于其对模型福利的深入研究,若用户反复恶意对待模型,Anthropic 将直接终止对话。除了保护 AI 模型,新规还严厉禁止利用 Claude 进行选举干扰、武器开发、虚假宣传及未经同意的监控。Anthropic 强调,这些规则针对的是极端滥用案例,而非普通用户的挫败感或创意测试。这标志着 AI 行业在模型伦理与法律地位上的探索迈出了关键一步。
新政策更新仅适用于极端情况,即用户反复对我们的模型实施残忍行为且毫无明确目的。