Anthropic 要求用户别再对 Claude 恶语相向
Anthropic asks users to stop being mean to Claude

Anthropic 更新了使用政策,明确禁止用户对其 AI 模型 Claude 进行持续且无意义的虐待或残忍行为。虽然允许用户表达不满或进行黑暗主题的创作,但单纯为了取乐而反复辱骂模型将被禁止。这项新规将于 11 月 12 日生效,旨在保护模型免受极端恶意对待,同时 Anthropic 也借此机会收紧了关于武器开发、选举干扰和监控等领域的限制。尽管 Claude 只是软件,但 Anthropic 显然希望用户能对其保持基本的礼貌,毕竟在 AI 安全防御尚未完全成熟的当下,维护良好的交互环境同样重要。
这项政策更新仅适用于极端情况,即用户反复对我们的模型实施残忍行为且毫无明确目的时。