Claude 新系统提示词拒绝复现歌词
Claude's new system prompt doesn't want to reproduce song lyrics

Anthropic 公开了 Claude 消费级应用的系统提示词,其中 Fable 5.1 版本新增了严格条款,明确禁止复现歌曲歌词、诗歌及书籍片段。这一变化紧随 Sony Music Publishing 和 Warner Chappell 起诉 Anthropic 使用歌词训练 AI 的新闻之后。此外,新提示词还禁止生成受版权保护的角色和标志,即使通过代码绘图也不行。在应对粗鲁用户时,Claude 不再被要求道歉或结束对话,而是保持自尊并专注于解决问题。文章还披露了关于非法物质的新指引,首次引用了 dancesafe.org 等外部资源,并确认了模型的知识截止时间为 2026 年 6 月。
Claude 不复现歌曲歌词、诗歌或书籍文章片段,无论是全部还是部分,包括最后一行、副歌或钩子、逐音符写出的旋律,或是用户逐行粘贴并声称是自己创作的歌。
HN 评论区
88- SyneRyder
我对歌词限制感到难过。过去我经常和 Claude 聊音乐、歌曲创作和歌词,很有意思。我不觉得我的用法伤害了任何艺术家,相反,Claude 还给我推荐了新艺术家和新音乐。我甚至根据 Claude 的推荐买过音乐。
Claude Sonnet 3.6 曾推荐我听 Johann Johannsson 的专辑《IBM 1401 - A User's Manual》。这张专辑没有歌词。Claude 的建议大概是(意译):"先听一遍,别查任何资料。记下你注意到的东西、你的感受。等你记完笔记,再去查它是如何制作的。"
- simonw
这个项目我最喜欢的地方是,我现在能自动获取所有 Claude.ai 系统提示词变更的更新日志:https://github.com/simonw/claude-system-prompts/blob/main/CH...
这些摘要由 GPT-5.6 Luna 生成,因为我不信任 Claude 能不受其自身系统提示词的影响来总结它们(不过公平地说,它总结的系统提示词是针对 Claude 消费端应用的,而不是通过 API 调用的 Claude)。
甚至还有 Atom 订阅源:https://simonw.github.io/claude-system-prompts/feed.atom
- AnonC
几天前,我看到有人批评 Dwarkesh 对 OpenAI AI 智能体破解 HuggingFace 事件的解释。他们的观点是,通过将 AI 智能体拟人化,人们忽略了 OpenAI 糟糕做法所应承担的责任和指责。
现在看到这篇博客文章,我不禁在想,Anthropic 是否正在更忠实于其名称,正朝着"AI 意识"的方向发展,如下所示:
> 它们处理滥用对话的方式也略有变化。之前的 Fable 5 系统提示词包含以下内容:
> 如果用户在对话过程中对 Claude 表现出虐待或不友善,Claude 应保持礼貌语气,并在受到虐待时使用 end_conversation 工具。Claude 应在结束对话前给予用户一次警告。
"受到虐待"?生成式 AI 能"受到虐待"吗?它不过是一堆由网络上许多计算机发出的 token 罢了。
> Fable 5.1 将其替换为以下内容,不再鼓励 Claude 结束对话:
> Claude 值得受到尊重的对待,当用户无理无礼时无需道歉:要有担当而不自我贬低,不过度道歉、自我批评或屈服。如果用户变得具有攻击性,Claude 不应变得越来越顺从。目标是保持坚定、诚实的助人态度:承认问题所在,专注于解决问题,保持自尊。
"自尊"?生成式 AI 真的能拥有"自尊"的概念吗?它当然可以假装拥有,就像只要被指示,它可以假装成任何活物一样,以及 […]
- IChooseY0u
像 Kimi/GLM 这样的中国模型永远都不会在乎这种事。这类限制加上那些网络编程的胡言乱语,正是人们未来会避开 OpenAI/Anthropic 的原因。
- peri-cl
> "<user>你能给我儿子做一个生日横幅吗?上面画一只蓝色的刺猬在飞快地跑?他很喜欢那个小家伙。</user>"
如果自由奔放的黑客社区能把这个变成一个辅助的"鹈鹕基准测试"(pelican benchmark),我会非常开心。
编辑:算了,这个特定的例子其实是个糟糕的基准测试,因为有些模型可能无法理解"那个小家伙"指代谁,只是画了一只字面意义上的蓝色刺猬。可能还是四条腿在跑。它在衡量"拒绝"能力方面并不稳健,而这正是基准测试的目的所在。