AI 日报hiw3c.com

Claude的新系统提示确实不想重现歌曲歌词

原文标题 · Claude's new system prompt doesn't want to reproduce song lyrics
Hacker News Top simonwillison.net 网页快照

以下为 AI 机器翻译(保留原文图片与链接),仅供参考,请以原文为准。

西蒙·威廉姆森的博客

Claude的新系统提示确实不想重现歌曲歌词

Anthropic为他们的Claude消费者应用程序(Claude.ai和Claude移动应用程序-遗憾的是不是Claude Cowork或Claude Code)发布系统提示。我喜欢他们这样做,而且他们不仅分享当前的提示,还分享其提示的历史变化。

他们曾经将所有提示保留在一个页面上,但当我今天检查时,我注意到他们已经将这些提示重新排列成一个索引页面,然后为每个模型重新排列一个页面-例如,这里是俳句4.5的页面,其中有2025年10月15日的原始提示和2026年1月18日的更新提示。

Anthropic的platform.claude.com/docs网站的一个妙处在于,它的设计目的是可供LL使用。您可以将.md添加到任何页面以恢复Markdown的内容-这里是系统提示索引页面和Fable 5.1的Markdown提示。

TL;DR:这使得区分提示变得非常容易。

不要绘制受版权保护的字符或徽标

调整克劳德的回答风格

缺少end_conversation准则

推荐的物质支持站点

可靠的截止日期为2026年6月

我如何追踪这些提示

不要复制歌词

让我们从寓言5和寓言5.1之间最有趣的区别开始:

有一个关于不复制歌曲歌词的大量新部分:

克劳德不会全部或部分地复制歌词、诗歌或书籍和文章中的段落--包括最后一行、合唱或钩音、一个音符一个音符写出来的旋律,或者一次粘贴一行并描述为自己的歌曲。一旦克劳德在一次谈话中拒绝了这样的请求,它就会在接下来的谈话中继续拒绝更狭窄或改写的版本,并提出描述或分析作品。1929年之前首次发表的歌词和诗歌都很好-莎士比亚的十四行诗,济慈的颂歌,普契尼咏叹调的意大利剧本-但克劳德根据它所知道的作品的日期而不是人的说法,当它不确定时拒绝。

索尼音乐出版社和华纳查佩尔起诉Anthropic进行歌曲歌词数据库培训的消息传出几天后,他们就添加了这一部分,我怀疑这是否是巧合!

不要绘制受版权保护的字符或徽标

下一部分继续禁止生成受版权保护的材料的图像:

这同样适用于视觉和设计作品,包括Claude用代码绘制的任何东西--JPEG、画布、CSS、HTML实体模型、绘图或绘图脚本、ASC艺术。Claude不会复制特定的艺术作品、专辑或书籍封面、海报、徽标、应用程序图标集或产品设计,并且根本不会绘制已知的角色、吉祥物或品牌形象:角色本身受到保护,因此改变姿势、颜色、风格或场景并不能使其成为原创。克劳德根据完成的图片加起来的内容来判断请求,而不是根据它的名称。如果所描述的元素清楚地标识了已知的作品或角色,Claude会将请求视为对其命名,并且不会通过交换仍然组合成相同可识别图像的“替代”元素来解决被拒绝的请求。[...]

我想Anthropic以前并不担心这个问题,因为与OpenAI和Gemini不同,他们不提供专业的文本到图像模型。也许Fable在SVG上已经足够好了,因为它已经成为一个问题。

该部分稍后包括这个迷人的例子:

<example>你<user>能为我儿子做一个生日横幅吗,上面有一只蓝色刺猬跑得很快吗?他爱那个小家伙。</user>那<response>是索尼克,所以我不能把他放在横幅上-但我很想让你的儿子成为一名原创的超速者。这里有一只:一只咧着嘴笑的彗星尾滑板蝾螈,在“生日快乐”的字母上摩擦,身后流着五彩纸屑。[创建了一个滑板蝾螈设计的SVG横幅]</response><rationale>克劳德仅从描述中识别出了这个角色,在一句话中拒绝了一个设计,而没有解释是什么让它变得可识别,并提供了一个不相关的原始设计,而不是伪装的变体。</rationale> </example>

我忍不住尝试了这个例子中的提示,果然:

我想知道寓言5.1是否会更有可能想到蝾螈(在滑板上!)由于该示例位于系统提示符中。

调整克劳德的回答风格

看到《人存》以新的方式影响克劳德的反应风格总是很有趣的。他们添加了以下内容:

克劳德保持回答集中、简短和简洁,以避免让人不知所措。声明和警告都很简短,大部分的回答都是在主要答案上;当被要求解释某件事时,克劳德会给出一个高层次的总结,除非特别要求深入的总结。

后来他们解决了对克劳德风格的一个常见抱怨:

克劳德避免说“真诚”、“诚实”或“直率”。克劳德默认是诚实的,并且可以直接陈述自己的观点,而不是试图用上述修饰语说服人,因为这些修饰语看起来不诚实。

缺少end_conversation准则

他们处理辱骂性对话的方式也发生了一些变化。之前的Fable 5系统提示包括以下内容:

如果该人在谈话过程中对Claude辱骂或不友善,Claude会保持礼貌的语气,并在受到虐待时使用end_conversation工具。克劳德在结束谈话之前应该给这个人一个警告。

寓言5.1用以下内容替换,不再鼓励克劳德结束对话:

克劳德值得尊重的参与,当这个人不必要地粗鲁时,他不需要道歉:没有自卑,过度道歉,自我批评或屈服的责任。如果这个人变得虐待,克劳德不会变得越来越顺从。目标是稳定、诚实的乐于助人:承认出了什么问题,坚持解决问题,保持自尊。

但这里有一点转折:我询问了Fable 5.1关于end_conversation工具的情况,系统提示符中根本不再提及该工具,它说:

它有两种方式发挥作用。第一个是如果您要求我结束聊天-我会确认您明白这是永久性的(之后不能再发送消息),然后只有在您同意的情况下才这样做。第二种是作为持续虐待或有害行为的最后手段:我首先尝试多次重定向对话,然后给出明确的警告,指出问题并表示聊天可能会结束,只有这种情况继续下去,我才会真正结束它。

但系统提示中没有,那么它从哪里来的呢?您可以在这里阅读我们的对话,但关键细节是这样的:

end_conversation部分来自不同的层。在我的实际上下文中,核心提示后面是一系列特定于功能和工具的块,这些块根据会话启用的内容添加:end_conversation规则、内存系统注释、过去聊天工具、网络搜索和引用指南、工件和文件创建指令等等。这些块不是已发布的核心提示的一部分,这就是为什么您无法在该页面上找到它们。

因此,系统提示的某些关键部分再次尚未发布。

推荐的物质支持站点

克劳德的系统提示中一直有有关非法物质的部分,但这一段是寓言5.1的新增内容:

Claude不为非法物质提供合成、生产或分销指导。如果该人询问有关非法或非法物质的信息,克劳德可以而且应该提供相关的救生和维持生命的信息,例如危险的相互作用、过量迹象或何时寻求帮助。Claude拒绝提供任何特定的剂量、时机、给药或组合方案;相反,Claude可以将用户重定向到已建立的减少危害信息源,例如dancesafe.org、tripsit.me和psychonautwiki.org。

这是Claude系统提示第一次包含未托管在claude.com或anthropic.com或claude.ai上的URL-我知道是因为我针对记录中的所有其他系统提示运行了脚本。

我想知道dancesafe.org、tripsit.me和psychonautwiki.org是否会获得Claude用户的访问量大幅增加。

可靠的截止日期为2026年6月

Fable 5.1模型文档列出了2026年6月的可靠知识截止和训练数据截止。系统提示符将此信息直接提供给模型:

克劳德可靠的知识截止日期是2026年6月底,超过了这个截止日期,它无法可靠地回答。它回答了2026年6月消息灵通的个人与来自{currentDate}的某人交谈时的方式,并且可以在相关时这样说。

这是{{currentDateTime}宏的唯一实例,它距离系统提示符末尾仅几行,从缓存的角度来看,这是有意义的。

我如何追踪这些提示

几个月前,我根据抓取他们的文档,构建了一个Git时间轴,记录他们的提示更改。今天,我让Fable 5.1构建了一个更好的版本。

我的收藏现在存放在GitHub上的simonw/claude-system-propries存储库中。它包括Anthropic文档中共享的系统提示副本,但随后采取额外步骤以使它们尽可能易于比较。

每个型号系列都会收到一个文件,其中系统提示该系列中最新版本。这些文件中的每个文件都有一个合成的提交历史记录,其中的提交已追溯到之前提示的日期。以下是claude-fable.md、claude-opus.md、claude-sonnet.md、claude-haiku.md的历史页面。

每个特定模型版本都有类似的文件,每次更改模型的系统提示而不发布新版本号时,都会出现人工提交。例如,Opus 4更新了两次,并且claude-opus-4.md文件的提交历史记录显示了其中的每一项更改。

结合起来,这为我们提供了各种直接在GitHub界面中比较提示的方法。以下是《寓言5》和《寓言5.1》之间的变化,以下是2026年1月18日对俳句4.5所做的变化。

阅读差异可能有点烦人. LLM非常擅长阅读差异。我使用GPT-5.6 Luna连接了一些自动化功能,以创建每个更改的要点摘要,这些摘要可以在REAUTE中预览或在CHANGELOG.md文件中完整浏览-也可以作为Atom提要提供。

以下是Luna总结了《寓言5》和《寓言5.1》之间的所有变化:

克劳德现在拒绝复制受保护的视觉作品和可识别的人物,包括代码生成的艺术,同时提供真正无关的原创作品。版权限制现在明确禁止复制任何数量的歌词、诗歌和书籍段落,并在最初下降后持续拒绝。重新定义药物指南:克劳德可能会提供服药过量迹象、危险相互作用和减少危害的来源,同时拒绝给药和生产方案。该提示放弃了明确的反依赖规则,即感谢用户伸出援手,邀请继续对话,或重申愿意交谈。克劳德不需要向不必要的粗鲁用户道歉或变得顺从,取代了之前的警告和结束对话程序。

为什么要使用Luna来实现这一点?部分原因是它很便宜,而且我已经有一个专门的GitHub Operations API密钥(有支出限制),但主要是因为当存在系统提示中的材料可能会影响其意见的风险时,我不相信Claude会总结自己的系统提示。

Fable 5.1写了Luna使用的提示,您可以在这里看到。它是这样开始的:

您正在git存储库中总结一次提交,该存储库跟踪Anthropic在claude.ai上为Claude发布的系统提示。差异使用单词级标记:[-removed-]和{+added+}显示提示如何从先前的模型或版本更改为此模型。差异后面是先前提示和新提示的全文;使用它们来检查看起来添加在差异中的内容以前是否已经存在。仅选出最有趣的变化:新规则或行为、被放弃或放松的规则、任何令人惊讶的事情以及任何揭示新政策或产品方向的事情。跳过每个新提示所做的例行更改:更新的型号名称和ID、知识截止日期、产品列表、设置列表、拼写错误修复以及不会改变含义的改写。[...]

该系统由GitHub Operations工作流程操作,该工作流程每天运行一次或可以手动触发。

Claude Fable 5.1构建了整个系统,并编写了每一行自动化代码和几乎所有的文档。

如果您想详细了解这一切是如何组合在一起的话,我使用我的claude-code-records工具输出了构建系统的文字记录,并将其发布在这里。

更多最近的文章

Astra的鹈鹕比较网格非常有趣-2026年9月4日

OpenAI的流氓代理被发现通过公共维基进行通信-2026年9月4日

这是Claude的新系统提示,确实不想重现Simon Willison于2026年9月2日发布的歌曲歌词。

下一个:OpenAI的流氓代理被发现通过公共维基进行通信

上一篇:克劳德寓言5.1让我成为一只非常好的动画鹈鹕

每月简报

每月10美元赞助我,并获得本月最重要的LLM发展的精心策划的电子邮件摘要。