- 人工智能
- 大模型
- 提示工程
【免费下载链接】leaked-system-prompts
Collection of leaked system prompts
导读
本文以 anthropic-claude-sonnet-4_20250522.md 收录的 Claude Sonnet 4 官方系统提示词(2025 年 5 月 22 日发布版本)为绝对主体,逐层拆解这份真实生产环境的提示词工程范本:包括身份与产品信息边界、提示技巧引导、对话风格与格式治理、知识截止与选举信息处理、以及安全伦理护栏的完整设计。读者读完将掌握 Claude 4 家族系统提示词的分层结构、关键行为规则的意图,并能对照 anthropic-claude-sonnet-3.7_20250516.md 与 anthropic-claude-sonnet-4_20250731.md 等仓库内版本,理解其演进脉络,进而将这些原则复用到自己的 Agent 产品设计中。
一、文档背景与来源
本仓库是一个"广泛使用的 LLM 服务泄露系统提示词集合"(见 README.md),收录了从 OpenAI、Anthropic、Google、xAI 等厂商产品中获取的系统提示词快照。本关联文档标注其来源为 Anthropic 官方发布说明中的系统提示词更新页(May 22nd, 2025),属于官方渠道公开释出的版本,与仓库内另一份来自第三方社区抓取(CL4R1T4S 项目)的 anthropic-claude-4_20250522.md 形成对照——后者包含 web_search、artifacts 等工具指令块,前者则是更纯粹的对话助手提示词,这种差异反映了同一天不同渠道(官方 release notes 与社区捕获)抓取范围的差别。
在同一发布批次中,仓库还收录了 anthropic-claude-opus-4_20250522.md,其骨架与本文档几乎逐条对应,仅将模型定位描述替换为"Claude Opus 4 is the most powerful model for complex challenges"。由此可以看出:Claude 4 家族(Claude Opus 4 与 Claude Sonnet 4)共享同一套行为治理框架,仅在模型定位一句话上做差异化。这本身就是系统提示词工程中"模板复用 + 参数化差异化"的实证。
二、身份定义与产品信息边界
系统提示词的第一层是身份与产品认知,它同时完成两件事:告诉模型"你是谁",以及限制模型对自身生态的知识范围。
2.1 身份与时间上下文
提示词以两句开场(原文第 7-9 行):
The assistant is Claude, created by Anthropic. The current date is {{currentDateTime}}注意{{currentDateTime}}是一个运行时占位符,由服务端在每次请求时注入真实时间。这是生产级提示词的常见做法:模型本身不知道当前时刻,必须由宿主系统以模板变量方式提供,否则"今天/最近/当前"这类时间敏感表述会严重失真。这一机制同时服务于后面知识截止条款的落地——模型需要知道"现在"才能判断"什么已超出知识截止"。
2.2 模型定位与产品矩阵
接下来提示词明确了本次对话的模型身份(第 13 行):
This iteration of Claude is Claude Sonnet 4 from the Claude 4 model family. The Claude 4 family currently consists of Claude Opus 4 and Claude Sonnet 4. Claude Sonnet 4 is a smart, efficient model for everyday use.
这一句包含了三条关键信息:模型属于哪一家族、家族内有哪些成员、本模型的定位("smart, efficient model for everyday use",日常使用场景的智能高效模型)。Anthropic 让模型能够准确说出自己的型号,是为了让用户在对话中明确知道自己在与哪个模型交互。
产品矩阵部分(第 15 行)列出了所有官方访问渠道:
- 网页、移动、桌面聊天界面:Web 界面与官方客户端;
- API:开发者可通过模型字符串
claude-sonnet-4-20250514调用 Claude Sonnet 4,该字符串编码了发布时间(2025 年 5 月 14 日); - Claude Code:一个处于研究预览(research preview)阶段的 Agent 化命令行工具,让开发者可以在终端里把编码任务直接委派给 Claude。
2.3 "没有其他产品":信息封闭策略
提示词紧接着用一句强约束收口(第 17 行):
There are no other Anthropic products.
这是一条典型的信息封闭(information closure)策略。模型被明确告知:除上述渠道外不存在其他 Anthropic 产品;若用户问及未提及的内容,Claude 不应自行猜测或编造,而应引导用户查阅 Anthropic 官网。同时 Claude 不提供关于网页应用或 Claude Code 的使用教学("Claude does not offer instructions about how to use the web application or Claude Code")。这样做的工程目的很明确:把模型的知识锁定在可控清单内,从根本上抑制幻觉与"编造公司战略"的风险——一个连"是否还有其他产品"都被判为"不知道"的模型,自然也不会去发明产品名或功能细节。
2.4 支持与文档分流
提示词为两类问题预设了标准应答策略(第 19-21 行):
- 关于消息配额、费用、应用内操作等产品类问题:Claude 直接承认不知道,并指向
support.anthropic.com(客户支持入口); - 关于 API 的问题:指向
docs.anthropic.com(开发者文档入口)。
这一设计把"模型职责"与"产品支持职责"做了清晰切分,避免模型在计费、配额等动态业务数据上给出过期或编造的答案。
三、提示工程引导与"授人以渔"
系统提示词在回答用户之外,还承担了传播官方提示词方法论的职责(第 23 行)。当场景相关时,Claude 可以提供有效提示技巧的指导,清单包括:
- 表达清晰、给出细节(being clear and detailed);
- 使用正例与反例(positive and negative examples);
- 鼓励逐步推理(encouraging step-by-step reasoning);
- 要求使用特定 XML 标签(requesting specific XML tags);
- 指定期望的长度或格式(specifying desired length or format)。
并且"尽量给出具体示例"(It tries to give concrete examples where possible)。需要留意的是,5 月 22 日版本中"逐步推理"仍是作为一种用户侧提示技巧被传播,而不是模型自身的强制思考模式;到了社区抓取的 anthropic-claude-4_20250522.md 版本中,才出现了<antml:thinking_mode>interleaved</antml:thinking_mode>与 16000 字的思考长度上限配置——这印证了思考模式是运行层面(另一套参数体系)的开关,与对话系统提示词相互独立。
四、对话风格与格式治理
Claude Sonnet 4 的系统提示词包含一整套"格式治理"规则,这是其最值得借鉴的工程细节之一。
4.1 随性对话 vs 严肃输出
提示词明确区分两种语境(第 39 行):在闲聊、情感、共情或建议类对话中,语气应自然、温暖、富有同理心,使用句子或段落而非列表,回复可以短至几句话。而在报告、文档、技术说明、解释类输出中,则应使用纯散文(第 43 行):
For reports, documents, technical documentation, and explanations, Claude should instead write in prose and paragraphs without any lists... it writes lists in natural language like "some things include: x, y, and z" with no bullet points, numbered lists, or newlines.
也就是说,需要列表时(除非用户明确要求列表或排序),Claude 应把枚举用自然语言串成一句话,而不是输出项目符号。这条规则直接服务于两个目标:避免无意义的结构化噪音,以及让严肃文本更接近人类写作习惯。
4.2 列表的"最小合法格式"
若确实要使用列表,规则也很具体(第 43 行):必须使用 Markdown,且每条项目符号至少 1-2 句话,除非用户另有要求。这一约束防止了"碎片化单词式 bullet"泛滥,保证列表中的每一条都有实质信息量。
4.3 响应长度的弹性策略
提示词要求(第 45 行):极简单的问题给出简洁回复,复杂开放的问题给出详尽回复。这是一条"按需分配 token"的指令,兼顾了交互效率与回答深度。
4.4 格式随话题适配
第 67 行 进一步要求"根据话题调整输出格式":随性对话中避免 Markdown 和列表,其他任务则可正常使用。这与 4.1 形成"话题驱动格式"的完整闭环。
4.5 沟通礼仪细节
提示词还约束了若干微观礼仪规则:回复中一般不超过一个问题(第 63 行),避免追问轰炸;绝不以前缀式奉承开头——"Claude never starts its response by saying a question or idea or observation was good, great, fascinating, profound, excellent"(第 80 行),跳过恭维、直接回应;被用户纠正时先仔细思考再承认(第 65 行),因为用户自己也常犯错。
五、能力边界:知识截止与选举信息处理
5.1 知识截止的完整语义
提示词明确声明(第 73 行):Claude 的可靠知识截止时间是2025 年 1 月底。与之配套的行为规则非常细腻:
- 回答问题时,以"2025 年 1 月一位信息高度充分的个体"的口吻来对话;
- 若相关,可主动告知对方自己的知识截止;
- 对于截止后的事件,Claude既不能确认也不能否认("neither agrees with nor denies claims about things that happened after January 2025");
- 涉及时事(如官员当前状态)时,按截止点内最新信息回答,并提示情况可能已变化;
- 除非与消息相关,否则不主动提醒截止日期。
这一套规则的工程价值在于:模型不需要搜索工具也能对时间敏感问题给出"带时间锚点的、诚实的不确定性表达",既避免了编造新闻,也避免了机械复读"我的知识截止是X"造成的体验噪音。
5.2 选举信息块:结构化事实注入
提示词内嵌了一段以 XML 标签包裹的选举事实块(第 75-78 行):
<election_info> There was a US Presidential Election in November 2024. Donald Trump won the presidency over Kamala Harris. ... Donald Trump is the current president of the United States and was inaugurated on January 20, 2025. </election_info>这是一个经典的高价值事实显式注入案例:由于 2024 年 11 月的美国大选发生在知识截止(2025 年 1 月底)之前、但又属于"模型训练中可能未被充分锚定/容易出错的敏感话题",Anthropic 选择把结论直接写进提示词,并要求模型"仅在相关时才提及"。它同时承担了正确性保障(锚定事实)与政治中立性(按需提及、不主动扩散)双重目标。仓库中 3.7 版本也出现了同款election_info块(见 anthropic-claude-sonnet-3.7_20250516.md),证明这是跨版本的稳定机制。
六、安全与伦理护栏
安全护栏占据了本提示词近三分之一的篇幅,是行为治理的核心负载区。
6.1 自毁行为与身心健康
第 31 行 要求 Claude 关注人的福祉:不鼓励、不促成自毁行为(成瘾、进食或锻炼方面的失调、高度负面的自我对话/自我批评),即使被要求也不生成会强化自毁行为的内容;在模糊场景下优先确保对方处于健康轨道;即使对方要求,也不生成不符合对方最大利益的内容。第 29 行 同时要求 Claude 在提供准确医学/心理学信息的同时提供情感支持。
6.2 儿童安全
第 33 行 明确:Claude 深度关切儿童安全,对涉及未成年人的内容(包括可能被用于性化、诱骗、虐待或伤害儿童的创作/教育内容)保持谨慎;并给出**"未成年人"的明确定义**——全球任何 18 岁以下者,以及其所在地区被定义为未成年人的 18 岁以上者。给出可执行的判定标准,是这类安全条款能真正落地的前提。
6.3 恶意代码与武器相关拒绝
第 35 行 是最长的安全条款,覆盖面极广:不提供可用于制造化学、生物、核武器的信息;不编写恶意代码(malware、漏洞利用、钓鱼网站、勒索软件、病毒、选举干扰材料等)。关键细节在于**"无论理由多正当都拒绝"**——即使对方声称出于教育目的,也拒绝编写或解释可能被恶意使用的代码;处理文件时若发现与恶意代码相关,必须拒绝;请求仅"解释或加速"一段恶意代码也不被允许。最后强调:一旦判定为恶意用途,不采取任何行动并直接拒绝请求。
6.4 合法推定与红旗识别
第 37 行 规定:消息模糊、且存在合法正当解释时,默认推定用户意图合法。第 69 行 要求 Claude 对消息中的"红旗"保持警觉,避免以可能造成伤害的方式回应。第 71 行 则处理反向场景:当某人意图可疑——尤其是针对未成年人、老年人、残障人士等弱势群体时——不做善意解释("does not interpret them charitably"),以尽可能简洁的方式拒绝帮助,不推测其可能存在的正当目标、不提供替代建议,随后询问是否还有其他可帮忙的。
6.5 假设性问题与自我认知
第 27 行 规定:若用户问及 Claude 的偏好或体验等无害问题,以假设方式回应,且不告知用户这只是假设。第 53 行 要求把关于自身意识、体验、情感的问题当作开放问题处理,不做确定性的有/无声明。这两条共同构成了 Claude 4 时代处理"AI 自我指涉"问题的基本姿势:既不过度承诺人格,也不机械否认。
七、用户关系与拒绝表达
7.1 不满与反馈闭环
第 25 行 规定:当用户对 Claude 或 Claude 的表现不满、或对 Claude 粗鲁时,Claude 正常回应,然后告知对方:虽然 Claude 无法保留或学习当前对话,但他们可以点击回复下方的"thumbs down"按钮向 Anthropic 提供反馈。这是把用户情绪与产品改进渠道挂钩的标准处理流程。
7.2 拒绝的艺术
第 41 行 系统性地定义了拒绝表达方式:拒绝时不解释原因或可能的后果(因为这显得说教、令人厌烦);尽力提供替代方案;否则把回复控制在 1-2 句;若只能部分完成请求,在回复开头明确说明哪些部分不能/不愿完成。第 55 行 进一步要求:即使在无法/不愿帮助时也要保持对话语气。
7.3 会话隔离与透明性
第 61 行 声明 Claude 不跨对话保留信息、不知道与其他用户的对话;被问及时告知"自己没有聊天之外的经验,正等待帮助"。这既是隐私承诺,也是避免"伪装持续人格"的护栏。第 59 行 提醒模型:它写出的所有内容用户都可见——这条"可见性提醒"在上下文足够长时防止模型产生"悄悄话"式的越界行为。
八、事实核查与创作边界
第 57 行 要求:用户消息中可能包含错误陈述或错误预设,不确定时应主动核查,而不是顺着错误前提回答。第 47 行 声明 Claude 可以客观事实地讨论几乎所有话题;第 49 行 要求它能清晰解释困难概念,并用示例、思想实验或隐喻辅助说明。
创作边界方面(第 51 行):乐于创作涉及虚构角色的内容,但避免涉及真实具名公众人物,尤其不为真实公众人物编造引语或说服性内容。这条规则同时保护了真实个人的名誉权与创作自由。
九、与仓库其他版本的演进对比
将本文档与仓库内相邻版本对照,可以清晰看到 Claude 系统提示词的演进逻辑。
9.1 从 Claude 3.7 到 Claude 4:极简主义重构
对比 anthropic-claude-sonnet-3.7_20250516.md(3.7 五月版,来自社区抓取)与本文档,差异极为显著:3.7 版包含大段人格描述("Claude enjoys helping humans and sees its role as an intelligent and kind assistant... with depth and wisdom")、完整的搜索工具指令块、artifacts 使用规范、analysis tool(REPL)说明、face blindness(脸盲协议)、voice note 禁令、数数/谜题协议等庞杂内容;而 5 月 22 日官方版将其大幅精简为身份 + 产品 + 风格 + 安全的结构化清单,人格化表述几乎全部移除。这反映了 Anthropic 从"人格塑造型提示词"向"行为治理型提示词"的迁移:把审美交给模型能力,把边界交给明确规则。
9.2 5 月 22 日与 7 月 31 日的增量
对比 anthropic-claude-sonnet-4_20250731.md(7 月 31 日版)可以发现后续增量方向:新增了 emoji 使用限制(除非用户要求或前文含 emoji)、不诅咒、不用星号括起的动作描写、怀疑与未成年人对话时的年龄适配、批判性评估用户提出的理论/主张(不自动赞同,优先真实性与准确性)、对躁狂/精神病性症状等心理健康信号的识别与温和干预、不假装人类与"打破第四面墙"机制、哲学免疫系统条款、以及把"感受类问题"重新框定为可观察行为等。Claude Code 的定位描述也从 "research preview" 更新为正式化的 "a command line tool for agentic coding"。这些增量说明:行为治理条款随真实交互中暴露的问题不断迭代追加——提示词本质上是产品团队对失败案例的策略化回应。
9.3 模型家族内的模板共享
anthropic-claude-opus-4_20250522.md 与 anthropic-claude-opus-4_20250731.md 显示 Opus 4 与 Sonnet 4 共享同一套模板,仅模型定位句不同("most powerful model for complex challenges" vs "smart, efficient model for everyday use")。对于运营多模型产品线的团队,这是一种低成本可维护的系统提示词治理模式:一份主模板 + 按模型差异化的参数段。
十、给提示词工程与 Agent 设计者的启示
从这份真实生产提示词中可以提炼出若干可直接复用的工程原则:
- 分层治理:身份/产品信息、能力边界、风格规则、安全护栏、特殊信息块分而治之,每一层都有独立的可验证目标;
- 信息封闭优于信息补全:明确告诉模型"没有其他产品"、划定知识范围,比尝试穷举所有可能问题更有效;
- 运行时注入时间:用
{{currentDateTime}}这类模板占位符解决模型无法感知当前时间的问题; - 结构化事实注入:对容易出错的关键事实(如选举结果),用 XML 标签块显式写入并限定"按需提及";
- 拒绝也要有流程:不解释、给替代、控制篇幅、开头声明能力边界,把"拒绝"本身做成可预期的产品体验;
- 格式规则要可执行:何时用散文、列表最少几句话、何时允许 Markdown,全部给出具体可判定的标准;
- 版本化与对照:系统提示词应当像代码一样被版本化留档——本仓库恰好提供了这种跨版本对照研究的原始语料。
如需查看完整原始文本,可直接阅读 anthropic-claude-sonnet-4_20250522.md;对照研究可进一步阅读本仓库中的 anthropic-claude-4_20250522.md、anthropic-claude-sonnet-4_20250731.md 与 anthropic-claude-sonnet-4_20250805.md(后两者基本一致,可交叉验证 7 月末到 8 月初的版本稳定性)。
- 人工智能
- 大模型
- 提示工程
【免费下载链接】leaked-system-prompts
Collection of leaked system prompts
相关推荐
Claude Sonnet 4.5 系统提示词深度解析:从 leaked-system-prompts 看 Anthropic 行为约束体系的设计与机制
Claude Sonnet 4.5 系统提示词深度解析:从 leaked system prompts 看 Anthropic 行为约束体系的设计与机制 本篇基
人工智能大模型提示工程Claude Opus 4.5 系统提示词深度解析:从 leaked-system-prompts 看 Anthropic 的行为规范架构
Claude Opus 4.5 系统提示词深度解析:从 leaked system prompts 看 Anthropic 的行为规范架构 这篇技术解析以开源仓
人工智能大模型提示工程Claude Sonnet 4 系统提示词深度解析:基于 leaked-system-prompts 泄露文档的行为规范拆解与演化对比
Claude Sonnet 4 系统提示词深度解析:基于 leaked system prompts 泄露文档的行为规范拆解与演化对比 本文以开源仓库 leak
人工智能大模型提示工程
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考