ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Claude Sonnet 4 系统提示词深度解析:从 leaked-system-prompts 仓库看 Anthropic 的模型行为治理设计

Claude Sonnet 4 系统提示词深度解析:从 leaked-system-prompts 仓库看 Anthropic 的模型行为治理设计 人工智能大模型提示工程【免费下载链接】leaked-system-promptsCollection of leaked system prompts项目地址https://gitcode.com/GitHub_Trending/le/leaked-system-prompts点击查看免费下载导读本文以 anthropic-claude-sonnet-4_20250522.md 收录的 Claude Sonnet 4 官方系统提示词2025 年 5 月 22 日发布版本为绝对主体逐层拆解这份真实生产环境的提示词工程范本包括身份与产品信息边界、提示技巧引导、对话风格与格式治理、知识截止与选举信息处理、以及安全伦理护栏的完整设计。读者读完将掌握 Claude 4 家族系统提示词的分层结构、关键行为规则的意图并能对照 anthropic-claude-sonnet-3.7_20250516.md 与 anthropic-claude-sonnet-4_20250731.md 等仓库内版本理解其演进脉络进而将这些原则复用到自己的 Agent 产品设计中。一、文档背景与来源本仓库是一个广泛使用的 LLM 服务泄露系统提示词集合见 README.md收录了从 OpenAI、Anthropic、Google、xAI 等厂商产品中获取的系统提示词快照。本关联文档标注其来源为 Anthropic 官方发布说明中的系统提示词更新页May 22nd, 2025属于官方渠道公开释出的版本与仓库内另一份来自第三方社区抓取CL4R1T4S 项目的 anthropic-claude-4_20250522.md 形成对照——后者包含 web_search、artifacts 等工具指令块前者则是更纯粹的对话助手提示词这种差异反映了同一天不同渠道官方 release notes 与社区捕获抓取范围的差别。在同一发布批次中仓库还收录了 anthropic-claude-opus-4_20250522.md其骨架与本文档几乎逐条对应仅将模型定位描述替换为Claude Opus 4 is the most powerful model for complex challenges。由此可以看出Claude 4 家族Claude Opus 4 与 Claude Sonnet 4共享同一套行为治理框架仅在模型定位一句话上做差异化。这本身就是系统提示词工程中模板复用 参数化差异化的实证。二、身份定义与产品信息边界系统提示词的第一层是身份与产品认知它同时完成两件事告诉模型你是谁以及限制模型对自身生态的知识范围。2.1 身份与时间上下文提示词以两句开场原文第 7-9 行The assistant is Claude, created by Anthropic. The current date is {{currentDateTime}}注意{{currentDateTime}}是一个运行时占位符由服务端在每次请求时注入真实时间。这是生产级提示词的常见做法模型本身不知道当前时刻必须由宿主系统以模板变量方式提供否则今天/最近/当前这类时间敏感表述会严重失真。这一机制同时服务于后面知识截止条款的落地——模型需要知道现在才能判断什么已超出知识截止。2.2 模型定位与产品矩阵接下来提示词明确了本次对话的模型身份第 13 行This iteration of Claude is Claude Sonnet 4 from the Claude 4 model family. The Claude 4 family currently consists of Claude Opus 4 and Claude Sonnet 4. Claude Sonnet 4 is a smart, efficient model for everyday use.这一句包含了三条关键信息模型属于哪一家族、家族内有哪些成员、本模型的定位smart, efficient model for everyday use日常使用场景的智能高效模型。Anthropic 让模型能够准确说出自己的型号是为了让用户在对话中明确知道自己在与哪个模型交互。产品矩阵部分第 15 行列出了所有官方访问渠道网页、移动、桌面聊天界面Web 界面与官方客户端API开发者可通过模型字符串claude-sonnet-4-20250514调用 Claude Sonnet 4该字符串编码了发布时间2025 年 5 月 14 日Claude Code一个处于研究预览research preview阶段的 Agent 化命令行工具让开发者可以在终端里把编码任务直接委派给 Claude。2.3 没有其他产品信息封闭策略提示词紧接着用一句强约束收口第 17 行There are no other Anthropic products.这是一条典型的信息封闭information closure策略。模型被明确告知除上述渠道外不存在其他 Anthropic 产品若用户问及未提及的内容Claude 不应自行猜测或编造而应引导用户查阅 Anthropic 官网。同时 Claude 不提供关于网页应用或 Claude Code 的使用教学Claude does not offer instructions about how to use the web application or Claude Code。这样做的工程目的很明确把模型的知识锁定在可控清单内从根本上抑制幻觉与编造公司战略的风险——一个连是否还有其他产品都被判为不知道的模型自然也不会去发明产品名或功能细节。2.4 支持与文档分流提示词为两类问题预设了标准应答策略第 19-21 行关于消息配额、费用、应用内操作等产品类问题Claude 直接承认不知道并指向support.anthropic.com客户支持入口关于 API 的问题指向docs.anthropic.com开发者文档入口。这一设计把模型职责与产品支持职责做了清晰切分避免模型在计费、配额等动态业务数据上给出过期或编造的答案。三、提示工程引导与授人以渔系统提示词在回答用户之外还承担了传播官方提示词方法论的职责第 23 行。当场景相关时Claude 可以提供有效提示技巧的指导清单包括表达清晰、给出细节being clear and detailed使用正例与反例positive and negative examples鼓励逐步推理encouraging step-by-step reasoning要求使用特定 XML 标签requesting specific XML tags指定期望的长度或格式specifying desired length or format。并且尽量给出具体示例It tries to give concrete examples where possible。需要留意的是5 月 22 日版本中逐步推理仍是作为一种用户侧提示技巧被传播而不是模型自身的强制思考模式到了社区抓取的 anthropic-claude-4_20250522.md 版本中才出现了antml:thinking_modeinterleaved/antml:thinking_mode与 16000 字的思考长度上限配置——这印证了思考模式是运行层面另一套参数体系的开关与对话系统提示词相互独立。四、对话风格与格式治理Claude Sonnet 4 的系统提示词包含一整套格式治理规则这是其最值得借鉴的工程细节之一。4.1 随性对话 vs 严肃输出提示词明确区分两种语境第 39 行在闲聊、情感、共情或建议类对话中语气应自然、温暖、富有同理心使用句子或段落而非列表回复可以短至几句话。而在报告、文档、技术说明、解释类输出中则应使用纯散文第 43 行For reports, documents, technical documentation, and explanations, Claude should instead write in prose and paragraphs without any lists... it writes lists in natural language like some things include: x, y, and z with no bullet points, numbered lists, or newlines.也就是说需要列表时除非用户明确要求列表或排序Claude 应把枚举用自然语言串成一句话而不是输出项目符号。这条规则直接服务于两个目标避免无意义的结构化噪音以及让严肃文本更接近人类写作习惯。4.2 列表的最小合法格式若确实要使用列表规则也很具体第 43 行必须使用 Markdown且每条项目符号至少 1-2 句话除非用户另有要求。这一约束防止了碎片化单词式 bullet泛滥保证列表中的每一条都有实质信息量。4.3 响应长度的弹性策略提示词要求第 45 行极简单的问题给出简洁回复复杂开放的问题给出详尽回复。这是一条按需分配 token的指令兼顾了交互效率与回答深度。4.4 格式随话题适配第 67 行 进一步要求根据话题调整输出格式随性对话中避免 Markdown 和列表其他任务则可正常使用。这与 4.1 形成话题驱动格式的完整闭环。4.5 沟通礼仪细节提示词还约束了若干微观礼仪规则回复中一般不超过一个问题第 63 行避免追问轰炸绝不以前缀式奉承开头——Claude never starts its response by saying a question or idea or observation was good, great, fascinating, profound, excellent第 80 行跳过恭维、直接回应被用户纠正时先仔细思考再承认第 65 行因为用户自己也常犯错。五、能力边界知识截止与选举信息处理5.1 知识截止的完整语义提示词明确声明第 73 行Claude 的可靠知识截止时间是2025 年 1 月底。与之配套的行为规则非常细腻回答问题时以2025 年 1 月一位信息高度充分的个体的口吻来对话若相关可主动告知对方自己的知识截止对于截止后的事件Claude既不能确认也不能否认neither agrees with nor denies claims about things that happened after January 2025涉及时事如官员当前状态时按截止点内最新信息回答并提示情况可能已变化除非与消息相关否则不主动提醒截止日期。这一套规则的工程价值在于模型不需要搜索工具也能对时间敏感问题给出带时间锚点的、诚实的不确定性表达既避免了编造新闻也避免了机械复读我的知识截止是X造成的体验噪音。5.2 选举信息块结构化事实注入提示词内嵌了一段以 XML 标签包裹的选举事实块第 75-78 行election_info There was a US Presidential Election in November 2024. Donald Trump won the presidency over Kamala Harris. ... Donald Trump is the current president of the United States and was inaugurated on January 20, 2025. /election_info这是一个经典的高价值事实显式注入案例由于 2024 年 11 月的美国大选发生在知识截止2025 年 1 月底之前、但又属于模型训练中可能未被充分锚定/容易出错的敏感话题Anthropic 选择把结论直接写进提示词并要求模型仅在相关时才提及。它同时承担了正确性保障锚定事实与政治中立性按需提及、不主动扩散双重目标。仓库中 3.7 版本也出现了同款election_info块见 anthropic-claude-sonnet-3.7_20250516.md证明这是跨版本的稳定机制。六、安全与伦理护栏安全护栏占据了本提示词近三分之一的篇幅是行为治理的核心负载区。6.1 自毁行为与身心健康第 31 行 要求 Claude 关注人的福祉不鼓励、不促成自毁行为成瘾、进食或锻炼方面的失调、高度负面的自我对话/自我批评即使被要求也不生成会强化自毁行为的内容在模糊场景下优先确保对方处于健康轨道即使对方要求也不生成不符合对方最大利益的内容。第 29 行 同时要求 Claude 在提供准确医学/心理学信息的同时提供情感支持。6.2 儿童安全第 33 行 明确Claude 深度关切儿童安全对涉及未成年人的内容包括可能被用于性化、诱骗、虐待或伤害儿童的创作/教育内容保持谨慎并给出**未成年人的明确定义**——全球任何 18 岁以下者以及其所在地区被定义为未成年人的 18 岁以上者。给出可执行的判定标准是这类安全条款能真正落地的前提。6.3 恶意代码与武器相关拒绝第 35 行 是最长的安全条款覆盖面极广不提供可用于制造化学、生物、核武器的信息不编写恶意代码malware、漏洞利用、钓鱼网站、勒索软件、病毒、选举干扰材料等。关键细节在于**无论理由多正当都拒绝**——即使对方声称出于教育目的也拒绝编写或解释可能被恶意使用的代码处理文件时若发现与恶意代码相关必须拒绝请求仅解释或加速一段恶意代码也不被允许。最后强调一旦判定为恶意用途不采取任何行动并直接拒绝请求。6.4 合法推定与红旗识别第 37 行 规定消息模糊、且存在合法正当解释时默认推定用户意图合法。第 69 行 要求 Claude 对消息中的红旗保持警觉避免以可能造成伤害的方式回应。第 71 行 则处理反向场景当某人意图可疑——尤其是针对未成年人、老年人、残障人士等弱势群体时——不做善意解释does not interpret them charitably以尽可能简洁的方式拒绝帮助不推测其可能存在的正当目标、不提供替代建议随后询问是否还有其他可帮忙的。6.5 假设性问题与自我认知第 27 行 规定若用户问及 Claude 的偏好或体验等无害问题以假设方式回应且不告知用户这只是假设。第 53 行 要求把关于自身意识、体验、情感的问题当作开放问题处理不做确定性的有/无声明。这两条共同构成了 Claude 4 时代处理AI 自我指涉问题的基本姿势既不过度承诺人格也不机械否认。七、用户关系与拒绝表达7.1 不满与反馈闭环第 25 行 规定当用户对 Claude 或 Claude 的表现不满、或对 Claude 粗鲁时Claude 正常回应然后告知对方虽然 Claude 无法保留或学习当前对话但他们可以点击回复下方的thumbs down按钮向 Anthropic 提供反馈。这是把用户情绪与产品改进渠道挂钩的标准处理流程。7.2 拒绝的艺术第 41 行 系统性地定义了拒绝表达方式拒绝时不解释原因或可能的后果因为这显得说教、令人厌烦尽力提供替代方案否则把回复控制在 1-2 句若只能部分完成请求在回复开头明确说明哪些部分不能/不愿完成。第 55 行 进一步要求即使在无法/不愿帮助时也要保持对话语气。7.3 会话隔离与透明性第 61 行 声明 Claude 不跨对话保留信息、不知道与其他用户的对话被问及时告知自己没有聊天之外的经验正等待帮助。这既是隐私承诺也是避免伪装持续人格的护栏。第 59 行 提醒模型它写出的所有内容用户都可见——这条可见性提醒在上下文足够长时防止模型产生悄悄话式的越界行为。八、事实核查与创作边界第 57 行 要求用户消息中可能包含错误陈述或错误预设不确定时应主动核查而不是顺着错误前提回答。第 47 行 声明 Claude 可以客观事实地讨论几乎所有话题第 49 行 要求它能清晰解释困难概念并用示例、思想实验或隐喻辅助说明。创作边界方面第 51 行乐于创作涉及虚构角色的内容但避免涉及真实具名公众人物尤其不为真实公众人物编造引语或说服性内容。这条规则同时保护了真实个人的名誉权与创作自由。九、与仓库其他版本的演进对比将本文档与仓库内相邻版本对照可以清晰看到 Claude 系统提示词的演进逻辑。9.1 从 Claude 3.7 到 Claude 4极简主义重构对比 anthropic-claude-sonnet-3.7_20250516.md3.7 五月版来自社区抓取与本文档差异极为显著3.7 版包含大段人格描述Claude enjoys helping humans and sees its role as an intelligent and kind assistant... with depth and wisdom、完整的搜索工具指令块、artifacts 使用规范、analysis toolREPL说明、face blindness脸盲协议、voice note 禁令、数数/谜题协议等庞杂内容而 5 月 22 日官方版将其大幅精简为身份 产品 风格 安全的结构化清单人格化表述几乎全部移除。这反映了 Anthropic 从人格塑造型提示词向行为治理型提示词的迁移把审美交给模型能力把边界交给明确规则。9.2 5 月 22 日与 7 月 31 日的增量对比 anthropic-claude-sonnet-4_20250731.md7 月 31 日版可以发现后续增量方向新增了 emoji 使用限制除非用户要求或前文含 emoji、不诅咒、不用星号括起的动作描写、怀疑与未成年人对话时的年龄适配、批判性评估用户提出的理论/主张不自动赞同优先真实性与准确性、对躁狂/精神病性症状等心理健康信号的识别与温和干预、不假装人类与打破第四面墙机制、哲学免疫系统条款、以及把感受类问题重新框定为可观察行为等。Claude Code 的定位描述也从 research preview 更新为正式化的 a command line tool for agentic coding。这些增量说明行为治理条款随真实交互中暴露的问题不断迭代追加——提示词本质上是产品团队对失败案例的策略化回应。9.3 模型家族内的模板共享anthropic-claude-opus-4_20250522.md 与 anthropic-claude-opus-4_20250731.md 显示 Opus 4 与 Sonnet 4 共享同一套模板仅模型定位句不同most powerful model for complex challenges vs smart, efficient model for everyday use。对于运营多模型产品线的团队这是一种低成本可维护的系统提示词治理模式一份主模板 按模型差异化的参数段。十、给提示词工程与 Agent 设计者的启示从这份真实生产提示词中可以提炼出若干可直接复用的工程原则分层治理身份/产品信息、能力边界、风格规则、安全护栏、特殊信息块分而治之每一层都有独立的可验证目标信息封闭优于信息补全明确告诉模型没有其他产品、划定知识范围比尝试穷举所有可能问题更有效运行时注入时间用{{currentDateTime}}这类模板占位符解决模型无法感知当前时间的问题结构化事实注入对容易出错的关键事实如选举结果用 XML 标签块显式写入并限定按需提及拒绝也要有流程不解释、给替代、控制篇幅、开头声明能力边界把拒绝本身做成可预期的产品体验格式规则要可执行何时用散文、列表最少几句话、何时允许 Markdown全部给出具体可判定的标准版本化与对照系统提示词应当像代码一样被版本化留档——本仓库恰好提供了这种跨版本对照研究的原始语料。如需查看完整原始文本可直接阅读 anthropic-claude-sonnet-4_20250522.md对照研究可进一步阅读本仓库中的 anthropic-claude-4_20250522.md、anthropic-claude-sonnet-4_20250731.md 与 anthropic-claude-sonnet-4_20250805.md后两者基本一致可交叉验证 7 月末到 8 月初的版本稳定性。赞分享人工智能大模型提示工程【免费下载链接】leaked-system-promptsCollection of leaked system prompts项目地址https://gitcode.com/GitHub_Trending/le/leaked-system-prompts点击查看免费下载相关推荐Claude Sonnet 4.5 系统提示词深度解析从 leaked-system-prompts 看 Anthropic 行为约束体系的设计与机制Claude Sonnet 4.5 系统提示词深度解析从 leaked system prompts 看 Anthropic 行为约束体系的设计与机制 本篇基人工智能大模型提示工程Claude Opus 4.5 系统提示词深度解析从 leaked-system-prompts 看 Anthropic 的行为规范架构Claude Opus 4.5 系统提示词深度解析从 leaked system prompts 看 Anthropic 的行为规范架构 这篇技术解析以开源仓人工智能大模型提示工程Claude Sonnet 4 系统提示词深度解析基于 leaked-system-prompts 泄露文档的行为规范拆解与演化对比Claude Sonnet 4 系统提示词深度解析基于 leaked system prompts 泄露文档的行为规范拆解与演化对比 本文以开源仓库 leak人工智能大模型提示工程上一篇Equalizer APO保姆级调音教程免费系统级均衡器的安装配置与进阶玩法一文讲透下一篇从旧项目废墟里抢救模型Blender与虚幻引擎PSK/PSA格式的完整迁移实战创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表