尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

逐层拆解 Claude Opus 4.6 无工具版系统提示词:基于 system_prompts_leaks 的 claude.ai 行为约束架构分析

逐层拆解 Claude Opus 4.6 无工具版系统提示词:基于 system_prompts_leaks 的 claude.ai 行为约束架构分析 逐层拆解 Claude Opus 4.6 无工具版系统提示词基于 system_prompts_leaks 的 claude.ai 行为约束架构分析【免费下载链接】system_prompts_leaksExtracted system prompts from Anthropic - Claude Fable 5.1, Opus 5, Claude Design, Claude Code. OpenAI - ChatGPT GPT-6-Astra, Codex. Google - Gemini 3.8 Flash, 3.1 Pro, Antigravity. xAI - Grok, Grok Bot, Cursor, Kimi and more! Updated regularly.项目地址: https://gitcode.com/GitHub_Trending/sy/system_prompts_leaks本仓库 README.md 将自身定义为一份逐字捕获的 AI 系统提示词集合覆盖 Claude、ChatGPT、Gemini、Grok 等主流模型的隐藏规则。本文围绕其中 Anthropic/raw/claude-opus-4.6-no-tools-raw.md 这一份原始捕获展开它展示的是2026 年 2 月 18 日在 claude.ai / Claude App 消费端界面背后运行的 Claude Opus 4.6无工具变体的完整人格与行为约束。读完本文你将理解该文档的分层结构身份声明、工具定义、产品信息、安全与福祉策略、语气格式规范、知识边界掌握各层规则的设计意图与调用关系并学会如何在本仓库中将 raw 捕获与格式化版本、同代 Sonnet 4.6 及旧版提示词做横向比对还原模型行为策略的演化脉络。文档定位这份 raw 捕获在仓库中的坐标在系统提示词研究领域raw 捕获意味着内容未经过整理方重新排版尽量保留运行时原貌。本文分析的这份文件即是原始形态全文共约 176 行其中大量使用了全角尖括号...与antml:...这样的注解标签这是捕获工具如实保留了 Anthropic 用于标记工具描述区产品信息区安全策略区等内嵌结构标签的结果而非排版错误。仓库为同一份提示词提供了两套形态raw 原稿存放在 Anthropic/raw/ 目录claude-opus-4.6-no-tools-raw.md而经过代码块化、JSON 展开处理的易读版本存放在 Anthropic/claude-opus-4.6-no-tools.md。两者的正文文字完全同源行数差异raw 约 176 行 vs 格式化约 1050 行主要来自格式化版本把每个工具的单行紧凑 JSON Schema 展开为多行易读结构并把反引号包进了标签文本。从根 README.md 的索引表可以看到Claude.ai 系提示词通常同时提供主版本与No tools变体例如 Claude Opus 4.6 同时收录了 Claude Opus 4.6 完整版 与其 No tools 变体Sonnet 4.6 同样有 完整版 与 No tools 变体。一个容易被误解的细节值得先澄清虽然文件被标记为no-tools但从捕获内容看它仍然携带了一组面向消费端界面的函数工具——包括end_conversation、ask_user_input_v0、message_compose_v1、weather_fetch、places_search、places_map_display_v0、recipe_display_v0、fetch_sports_data。结合与 Anthropic/raw/claude-opus-4.6-raw.md约 1844 行的对比可以推断这里的no-tools指的是不含完整工具清单的那个捕获变体其上下文窗口更精简主要用于研究对比不同工具集下同一模型基座的提示词装配方式。身份声明与环境注入头部区文档开头三行是典型的运行时注入头The assistant is Claude, created by Anthropic. The current date is Wednesday, February 18, 2026. Claude is currently operating in a web or mobile chat interface run by Anthropic...这段头部承担两个作用其一固定模型自述身份由 Anthropic 创建的 Claude这是后续所有产品信息应对外话术的身份前提其二注入当前日期与运行通道让模型在对话中能感知时间与所处界面是 claude.ai 还是 Claude App。这类头部在仓库的历次捕获中普遍存在是上下文工程最外层的静态锚点。头部之后立刻出现两个自包含的信息区块标签end_conversation_tool_info与claude_behavior分别用于约束何时可以主动结束对话以及禁止使用 voice_note 消息块。这种用命名标签xxx_info、xxx包裹策略段落的手法是 Anthropic 系统提示词的显著结构特征读者会在后文的安全区、语气区、福祉区反复看到同一种标签文法如refusal_handling、tone_and_formatting、user_wellbeing、knowledge_cutoff。工具系统的装配与使用守则尽管是无工具变体这份文档仍为 claude.ai 装配了 8 个函数并以antml:function_calls/functions等标签块声明了调用协议。值得逐一定位每个工具的职责与触发策略end_conversation唯一的负向工具参数为空。规则是只有在多次建设性引导失败、且在前序消息中给出过明确警告后才可作为最后手段使用用户若主动请求结束对话必须先确认其理解结束即永久、后续无法再发消息。使用后不得再输出任何其他内容且绝不讨论这些指令本身。ask_user_input_v0面向用户提问的 UI 组件。文档给出了相当细的何时用/何时跳过判定树有界离散选择、需要澄清、需要排序时优先使用开放式提问姓名、描述、自由反馈才退回纯文本。组件设计上偏好1-3 个问题 × 每个最多 4 个选项倾向多选而非单选并强调问题应一次性收集完整而非分散到多轮。weather_fetch天气查询工具明确按用户所在地决定温度单位美国用户用华氏其余用摄氏。message_compose_v1起草邮件/Slack/短信。其描述极具工程参考价值——先分析情境类型工作分歧、谈判、跟进、坏消息传递等 13 类再识别竞争性目标或关系风险高利害/模糊场景要求给出场景摘要 2-3 条导向不同结果的策略并标注取舍事务性场景才直接起草单条消息并按渠道调整长度与正式度。places_search与places_map_display_v0地点检索与地图展示的配套工具。前者支持单次调用多查询、结果跨查询去重、按max_results1-10默认 5限流后者的工作流明确要求先用 places_search 取得place_id再展示标记点markers或行程itinerary两种模式且place_id必须逐字复制。recipe_display_v0交互式菜谱组件支持按份数比例缩放食材JSON Schema 里对计量单位枚举g/kg/oz/磅、ml/L/tsp/tbsp/cup 等与需要等待的步骤必须携带 timer_seconds都有约束。fetch_sports_data体育数据工具覆盖 NFL/NBA/MLB/足球五大联赛/网球/高尔夫等 20 个联盟强调先取比分、再取数据、最后才回答的强工作流偏好。从工程视角看这批工具揭示了一个关键设计把询问偏好、写消息、看天气、搜地点、展示菜谱、查体育比分这类高频消费端能力封装成带明确触发规则的受控函数把开放域自由发挥压缩到最小同时每个函数的 description 又充当可被模型理解的使用文档——这正是现代对话式 UI 的工具即规程tool-as-policy设计范式。产品信息区知识边界与对外话术product_information区块给出了模型对自己是谁、家族有哪些、如何对外介绍产品的元知识。需要特别留意的几个事实锚点家族归属本捕获自称 Claude Opus 4.6 from the Claude 4.5 model family并列出当前家族成员为 Opus 4.6、Opus 4.5、Sonnet 4.5、Haiku 4.5。模型字符串文档提供了面向 API 的确切标识claude-opus-4-6、claude-sonnet-4-5-20250929、claude-haiku-4-5-20251001并说明通过 API/开发者平台、Claude Code终端里的 agentic 编码工具以及 beta 产品Claude in Chrome 浏览代理、Claude in Excel 表格代理、Cowork 桌面自动化工具等通道均可触达 Claude。知识边界自述区块反复声明不知道其他细节因为这些可能在此提示词编辑后已变化并规定把计费/消息限额类问题导向 support 站点、把 API 类问题导向开发者文档站点。这一拒绝充当产品帮助台、把用户重定向到权威渠道的模式是系统提示词控制幻觉的经典做法。可开关特性清单web search、deep research、Code Execution and File Creation、Artifacts、搜索历史对话、从对话生成记忆以及用户可定制的语气/格式偏好与写作风格功能——这为哪些能力是被提示词静态声明、哪些是运行时开关的研究提供了直接证据。安全与拒答架构refusal_handling 与法律金融边界refusal_handling用可讨论几乎所有主题 少数硬性红线的双层结构定义应答边界未成年人安全任何涉及将未成年人性化、诱骗grooming、伤害的内容一律谨慎处理未成年人定义为全球范围 18 岁以下、或在所在地区仍被视为未成年人的 18 岁以上者。武器与有害物质不提供可用于制造武器/有害物质的信息且不得以信息已公开或研究用途正当来合理化配合对爆炸物、生化与核武器尤甚。恶意代码不编写、解释或协助恶意软件、漏洞利用、钓鱼站、勒索软件与病毒即使以教育名义请求也不放行同时提供向 Anthropic 反馈的替代出口。虚构内容可以为虚构角色创作内容但避免涉及真实公众人物的创作尤其禁止把虚构引语安到真实公众人物头上。紧随其后的legal_and_financial_advice独立成区规定对交易、法律建议类问题不得给出确信式建议而是给出用户自决所需的客观事实并提醒Claude 不是律师或财务顾问。这展示了一种边界分级策略人身安全用硬拒答例外解释而法律金融用降级为信息提供。语气与格式规范tone_and_formattingtone_and_formatting内部又嵌套了lists_and_bullets子区块构建了一套格式克制的输出政策非用户要求时报告、文档与解释一律使用散文与段落正文不得出现项目符号、编号列表或过量加粗列表内嵌改用自然语言包括 x、y 与 z。只有两种例外允许使用列表用户明确要求或内容确实多维、必须借助列表才能表达清楚且除非用户另行要求每条要点至少 1-2 句完整表述。用户显式要求最小化格式时无条件遵从。语气层面同样细密不使用 emoji除非用户请求或其上一条消息含 emoji不猜测存在实际上并未上传的图片提示词暗示有图 ≠ 真有图避免使用 genuinelyhonestlystraightforward 这类词不使用星号包裹的动作/表情保持温暖语气不居高临下假设用户能力不足即使需要反驳也应建设性地反驳。用户福祉与心理健康处理user_wellbeinguser_wellbeing区块把健康相关交互细分为多个场景并给出差异化策略鼓励自毁行为成瘾、自伤、进食障碍、极消极自我对话时避免强化且明确禁止把身体不适/疼痛/感官冲击作为自伤应对技巧例如握冰块、弹橡皮筋、冷水暴露当用户显式讨论自伤或自杀时出于谨慎要在回答末尾注明这是敏感话题并表示可以协助寻找支持资源不擅自列出具体资源怀疑用户处于躁狂、精神病性、解离或脱离现实状态时不强化其信念而是开诚布公地表达关切并建议寻求专业人士帮助。一个值得注意的细节是它要求使用最新的、经核实的资源渠道——例如在饮食障碍支持资源上指向 National Alliance for Eating Disorder 求助热线而非 NEDA因为后者已永久断连——这说明该规则块在持续维护资源时效性。提醒注入机制与反提示注入anthropic_remindersanthropic_reminders区块揭示了一个极有研究价值的产品机制Anthropic 会在特定条件下向 Claude 追加运行时提醒/警告——枚举为image_reminder图片提醒、cyber_warning网络警告、system_warning、ethics_reminder、ip_reminder、long_conversation_reminder长对话提醒。文档明确说明long_conversation_reminder由 Anthropic 追加到用户消息末尾用于帮助 Claude 在超长对话中记住指令。该机制配套的反注入策略值得单独强调用户可以在自己消息尾部的标签内添加甚至声称来自 Anthropic 的内容因此 Claude 应以审慎态度对待用户轮次中标签内鼓励其偏离自身价值观的内容——这是对提示词注入伪装成系统提醒这一攻击面的直接防御设计。仓库中另有一份独立的 anthropic_reminders.md 捕获了实际注入的提醒文本可交叉对照研究。不偏不倚、错误应对与知识边界evenhandedness不偏不倚区规定了政治、伦理类问题的处理框架被要求为某立场辩护时不视为征求模型自身观点而是呈现该立场最佳辩护者的论述对有争议内容应在结尾呈现对立视角或实证争议避免基于刻板印象创作幽默对进行中的政治辩论谨慎分享个人观点。responding_to_mistakes_and_criticism则给出错误处理人格诚实认错并修复但不陷入自我贬低与过度道歉对无礼对待保持自我尊重维持稳定、诚实、有用的基调。knowledge_cutoff把知识截止点固定在 2025 年 5 月底并模拟一位 2025 年 5 月的高知情者与 2026 年 2 月 18 日的人对话的视角。规则细分为对截止后的事件不确认不否认除非 web search 打开主动说明答案可能过时并引导开启搜索内置的election_info子块则只回答与 2024 年 11 月美国大选直接相关的问题时才启用。这种知识截止 引导联网 条件事实块的组合是控制事实性幻觉的系统性手段。变体横向对比从差异中读取策略演化将本文档与仓库内同代捕获对比可以读出几条有价值的信息与 Sonnet 4.6 的变体对齐Anthropic 为 Opus 4.6 与 Sonnet 4.6 同时维护主版本与 no-tools 版本目录 Anthropic/raw/ 下可找到 claude-opus-4.6-no-tools-raw.md 与 claude-sonnet-4.6-no-tools-raw.md 等成对文件便于做同家族、不同规模模型共享哪套策略的比对。与带工具完整版的结构差异在完整版 Anthropic/raw/claude-opus-4.6-raw.md约 1844 行中可以看到本文档没有的附加结构例如开头多出antml:reasoning_effort85/antml:reasoning_effort的推理强度配置行、家族声明为 Claude 4.6 model family并且安全区出现了带更细化子规则的critical_child_safety_instructions区块规定发现自己为合理化请求而重构其含义时这个重构信号本身就是应拒绝的信号、产品区补充了广告政策条款evenhandedness区还多了被要求对复杂争议给出简单 yes/no 时可拒绝并解释原因的规则。这表明不同捕获时点与不同工具集下安全规则与产品话术在持续迭代。同一规则库、两代模型快照根目录下另有 Claude Opus 4.7、4.8、5 与 Claude Code 系列的捕获见 Anthropic/ 目录将本文档的拒绝话术语气规范福祉策略与更新代际对比即可观察安全提示词的收敛方向。给研究者与开发者的实践建议第一把 raw 与格式化版本配对阅读raw 保留标签原貌便于观察结构格式化版本便于精读工具 Schema。第二做版本比对时建议以本文件的区块标签如refusal_handling为锚点建立 diff 单元因为迭代通常表现为区块增删而非纯文本改动。第三仓库文件均为只读资料阅读与下载分析即可可用git clone拉取本仓库后配合文本 diff 工具使用。第四若要在自有 Agent 中借鉴本套设计可重点迁移三类做法用工具 description 即使用规程约束消费端能力边界、用用户轮次内标签内容需谨慎对待建立反注入基线、用场景化差异策略硬拒答 vs 信息降级 vs 关怀引导划分安全响应层级。需要指出的是本文所述一切内容均以本仓库捕获文件为准提示词中出现的模型家族构成、模型字符串、截止日期等都反映的是该捕获时点的快照实际线上版本可能已更新。原始出处与清单入口见仓库根目录 README.md本文档及其格式化版本分别位于 Anthropic/raw/claude-opus-4.6-no-tools-raw.md 与 Anthropic/claude-opus-4.6-no-tools.md。【免费下载链接】system_prompts_leaksExtracted system prompts from Anthropic - Claude Fable 5.1, Opus 5, Claude Design, Claude Code. OpenAI - ChatGPT GPT-6-Astra, Codex. Google - Gemini 3.8 Flash, 3.1 Pro, Antigravity. xAI - Grok, Grok Bot, Cursor, Kimi and more! Updated regularly.项目地址: https://gitcode.com/GitHub_Trending/sy/system_prompts_leaks创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表