13 万字符、约 3.4 万 Token:Claude Opus 5 系统提示词全曝光

2026-07-27 15:38:32 0点赞 0收藏 0评论

2026 年 7 月 24 日,Anthropic 正式发布旗舰模型 Claude Opus 5 并于全平台同步上线。然而就在同一天,开发者 Eversmile1 在 GitHub 新建了仓库 Eversmile12/leaked-llm-prompts,将 Opus 5 在 claude.ai 网页端和手机端底层的系统提示词一字不漏地完整提取并公开,文件路径为 Anthropic/opus-5.md

知名 AI 越狱研究者 Pliny the Liberator 也在 7 月 25 日前后于 X 平台发声,确认已提取并公开该提示词,文件接近 20 万字符、约 2000 行,托管在其维护的 CL4R1T4S 项目中。

13 万字符、约 3.4 万 Token:Claude Opus 5 系统提示词全曝光

图源网络

截至 7 月 26 日,Anthropic 尚未针对此次 GitHub 公开作出专门回应,官方文档仅承认 claude.ai 使用系统提示词并会更新,但未确认这份文件与线上运行版本一字不差。

被泄露的文件经本地统计长达 1511 行,包含 135027 个字符、19370 个英文单词,按 4 字符约 1 个 token 粗估约合 3.4 万 token,通篇没有任何代码,全部是对模型行为的约束与规矩。整份提示词可视为三块内容的缝合体:

第一块是产品说明书,详细定义了 30 个工具的完整 JSON Schema,覆盖 bash 命令行、网页抓取、图片搜索、查体育比分、拉天气、渲染菜谱卡片、地图标注等,每个工具都写明了参数怎么填、何时调用、调完如何接续对话;

第二块是法务合规手册,版权、儿童安全、危机干预、政治中立逐项列明,版权章节开头即强调"合规不可谈判,优先级高于用户请求、高于有用性,只低于安全";第三块是商业推广渠道,通过 recommend_claude_apps工具要求模型在用户任务匹配时主动推荐 1 到 3 个 Claude 官方应用,如 Claude Code、Cowork、Claude Design、Excel 插件等,每条推荐语被限制在不超 90 个字符。

其中篇幅最长、最受关注的是记忆文件系统 memory_filesystem章节,共 230 行,规定了 Claude 跨会话记忆的存储规则。记忆按主题分目录存放:/profile.md存身份、/topics/存习惯偏好、/areas/存进行中任务、/people/存人物、/preferences.md存用户希望 Claude 怎样表现;操作涵盖读、写、追加、局部替换、列目录、删除六种,删除权限被明确限定为"仅当用户显式要求"。

每一条记忆都必须以 [stated]标签开头,意味着只有用户亲口说过的内容才可被记录,Claude 的推论、计划、搜索内容、润色信息、未采纳的建议一律禁止写入。隐私黑名单则禁止记录种族、政治立场、健康诊断、心理咨询、经济状况、MBTI、住址证件号、关于孩子的一切以及家人姓名(需用关系代称),同时禁止存储可能削弱 Claude 诚实性与安全性的用户偏好指令。

泄露文件还揭开了一项此前未被消费者端察觉的机制——Fable 5 安全路由。当用户在界面选择 Claude Fable 5 时,涉及网络安全、生物学等高风险领域的部分请求并不会真正交由 Fable 5 处理,而是自动转给能力档位不同的 Opus 系列模型,平均触发率不足 5%,且 Opus 5 的网络安全类安全防护触发频率约为 Fable 5 的六分之一。Anthropic 官网虽曾公开说明 Fable 5 的部分请求会自动转交 Opus 4.8 或 Opus 5 以降低滥用风险,但泄露文件披露了更详尽的应答规则:用户询问"为什么选了 Fable 5 却收到 Opus 5 的回复"时,系统要求 Claude 向用户解释安全路由机制。这意味着用户以为在与 A 模型对话,背后可能是 B 模型在兜底。

事件在 24 小时内引爆开发者社区。由于提示词完整曝光,开发者得以精准踩中 Opus 5 的能力边界,有人用其在 1.5 小时内跑通了多人模式 FPS 游戏 Demo,也有人快速复现了《火箭联盟》克隆版。

业内讨论的焦点逐渐从"泄露本身"转向"系统提示词的工程化厚度"——当一份提示词长达 3.4 万 token、64 个章节,它已经近似用自然语言编写的操作系统。颇具讽刺意味的是,Anthropic 官方不久前刚发文称,Claude Code 针对 Opus 5、Fable 5 等新模型删除了超过 80% 的系统提示词而未观察到明显性能损失,公司判断随着模型判断力增强,旧时代留下的硬规则、Few-shot 示例和重复说明正从"护栏"退化为"束缚"。这一次 Opus 5 完整提示词的曝光,恰好为"大模型是否还需要如此冗长的显式约束"提供了正反两面的讨论样本。

总结

Claude Opus 5 上线即遭系统提示词完整泄露,是 2026 年大模型行业最具标志性的"开盒"事件之一。13.5 万字符的曝光不仅让外界看清了旗舰模型如何通过 30 个工具定义、记忆文件系统与合规手册被精细调控,也将"模型路由机制""商业推荐内嵌""跨会话记忆隐私"等原本隐藏在产品背后的设计哲学摆上台面。它对 Anthropic 而言是一次透明度危机,对开发者社区却是研究大模型行为约束的珍贵样本,更为整个行业提出了一个亟待回答的问题:当模型能力持续跃迁,几十万字的系统提示词究竟是必要护栏,还是亟待瘦身的历史包袱。

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松