把OpenAI、Anthropic、Google的AI底裤扒光
把OpenAI、Anthropic、Google的AI底裤扒光:一个49k star的仓库火了

你知道AI私下里是怎么被"调教"的吗?
我叫它"AI",它叫自己"助手的思考过程"。这是隐藏在系统提示里的一个小细节。
有人把OpenAI、Anthropic、Google、xAI、Microsoft、Perplexity等几乎所有主流AI公司的系统提示(System Prompt)全部扒了出来,整理成一个开源仓库[1]。一个多月,49k star,被华盛顿邮报报道[2]。
先说清楚:这些系统提示本身不是秘密——但对于研究AI行为、安全策略和产品方向的人来说,它们就是一份绝密的"公司章程"。
一、这个仓库里有什么
仓库名叫 system_prompts_leaks[1],维护者是GitHub用户asgeirtj。他通过社区贡献和自己"钓鱼"(让AI自己暴露自己的提示),系统收集了几乎你能想到的所有AI产品的隐藏指令:
🔹 Anthropic Claude:Claude Fable 5完整提示、Opus 4.8官方行为定义、Sonnet 5最新版本、Claude Code的Glob/Grep工具提示、Deferred tools文档……甚至Claude for Excel/Word/PowerPoint插件提示都有。
🔹 OpenAI ChatGPT:GPT-5.5的Thinking模式/Instant模式/API模式/Pro API/Codex(还有Friendly和Pragmatic人格变体)、GPT-5.4/5.3/5.2/5.1/GPT-4o……几乎所有历史版本的安全策略、工具定义、搜索策略。
🔹 Google Gemini:Gemini 3.5 Flash系统提示、AI Studio版本、完整工具定义(JSON格式)、Jules编程助手、NotebookLM、Gemini in Chrome/Workspace/YouTube。
🔹 xAI Grok:Grok Build CLI Agent提示、Grok 4.3/4.2/4/3.x全系列,包括Personas和安全指令。
🔹 Perplexity:Computer控制代理、Comet浏览器助手、语音助手。
🔹 Microsoft Copilot:GitHub Copilot、VS Code Copilot Agent、Copilot CLI、Copilot for macOS、Copilot in Word。
🔹 其他:Cursor完整提示、Meta AI、Mistral Le Chat、Notion AI、Qwen 3.6 Plus、Docker Gordon AI、ElevenLabs语音Agent、Reddit Answers、Character AI……
总共覆盖了20多家公司、上百个版本、600多次提交。
二、这些提示透露了什么
我翻了一遍,几个让我觉得有意思的点:
❶ Anthropic的"人格定义"比想象中详细
Claude Opus 4.8的官方系统提示里有一段关于行为守则的详细描述——它定义了"当用户要求做XX时,Claude应该如何回应"。推荐标签、是否主动推荐工具、什么时候拒绝回答……都有分值化的规则。不像一个"大模型",像一个装了厚厚员工手册的新人。
❷ OpenAI的Codex有"人格"选择
Codex有Friendly和Pragmatic两种人格变体。前者更温和、会解释为什么要这么改;后者更直接、只给代码不给解释。提示词里甚至详细定义了两种人格的语调和信息密度。你选择的可能不是模型,只是一个Persona配置。
❸ Grok的"叛逆"也是写的
xAI给Grok的安全指令里,明确写了大段关于"你应该在什么场景下幽默、什么场景下严肃"的规则。所以当你觉得Grok的回答很"耿直"时,那不是它的性格——那是提示词定的。
❹ Google的工具定义是目前最完整的
Gemini的提示里包含了完整的JSON格式工具调用定义——每个工具的输入参数、返回值、错误码。像一个完整的API文档。和其他家的"软约束"比,Google更像在写接口说明。
三、这事为什么火
我在便利店管系统的时候,最怕的是被供应商"黑盒化"——系统不告诉你它在做什么,出了问题你只能等售后。后来我们定了一个规矩:所有系统必须开放核心配置日志,IT自己能看到"为什么是这么跑的"。
这些系统提示,就是AI的"核心配置"。
华盛顿邮报的报道标题很直接:《See the hidden rules behind AI. Then use them to rewrite this article.》[2]——"看看AI背后的隐藏规则,然后用它重写这篇文章。"
这恰恰是这个仓库火的根本原因——不再是用户猜测AI为什么会这么回答,而是有人把"说明书"拍在桌上了。
四、对普通用户有什么用
说点实际的。这些泄露的提示对普通用户有几层价值:
🔸 选模型有依据:看到不同模型的系统提示,你就知道哪个更"像人话"、哪个更"像客服"。Claude的设计偏向于深度对话,GPT的设计偏向于高效完成任务——这些都能从提示词里看出来。
🔸 安全边界心里有数:提示词里写明了模型会拒绝什么、什么时候会调用工具。知道这些"红线",至少不会浪费时间跟AI较劲。
🔸 对比竞品够直接:想做AI产品的竞品分析?提示词就是最直接的产品定义文档。Google给工具定义写了完整的JSON schema,其他家还在用人话描述——这本身就是一个产品决策信号。
当然,这些提示随时可能更新。这更像一个"时间胶囊"——记录了2026年上半年各家公司想让自己AI变成什么样子。
一个多月前的GPT-5.5系统提示和现在的已经不是同一套了。但我保留了一份备份——不为别的,就想看看一年后,这些"人格定义"会变成什么样。
👇 关注「亮虾哥」,看看AI底层那些事 👇
每周不定时更新,篇篇说实话。
#AI透明度 #SystemPrompt #开源 #Claude #ChatGPT
参考来源
[1] GitHub — system_prompts_leaks(asgeirtj),覆盖20+公司AI系统提示 [2] The Washington Post — "See the hidden rules behind AI", 2026-05-11
