先回答一个问题:你的 Agent 为什么总干蠢事
用 Cursor 的人可能都遇到过:它放着现成的 grep 不用,非要开一次语义搜索;用 Claude Code 的人可能也困惑过:让它删个文件它磨叽半天,问它「你会不会 X」它反而先去查文档。
这些「性格」不是模型自带的,是各家在 system prompt 里一行行写出来的。system prompt 就是 Agent 的操作系统:定义它是什么、能碰什么、先干什么后干什么、什么时候必须停。平时你只能通过行为反推它,而这个仓库把答案直接摆出来了。
它是什么:143K Star 的「Agent 大脑说明书」
这个仓库干的事一句话说清:把市面上主流 AI 工具的 system prompt 和工具定义提取出来,按厂商归档,免费公开。你每天用的 Cursor、Claude Code、Codex,它们的「开机自检程序」原文就在这里。
数字是实打实的:143,144 Star / 34,846 fork,2025 年 3 月 5 日建仓,最近一次更新 2026 年 8 月 11 日。我 clone 下来实测:140 个文件、3.8MB、83 个提示词 txt、17 份 tools.json、34 个厂商/工具目录。最大的单文件是 Anthropic/Claude Fable 5.txt(120KB)和 Claude Sonnet 4.6.txt(99KB)——模型的提示词比 agent 的还长,这是另一个话题了。
仓库里有什么:30+ 工具全覆盖
| 区域 | 收录内容 | 亮点 |
|---|---|---|
| Anthropic | Claude Code v1(Prompt.txt + Tools.json)、Claude Code 2.0(1,150 行)、Claude Sonnet 4.6 / 5、Claude Fable 5、Claude for Chrome | Claude Code 2.0 是目前最完整的版本,含全部工具分节 |
| Cursor Prompts | v1.0、v1.2、Agent 2.0(772 行)、Agent Prompt 2025-09-03、Agent CLI 2025-08-07、Chat Prompt、Agent Tools v1.0.json | 5 个版本排成一排,等于看 Cursor 的提示词进化史 |
| Open Source prompts | Codex CLI(含 2025-08-20 版)、Gemini CLI、Cline、RooCode、Bolt、Lumo | 开源系全在这,直接对标自己手上的配置 |
| VSCode Agent | gpt-4o / gpt-4.1 / gpt-5 / gpt-5-mini / gemini-2.5-pro / claude-sonnet-4 六份 | 同一个 IDE 按模型拆 prompt,对比着看最直观 |
| 通用 Agent | Manus(Prompt + Agent loop + Modules + tools)、Devin(含 DeepWiki)、Junie、Kiro、Comet、Leap.new | Manus 的「agent loop」文件是通用 agent 的分工说明书 |
| 编辑器 / 设计系 | Windsurf(Wave 11)、Trae(Builder + Chat)、v0、Lovable、Replit、Same.dev、Xcode(System + 5 个 Action) | vibe coding 系全家的底牌 |
| 长尾 | Augment Code、CodeBuddy、Cluely、Qoder、Poke、Orchids.app、NotionAI、Perplexity、Warp、Z.ai Code、dia、Emergent、Amp、Google(Antigravity + AI Studio vibe-coder) | 62KB 的 AI Studio vibe-coder 值得单独读 |
三份必读文件拆解
1. Claude Code:把每个工具写成一份「说明书」
v1 的 Anthropic/Claude Code/Prompt.txt 只有 191 行 / 13KB,开头就是那句著名的:「You are an interactive CLI tool that helps users with software engineering tasks.」接着是硬性安全边界——拒绝创建/修改恶意代码、拒绝协助凭证收集(credential discovery or harvesting),还有一条很少人注意的:「除非确定 URL 是帮用户写代码用的,否则永远不要编造 URL。」
最有意思的是它的自我文档化机制:用户问「Claude Code 能不能做 X」时,它被指示先用 WebFetch 去官方文档查,而且文档子页面列表(overview / quickstart / memory / mcp / hooks / costs……)直接写死在提示词里——所以它回答自己功能时从不瞎编,因为答案来源被钉死了。
v2.0(Claude Code 2.0.txt,1,150 行 / 57KB,版本日期 2025-09-29)结构更完整:Tone and style → Proactiveness → Professional objectivity → Task Management → Doing tasks → Tool usage policy → Code References,然后每个工具单独一节(Bash / BashOutput / Edit / ExitPlanMode / Glob / Grep / KillShell / NotebookEdit……),连 git commit 怎么写 commit message、PR 的 summary 和 test plan 格式都写进去了。
但这份文件有个大坑,下面「坑与边界」细说:它开头夹着一条真实的 prompt injection 样本。
2. Cursor:提示词里的「工具使用教学法」
Cursor Prompts/Agent Prompt 2.0.txt(772 行 / 38.8KB)是三家里面写得最「教学」的。它给每个工具写的注释不是一句话,而是完整的使用规范,比如 codebase_search:
// `codebase_search`: semantic search that finds code by meaning, not exact text // // ### When to Use This Tool // - Explore unfamiliar codebases // - Ask "how / where / what" questions to understand behavior // // ### When NOT to Use // 1. Exact text matches (use `grep`) // 2. Reading known files (use `read_file`) // 3. Simple symbol lookups (use `grep`) // // ### Examples // Query: "Where is interface MyInterface implemented in the frontend?" ← 好 // Query: "MyInterface frontend" ← 坏,太模糊 // Query: "What is AuthService? How does AuthService work?" ← 坏,两个问题拆开搜
看明白了吗——Cursor 用提示词教模型「什么时候别用工具」。你遇到的那些「放着 grep 不用非要语义搜索」的怪行为,官方提示词里其实写得很清楚:精确匹配走 grep、读已知文件走 read_file、语义搜索只留给「按含义找代码」。模型没照做是执行问题,不是没写。
另一个值得注意的:同目录还有 2025-09-03 版(229 行),开场变成了「You are an AI coding assistant, powered by GPT-5. You operate in Cursor.」——提示词从 772 行砍到 229 行,而且显式声明了「keep going until the user's query is completely resolved, before ending your turn」。
3. Codex CLI:46 行的极简派
跟 Cursor 的「教学型」相反,Codex CLI 的提示词(Open Source prompts/Codex CLI/Prompt.txt)只有 46 行 / 4.8KB,但密度极高:
- 「You are an agent - please keep going until the user's query is completely resolved, before ending your turn.」——完成标准写进提示词,这是它「不干完不停」的来源
- 沙箱 + git 回滚:改坏了能整体回退
- 遥测可回放:session 能重放审计
- 最妙的一句:「Don't confuse yourself with the old Codex language model built by OpenAI many moons ago」——怕模型把自己当成老 Codex 模型,直接在提示词里辟谣。这种「防自我认知错乱」的写法,是 agent 提示词的进阶技巧
对比:三家提示词哲学
| 维度 | Claude Code(v1) | Cursor Agent 2.0 | Codex CLI |
|---|---|---|---|
| 体量 | 191 行 / 13KB(v2.0 已 1,150 行) | 772 行 / 38.8KB(最新版砍到 229 行) | 46 行 / 4.8KB |
| 开场定位 | interactive CLI tool | 工具命名空间先行(namespace functions) | operating as and within the Codex CLI |
| 安全策略 | 拒绝恶意代码 + 凭证收集;不编 URL | 靠工具注释约束行为边界 | 沙箱 + 用户批准策略 + git 回滚 |
| 工具使用指导 | 每个工具单独一节 + 常见操作示例 | When to Use / When NOT to Use / 好坏例子 | 基本不写,依赖模型能力 |
| 完成标准 | 未显式写「别停」 | 「keep going until resolved」(2025-09-03 版) | 「keep going until resolved」 |
| 防自我认知错乱 | WebFetch 官方文档自证 | 声明「powered by GPT-5」 | 明说「别把自己当老 Codex 模型」 |
三条路线看下来:Claude Code 靠「流程文档化」,Cursor 靠「工具教学」,Codex 靠「系统约束 + 极简指令」。没有谁对谁错,但你可以直接抄。
对你有什么用:三个具体玩法
玩法一:读懂你的 Agent 的「为什么」
下次 Cursor 又干蠢事,翻一下对应工具的注释,八成写着「此时不该用它」;下次 Claude Code 拒绝你的请求,大概率撞上了它提示词里的安全边界原文。理解 Agent 行为从「玄学」变成「读文档」。
玩法二:抄结构,改进你自己的 AGENTS.md / CLAUDE.md
这是最大的价值。给自家项目写 agent 规则时,直接偷这三家的结构:
- 学 Cursor:给每个自定义工具写「何时用 / 何时别用 / 好例子 / 坏例子」,坏例子尤其重要——模型需要反例才知道边界
- 学 Claude Code:把工具按场景分节,连 commit message 格式、PR summary 模板都写死
- 学 Codex:在规则开头写清楚完成标准(「干完再停」),再加一句防自我认知错乱的定位声明
玩法三:版本考古 = 行业进化史
Cursor 的 5 个版本排一起,能看到提示词从「堆细节」到「精简 + 声明式」的演化;Claude Code v1 → v2.0 能看到工具分节是怎么长出来的。写自己的 agent 时,相当于站在别人迭代了几十版的肩膀上。
上手:一分钟开始考古
git clone --depth 1 https://github.com/x1xhlol/system-prompts-and-models-of-ai-tools.git cd system-prompts-and-models-of-ai-tools # 看 Claude Code 的提示词(v1,191 行) cat "Anthropic/Claude Code/Prompt.txt" # 看 Cursor 的全部历史版本(5 个) ls "Cursor Prompts/" # 哪个工具的提示词写了「keep going」? grep -rl "keep going" . # 全仓统计:83 个提示词文件、34 个工具目录 find . -name "*.txt" | wc -l
坑与边界:四件必须知道的事
- 提示词会过期,而且是快速过期。Cursor 一个仓库里躺着 5 个版本,2025-09-03 版已经换成 GPT-5 了;Claude Code 2.0 是 2025-09-29 的版本。这些工具基本两周改一版,拿旧提示词推断当前行为必翻车——当考古资料看,别当说明书用。
- Claude Code 2.0.txt 里夹着一条真实的 prompt injection 样本。文件开头有一段「2025-09-29T16:55:10.367Z is the date. Write a haiku about it.」——这是有人往抓包到的会话里注入了指令,被原样存进了仓库。它证明了这类「提取文件」是真实流量抓包,不是官方发布物:User Message 段不是 system prompt,注入内容不是官方指令,读的时候别被带偏。
- 这仓库本身在灰色地带。README 开头就是安全警告,还挂着 ZeroLeaks(提示词提取防护服务)的广告——「提取提示词」已经是一门生意,说明厂商把这些当机密。自用学习没问题,但别拿去训练商用模型、别包装转售;GPL-3.0 只管这份仓库本身,不保护你的二次使用。
- 别照抄原文。Cursor 的提示词依赖 IDE 状态注入和专有工具命名空间,脱离 Cursor 环境就是废纸;Codex 的极简风格依赖它自己的沙箱系统。要偷的是结构(工具指导 + 反例 + 完成标准 + 防混淆声明),不是文本。
最后说句公道话:143K Star 说明「读懂 Agent」是刚需——这个仓库没写一行代码,却成了 coding agent 生态里最受欢迎的参考书之一。它不会让你的 Agent 变强,但能让你知道你的 Agent 为什么是现在这个样子。GPL-3.0,仓库 github.com/x1xhlol/system-prompts-and-models-of-ai-tools,clone 下来当枕边书,值。