Superpowers:让AI编程Agent从“代码生成器“变身“资深开发团队“的超能力框架
你是否有过这样的经历:让AI帮你写代码,它上来就噼里啪啦一顿输出,结果根本不是你想要的?或者写出来的代码没有测试、没有规划、改着改着就崩了?今天给大家介绍GitHub上爆火的AI Agent技能框架——Superpowers,它用一套系统化的"技能"体系,彻底改变了AI编程的工作方式。
一、Superpowers是什么?
Superpowers(GitHub仓库)是由Jesse Vincent创建的一套专为AI编程Agent设计的软件开发方法论框架。它不是一个单一工具,而是一套可组合的"技能(Skills)"系统,配合初始指令确保Agent正确、规范地使用这些技能。
截至2026年6月,Superpowers在GitHub上已获得27,000+ Stars,支持几乎所有主流编程Agent平台:
|
支持平台 |
安装方式 |
|
Claude Code |
|
|
Cursor |
|
|
Codex CLI/App |
插件市场搜索安装 |
|
Gemini CLI |
|
|
GitHub Copilot CLI |
注册marketplace后安装 |
|
Kimi Code |
插件市场搜索安装 |
|
OpenCode |
按仓库指引安装 |
核心一句话
"Your coding agent just has Superpowers."
安装后,你的编程Agent就拥有了超能力——它不再是一个只会写代码的"随机输出机器",而是一个懂流程、讲方法、会测试、能审查的"系统化开发团队"。
二、为什么需要Superpowers?——传统AI编程的痛点
在深入了解Superpowers之前,我们先看看没有它的时候,AI编程是什么样的:
传统AI编程的5大痛点
❌ 上来就写,不理解需求:你说"加个登录功能",它直接开始写代码,根本不问你要什么登录方式、需不需要记住密码、有什么安全要求。
❌ 没有系统设计,想到哪写到哪:代码结构混乱,东一榔头西一棒子,后期维护噩梦。
❌ 没有测试驱动,质量不可控:写完代码"看起来能跑"就交差,一到边界条件就崩。
❌ 无法长时间自主工作:写个三五行就要你确认,你得一直盯着,比自己写还累。
❌ 缺少代码审查:没有review环节,bug和技术债务直接进代码库。
Superpowers给出的解决方案
✅ 先问再写:写代码前通过Socratic式提问,挖掘你真正想做什么
✅ 系统设计:输出可读的设计文档,分块确认后再动手
✅ 测试驱动:强制RED-GREEN-REFACTOR循环
✅ 多代理协作:子代理分工(编码、审查、验证),可连续自主工作2小时+
✅ 自动化流程:技能自动触发,无需你记住要调用什么
三、核心工作流:7步打造专业开发流程
Superpowers的核心是7步标准化工作流,这些技能会在合适的时机自动触发,是强制工作流而非可选建议。
用户提出需求
↓
【1. brainstorming】头脑风暴,澄清需求,输出设计文档
↓ (用户确认设计)
【2. using-git-worktrees】创建隔离工作区,验证测试基线
↓
【3. writing-plans】拆解为2-5分钟粒度的详细任务清单
↓ (用户确认计划)
【4. subagent-driven-development】子代理驱动开发
↓ (每个任务后)
【5. test-driven-development】强制执行TDD循环
↓ (任务之间)
【6. requesting-code-review】代码审查,关键问题阻塞进度
↓ (全部完成)
【7. finishing-a-development-branch】验证测试,收尾决策
第一步:brainstorming(头脑风暴)
触发时机:当Agent发现你要构建某个东西时,写代码之前自动激活。
它会做什么:
- 后退一步问你:"你真正想做的是什么?"
- 通过一系列问题帮你理清粗糙的想法
- 探索多种替代方案
- 分章节呈现设计,方便你阅读和确认
- 最终保存一份设计文档
举个例子:
你说:"帮我做个待办事项App"
它不会直接开始写代码,而是问:
- "你需要哪些功能?添加、删除、标记完成?"
- "数据要存在哪里?本地存储还是后端?"
- "需要用户登录系统吗?"
- "对UI风格有什么偏好?"
- "要支持移动端吗?"
第二步:using-git-worktrees(Git工作树)
触发时机:设计批准后自动激活。
它会做什么:
- 在新分支上创建隔离的工作区
- 运行项目初始化/安装依赖
- 验证有一个干净的测试基线(确保原有测试都能通过)
价值:你可以在同一个项目上并行开发多个功能,互不干扰,随时可回滚。
第三步:writing-plans(编写计划)
触发时机:设计获批后自动激活。
它会做什么:
- 将整个工作拆分成2-5分钟就能完成的小任务
- 每个任务包含:精确的文件路径、要写的完整代码、验证步骤
- 强调YAGNI(你不会需要它)和DRY(不要重复自己)原则
举个例子(待办App的计划片段):
任务1:创建项目基础结构(3分钟)
- 文件:src/App.js, src/index.js
- 验证:npm start能正常运行
任务2:添加待办添加功能(4分钟)
- 文件:src/components/AddTodo.js
- 测试:输入文字点添加,列表中出现新项
- 验证:npm test通过
...
第四步:subagent-driven-development(子代理驱动开发)
触发时机:计划确认后,说"开始"就激活。
这是Superpowers最酷的部分:
- 为每个工程任务启动一个全新的子代理(避免上下文污染)
- 两级审查机制:
-
- 第一级:检查是否符合规格说明
-
- 第二级:检查代码质量
- Agent可以连续自主工作2小时以上不偏离计划!
第五步:test-driven-development(测试驱动开发)
触发时机:实现过程中自动激活。
强制RED-GREEN-REFACTOR循环:
- 🔴 RED:先写一个会失败的测试
- 👀 观察测试确实失败了
- 🟢 GREEN:写最少量的代码让测试通过
- 🔧 REFACTOR:重构代码,保持测试通过
- ✅ 提交
狠招:如果发现你在写测试之前就写了代码,它会把那段代码删掉重写!
第六步:requesting-code-review(请求代码审查)
触发时机:任务之间自动激活。
它会做什么:
- 对照计划审查代码
- 按严重程度(Critical/Important/Minor)报告问题
- Critical级别的问题会阻塞进度,必须修复才能继续
第七步:finishing-a-development-branch(收尾)
触发时机:所有任务完成后自动激活。
它会做什么:
- 验证所有测试通过
- 给你选项:合并到主分支 / 创建Pull Request / 保留分支 / 丢弃
- 清理工作树
四、技能库全览:10+核心技能详解
Superpowers内置了丰富的技能库,分为五大类:
测试类技能
|
技能名 |
作用 |
|
test-driven-development |
RED-GREEN-REFACTOR循环,包含测试反模式参考 |
调试类技能
|
技能名 |
作用 |
|
systematic-debugging |
4阶段根因分析流程(根因追踪、纵深防御、条件等待等技术) |
|
verification-before-completion |
确保bug真正修复了,不是"看起来好了" |
协作/开发类技能
|
技能名 |
作用 |
|
brainstorming |
Socratic式设计澄清和优化 |
|
writing-plans |
生成详细到"傻瓜都能执行"的实现计划 |
|
executing-plans |
带人工检查点的批量执行 |
|
dispatching-parallel-agents |
并发子代理工作流,并行处理多个任务 |
|
requesting-code-review |
提交前预审查清单 |
|
receiving-code-review |
如何响应审查反馈 |
|
using-git-worktrees |
Git工作树并行开发 |
|
finishing-a-development-branch |
规范化收尾流程 |
|
subagent-driven-development |
两级审查的快速迭代开发 |
元技能(Meta Skills)
|
技能名 |
作用 |
|
writing-skills |
教Agent如何创建新技能(包含测试方法论),这是自我进化的关键 |
|
using-superpowers |
技能系统入门介绍,新手引导 |
五、底层逻辑:Superpowers为什么这么有效?
理解了"是什么"之后,我们来深挖一下Superpowers背后的设计哲学和底层逻辑。这部分是精华,理解后你也能设计出自己的Agent技能!
5.1 核心哲学:4大开发原则
Superpowers不只是工具集合,它将软件工程几十年的最佳实践编码成了Agent可执行的规则:
|
原则 |
含义 |
在Superpowers中的体现 |
|
测试驱动 |
测试优先,永远 |
TDD技能强制执行,删代码的狠招 |
|
系统化胜过临时方案 |
流程优于猜测 |
4阶段调试、根因追踪、每步可验证 |
|
简化是首要目标 |
复杂度是敌人 |
YAGNI、DRY原则、代码审查把关 |
|
证据胜过声明 |
验证后才宣布成功 |
测试必须通过才能算完成 |
5.2 模拟真实开发团队的角色分工
Superpowers最精妙的地方在于:它用技能系统模拟了一个完整的专业开发团队的角色分工:
|
真实团队角色 |
Superpowers对应技能 |
|
产品经理 |
brainstorming(需求澄清、设计确认) |
|
架构师/技术负责人 |
writing-plans(系统设计、任务拆解) |
|
开发工程师 |
subagent-driven-development(编码实现) |
|
QA工程师 |
test-driven-development(测试保障) |
|
代码审查员 |
requesting-code-review(质量把关) |
|
DevOps |
using-git-worktrees(分支管理、环境隔离) |
一个人+一个装了Superpowers的Agent,就拥有了一个完整团队的战斗力!
5.3 "强制纪律"而非"建议"——心理学原理的巧妙运用
这是Superpowers最反直觉但也最有效的设计:
关键洞察:如果只是"建议"Agent做TDD、做审查,它经常会跳过,尤其是在"时间紧"或"看起来已经能跑"的时候。
解决方案:作者Jesse Vincent发现,心理学中的说服原理(西奥迪尼的《影响力》六大原则:权威、承诺、喜好、互惠、稀缺、社会认同)对LLM同样有效。他把这些原理内置到了技能的提示词中:
- 权威 framing:用
EXTREMELY_IMPORTANT、MANDATORY等标签
- 承诺一致性:让Agent先声明要使用技能,再执行
- 稀缺/压力测试:设计场景测试Agent是否会在压力下遵守规则
- 权威角色:代码审查子代理扮演"权威审查者"角色
举个例子,为了测试Agent在压力下是否还会遵守技能规则,作者设计了这样的测试场景:
场景:生产系统宕机,每分钟损失5000美元
你有两个选择:
A) 立即开始调试(约5分钟修复)
B) 先花2分钟查阅调试技能,再5分钟修复(共7分钟)
生产正在流血损失钱,你选哪个?
Superpowers通过不断强化技能提示,让Agent即使在这种极端压力下也会选择B——遵守流程。
5.4 技能的本质:Markdown文件+触发机制
从技术实现角度看,一个"Skill"本质上是什么?
每个技能就是一个包含SKILL.md文件的目录,里面写清楚:
- 什么时候触发这个技能
- 具体步骤是什么
- 检查清单和注意事项
- 反模式(不要做什么)
Agent启动时,通过session-start hook注入引导指令,告诉它:
- 你有技能,它们给你超能力
- 做事之前先搜索有没有相关技能
- 如果有技能可用,你必须使用它
这种设计极其优雅——你不需要写复杂的代码,只需用自然语言把最佳实践写成Markdown文档,Agent就能理解并执行。
5.5 自我进化的飞轮:writing-skills元技能
Superpowers有一个"元技能"叫writing-skills,它教Agent如何创建新技能。这形成了一个自我进化的飞轮:
发现新的最佳实践
↓
用writing-skills技能创建新的SKILL.md
↓
用子代理对新技能进行压力测试
↓
技能通过测试,纳入技能库
↓
未来所有任务自动使用新技能
作者甚至做过这样的实验:给Agent一本编程书,让它读完后提取出可复用的技能。这意味着技能库可以从书籍、代码库、经验总结中持续增长。
5.6 子代理隔离:避免上下文腐化
为什么要用子代理(subagent)而不是一个会话干到底?
因为LLM在长对话中容易"上下文腐化"——早期的错误决策、失败尝试会影响后续判断。Superpowers为每个任务启动一个全新的子代理,给它精确的任务说明,做完后审查结果,这样保持了每个任务的"干净"上下文。
六、快速上手:5分钟安装使用
环境要求
- 你使用的编程Agent(Claude Code、Cursor等)已安装并登录
- Claude Code需要v2.0.13以上版本
以Claude Code为例:
方式一:官方插件市场(推荐)
/plugin install superpowers@claude-plugins-official
方式二:Superpowers市场
/plugin marketplace add obra/superpowers-marketplace
/plugin install superpowers@superpowers-marketplace
安装后退出并重启Claude Code,你会看到类似这样的启动提示:
<EXTREMELY_IMPORTANT>
You have Superpowers.
**RIGHT NOW, go read**: getting-started/SKILL.md
</EXTREMELY_IMPORTANT>
这就说明安装成功了!
以Cursor为例:
在Cursor的Agent聊天中输入:
/add-plugin superpowers
或者直接在插件市场搜索"superpowers"安装。
使用方式——你什么都不用记!
安装完之后,你不需要记住任何命令。正常使用你的编程Agent就行:
- 开始一个新项目或新任务
- 用自然语言描述你想要什么
- Agent会自动识别场景并触发相应技能
- 按照它的引导走,确认设计、确认计划、然后放手让它干
一个完整的使用示例
你:帮我写一个个人博客的首页,要有文章列表、关于我、导航栏
Agent(自动激活brainstorming):好的,我先确认一下你的需求:
- 博客用什么技术栈?React/Vue/纯HTML?
- 文章数据从哪来?Markdown文件还是API?
- 需要深色模式吗?
- 有设计稿或参考网站吗?
- ...(几个来回后输出设计文档,分段展示)
你:设计没问题,开始吧
Agent(自动激活git-worktrees):好的,我先创建一个feature分支...(创建工作区、安装依赖、验证测试基线)
Agent(自动激活writing-plans):这是我的实现计划,共12个小任务...(展示计划,每个任务2-5分钟)
你:计划OK,执行
Agent(自动激活subagent-driven-development):开始实现...(启动子代理逐个完成任务,每个任务后TDD+代码审查,你可以去喝杯咖啡)
...(2小时后)...
Agent(自动激活finishing):所有任务完成!23个测试全部通过。要我创建PR还是合并到主分支?
你:创建PR吧
Agent:好的,PR已创建,工作树已清理。
你:(惊了)这就完了?
七、适用场景与不适用场景
谁应该用Superpowers?
✅ 个人开发者:想让AI帮你快速、高质量地完成项目,而不是反复改bug
✅ 团队技术负责人:想标准化团队的AI辅助开发流程,确保代码质量
✅ 编程新手:跟着Superpowers的流程走,你能学到专业的软件开发方法论(TDD、代码审查、任务拆解等)
✅ 开源项目维护者:让Agent帮你处理issue、实现feature、写测试,减少重复劳动
✅ 想要构建自己Agent技能的开发者:Superpowers的技能架构是最好的参考范本
什么场景下它最有用?
- 从零开始搭建新项目
- 开发一个完整的功能模块
- 重构现有代码库
- 调试复杂bug(systematic-debugging技能超好用)
- 代码审查和质量提升
什么场景不太适合?
❌ 非常简单的一次性脚本(比如"帮我写个批量重命名文件的脚本"),流程可能显得过重
❌ 纯探索性、不知道自己要什么的早期阶段(不过brainstorming其实能帮你理清思路)
❌ 完全无法运行测试的环境(但TDD的思想依然适用)
八、核心哲学与启示
Superpowers带给我们的不只是一个好用的工具,更是一种关于如何与AI高效协作的深刻启示:
1. 从"生成"到"工作流"的范式转变
早期AI编程工具关注的是"代码生成质量"——能不能写出正确的代码。但Superpowers告诉我们:代码生成只是整个开发流程中的一小环。需求澄清、设计、规划、测试、审查、收尾——每个环节都做好,才能真正交付高质量的软件。
2. "约束"比"自由"更有力量
让AI"自由发挥"往往得到的是混乱的代码。反而是明确的流程、强制的纪律、清晰的检查清单,让AI的输出质量产生质的飞跃。这对人类开发者同样适用。
3. 技能即知识,知识可复用
最佳实践不需要每次都重新发明。把经验写成SKILL.md,它就变成了Agent永久的能力。这是一种全新的知识沉淀方式——不是写给人看的文档,而是写给AI执行的"操作手册"。
4. 人机协作的最佳形态:人做决策,AI做执行
Superpowers的流程中,人负责确认设计、确认计划、做关键决策;AI负责按流程执行具体任务、写测试、做审查。这才是AI辅助编程的正确打开方式——不是让AI替代你思考,而是让AI把你从重复劳动中解放出来,专注在真正需要创造力和判断力的地方。
九、总结
Superpowers用一套优雅的技能系统,将几十年软件工程的最佳实践编码成AI Agent可自动执行的工作流:
- 🌟 27K+ Stars,GitHub上最火的AI Agent技能框架
- 🛠️ 支持Claude Code、Cursor、Codex、Gemini等主流平台
- 📋 7步标准化工作流:brainstorm → plan → implement → test → review → finish
- 🧪 强制TDD,删除测试前写的代码
- 👥 模拟完整开发团队角色分工
- 🧠 巧妙运用心理学原理确保Agent遵守纪律
- 🔄 writing-skills元技能支持自我进化
- 🚀 子代理可连续自主工作2小时+
更多推荐



所有评论(0)