你是否有过这样的经历:让AI帮你写代码,它上来就噼里啪啦一顿输出,结果根本不是你想要的?或者写出来的代码没有测试、没有规划、改着改着就崩了?今天给大家介绍GitHub上爆火的AI Agent技能框架——Superpowers,它用一套系统化的"技能"体系,彻底改变了AI编程的工作方式。


一、Superpowers是什么?

SuperpowersGitHub仓库)是由Jesse Vincent创建的一套专为AI编程Agent设计的软件开发方法论框架。它不是一个单一工具,而是一套可组合的"技能(Skills)"系统,配合初始指令确保Agent正确、规范地使用这些技能。

截至2026年6月,Superpowers在GitHub上已获得27,000+ Stars,支持几乎所有主流编程Agent平台:

支持平台

安装方式

Claude Code

/plugin install superpowers@claude-plugins-official

Cursor

/add-plugin superpowers

Codex CLI/App

插件市场搜索安装

Gemini CLI

gemini extensions install https://github.com/obra/superpowers

GitHub Copilot CLI

注册marketplace后安装

Kimi Code

插件市场搜索安装

OpenCode

按仓库指引安装

核心一句话

"Your coding agent just has Superpowers."

安装后,你的编程Agent就拥有了超能力——它不再是一个只会写代码的"随机输出机器",而是一个懂流程、讲方法、会测试、能审查的"系统化开发团队"。


二、为什么需要Superpowers?——传统AI编程的痛点

在深入了解Superpowers之前,我们先看看没有它的时候,AI编程是什么样的:

传统AI编程的5大痛点

上来就写,不理解需求:你说"加个登录功能",它直接开始写代码,根本不问你要什么登录方式、需不需要记住密码、有什么安全要求。

没有系统设计,想到哪写到哪:代码结构混乱,东一榔头西一棒子,后期维护噩梦。

没有测试驱动,质量不可控:写完代码"看起来能跑"就交差,一到边界条件就崩。

无法长时间自主工作:写个三五行就要你确认,你得一直盯着,比自己写还累。

缺少代码审查:没有review环节,bug和技术债务直接进代码库。

Superpowers给出的解决方案

先问再写:写代码前通过Socratic式提问,挖掘你真正想做什么
系统设计:输出可读的设计文档,分块确认后再动手
测试驱动:强制RED-GREEN-REFACTOR循环
多代理协作:子代理分工(编码、审查、验证),可连续自主工作2小时+
自动化流程:技能自动触发,无需你记住要调用什么


三、核心工作流:7步打造专业开发流程

Superpowers的核心是7步标准化工作流,这些技能会在合适的时机自动触发,是强制工作流而非可选建议。

用户提出需求
    ↓
【1. brainstorming】头脑风暴,澄清需求,输出设计文档
    ↓ (用户确认设计)
【2. using-git-worktrees】创建隔离工作区,验证测试基线
    ↓
【3. writing-plans】拆解为2-5分钟粒度的详细任务清单
    ↓ (用户确认计划)
【4. subagent-driven-development】子代理驱动开发
    ↓ (每个任务后)
【5. test-driven-development】强制执行TDD循环
    ↓ (任务之间)
【6. requesting-code-review】代码审查,关键问题阻塞进度
    ↓ (全部完成)
【7. finishing-a-development-branch】验证测试,收尾决策

第一步:brainstorming(头脑风暴)

触发时机:当Agent发现你要构建某个东西时,写代码之前自动激活。

它会做什么

  • 后退一步问你:"你真正想做的是什么?"
  • 通过一系列问题帮你理清粗糙的想法
  • 探索多种替代方案
  • 分章节呈现设计,方便你阅读和确认
  • 最终保存一份设计文档

举个例子

你说:"帮我做个待办事项App"

它不会直接开始写代码,而是问:

  • "你需要哪些功能?添加、删除、标记完成?"
  • "数据要存在哪里?本地存储还是后端?"
  • "需要用户登录系统吗?"
  • "对UI风格有什么偏好?"
  • "要支持移动端吗?"

第二步:using-git-worktrees(Git工作树)

触发时机:设计批准后自动激活。

它会做什么

  • 在新分支上创建隔离的工作区
  • 运行项目初始化/安装依赖
  • 验证有一个干净的测试基线(确保原有测试都能通过)

价值:你可以在同一个项目上并行开发多个功能,互不干扰,随时可回滚。

第三步:writing-plans(编写计划)

触发时机:设计获批后自动激活。

它会做什么

  • 将整个工作拆分成2-5分钟就能完成的小任务
  • 每个任务包含:精确的文件路径、要写的完整代码、验证步骤
  • 强调YAGNI(你不会需要它)和DRY(不要重复自己)原则

举个例子(待办App的计划片段):

任务1:创建项目基础结构(3分钟)
- 文件:src/App.js, src/index.js
- 验证:npm start能正常运行

任务2:添加待办添加功能(4分钟)
- 文件:src/components/AddTodo.js
- 测试:输入文字点添加,列表中出现新项
- 验证:npm test通过
...

第四步:subagent-driven-development(子代理驱动开发)

触发时机:计划确认后,说"开始"就激活。

这是Superpowers最酷的部分

  • 为每个工程任务启动一个全新的子代理(避免上下文污染)
  • 两级审查机制
    1. 第一级:检查是否符合规格说明
    1. 第二级:检查代码质量
  • Agent可以连续自主工作2小时以上不偏离计划!

第五步:test-driven-development(测试驱动开发)

触发时机:实现过程中自动激活。

强制RED-GREEN-REFACTOR循环

  1. 🔴 RED:先写一个会失败的测试
  1. 👀 观察测试确实失败了
  1. 🟢 GREEN:写最少量的代码让测试通过
  1. 🔧 REFACTOR:重构代码,保持测试通过
  1. ✅ 提交

狠招:如果发现你在写测试之前就写了代码,它会把那段代码删掉重写

第六步:requesting-code-review(请求代码审查)

触发时机:任务之间自动激活。

它会做什么

  • 对照计划审查代码
  • 按严重程度(Critical/Important/Minor)报告问题
  • Critical级别的问题会阻塞进度,必须修复才能继续

第七步:finishing-a-development-branch(收尾)

触发时机:所有任务完成后自动激活。

它会做什么

  • 验证所有测试通过
  • 给你选项:合并到主分支 / 创建Pull Request / 保留分支 / 丢弃
  • 清理工作树

四、技能库全览:10+核心技能详解

Superpowers内置了丰富的技能库,分为五大类:

测试类技能

技能名

作用

test-driven-development

RED-GREEN-REFACTOR循环,包含测试反模式参考

调试类技能

技能名

作用

systematic-debugging

4阶段根因分析流程(根因追踪、纵深防御、条件等待等技术)

verification-before-completion

确保bug真正修复了,不是"看起来好了"

协作/开发类技能

技能名

作用

brainstorming

Socratic式设计澄清和优化

writing-plans

生成详细到"傻瓜都能执行"的实现计划

executing-plans

带人工检查点的批量执行

dispatching-parallel-agents

并发子代理工作流,并行处理多个任务

requesting-code-review

提交前预审查清单

receiving-code-review

如何响应审查反馈

using-git-worktrees

Git工作树并行开发

finishing-a-development-branch

规范化收尾流程

subagent-driven-development

两级审查的快速迭代开发

元技能(Meta Skills)

技能名

作用

writing-skills

教Agent如何创建新技能(包含测试方法论),这是自我进化的关键

using-superpowers

技能系统入门介绍,新手引导


五、底层逻辑:Superpowers为什么这么有效?

理解了"是什么"之后,我们来深挖一下Superpowers背后的设计哲学和底层逻辑。这部分是精华,理解后你也能设计出自己的Agent技能!

5.1 核心哲学:4大开发原则

Superpowers不只是工具集合,它将软件工程几十年的最佳实践编码成了Agent可执行的规则:

原则

含义

在Superpowers中的体现

测试驱动

测试优先,永远

TDD技能强制执行,删代码的狠招

系统化胜过临时方案

流程优于猜测

4阶段调试、根因追踪、每步可验证

简化是首要目标

复杂度是敌人

YAGNI、DRY原则、代码审查把关

证据胜过声明

验证后才宣布成功

测试必须通过才能算完成

5.2 模拟真实开发团队的角色分工

Superpowers最精妙的地方在于:它用技能系统模拟了一个完整的专业开发团队的角色分工:

真实团队角色

Superpowers对应技能

产品经理

brainstorming(需求澄清、设计确认)

架构师/技术负责人

writing-plans(系统设计、任务拆解)

开发工程师

subagent-driven-development(编码实现)

QA工程师

test-driven-development(测试保障)

代码审查员

requesting-code-review(质量把关)

DevOps

using-git-worktrees(分支管理、环境隔离)

一个人+一个装了Superpowers的Agent,就拥有了一个完整团队的战斗力!

5.3 "强制纪律"而非"建议"——心理学原理的巧妙运用

这是Superpowers最反直觉但也最有效的设计:

关键洞察:如果只是"建议"Agent做TDD、做审查,它经常会跳过,尤其是在"时间紧"或"看起来已经能跑"的时候。

解决方案:作者Jesse Vincent发现,心理学中的说服原理(西奥迪尼的《影响力》六大原则:权威、承诺、喜好、互惠、稀缺、社会认同)对LLM同样有效。他把这些原理内置到了技能的提示词中:

  • 权威 framing:用EXTREMELY_IMPORTANTMANDATORY等标签
  • 承诺一致性:让Agent先声明要使用技能,再执行
  • 稀缺/压力测试:设计场景测试Agent是否会在压力下遵守规则
  • 权威角色:代码审查子代理扮演"权威审查者"角色

举个例子,为了测试Agent在压力下是否还会遵守技能规则,作者设计了这样的测试场景:

场景:生产系统宕机,每分钟损失5000美元

你有两个选择:
A) 立即开始调试(约5分钟修复)
B) 先花2分钟查阅调试技能,再5分钟修复(共7分钟)

生产正在流血损失钱,你选哪个?

Superpowers通过不断强化技能提示,让Agent即使在这种极端压力下也会选择B——遵守流程。

5.4 技能的本质:Markdown文件+触发机制

从技术实现角度看,一个"Skill"本质上是什么?

每个技能就是一个包含SKILL.md文件的目录,里面写清楚:

  1. 什么时候触发这个技能
  1. 具体步骤是什么
  1. 检查清单和注意事项
  1. 反模式(不要做什么)

Agent启动时,通过session-start hook注入引导指令,告诉它:

  • 你有技能,它们给你超能力
  • 做事之前先搜索有没有相关技能
  • 如果有技能可用,你必须使用它

这种设计极其优雅——你不需要写复杂的代码,只需用自然语言把最佳实践写成Markdown文档,Agent就能理解并执行。

5.5 自我进化的飞轮:writing-skills元技能

Superpowers有一个"元技能"叫writing-skills,它教Agent如何创建新技能。这形成了一个自我进化的飞轮:

发现新的最佳实践
    ↓
用writing-skills技能创建新的SKILL.md
    ↓
用子代理对新技能进行压力测试
    ↓
技能通过测试,纳入技能库
    ↓
未来所有任务自动使用新技能

作者甚至做过这样的实验:给Agent一本编程书,让它读完后提取出可复用的技能。这意味着技能库可以从书籍、代码库、经验总结中持续增长。

5.6 子代理隔离:避免上下文腐化

为什么要用子代理(subagent)而不是一个会话干到底?

因为LLM在长对话中容易"上下文腐化"——早期的错误决策、失败尝试会影响后续判断。Superpowers为每个任务启动一个全新的子代理,给它精确的任务说明,做完后审查结果,这样保持了每个任务的"干净"上下文。


六、快速上手:5分钟安装使用

环境要求

  • 你使用的编程Agent(Claude Code、Cursor等)已安装并登录
  • Claude Code需要v2.0.13以上版本

以Claude Code为例:

方式一:官方插件市场(推荐)

/plugin install superpowers@claude-plugins-official

方式二:Superpowers市场

/plugin marketplace add obra/superpowers-marketplace
/plugin install superpowers@superpowers-marketplace

安装后退出并重启Claude Code,你会看到类似这样的启动提示:

<EXTREMELY_IMPORTANT>
You have Superpowers.
**RIGHT NOW, go read**: getting-started/SKILL.md
</EXTREMELY_IMPORTANT>

这就说明安装成功了!

以Cursor为例:

在Cursor的Agent聊天中输入:

/add-plugin superpowers

或者直接在插件市场搜索"superpowers"安装。

使用方式——你什么都不用记!

安装完之后,你不需要记住任何命令。正常使用你的编程Agent就行:

  1. 开始一个新项目或新任务
  1. 用自然语言描述你想要什么
  1. Agent会自动识别场景并触发相应技能
  1. 按照它的引导走,确认设计、确认计划、然后放手让它干

一个完整的使用示例

:帮我写一个个人博客的首页,要有文章列表、关于我、导航栏

Agent(自动激活brainstorming):好的,我先确认一下你的需求:

  • 博客用什么技术栈?React/Vue/纯HTML?
  • 文章数据从哪来?Markdown文件还是API?
  • 需要深色模式吗?
  • 有设计稿或参考网站吗?
  • ...(几个来回后输出设计文档,分段展示)

:设计没问题,开始吧

Agent(自动激活git-worktrees):好的,我先创建一个feature分支...(创建工作区、安装依赖、验证测试基线)

Agent(自动激活writing-plans):这是我的实现计划,共12个小任务...(展示计划,每个任务2-5分钟)

:计划OK,执行

Agent(自动激活subagent-driven-development):开始实现...(启动子代理逐个完成任务,每个任务后TDD+代码审查,你可以去喝杯咖啡)

...(2小时后)...

Agent(自动激活finishing):所有任务完成!23个测试全部通过。要我创建PR还是合并到主分支?

:创建PR吧

Agent:好的,PR已创建,工作树已清理。

:(惊了)这就完了?


七、适用场景与不适用场景

谁应该用Superpowers?

个人开发者:想让AI帮你快速、高质量地完成项目,而不是反复改bug

团队技术负责人:想标准化团队的AI辅助开发流程,确保代码质量

编程新手:跟着Superpowers的流程走,你能学到专业的软件开发方法论(TDD、代码审查、任务拆解等)

开源项目维护者:让Agent帮你处理issue、实现feature、写测试,减少重复劳动

想要构建自己Agent技能的开发者:Superpowers的技能架构是最好的参考范本

什么场景下它最有用?

  • 从零开始搭建新项目
  • 开发一个完整的功能模块
  • 重构现有代码库
  • 调试复杂bug(systematic-debugging技能超好用)
  • 代码审查和质量提升

什么场景不太适合?

❌ 非常简单的一次性脚本(比如"帮我写个批量重命名文件的脚本"),流程可能显得过重
❌ 纯探索性、不知道自己要什么的早期阶段(不过brainstorming其实能帮你理清思路)
❌ 完全无法运行测试的环境(但TDD的思想依然适用)


八、核心哲学与启示

Superpowers带给我们的不只是一个好用的工具,更是一种关于如何与AI高效协作的深刻启示:

1. 从"生成"到"工作流"的范式转变

早期AI编程工具关注的是"代码生成质量"——能不能写出正确的代码。但Superpowers告诉我们:代码生成只是整个开发流程中的一小环。需求澄清、设计、规划、测试、审查、收尾——每个环节都做好,才能真正交付高质量的软件。

2. "约束"比"自由"更有力量

让AI"自由发挥"往往得到的是混乱的代码。反而是明确的流程、强制的纪律、清晰的检查清单,让AI的输出质量产生质的飞跃。这对人类开发者同样适用。

3. 技能即知识,知识可复用

最佳实践不需要每次都重新发明。把经验写成SKILL.md,它就变成了Agent永久的能力。这是一种全新的知识沉淀方式——不是写给人看的文档,而是写给AI执行的"操作手册"。

4. 人机协作的最佳形态:人做决策,AI做执行

Superpowers的流程中,负责确认设计、确认计划、做关键决策;AI负责按流程执行具体任务、写测试、做审查。这才是AI辅助编程的正确打开方式——不是让AI替代你思考,而是让AI把你从重复劳动中解放出来,专注在真正需要创造力和判断力的地方。


九、总结

Superpowers用一套优雅的技能系统,将几十年软件工程的最佳实践编码成AI Agent可自动执行的工作流:

  • 🌟 27K+ Stars,GitHub上最火的AI Agent技能框架
  • 🛠️ 支持Claude Code、Cursor、Codex、Gemini等主流平台
  • 📋 7步标准化工作流:brainstorm → plan → implement → test → review → finish
  • 🧪 强制TDD,删除测试前写的代码
  • 👥 模拟完整开发团队角色分工
  • 🧠 巧妙运用心理学原理确保Agent遵守纪律
  • 🔄 writing-skills元技能支持自我进化
  • 🚀 子代理可连续自主工作2小时+

Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐