Superpowers-skills:让 AI Agent 像工程师一样开发

Superpowers 是一套「装在编码 Agent 上的软件开发方法论」,由一组可组合的 Skills 构成。它解决的不是「让 Agent 写代码更快」,而是「让 Agent 像一个靠谱的工程师那样工作」——先想清楚需求、再设计方案、然后写测试、按计划实现、互相 review、最后干净交付。
本文拆解它的 14 个核心 Skills、7 步工作流,以及它为什么能跨 Claude Code、Codex、Cursor、Antigravity 等十种 Agent 工具运行。如果你已经读过本博客的「AI Agent 技能实战解析」,这篇是它的进阶——看一个真实、完整、生产级的 Skills 体系长什么样。
本文脉络: |
一、Superpowers 是什么:不是工具,是方法论
先纠正一个常见误解:Superpowers 不是一个「让 Agent 多几个功能」的工具集,而是一套强制约束 Agent 工作方式的方法论。
普通的 Agent 用法是「你说一句,它写一段」:
你:帮我加个登录接口 |
装了 Superpowers 之后,Agent 会主动按流程走:
你:帮我加个登录接口 |
关键区别:Superpowers 把「软件工程的最佳实践」固化成 Agent 会自动触发的 Skills,让 Agent 从「打字员」升级成「按流程办事的工程师」。
作者 Jesse Vincent 在发布文章里说得很直白: |
二、核心工作流:从想法到交付的 7 步
这是 Superpowers 的主干。一个完整的开发任务,会按这 7 步走:
为什么强调「2~5 分钟一个任务」:子 Agent 的上下文有限,任务太大会跑偏、会漏边界条件。切成小块,每个子 Agent 聚焦一件事,做完被 review,问题能在早期暴露。
为什么用子 Agent 而不是主 Agent 直接写:主 Agent 负责调度和 review,保持「全局视野」;子 Agent 只管「实现这个具体任务」,上下文干净、不被前面的对话污染。Jesse Vincent 说,这套流程下 Agent 经常能自主工作两小时不偏离计划。
三、14 个 Skills 全景:按职责分类
Superpowers 内置 14 个 Skills,按职责分成四类:
测试类
| Skill | 作用 |
|---|---|
| test-driven-development | 强制 RED-GREEN-REFACTOR 循环,附「测试反模式」参考资料 |
调试类
| Skill | 作用 |
|---|---|
| systematic-debugging | 4 阶段根因定位流程,含 root-cause-tracing、defense-in-depth、condition-based-waiting 等技巧 |
| verification-before-completion | 声称「修好了」之前,必须运行验证命令确认 |
协作类(工作流主干)
| Skill | 作用 |
|---|---|
| brainstorming | 苏格拉底式设计推演,把模糊需求变成清晰规格 |
| writing-plans | 把设计拆成可执行的细粒度任务清单 |
| executing-plans | 带人工检查点的批次执行(subagent-driven 的轻量替代) |
| dispatching-parallel-agents | 并发派发多个子 Agent 处理独立任务 |
| requesting-code-review | 主动发起 review,按计划核对 |
| receiving-code-review | 接到 review 反馈后怎么处理(不盲从,也不对抗) |
| using-git-worktrees | 用 git worktree 做并行开发的隔离工作区 |
| finishing-a-development-branch | 开发完成后的合并/PR/清理决策 |
| subagent-driven-development | 子 Agent 快速迭代 + 两阶段 review(规格符合性 + 代码质量) |
元类
| Skill | 作用 |
|---|---|
| writing-skills | 怎么按规范创建和测试新 Skill |
| using-superpowers | 整个 Skills 系统的入口介绍 |
注意这 14 个不是「平级」的: |
四、设计哲学:TDD、系统化、证据驱动
Superpowers 的 Skills 不是随意拼凑的,背后有四条统一哲学:
① 测试驱动(Test-Driven Development) |
为什么这四条重要:Agent(LLM)有几个天然弱点——容易过度自信、容易跳过验证、容易过度设计。Superpowers 的哲学针对性反制这些弱点,本质是用流程约束 LLM 的不可靠性。
对比普通 Agent 和 Superpowers Agent: |
五、它是怎么「自动生效」的:session-start 注入
很多人好奇:装了 Superpowers,Agent 怎么就「自动按流程走」了?答案在它的 session-start hook。
普通 Skills 的触发: |
hooks/session-start 的核心逻辑(简化): |
真实实现会根据运行平台输出不同的 JSON 字段,避免同一段上下文被重复注入。这个设计的巧妙之处在于:它不依赖你「记得用 Superpowers」,而是让 Agent 一启动就处于 Superpowers 模式。这就是 README 里说的「Your coding agent just has Superpowers」——你不需要做任何特殊操作,方法论自动生效。
对比两种「让方法论生效」的方式: |
六、跨 Agent 适配:一份 Skills,十种工具
Superpowers 基本上支持当前主流的 Agent 工具:
Claude Code、Codex App、Codex CLI、Cursor、Antigravity、 |
它是怎么做到「一份 Skills 适配这么多工具」的?核心是两件事:
1. Skills 本身是工具无关的 Markdown
skills/brainstorming/SKILL.md |
2. 每个 Agent 有一个适配层(plugin.json / 扩展)
以 Kimi Code 的 plugin.json 为例,有一个 skillInstructions 字段: |
Claude Code:用 plugin 系统的 sessionStart hook 注入 |
这套设计给我们的启发:写 Skill 时不要绑定具体工具的 API,用「问用户」「派子 Agent」「写待办」这种抽象动作描述,让 Skill 可移植。具体的工具映射交给适配层处理。
七、和单兵 Skill 的区别:为什么是「体系」
本博客之前的「AI Agent 技能实战解析」讲的是怎么写一个独立的 Skill。Superpowers 给出的进阶认知是:单个 Skill 解决一类任务,Skills 体系固化一整套工作方法。
| 形态 | 适合解决什么 | 关键特征 |
|---|---|---|
| 单个 Skill | 反复出现的单一任务,比如写技术文章、生成提交信息、做一次代码审查 | 独立触发,边界清楚,成本低 |
| Skills 体系 | 一个完整领域里的长期工作方式,比如软件开发全流程 | 有入口、有顺序、有交接、有验证闭环 |
判断标准很简单:如果你只是想让 Agent 在一个动作上更稳定,用单个 Skill 就够;如果你想让 Agent 在一个领域里持续按专家流程工作,就应该像 Superpowers 一样,把流程节点都拆成 Skills,再用入口 Skill 串起来。
八、上手与踩坑
安装
以 Claude Code 为例(最主流):
# 方式一:Anthropic 官方 marketplace |
其他工具见项目的 README。
踩坑提示
| 坑 | 后果 | 对策 |
|---|---|---|
| 不信任流程,急着让 Agent 写代码 | Superpowers 会被架空,退化回普通 Agent | 至少完整走一次 brainstorming → plan → 实现,体会差异 |
| 跳过 brainstorming 直接给详细需求 | 后续 plan 可能和你预期不符 | 即使需求清楚,也走一遍设计确认,能补盲点 |
| 任务拆太大 | 子 Agent 跑偏、上下文溢出 | writing-plans 阶段盯紧任务粒度,坚持 2~5 分钟一个 |
| review 反馈不当真 | 问题积累到后期爆炸 | 严重问题会阻塞流程,别手动绕过 |
| 在错误的项目上用 | 强行 TDD 会让脚本类项目变累 | 工具脚本、一次性代码可以不开 Superpowers |
什么时候不适合用
Superpowers 的设计假设是「正经软件项目」。 |
九、速查表
| 你可能想问 | 一句话答案 |
|---|---|
| Superpowers 是什么? | 一套用 Skills 构建的开发方法论,让 Agent 按流程做事而非即兴发挥 |
| 和单个 Skill 有什么区别? | 单个 Skill 解决一类任务;Superpowers 是覆盖开发全流程的 Skills 体系 |
| 核心工作流几步? | 7 步:头脑风暴→worktree→计划→子 Agent 实现→TDD→review→收尾 |
| 几个内置 Skill? | 14 个,分测试/调试/协作/元类四类 |
| 它怎么自动生效的? | session-start hook 把 using-superpowers 全文注入会话开场 |
| 怎么支持这么多 Agent 工具? | Skills 本身工具无关(纯 Markdown),每个工具有适配层 |
| 怎么体现「证据驱动」? | 声称完成前必须跑验证命令;不允许「应该可以了」 |
| 适合什么场景? | 正经软件项目;不适合一次性脚本和探索性 prototype |
| 怎么装? | /plugin install superpowers@claude-plugins-official(Claude Code) |
一句话总结:Superpowers 把「靠谱工程师的工作方式」——先想清楚、再拆细、TDD、互相 review、用证据说话——固化成 Agent 自动触发的 Skills。它的核心价值不是「让 Agent 多会几件事」,而是「让 Agent 按方法论做事,而不是即兴发挥」。
如果你正在用 Claude Code / Codex / Cursor 这类工具做正经开发,装上试一次完整流程,会真切感受到「Agent 从打字员变成工程师」的差别。