Superpowers 破 22 万星:AI 编程的范式转移——从「写代码」到「管流程」
2026 年 7 月,Superpowers 以 22.6 万星登顶 GitHub。它不是新模型,而是一套用 Markdown 写的 AI 编码方法论,正在重新定义开发者与 AI 的关系:关键不再是让 AI 更聪明,而是让它更守规矩。
一场不起眼的爆发
2026 年 7 月,GitHub Trending 榜首被一个项目牢牢占据:Superpowers。22.6 万颗星,2.2 万次 fork,MIT 开源协议。
它不是新模型,不是新框架,不是某家大厂的重磅发布。它是一套用 Markdown 写的 AI 编码方法论——教你的编码 Agent 怎么写好代码。
如果你觉得这事听起来不够"炸裂",那恰恰是这个故事最值得讲的地方。
不是"更强",是"更靠谱"
过去两年,AI 编程的叙事主线很清晰:模型越来越强,程序员越来越不重要。GPT、Claude、Gemini 轮番刷新 SWE-bench,仿佛下一秒 AI 就能接管整个代码仓库。
但 2026 年上半年的数据讲了一个完全不同的故事。
GitLab 的 AI 问责报告显示:78% 的开发者表示编码速度变快了,但整体软件交付效率并没有提升。Anthropic 的研究更直接:工程师 60% 的工作中用到了 AI,但只有 0-20% 的任务能"完全委托"给 AI。
快是快了,但没快对地方。代码写完就崩、需求理解跑偏、缺乏测试覆盖、上下文管理混乱——这些才是真正卡脖子的地方。
Superpowers 的 22 万星,本质上是对这种现象的一次集体投票。
7 步工作流:把工程直觉变成强制流程
Superpowers 的核心是一套 7 阶段结构化工作流,每一阶段对应一个可组合的 Skill 文件:
| 阶段 | 核心动作 | 关键约束 |
|---|---|---|
| 头脑风暴 | 苏格拉底式提问,细化需求 | 设计批准前不写一行代码 |
| Git Worktrees | 创建隔离工作区 | 确保干净的测试基线 |
| 撰写计划 | 拆解为 2-5 分钟的小任务 | 每个任务有精确文件路径和验证步骤 |
| 子 Agent 开发 | 每任务分配独立子 Agent | 两阶段审查:先审规范合规,再审代码质量 |
| TDD 强制 | 红-绿-重构循环 | 测试之前写的代码会被直接删除 |
| 代码审查 | 自动审查,按严重级别报告 | Critical 级别问题阻断进度 |
| 完成分支 | 验证测试,决策合并/PR/丢弃 | 证据驱动:运行结果而非口头声称 |
这七个阶段串起来,本质上是在做一件事:让 AI 像资深工程师一样先想清楚再动手,而不是上来就写代码。
最"狠"的设计:TDD 铁律
Superpowers 的 TDD 规则简单到近乎暴力:
先写测试。看它失败。写最少代码。看它通过。提交。 在测试之前写的任何实现代码,会被 Agent 主动删除。
不是"标记为需要修改",不是"建议你重构"。直接删。
这个设计背后是一个残酷的现实洞察:AI 写代码的能力已经过了临界点,但 AI 验证自己代码正确性的能力远远没跟上。Superpowers 社区公布过一个数据:过去 100 个 AI 直接提交的 PR,94 个被拒绝。不是因为代码写不好——是因为没有验证、没有测试、没有边界情况考虑。
强制 TDD 就是在源头堵住这个漏洞。
子 Agent 驱动:用"健忘"对抗上下文污染
Superpowers 最具创新性的机制是子 Agent 驱动开发。每个任务分配一个全新的子 Agent,带着干净的上下文开始工作。任务完成后,由两个独立的审查 Agent 分别检查规范合规性和代码质量。
为什么要这么做?因为 AI Agent 的上下文窗口是它的"记忆",而这个记忆会在长链任务中不断累积噪音。一个在前五个任务中形成的小偏差,到第十个任务时可能已经被当成"既定事实"。
子 Agent 机制的设计哲学很像函数式编程中的纯函数:每个子 Agent 只接受当前任务的输入,不继承任何历史上下文偏差。
从"模型竞赛"到"工程竞赛"
Superpowers 的爆火不是孤例。同一周,TypeScript 社区顶流 Matt Pocock 的 skills 项目冲到 14.8 万星,其四个核心命令 /grill-me、/tdd、/diagnose、/caveman 同样在做一件事:约束 AI,而不是让 AI 更聪明。Pocock 自己总结得很精准:
我不是让 AI 更聪明,我是让它更守规矩。
与此同时,agency-agents 冲上 12.3 万星,Compound Engineering 在强调"让每次工程工作都比上一次更轻松",Google 的 agents-cli 和小米的 MiMo-Code 也在同一周下场。
这不是极客圈的自嗨。AI 编程规范工具正在成为行业标配。
2026 年旧金山 AI 工程技术大会上释放的信号更加明确:AI 竞争正在从"模型竞赛"全面转向"应用与工程竞赛"。业界关注的重点不再是模型参数和性能,而是 AI 如何真正进入企业生产体系。
方法论之争:全流程 vs 轻量组合
Superpowers 最直接的竞争者——或者说互补者——是 Matt Pocock 的 skills。
区别在于哲学:
| 维度 | Superpowers | Matt Pocock Skills |
|---|---|---|
| 定位 | 完整开发方法论 | 轻量、可组合的工作流增强 |
| 接管程度 | 全流程接管,从脑暴到发布 | 按需组合,增强现有流程 |
| 学习曲线 | 中等偏高,需要改变开发习惯 | 低,选择需要的 skill 即可 |
| 最佳场景 | 追求流程规范和团队一致性 | 希望渐进式改善个人工作流 |
两者不是非此即彼的关系。全栈开发时完全可以用 agency-agents 定义角色 + skills 执行任务 + Superpowers 兜底纪律,形成 1+1+1 > 3 的组合。
另外值得一提的是 Superpowers 中文增强版(superpowers-zh),在原有 14 个 Skill 基础上新增了 6 个中国原创技能,支持包括 Claude Code、Cursor、Codex 在内的 18 款 AI 编码工具,安装只需一行 npx superpowers-zh。
下一步:从"会不会写代码"到"会不会工程"
如果把时间线拉长,你会看到一个清晰的三年轨迹:
- 2024 年:Copilot 提供代码补全,AI 是"副驾驶"
- 2025 年:Claude Code 可以写多文件功能,AI 是"初级工程师"
- 2026 年:Superpowers 让 AI 编码系统化,AI 是"遵循工程规范的虚拟同事"
这条轨迹的核心变量不是模型能力——模型能力一直在线性增长。核心变量是工程范式的成熟度。
Superpowers 的意义不在于它有多"聪明",而在于它定义了一套可以被复用、被审查、被改进的工程标准。这是软件工程史上反复出现的规律:汇编语言到高级语言、手动内存管理到垃圾回收、裸机部署到 Kubernetes——每一次范式跃迁,本质上都是将"易错的、依赖人类直觉的手工操作"抽象为"确定性的、可自动化的工程组件"。
22 万颗星,只是一个开始。