MLog
返回文章列表
Tech#AI开发工具#AI智能体框架#开源项目#工程化

Superpowers 破 22 万星:AI 编程的范式转移——从「写代码」到「管流程」

发布于: 2026年7月18日阅读时长: 9 min

2026 年 7 月,Superpowers 以 22.6 万星登顶 GitHub。它不是新模型,而是一套用 Markdown 写的 AI 编码方法论,正在重新定义开发者与 AI 的关系:关键不再是让 AI 更聪明,而是让它更守规矩。

一场不起眼的爆发

2026 年 7 月,GitHub Trending 榜首被一个项目牢牢占据:Superpowers。22.6 万颗星,2.2 万次 fork,MIT 开源协议。

它不是新模型,不是新框架,不是某家大厂的重磅发布。它是一套用 Markdown 写的 AI 编码方法论——教你的编码 Agent 怎么写好代码。

如果你觉得这事听起来不够"炸裂",那恰恰是这个故事最值得讲的地方。

不是"更强",是"更靠谱"

过去两年,AI 编程的叙事主线很清晰:模型越来越强,程序员越来越不重要。GPT、Claude、Gemini 轮番刷新 SWE-bench,仿佛下一秒 AI 就能接管整个代码仓库。

但 2026 年上半年的数据讲了一个完全不同的故事。

GitLab 的 AI 问责报告显示:78% 的开发者表示编码速度变快了,但整体软件交付效率并没有提升。Anthropic 的研究更直接:工程师 60% 的工作中用到了 AI,但只有 0-20% 的任务能"完全委托"给 AI。

快是快了,但没快对地方。代码写完就崩、需求理解跑偏、缺乏测试覆盖、上下文管理混乱——这些才是真正卡脖子的地方。

Superpowers 的 22 万星,本质上是对这种现象的一次集体投票。

7 步工作流:把工程直觉变成强制流程

Superpowers 的核心是一套 7 阶段结构化工作流,每一阶段对应一个可组合的 Skill 文件:

阶段 核心动作 关键约束
头脑风暴 苏格拉底式提问,细化需求 设计批准前不写一行代码
Git Worktrees 创建隔离工作区 确保干净的测试基线
撰写计划 拆解为 2-5 分钟的小任务 每个任务有精确文件路径和验证步骤
子 Agent 开发 每任务分配独立子 Agent 两阶段审查:先审规范合规,再审代码质量
TDD 强制 红-绿-重构循环 测试之前写的代码会被直接删除
代码审查 自动审查,按严重级别报告 Critical 级别问题阻断进度
完成分支 验证测试,决策合并/PR/丢弃 证据驱动:运行结果而非口头声称

这七个阶段串起来,本质上是在做一件事:让 AI 像资深工程师一样先想清楚再动手,而不是上来就写代码

最"狠"的设计:TDD 铁律

Superpowers 的 TDD 规则简单到近乎暴力:

先写测试。看它失败。写最少代码。看它通过。提交。 在测试之前写的任何实现代码,会被 Agent 主动删除

不是"标记为需要修改",不是"建议你重构"。直接删。

这个设计背后是一个残酷的现实洞察:AI 写代码的能力已经过了临界点,但 AI 验证自己代码正确性的能力远远没跟上。Superpowers 社区公布过一个数据:过去 100 个 AI 直接提交的 PR,94 个被拒绝。不是因为代码写不好——是因为没有验证、没有测试、没有边界情况考虑。

强制 TDD 就是在源头堵住这个漏洞。

子 Agent 驱动:用"健忘"对抗上下文污染

Superpowers 最具创新性的机制是子 Agent 驱动开发。每个任务分配一个全新的子 Agent,带着干净的上下文开始工作。任务完成后,由两个独立的审查 Agent 分别检查规范合规性和代码质量。

为什么要这么做?因为 AI Agent 的上下文窗口是它的"记忆",而这个记忆会在长链任务中不断累积噪音。一个在前五个任务中形成的小偏差,到第十个任务时可能已经被当成"既定事实"。

子 Agent 机制的设计哲学很像函数式编程中的纯函数:每个子 Agent 只接受当前任务的输入,不继承任何历史上下文偏差。

从"模型竞赛"到"工程竞赛"

Superpowers 的爆火不是孤例。同一周,TypeScript 社区顶流 Matt Pocock 的 skills 项目冲到 14.8 万星,其四个核心命令 /grill-me/tdd/diagnose/caveman 同样在做一件事:约束 AI,而不是让 AI 更聪明。Pocock 自己总结得很精准:

我不是让 AI 更聪明,我是让它更守规矩。

与此同时,agency-agents 冲上 12.3 万星,Compound Engineering 在强调"让每次工程工作都比上一次更轻松",Google 的 agents-cli 和小米的 MiMo-Code 也在同一周下场。

这不是极客圈的自嗨。AI 编程规范工具正在成为行业标配

2026 年旧金山 AI 工程技术大会上释放的信号更加明确:AI 竞争正在从"模型竞赛"全面转向"应用与工程竞赛"。业界关注的重点不再是模型参数和性能,而是 AI 如何真正进入企业生产体系。

方法论之争:全流程 vs 轻量组合

Superpowers 最直接的竞争者——或者说互补者——是 Matt Pocock 的 skills。

区别在于哲学:

维度 Superpowers Matt Pocock Skills
定位 完整开发方法论 轻量、可组合的工作流增强
接管程度 全流程接管,从脑暴到发布 按需组合,增强现有流程
学习曲线 中等偏高,需要改变开发习惯 低,选择需要的 skill 即可
最佳场景 追求流程规范和团队一致性 希望渐进式改善个人工作流

两者不是非此即彼的关系。全栈开发时完全可以用 agency-agents 定义角色 + skills 执行任务 + Superpowers 兜底纪律,形成 1+1+1 > 3 的组合。

另外值得一提的是 Superpowers 中文增强版(superpowers-zh),在原有 14 个 Skill 基础上新增了 6 个中国原创技能,支持包括 Claude Code、Cursor、Codex 在内的 18 款 AI 编码工具,安装只需一行 npx superpowers-zh

下一步:从"会不会写代码"到"会不会工程"

如果把时间线拉长,你会看到一个清晰的三年轨迹:

  • 2024 年:Copilot 提供代码补全,AI 是"副驾驶"
  • 2025 年:Claude Code 可以写多文件功能,AI 是"初级工程师"
  • 2026 年:Superpowers 让 AI 编码系统化,AI 是"遵循工程规范的虚拟同事"

这条轨迹的核心变量不是模型能力——模型能力一直在线性增长。核心变量是工程范式的成熟度

Superpowers 的意义不在于它有多"聪明",而在于它定义了一套可以被复用、被审查、被改进的工程标准。这是软件工程史上反复出现的规律:汇编语言到高级语言、手动内存管理到垃圾回收、裸机部署到 Kubernetes——每一次范式跃迁,本质上都是将"易错的、依赖人类直觉的手工操作"抽象为"确定性的、可自动化的工程组件"。

22 万颗星,只是一个开始。