当你不必再写 Prompt:Loop Engineering 如何重塑 AI 编程
2026年6月,Claude Code负责人Boris Cherny与Google工程总监Addy Osmani相继发声,宣告AI编程进入Loop Engineering时代——你不再亲自向Agent发指令,而是设计一套系统让它自主运转。本文拆解四次范式跃迁、五大核心组件,以及实践中已暴露的陷阱。
三句话,一个新时代
2026 年 6 月,三则看似独立的发言在开发者社区引爆了一场认知震荡。
Claude Code 负责人 Boris Cherny 在接受采访时说:「I don't prompt Claude anymore. I have loops running that prompt Claude and figuring out what to do. My job is to write loops.」OpenClaw 创始人 Peter Steinberger 在推特上直言:「You shouldn't be prompting coding agents anymore. You should be designing loops that prompt your agents.」紧接着,Google Chrome 工程负责人 Addy Osmani 发表文章,正式为这个模式命名——Loop Engineering。
这不仅仅是换个说法。这意味着 AI 编程的下一次范式跃迁已经到来。
四次范式跃迁:人一步步把操作权交出去
把时间线压缩到过去两年,AI 编程的历史可以概括为四次连续的"交出操作权":
2023 · Prompt Engineering——手动编写每一条指令,一行一行告诉 AI 要做什么。瓶颈很快暴露:Prompt 写得好的人产出极高,写不好的人效率还不如不用 AI。
2024 · Agent Orchestration——不再写单条 Prompt,开始编排多个 Agent 协作完成复杂任务。核心是把"教 AI 理解项目"这件事工程化。
2025 · Harness Engineering——用配置文件(CLAUDE.md、hooks)搭建 Agent 的工作环境,让每次会话都能以充分的信息量开始。
2026 · Loop Engineering——Harness 解决了"怎么管",Loop 解决了"谁来管"。Harness 是被动的:你触发它,它执行。Loop 是主动的:它自己决定什么时候触发自己,自己评估输出,自己修复错误,然后把学到的东西写回持久存储——等待下一次唤醒。
Osmani 给出了一个精准的定位:「Loop engineering sits one floor above the harness. The harness runs when you trigger it; the loop runs on a timer, spawns little helpers, and feeds itself.」
五大构建块 + 记忆层
一个完整的 Loop 由五个组件加一个记忆层组成。Osmani 特别指出,Claude Code 和 OpenAI Codex 现在都已内置这五个构建块。
1. 排程自动化(Scheduled Automations)
Loop 的触发器。可以是 cron job、GitHub Actions、PR event webhook。Codex 的 Automations tab 让你设定项目、prompt、频率;Claude Code 的 /loop 和 /schedule 提供类似能力。OpenAI 内部用它做每日 issue triage、汇总 CI 失败、写 commit briefing。
2. Git Worktrees(隔离工作区)
每个 Agent 在独立的 git worktree 中工作,共享 git 历史但互不干扰。这让多个 Agent 可以并行处理不同任务——一个修 bug、一个写测试、一个做重构——而不会产生文件冲突。
3. Skills(项目知识)
通过 CLAUDE.md、AGENTS.md、skill 文件将项目规范、惯例、经验教训编码成 Agent 可理解的知识。Osmani 说得很直白:「An agent starts every session cold and will fill any hole in your intent with a confident guess. A skill is intent written down.」没有 skill,Agent 每次启动都从零推导;有了 skill,知识会累积。
4. Plugins / MCP Connectors(外部整合)
基于 MCP(Model Context Protocol)连接外部工具:GitHub、Slack、数据库、监控系统。让 Agent 不只能读写代码,还能与整个开发工具链互动。进度文件不只是一个 txt——它可以是 Linear 看板、Notion 页面、或者数据库里的一条记录。
5. Sub-agents(子代理)
将「执行者」(maker)和「验证者」(checker)分离,这是 Loop 中最关键的设计决定。Osmani 解释了为什么:「The reason it matters specifically inside a loop is the loop runs while you are not watching, so a verifier you actually trust is the only reason you can walk away.」
Claude Code 的 /goal 就是这样实现的——用另一个模型判断 Loop 是否完成,而不是让做事的 Agent 自己判断。自己检查自己作业的 Agent,永远不可信。
验证成本才是真正的瓶颈
在所有讨论中,Blake Crosley 的分析提出了最尖锐的洞见:「Verification cost, not loop construction, decides what you can automate.」
他拉了 Cherny 多场演讲的完整逐字稿,发现一个被多数人忽略的模式:Cherny 实际命名的每一个 Loop,都有机器可验证的成功条件——CI 修复、自动 rebasing、feedback clustering。不是开放式的 feature 开发。
这不是巧合。当验证可以自动化(test suite 通过、lint 清洁、type check 无误),Loop 就能无限运转。当验证需要人类判断(这个 UI 好不好看、这个架构决定对不对),Loop 就退化成"产出一堆东西等你 review"的生产线。
AlphaSignal 把这提炼成四个前提条件:
- 任务可重复——不是一次性的探索
- 验证可自动化——有 test suite、linter、type checker
- Token 预算能承受浪费——Loop 会重试、会探索死路
- Agent 已有所需工具——不需要人类帮忙操作外部系统
四个条件缺一个,Loop 的成本就会超过收益。
已知的陷阱
Token 成本。Loop 会重读上下文、重试、探索多条路径,token 消耗远非单次 prompt 可比。有分析计算过,一个同时跑 maker 和 checker 的 loop,"will burn through a limited plan before breakfast."
理解负债(Comprehension Debt)。Loop 产出的代码你没写、可能没仔细 review、不完全理解。技术债你至少知道欠了什么;理解债是你连自己欠了什么都不知道。
认知投降(Cognitive Surrender)。Osmani 用这个词描述了最微妙的风险:「When the loop runs itself it's very tempting to stop having an opinion and just take whatever it gives back.」同一个 Loop,用来加速你深度理解的工作是利器,用来逃避理解是毒药。
Review 成为新瓶颈。Loop 产出增加,人类 review 频宽成为上限。你能跑多少个 Loop,不取决于 token 预算,而取决于你能多快检查产出。
现在就能开始的三件事
Loop Engineering 的进入门槛比想象中低,因为工具已经内置了核心能力:
写好你的 CLAUDE.md / AGENTS.md。把项目规范、惯例、"我们不这样做因为那次出事"的知识写下来。这是 Loop 最基础的构建块。
用 /goal 或 /loop 跑第一个 Loop。不需要自己写 bash orchestrator。Claude Code 的 /goal 会自动做 maker-checker split,从一个小任务开始——babysit 一个 PR、每小时跑一次 lint check。
拆分 Maker 和 Checker。开始习惯用 sub-agent 做验证。不是让同一个 Agent 自己检查自己。这个简单的分工就是 Loop 质量保证的核心。
结语
Loop Engineering 是真实的工程演进,不是炒作。但它比 Prompt Engineering 更难,不是更容易——因为你设计的不再是一段文字,而是一个能在无人值守时稳定运作的系统。
Osmani 的结语值得反复读:
Build the loop. But build it like someone who intends to stay the engineer, not just the person who presses go.
Pulumi 的 Engin Diri 换了个说法,但指向同一件事:
The loop will do the typing. The thinking is the work.
Loop 不会取代你的判断力。它会放大你的判断力——前提是你还有判断力可以被放大。