Clipping 微信公众号

别再亲手给 agent 写 prompt 了:全网火爆的「Loop Engineering」正在重新定义编程

by AI兴观点 原文 ↗
Created: 2026-06-11

公众号名称:程叙架构与AI.

作者名称:AI兴观点

发布时间:2026-06-11 06:27

✅点击上方🔺公众号🔺关注我✅

Anthropic 的 Claude Code 负责人 @bcherny 在推特上说了句话,乍看像在吹牛,仔细一想发现他说的是真的:

我现在已经不 prompt Claude 了。我有一堆 loops 在跑,它们去 prompt Claude,判断下一步做什么。我的工作变成了写这些 loops。

然后 Google 的 Addy Osmani 给这事起了个名,写了一篇长文来讲它。叫 Loop Engineering

读完后我的感觉:这事挺大的。不是那种「新工具发布了」的大,是那种「我们跟机器协作的方式可能要变」的大。


Loop Engineering 到底是什么

过去两年你跟 coding agent 协作的方式大概是这样的:你写一段 prompt,它吐一段代码,你读了觉得不对,再补一段 prompt,它再改。像两个人来回传话筒。你的注意力焊死在每一轮对话里。

Loop engineering 干的事,就是把「你坐在终端前一轮一轮敲」这个动作拿走。你搭一个小系统——它自己发现要做什么、拆任务、找人写、检查质量、记进度,然后决定下一步。

你变成了这个系统的设计师,不再是那个坐在终端前每轮手动输入的人。

Addy 说这已经不是”工具问题”了。一年前你想搭这样一个 loop,得写一堆 bash 脚本然后永远维护它,它只属于你。现在 Claude Code 和 Codex 都内置了这整套能力。两家用的词不一样,但拆开看核心能力是同一套东西。


五块积木,一个记忆

一个能自己跑的 loop 需要五样东西。再加一个「记住状态的地方」。

1. Automations:让 loop 循环起来

这是 loop 的心脏。不是跑一次就完,是按计划自动跑。

Codex 的 Automations 标签页里,你选一个项目、写一个 prompt、定一个频率,到点它就自己跑。跑完发现东西要处理的进 Triage inbox,没问题的自动归档。OpenAI 内部拿它做 daily issue triage、总结 CI 失败、写 commit briefings。

Claude Code 对应的是 scheduling 和 hooks。/loop 按间隔跑,你也可以安排 cron task,或者用 hooks 在 agent 生命周期节点触发脚本。不想一直开着电脑?推给 GitHub Actions。

两边的逻辑一模一样:你定义一个 autonomous task,给个节奏,发现的结果自己来找你。

还有一个不能漏的:/goal。它不是按时间重复,而是一直跑直到一个条件为真。你丢一句「test/auth 全部通过且 lint 干净」,就可以走了。每轮之后有个独立的小模型检查是否完成——写代码的 agent 不给自己打分。Codex 也有同样的 /goal

2. Worktrees:让并行不撞车

两个 agent 同时改同一个文件——跟两个工程师同时在同一个文件里改代码然后互相没打招呼一样麻烦。

git worktree 解决了这个:独立的 working directory,独立的 branch,共享同一个 repo history。一个 agent 的修改物理上碰不到另一个的。

Codex 直接内置了 worktree 支持。Claude Code 也有 --worktree flag,或者在 subagent 上设 isolation: worktree。每个 helper 拿到干净的 checkout,用完自动清理。

Addy 提了个有意思的点:worktree 解决的是机械层面冲突,但真正的天花板是你自己的 review bandwidth。决定你能同时跑多少个 agent 的,不是工具,是你看不看得过来。

3. Skills:让 agent 不再是金鱼

没有 skill 的 loop 是这样的:每次跑,agent 从头理解你的项目,猜一遍你的约定和规则。每次都做一遍同样的推理,花一样的钱。

Skill 就是把这些写在外面:项目约定、构建步骤、“我们为什么不用这个做法因为之前出过事”。你写一次,agent 每次跑都能读到。

Codex 用 $skill-name/skills 调用。Claude Code 做法一样,.claude/ 目录下放 SKILL.md。

没有 skills,loop 每轮都在从零推导你的整个项目。 有了 skills,它开始有复利效应。

4. Connectors:让 loop 碰到真实世界

一个只能看到文件系统的 loop,是个很小的 loop。

Connectors 基于 MCP,让 agent 能读 issue tracker、查数据库、调 staging API、在 Slack 发消息。Codex 和 Claude Code 都支持 MCP,所以你在一个上面写的 connector,通常可以直接用到另一个。

这就是”agent 说:这是修复方案”跟”loop 自己开 PR、链 Linear ticket、CI 变绿后 ping 频道”之间的区别。

5. Sub-agents:写的人和检查的人分开

这是整个 loop 架构里最有用的设计。

写代码的模型在给自己作业打分时太友善了。

一个带着不同 instructions、有时用不同模型的第二个 agent,能抓住第一个 agent 自我说服后漏掉的问题。Codex 允许你在 .codex/agents/ 里定义 TOML 文件,给每个 sub-agent 指定 name、description、instructions、model 和 reasoning effort。这样你的 security reviewer 可以用一个强模型 high effort,explorer 用个快速 read-only。

Claude Code 用 .claude/agents/ 做一样的事。

常见的拆法:一个 agent 探索,一个实现,一个按 spec 验证。Maker 和 checker 的分离,甚至用到了停止条件本身——/goal 背后就是一个独立模型判断 loop 是否完成,而不是由干活的那个模型来判断。


第六样东西:Memory

一轮跑完,模型忘掉一切。所以 memory 必须在磁盘上,不在 context 里。一个 markdown 文件,一个 Linear board——任何在单次 conversation 之外、能记下”什么做完了、什么还没有”的地方。

Agent 会忘记,但 repo 不会。


一个真实的 loop 长什么样

Addy 在文章里描述了他正在用的一个:

每天早晨,一个 automation 在 repo 上跑。它的 prompt 调用一个 triage skill——读昨天的 CI failures、open issues、recent commits,把发现写成 markdown 或记到 Linear board。每个值得做的 finding,开一个隔离 worktree,派一个 sub-agent 写修复,派第二个 sub-agent 用 project skills 和现有 tests 做 review。Connectors 让 loop 打开 PR、更新 ticket。loop 接不住的落入 triage inbox。

State file 是整个东西的脊柱。它记住什么试过了、什么过了、什么还 open。第二天早上的跑从今天停下的地方接上。

看看你在这里面做了什么:你只设计了一次。你没有亲手 prompt 其中任何一步。


但有三件事不会变容易

Loop 会改变工作方式,但不会把你从工作中删除。而且随着 loop 变好,三个问题会变得更尖锐,而不是更简单。

第一,验证还在你身上

一个无人值守跑的 loop,也在无人值守地犯错误。你把 verifier sub-agent 和 maker 拆开,就是为了让 loop 说出的”done”有一点点意义。但即使这样,“done”也只是一种 claim,不是 proof。

Addy 反复说同一句话——你的工作,是交付你确认能跑的代码。 这点 loop 替你不了。

第二,你的理解会烂掉

Loop 越快交付不是你亲手写的代码,实际存在的系统和你能理解的系统之间的差距就越大。一个流畅的 loop 只会让这个差距增长得更快——除非你真的去读它产出了什么。

第三,最舒服的姿势,可能也是最危险的

当 loop 自己跑起来后,你很容易不再有自己的判断,只是接受它给你的东西。

Addy 管这个叫 cognitive surrender——认知投降。

带着判断力去设计 loop,它就是解药。为了逃避思考去设计 loop,它就是加速剂。同一个动作,完全相反的结果。


值得做吗?我觉得值

读完 Addy 这篇文章,我最深的感受不是”赶紧去配一套 loop”,而是想通了另一件事:

以后区分工程师的方式,可能不再是”谁会写代码”,而是”谁会设计让代码被写出来的系统”。

Loop engineering 不是让你偷懒的——它把杠杆点移了。你的工作从”亲自写每一行”变成”设计一个会自己写的系统”。这更难了,不是更简单了。但回报也不是线性的。

Cherny 那句话的意思不是”工作变轻松了”。是 leverage point 变了。

Build the loop. But build it like someone who intends to stay the engineer.

写到这突然想问一句:你已经开始用类似的东西了吗?还是还在手动一轮一轮跟 agent 对话?评论区聊聊。

如果觉得这篇文章有帮助,欢迎点赞、在看、转发!有问题也可以在评论区留言,我会尽量回复!


内容效果不满意?点此反馈

输入关键词开始搜索