首页
学习
活动
专区
圈层
工具
发布

《Loop Engineering 橙皮书》:从喂 prompt 到设计循环

《Loop Engineering 橙皮书》副标题叫“从一句句喂 prompt,到设计让 agent 自己干活的系统”。它讲的是 AI 应用往上多出来的一层——站在 Harness 之上的 Loop。这个词由 Google Chrome 工程师 Addy Osmani 提出:loop engineering 是把“那个负责 prompt agent 的人”从你换成一套系统。全手册 9 节,覆盖定义、四层栈、五个动作、六零件、评判器、真实案例、代价和上手。全书 32 页,定位是给已经会用 agent 的人,再往上走一层。

从 Prompt 到 Loop,AI 工程叠了四层

过去两年冒出来的“XX Engineering”其实是一层层叠起来的四层栈,不是谁取代谁。最底层 Prompt 管“写好一次的提示词”;往上是 Context,管“这一刻窗口里放什么”;再往上是 Harness,管“单次运行的武装”——给哪些工具、允许哪些动作、什么算完成;最上面是 Loop,管“在 harness 之上调度,怎么让它自己一遍遍跑起来”。每往上一层,你操心的东西就大一号,从一句话到一整套自动跑的循环。所以 Loop 也被叫做 The New Layer Above the Harness。

一个循环转一圈,只有五个动作

书里把一个 loop 拆成五个动作:发现、交付、验证、持久化、调度。少一个,循环就转不起来或者空转。最常被引用的例子是 Addy 在 Chrome 团队的“早间 triage loop”:自动化读 CI 失败、open issue、最近 commit,把分诊结果写进看板,开隔离 worktree,一个子 agent 起草修复、另一个子 agent 审查,connector 自动开 PR,处理不了的进收件箱,状态文件留给第二天接着跑。妙处是能自动的全自动,该停的地方停下来等人。

往循环里放一个能说“不”的东西

§05 讲生成器与评判器。让写代码的 agent 评价自己,它会自信地夸一通——Anthropic 工程师 Prithvi Rajasekaran 把这个现象写进了官方博客。一个无人值守的 loop,也是一个无人值守犯错的 loop。“循环的难点不在循环本身,难的是往里面放一个能说“不”的东西。”做法是安排独立的评判者,最好换模型、换指令,专门挑刺,而不是让干活的和打分的是同一个 agent。

循环也在替你悄悄欠债

§07 把另一半摆出来,重点讲验证债、理解腐烂、token 失控。自动开 PR、自动改代码省下的时间,变成一堆“还没人验证过”的产出,藏在测试没覆盖的地方,攒到上线那天一起爆。理解腐烂更隐蔽:循环每天替你写一堆没读过的代码,你慢慢就不懂自己的仓库了。书里提醒,加一个 agent 很容易,加一个能拦住 agent 的东西很难。

第一个 Loop,从一个 /loop 开始

§09 建议从小到不像系统起步,而不是一上来就想 Stripe 每周上千 PR 的流水线。Claude Code v2.1.72 之后自带 /loop 命令,有固定间隔、让 Claude 自己定节奏、裸跑维护任务三种形态。最朴素的起点是 triage:让它每天早上去看 CI、issue、commit,挑值得处理的列清单。注意它是 session 级、recurring 任务 7 天过期、跑在本机,真要关机也跑得换 Cloud Routines 或 GitHub Actions。先把“每天自动看一眼”跑通,比一次性设计完美流水线更有用。

写在最后

这本橙皮书不鼓吹“全自动化”,它把好处和代价都摊开:Loop Engineering 真正的难点,不是让 agent 跑起来,而是设计好那套系统里谁来说不、谁来验收。如果你已经会用 agent 干活,却还卡在“我一句句喂”的位置,这本书能帮你往漏斗上面走一层。

Loop-Engineering橙皮书

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OVo-tQ2X-vFL8fwwTYahx5Kg0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券