> > >
Harness 工程 / HARNESS ENGINEERING
循环 · LOOPEP 0201 / 14
Harness 工程 · LOOP ENGINEERING

你不再写提示了,
你开始写循环

2026 年,最早把 AI 用到极致的人悄悄换了说法——他们不再 prompt,而在设计一套替自己 prompt 的系统。这叫「循环工程」。这篇把最疯版本、翻车点、最硬反方,连同一个你明天能照抄的最小循环,一起摊开。

▸ 方向键 / 空格 / 点击翻页 · 右下角可“自动播放”
本期速览 · OVERVIEW

从「写提示」到「写循环」

进化
写循环
Prompt→Loop
六块拼图
6 块
心跳·隔离·知识…
翻车高发
4 处
自评·烧钱·失忆·腐烂
最小循环
5 步
明天能照抄
第三次进化

从「写提示」到「写循环

2023 · PROMPT

把一句话问好。天花板:再好的提示也只值一个回合,你松手它就停。

2024 · CONTEXT

经营给模型的整个上下文。天花板:仍「你问它答」,驱动它的还是你。

2026 · LOOP

你不再亲自 prompt,而是造一个小系统:它自己找活、派活、检查、记账,由系统去戳 agent,而不是你。

「我已经不再 prompt Claude 了。我有一堆循环在跑着,由它们去 prompt Claude……我的工作,是写循环。

— Boris Cherny · Anthropic Claude Code 负责人

最疯的版本

一个 while 循环里的「程序员」

Ralph(取自《辛普森一家》里憨憨的 Ralph,故意强调「这办法笨」),最纯粹形态就是一行 bash:

# the Ralph loop
while :; do cat PROMPT.md | claude-code ; done

它不追求「不确定的好」,而接受「可预测的烂」,再用海量迭代磨出结果。Huntley:「这个技术是确定地烂。」给摔跤的小孩「立牌子」——改之前先搜代码库,别假设没实现。

战绩:黑客松团队「把 agent 塞进 while,一夜 ship 6 个 repo」;一份 5 万美元合同交付+测试+review 仅 297 美元。但作者划了边界:只用于绿地、只到 90%、需资深工程师把关、且没被真正关住。

一个循环的拼图

六块拼图,今天全摸得到

心跳 · Automations

按时启动,自己发现任务、做分诊。让循环成为真循环。

隔离 · Worktrees

多 agent 各待副本,互不踩脚。并行的前提。

📘

知识 · Skills

把项目知识写成手册,匹配上自动调起。

🔌

接口 · MCP

连接器让循环真去动手,而不只是说「要是能做」。

制衡 · Sub-agents

一个出主意,另一个挑错。写代码的不给自己打分。

🧠

+记性 · Memory

活在对话之外的文件:agent 会忘,仓库不会

裸循环会在哪翻车

四个最常漏的地方

01

自评失真

写的人给自己打分,乐呵呵宣布能用。治法:换不同人格 agent 当验收员,吐 VERDICT:PASS 才算完。

02

无声烧钱

自跑的循环无人值守地花钱,子 agent 尤其费。治法:硬性预算,max_usd+max_iterations 双闸。

03

跨轮失忆

每次重跑从零推导,又慢又重复烧钱。治法:每轮配 markdown 记忆文件,追加注入下一轮。

04

上下文腐烂

不停往同一会话加东西,越跑越糊。治法:循环间清掉上下文、只留起点。

别只听鼓吹的人

最硬的一刀:控制论谬误

「一个概率性 agent 去检查另一个概率性 agent,并不构成可靠的控制系统——除非信号、边界、停止条件,从第 0 天起就被显式设计出来。」

— Oborskyi ·《重新发明控制论》

真正的控制系统先答 7 问:精确控制目标?多大偏差熔断?领域风险空间?哪些信号可信?谁负最终责任?在哪停?人工 review 在哪饱和?

🛤 第三条路:把 LLM 当开发加速器,不当运行时依赖。让 agent 写脚本、用系统 cron 跑,运行时一个 LLM 都不在——既拿到 AI 速度,又零运行时不确定性。

三个真实循环 · A

让红掉的测试自己修好

触发
cron 每晚 02:00 跑 npm test,有红才唤醒,全绿就睡。
执行
fix agent 钉死人格:「谨慎的维护者,只做最小改动」。
检查
换相反人格 review agent,必须吐 VERDICT:PASS,否则带评语打回。
记账
每轮往 loop.md 追加,记成本,下一轮注入。
何时停
验收 PASS / 烧到预算 / 跑满 3 轮,任一即停。

实测锚点:LoopFlow 这类「测试并修复」循环,2 轮收敛、整轮 0.82 美元。你照抄:一条 cron + 两个人格相反的子 agent + MEMORY.md + --max-budget-usd,零新工具。

三个真实循环 · B

把 AI 请出「运行时」

开发期
让 Claude Code 写确定性爬虫脚本,反复迭代到稳定跑通。
固化
脚本定稿,结果落 sqlite。agent 的活到此结束。
运行时
用系统自带 cron 跑脚本——自动化环节一个 LLM 都不在。
兜底
哪天 LLM 工具全消失,这条线照样不打嗝地跑。

区分两种循环:开发期循环(让 agent 迭代,值)和运行时循环(要稳要省的活,固化成脚本,别留 agent 跑)。能写确定性脚本的,就别套 LLM。

三个真实循环 · C

你正在读的这篇,本身就是循环

触发
选题雷达扫 AI 圈热点,按「破圈×契合×差异化」筛出本选题。
执行
agent 把 Addy、Huntley 原话逐句核实、标出处。
检查
另一 agent 出图;敏感判断由我人肉点头,不交概率系统。
记账
MEMORY.md 记这个号踩过的坑,下篇注入,同一坑不踩第三次

循环工程不是程序员专利——任何「重复且有明确成品」的活,都能套同一张五步骨架。

最小可复制循环

明天就能照抄的 5 步

发现 / 触发:先把「done 长什么样」定死。手动起就先手动。
执行:一个 agent 干活,给能动手的工具、给明确人格。
检查(关键):换不同人格的 agent 当验收员,不过就带评语打回。
记账:每轮学到的写进外部记忆文件,下一轮注入。
何时停:验收通过 / 预算耗尽 / 次数上限,任一触发即停。
把工作台掀给你看

同样的循环,相反的结果

「两个人可以搭出一模一样的循环,得到完全相反的结果。一个用它在自己深刻理解的活儿上跑得更快;另一个用它来彻底逃避理解。循环不知道这个差别。你知道。

— Addy Osmani ·《Loop Engineering》结尾

循环越好,三件事越尖锐:验证还是你的事(done 是声明不是证明);理解会烂掉(理解债);最危险的是认知投降——循环自己跑,你停止持有任何观点。

本期金句

搭好你的循环

搭好你的循环,但要像一个打算继续当工程师的人那样搭——而不只是那个按下「开始」的人。

先挑一件你每天重复、又有明确对错的活,照上面五步把它的圈画出来——这就是你的第一个循环

— Harness 工程 · EP 02 —

会勇禾口王的AI笔记

Harness 工程 · LOOP ENGINEERING · EP02 · @huiyonghkw

你不再写提示了,你开始写循环

🎁 微信搜 会勇禾口王的AI笔记,回复 循环 领最小循环模板