你不再写提示了,
你开始写循环
2026 年,最早把 AI 用到极致的人悄悄换了说法——他们不再 prompt,而在设计一套替自己 prompt 的系统。这叫「循环工程」。这篇把最疯版本、翻车点、最硬反方,连同一个你明天能照抄的最小循环,一起摊开。
从「写提示」到「写循环」
从「写提示」到「写循环」
把一句话问好。天花板:再好的提示也只值一个回合,你松手它就停。
经营给模型的整个上下文。天花板:仍「你问它答」,驱动它的还是你。
你不再亲自 prompt,而是造一个小系统:它自己找活、派活、检查、记账,由系统去戳 agent,而不是你。
「我已经不再 prompt Claude 了。我有一堆循环在跑着,由它们去 prompt Claude……我的工作,是写循环。」
一个 while 循环里的「程序员」
Ralph(取自《辛普森一家》里憨憨的 Ralph,故意强调「这办法笨」),最纯粹形态就是一行 bash:
它不追求「不确定的好」,而接受「可预测的烂」,再用海量迭代磨出结果。Huntley:「这个技术是确定地烂。」给摔跤的小孩「立牌子」——改之前先搜代码库,别假设没实现。
战绩:黑客松团队「把 agent 塞进 while,一夜 ship 6 个 repo」;一份 5 万美元合同交付+测试+review 仅 297 美元。但作者划了边界:只用于绿地、只到 90%、需资深工程师把关、且没被真正关住。
六块拼图,今天全摸得到
心跳 · Automations
按时启动,自己发现任务、做分诊。让循环成为真循环。
隔离 · Worktrees
多 agent 各待副本,互不踩脚。并行的前提。
知识 · Skills
把项目知识写成手册,匹配上自动调起。
接口 · MCP
连接器让循环真去动手,而不只是说「要是能做」。
制衡 · Sub-agents
一个出主意,另一个挑错。写代码的不给自己打分。
+记性 · Memory
活在对话之外的文件:agent 会忘,仓库不会。
四个最常漏的地方
自评失真
写的人给自己打分,乐呵呵宣布能用。治法:换不同人格 agent 当验收员,吐 VERDICT:PASS 才算完。
无声烧钱
自跑的循环无人值守地花钱,子 agent 尤其费。治法:硬性预算,max_usd+max_iterations 双闸。
跨轮失忆
每次重跑从零推导,又慢又重复烧钱。治法:每轮配 markdown 记忆文件,追加注入下一轮。
上下文腐烂
不停往同一会话加东西,越跑越糊。治法:循环间清掉上下文、只留起点。
最硬的一刀:控制论谬误
「一个概率性 agent 去检查另一个概率性 agent,并不构成可靠的控制系统——除非信号、边界、停止条件,从第 0 天起就被显式设计出来。」
真正的控制系统先答 7 问:精确控制目标?多大偏差熔断?领域风险空间?哪些信号可信?谁负最终责任?在哪停?人工 review 在哪饱和?
🛤 第三条路:把 LLM 当开发加速器,不当运行时依赖。让 agent 写脚本、用系统 cron 跑,运行时一个 LLM 都不在——既拿到 AI 速度,又零运行时不确定性。
让红掉的测试自己修好
实测锚点:LoopFlow 这类「测试并修复」循环,2 轮收敛、整轮 0.82 美元。你照抄:一条 cron + 两个人格相反的子 agent + MEMORY.md + --max-budget-usd,零新工具。
把 AI 请出「运行时」
区分两种循环:开发期循环(让 agent 迭代,值)和运行时循环(要稳要省的活,固化成脚本,别留 agent 跑)。能写确定性脚本的,就别套 LLM。
你正在读的这篇,本身就是循环
循环工程不是程序员专利——任何「重复且有明确成品」的活,都能套同一张五步骨架。
明天就能照抄的 5 步
同样的循环,相反的结果
「两个人可以搭出一模一样的循环,得到完全相反的结果。一个用它在自己深刻理解的活儿上跑得更快;另一个用它来彻底逃避理解。循环不知道这个差别。你知道。」
循环越好,三件事越尖锐:验证还是你的事(done 是声明不是证明);理解会烂掉(理解债);最危险的是认知投降——循环自己跑,你停止持有任何观点。
搭好你的循环
搭好你的循环,但要像一个打算继续当工程师的人那样搭——而不只是那个按下「开始」的人。
先挑一件你每天重复、又有明确对错的活,照上面五步把它的圈画出来——这就是你的第一个循环。
会勇禾口王的AI笔记
Harness 工程 · LOOP ENGINEERING · EP02 · @huiyonghkw
你不再写提示了,你开始写循环