以下是翻译后的内容:
本周 AI 编程领域被重复次数最多的一句话只有六个词,但几乎每个说这句话的人都说不清它是什么意思。一条推文这周把整个时间线都拿捏住了,所以我查了一下大家都在争论的那个词在过去 30 天里的热度。答案是真的,它有五年的演变脉络,而点睛之笔是:现在最贵的部分不是模型,而是循环。
那条拿捏了时间线的推文
这周,有一条推文让整个 AI 编程时间线都为之着迷。Peter Steinberger 在 6 月 7 日发布了它,浏览量超过 220 万,而评论区则演变成了一场关于它到底在说什么的混战。
“每月提醒:你不应该再给编程 Agent 写提示词了。你应该设计循环来给你的 Agent 提供提示。”
@steipete,2026 年 6 月 7 日
这就是每个人都在引用的那句话。最有价值的回复来自 Varadh Jain,他问了唯一关键的问题:这在实践中是什么样的?而最终成为主流看法的答案来自 Matthew Berman。
“没人知道,除了他和 boris。”
@MatthewBerman,2026 年 6 月 7 日
这才是真正的故事。重点不是循环是未来,而是一个六个词的短语获得了 200 万浏览量,同时追捧它的人却在评论区争论它到底是什么意思。我没有翻白眼,因为我每晚都在运行一个循环,在我睡觉的时候自动为大约三十个开源仓库创建拉取请求。90 秒的研究带回了十五个 Reddit 帖子、二十一个 X 平台帖子,以及一个令人不安的模式:AI 编程中最响亮的概念,却是大多数重复它的人无法解释的。一派高喊提示工程已死。另一派,那些真正在写代码的人,则更加谨慎。
“不是 ralph/goal 循环,那已经过时了。大概是某种持续编排循环,用来监督其他线程/Agent。”
@trashpandaemoji,2026 年 6 月 7 日
这条回复是所有人发布的内容中最接近正确答案的。记住它。
循环到底是什么
Boris Cherny 在 2024 年 9 月把 Claude Code 作为副业项目创建。据报道,现在 GitHub 上近 4% 的公共提交背后都有它的身影。在 6 月 2 日由 WorkOS 主办的 Acquired Unplugged 活动上,他给出了关于循环的最清晰定义。
“现在,我认为它实际上又升级了,进入了下一波抽象:我不再给 Claude 写提示词了。我运行着一些循环。正是这些循环在给 Claude 提供提示,并决定下一步要做什么。我的工作就是写循环。”
Boris Cherny,WorkOS Acquired Unplugged,2026 年 6 月 2 日
所以,这是通俗版解释。循环是你编写的一个小程序,它替你给编程 Agent 提供提示,读取它生成的内容,判断是否完成,如果没有完成,就再次提示它。你不再是循环里那个手打提示词的人。你变成了循环的作者。模型则变成了一个子程序。
Boris 把它分为三个阶段,弄清楚自己在哪个阶段是理解它的最快方法。一年前,他手动编写代码,配合自动补全。然后他同时运行五到十个 Claude 会话,并分别提示每个会话。现在他根本不再手动提示了。他编写循环来提示 Claude,而几百个 Agent 会读取他的 GitHub、Slack 和 Twitter 内容,决定接下来构建什么。他有证据。
“过去 30 天里,我对 Claude Code 的贡献 100% 是由 Claude Code 本身编写完成的。我提交了 259 个 PR。”
Boris Cherny,经由 Simon Willison,2025 年 12 月 27 日
他在 11 月删除了自己的 IDE,之后再也没打开过。提示工程已死那派忽略了一个细节:他并不是说工程师过时了。仍然需要有人来决定构建什么、与客户沟通、协调团队,而且他说优秀的工程师比以往任何时候都更重要。工作并没有消失,只是上升了一个层级,从编写代码变成了编写生成代码的东西。
频谱:从 ReAct 到编排
评论区一片混乱,因为“循环”这个词至少掩盖了五种不同的事物。下面是层级关系,从最旧到最新,这样你们就不会再各说各话了。
第一阶段是学术性的 while 循环。2022 年的 ReAct 论文将其形式化:模型进行推理、调用工具、读取结果,重复直到完成。一个模型,一个循环,一个人在一旁观察。第二阶段是 2023 年的 AutoGPT,它给模型一个目标,让它自己提示自己,最终以无限循环空转而闻名。那次失败为“Agent 只是个玩具”这种说法埋下了几年的伏笔。
第三阶段是 Trash Panda 称之为过时的那个:ralph 循环,由 Geoffrey Huntley 在 2025 年 7 月发布。它简单到几乎有点侮辱智商,就是一个 bash 单行命令,反复把同一个提示文件传给 Agent。它真正的创新在于纪律:每次迭代都将上下文重置为一组固定的参考文件,而不是让对话无限增长。Huntley 用这个循环花了大 约 297 美元就构建了一整套编程语言。第四阶段将其产品化:2026 年春季,Codex 和 Claude Code 都推出了 /goal 命令,它运行 ralph 循环,直到一个小型验证模型确认任务完成。
第五阶段才是 Boris 和 Steinberger 真正在说的东西,而且它确实是全新的,不仅仅是改名。有四件事变了。循环成为了工作单元,而不是任务。循环开始并发地、按计划地监督其他循环。调度取代了人工启动,所以循环按基础设施的时间运行,而不是占用你的注意力。持久性变得明确,采用了基于 git 的状态和崩溃恢复机制,因为这些循环必须能在重启后存活。ralph 假设你的终端一直开着。2026 年的版本则假设它不会一直开着。所以 Trash Panda 说对了两次:单 Agent 的 ralph 循环已经过时,而在此基础上构建的多 Agent 编排循环才是新事物。
它就是个戴上帽子的定时任务
整个讨论中最好的怀疑论观点只有四个词,发布在有人吹捧循环是未来趋势的帖子下面。
“定时任务最近改了个好名字。”
X 平台回复,循环讨论,2026 年 6 月
这值得一个直接的回答,而不是回避,因为这句话对了一半。是的,调度层就是 cron。Boris 自己的循环实际上就是运行在 cron 上的。Claude Code 中的 /loop 命令底层用的就是 cron。如果你对循环的全部定义就是一个按定时器运行的东西,那么是的,我们 1975 年就发明了它,你可以回家了。
但 cron 从来不具备中间那个部分。定时任务运行一个固定的脚本。循环运行一个模型,它查看当前状态,决定下一步做什么,执行它,检查是否成功,再决定是否继续。决策是由 Agent 做出的,而不是你,也不是一个硬编码的分支。把这些堆叠起来,让一个循环分发任务并监督其他循环,给它们持久化的共享状态,你就得到了 cron 无法表达的东西。诚实的表述不是“循环是全新的魔法”,也不是“循环不过是定时任务”。而是:循环 = 定时任务 + 一个决策者放在主体里,而有趣的工程问题是围绕这个决策者构建的一切,以防止它失控。
当你真正构建一个循环时是什么样子
理论够多了。入门方式就是一行代码。Claude Code 推出了 /loop,而 Boris 自己的示例就是标准的起点。粘贴并修改其中的名词即可。
/loop 监督我所有的 PR。自动修复构建问题,当有评论进来时,使用工作树 Agent 来修复它们。
这是他更完整的配方。几天后,Boris 发布了在自主运行 Opus 数小时或数天时的五个技巧。
用他自己的话说,五个技巧是:使用自动模式来处理权限,这样 Claude 就不需要请求批准;使用动态工作流,让 Claude 编排成百上千个 Agent 来完成一项任务;使用 /goal 或 /loop 来推动 Claude 继续工作直到完成;在云端使用 Claude Code,这样你可以合上笔记本电脑;并确保 Claude 有一种端到端自我验证其工作的方式。
@bcherny,2026 年 6 月
第五个技巧是炒作中忽略、而实践者痴迷的部分:一个循环的可靠性取决于它检查自己工作的能力。
这就是整个理念的缩影。你没有编写步骤。你编写了意图和停止行为,而循环在每个周期提示 Agent。在 TikTok 上,这种表述对普通观众来说很清晰。
“循环模式是最清晰的信号之一,表明 AI 编程正在从一次性的提示词转向后台操作。”
@ai.native.founder 在 TikTok 上,2026 年 6 月
高级阶段是 Steve Yegge 的 Gas Town,于 1 月发布:二十到三十个 Claude Code 实例由一个市长 Agent 协调,辅以运行持续循环的巡逻 Agent,状态存储在 git 中,这样工作可以在崩溃后存活。这就是 Trash Panda 试图表达的、那个监督其他线程的持续编排循环,已经发布并开源。
但研究中最实用的教训是,一个循环的好坏取决于它自我检查的能力。增长最快的子主题不是编排,而是验证。
“你的编码 Agent 可以快速行动,但糟糕的提交也会快速累积。”
@DanKornas,2026 年 6 月
Kornas 正在发布 roborev,这是一个在后台审查每次提交的工具,并在上下文还新鲜时将审查结果反馈给 Agent。一个在编写代码时没有反馈的开放循环,就是一台生成自信错误的机器。一个编写、运行、读取结果并修正错误的循环,才是真正有效的。循环本身不是魔法。循环内部的反馈才是。
剧情反转:循环现在成了最贵的部分
研究在此处从哲学问题转向了财务问题。整个 Agent 神话最犀利的戳破来自一位一线工程师。
“我今年发布的每个 AI Agent,都是一个 for 循环、一个 LLM 调用、以及一个围绕 JSON 解析的 try/catch。它唯一体现 Agent 特性的地方,就是月底 Anthropic 的账单。”
@rohit_jsfreaky,2026 年 6 月
那张账单可不是开玩笑。本月的收据是:Uber 将工程师使用 Claude Code 和 Cursor 的费用上限设为每人每工具每月 1500 美元,因为其在四个月内就烧完了全年的 AI 预算。一旦模型几乎免费地编写代码,成本就转移到了运行循环上。
“AI 编码中最昂贵的部分不再是写代码,而是管理 Agent 循环。”
@runes_leo,2026 年 6 月
而所有在生产环境中的人都害怕的失败模式,是停不下来的循环。
“没有护栏,你会遇到无限循环和远超预算的账单。”
@cv_usk,2026 年 6 月
这就是为什么每个严肃的 2026 年关于循环的文章都聚焦于同一个硬性停机机制:最大迭代次数、无进展检测、以及 token 或美元预算上限。关于循环的浪漫版本是,你编写循环,一千个 Agent 在一夜之间为你构建公司。生产版本是,你编写循环,而你的大部分工作是确保它们能停下来。Gartner 将 Agent AI 置于膨胀预期的顶峰,只有大约 17% 的组织实际部署了 Agent。时间线上的讨论与现实收据之间的差距,才是真正的现状。
关键不是循环,而是技能
这是我个人的看法,也是我观察了一周后的结论。循环只是管道。真正的资产是它调用的技能。
Steinberger 另一个反复出现的观点与循环观点相辅相成,并且是更持久的那一半:如果你做某件事超过一次,就把它变成自动化技能;如果你做某件困难的事,事后也把它变成技能,这样下次就是免费的。一个循环内部如果没有可复用的技能集,就只是一个围绕陌生人的 while-true。一个调用一组精良、经过测试、有名称的技能库的循环,是一个能自我复利的系统。那位真正在实践的 Reddit 用户说得最好。
“很多人在 Twitter 上翻白眼,但我竖起了耳朵。”
r/ChatGPTCoding,2026 年 6 月
所以,回答“循环到底是个啥”这个问题,并不是关于提示工程已死的火爆观点。而是:不要成为循环里的那个人。写一次循环,给它值得调用的技能和能自我检查的反馈机制,设置上限让它能停下来,然后让它按定时任务运行,而你去决定接下来要构建什么。Steinberger 和 Boris 从两个侧面描述了同一个东西。真正知道答案的,只有那些已经构建过一个循环的人。好消息是,从这个月开始,入门方式就是一个斜杠命令。
研究中的关键模式
循环 = 定时任务 + 一个决策者放在主体里:是模型,而不是硬编码的分支,在每个周期选择下一步行动。
演变脉络真实存在:2022 年 ReAct,2023 年 AutoGPT,2025 年 ralph,2026 年春季 /goal,现在的编排循环。单 Agent 的 ralph 已经过时;多 Agent 监督是新的层级。
循环的好坏取决于它的反馈。持续审查和验证关卡是使循环值得信赖的关键。
昂贵的资源从 token 转移到了循环管理。设置迭代上限、检测无进展、设定美元预算。
循环内部可复用的单元是技能,而不是提示词。调用精良具名技能的循环能自我复利;每次重新推导一切的循环只是在烧钱。
所有 Agent 汇报完毕
Reddit:17 个声音(r/ClaudeAI, r/AI_Agents, r/ExperiencedDevs),47 个帖子,3.4 万点赞
X 平台:21 个声音(steipete, bcherny, runes_leo),56 条帖子,175 次转发
YouTube:4 个声音(WorkOS, Lenny's Podcast, Y Combinator),演讲转录
TikTok:6 个声音(ai.native.founder, nikpolale),34 个片段
Instagram:4 个声音(sequenzy_com, ai.builders),14 个 Reel
Hacker News:12 个声音,54 个故事,1 千条评论
GitHub:6 个仓库(gastownhall/gastown, NousResearch/hermes),steipete 259+ 个 PR
主要声音:steipete, bcherny, runes_leo, rohit_jsfreaky, MatthewBerman
数据来源于 2026 年 6 月 7 日的 /last30days 查询。维度是:设计循环来提示编程 Agent,AI 循环,编码循环。
曾联合创办一家自动驾驶烤箱公司(被 Weber 收购)以及后来成为 Lyft 的公司。正在再次创业,更多信息即将发布。我运行循环在我睡觉时自动提交开源 PR,并且我在后台运行着 /last30days 研究来编写这些循环。





