什麼是 Loop?Peter Steinberger 對談 Boris Cherny

@mvanhorn
英語2 個月前 · 2026年6月08日
3.4M
4.8K
454
204
15.1K

TL;DR

AI 程式開發正從手動指令演進為能編排 Agent 並驗證程式碼的自動化 Loop。了解 Boris Cherny 等領袖如何運用這些系統,實現自動化處理數百個 PR。

本週 AI 程式設計領域最常被重複的一句話只有六個字,而且幾乎所有說出這句話的人都無法定義它。一則推文讓整個時間軸為之沸騰,於是我針對大家爭論不休的那個詞,跑了 /last30days 搜尋。答案是真實存在的,它有著五年的發展脈絡,而重點在於,現在最昂貴的部分是迴圈,而不是模型。

那則讓時間軸為之沸騰的推文

一則推文讓整個 AI 程式設計時間軸在本週為之著迷。Peter Steinberger 在 6 月 7 日發布了它,觀看次數突破 220 萬,而回覆區則演變成一場關於其真正含義的混戰。

「這是每月提醒:你不該再對程式設計 Agent 下提示了。你應該設計迴圈,讓迴圈來對你的 Agent 下提示。」

@steipete,2026 年 6 月 7 日

這就是大家都在引用的那句話。最耐人尋味的回覆來自 Varadh Jain,他問了唯一重要的問題:這在實務上看起來是什麼樣子?而 Matthew Berman 的回答則成為了所有人的共識。

「除了他和 boris,沒人知道。」

@MatthewBerman,2026 年 6 月 7 日

這才是真正的故事。重點不在於迴圈是未來趨勢,而在於一個六字短語達到了兩百萬次觀看,同時推廣它的人卻在回覆區爭論它的含義。我沒有翻白眼,因為我每晚都會運行一個迴圈,在我睡覺時,它會在大約三十個開源儲存庫中發起拉取請求。短短九十秒的研究,就找到了十五個 Reddit 討論串、二十一則 X 貼文,以及一個令人不安的模式:AI 程式設計領域最響亮的口號,卻是大多數重複它的人都無法解釋的。一派人大聲疾呼提示工程已死。另一派,那些真正在寫程式的人,則更加謹慎。

「這不是 ralph/goal 迴圈,那已經過時了。這大概是某種持續編排迴圈,用來監督其他執行緒/Agent。」

@trashpandaemoji,2026 年 6 月 7 日

這個回覆是所有貼文中,最接近正確答案的。請記住它。

迴圈的真正定義

Boris Cherny 在 2024 年 9 月將 Claude Code 作為一個 side project 創建。據報導,它現在支撐著 GitHub 上將近百分之四的所有公開提交。在 6 月 2 日由 WorkOS 主辦的 Acquired Unplugged 活動上,他給出了你所能找到的、關於迴圈最清晰的定義。

「現在它又升級了,我認為,到了下一波抽象層次,我不再對 Claude 下提示了。我有正在運行的迴圈。是它們在對 Claude 下提示,並決定下一步要做什麼。我的工作是編寫迴圈。」

Boris Cherny,WorkOS Acquired Unplugged,2026 年 6 月 2 日

所以,這裡是簡單明瞭的版本。迴圈是一個你編寫的小程式,它會為你對程式設計 Agent 下提示,讀取它產生的結果,判斷是否完成,如果沒有完成,就再次對它下提示。你不再是在迴圈中輸入提示的那個人。你成為了迴圈的作者。模型則變成了一個子程式。

Boris 將其分為三個階段,將自己定位在他的階梯上,是理解它的最快方法。一年前,他靠著自動完成功能手寫程式碼。然後,他並行運行五到十個 Claude 會話,並對每個會話下提示。現在,他完全不下提示了。他編寫那些對 Claude 下提示的迴圈,而數百個 Agent 則會讀取他的 GitHub、Slack 和 Twitter,並決定接下來要構建什麼。他有證據。

「在過去 30 天裡,我對 Claude Code 的 100% 貢獻都是由 Claude Code 編寫的。我完成了 259 個 PR。」

Boris Cherny,經由 Simon Willison,2025 年 12 月 27 日

他在 11 月刪除了他的 IDE,並且再也沒有打開過。提示工程已死的那群人忽略了一個細節:他並不是說工程師已經過時。仍然需要有人決定要構建什麼、與客戶交談、協調團隊,他說優秀的工程師比以往任何時候都更重要。工作並沒有消失。它只是提升了一個層次,從編寫程式碼,變成了編寫那個編寫程式碼的東西。

光譜:從 ReAct 到編排

回覆區之所以一團混亂,是因為「迴圈」這個詞至少隱含了五種不同的東西。以下是這個階梯,從最舊到最新,這樣你們就不會再雞同鴨講了。

第一階段是學術界的 while 迴圈。2022 年的 ReAct 論文將其形式化:模型進行推理、呼叫工具、讀取結果、重複直到完成。一個模型,一個迴圈,一個人在旁觀看。第二階段是 2023 年的 AutoGPT,它賦予了迴圈一個目標,讓它可以自我提示,並以其無限空轉而聞名。那次失敗為「Agent 只是個玩具」的觀點埋下了數年的伏筆。

第三階段是 Trash Panda 稱之為老掉牙的東西:ralph 迴圈,由 Geoffrey Huntley 在 2025 年 7 月發表。它簡單到幾乎令人難以置信,只是一個 bash 單行指令,將同一個提示檔案反覆傳送給 Agent。它真正的創新在於紀律:每次迭代都會將上下文重置為一組固定的錨點檔案,而不是讓對話不斷增長。Huntley 用這個方法,只花了約 297 美元就構建了一整個程式語言。第四階段將其產品化:在 2026 年春季,Codex 和 Claude Code 都推出了一個 /goal 指令,它會運行 ralph 迴圈,直到一個小型驗證模型確認任務完成。

第五階段才是 Boris 和 Steinberger 真正所指的東西,而且它確實是全新的,而不僅僅是換個名字。有四件事發生了變化。迴圈成為了工作單元,而不是任務。迴圈開始監督其他迴圈,而且是並發地、按計劃地進行。排程取代了人工啟動,因此迴圈是在基礎設施時間上運行,而不是依賴你的注意力。而且,持久性變得明確,有了基於 git 的狀態和崩潰恢復,因為這些東西必須能夠在重啟後存活。Ralph 假設你的終端機保持開啟。2026 年的版本則假設它不會。所以 Trash Panda 說對了兩次:單一 Agent 的 ralph 迴圈是老掉牙的東西,而建立在它之上的多 Agent 編排迴圈才是新事物。

它只是戴了頂帽子的 cron 工作

整個討論中最棒的懷疑論觀點只有四個字,發布在某人對「迴圈將是未來趨勢」的熱情讚揚之下。

「Cron 工作最近換了個有趣的品牌名稱。」

X 回覆,迴圈討論,2026 年 6 月

這值得一個直接的回答,而不是迴避,因為它說對了一半。是的,排程層就是 cron。Boris 實際上就是在 cron 上運行他的迴圈。Claude Code 中的 /loop 指令底層使用的就是 cron。如果你對迴圈的定義只是一個定時運行的東西,那麼是的,我們在 1975 年就發明了它,你可以回家了。

Cron 從未有過的是中間的那個部分。Cron 工作運行一個固定的腳本。迴圈則運行一個模型,這個模型會查看當前狀態、決定下一步要做什麼、執行它、檢查是否成功,並決定是否繼續。這個決定是 Agent 做出的,而不是你,也不是一個硬編碼的分支。將這些堆疊起來,讓一個迴圈分派並監督其他迴圈,賦予它們持久的共享狀態,你就得到了 cron 無法表達的東西。誠實的表述不是說迴圈是新的魔法,也不是說迴圈只是 cron。而是說,迴圈是 cron 加上主體中的一個決策者,而有趣的工程在於你圍繞這個決策所包裝的一切,以防止它失控。

當你實際構建一個時,它看起來是什麼樣子

理論夠了。入門方法只有一行指令。Claude Code 推出了 /loop,而 Boris 自己的範例就是標準的起手式。貼上它,然後更改名詞。

/loop 照看我的所有 PR。自動修復建置問題,當有評論進來時,使用一個工作樹 Agent 來修復它們。

這是他的更完整配方。幾天後,Boris 發布了五個讓 Opus 自主運行數小時或數天的技巧。

用他的話來說,五個技巧:使用自動模式處理權限,這樣 Claude 就不會請求批准;使用動態工作流程,讓 Claude 編排數百或數千個 Agent 來完成任務;使用 /goal 或 /loop 來促使 Claude 持續工作直到完成;在雲端使用 Claude Code,這樣你就可以關上筆電;確保 Claude 有一種方法可以端到端地自我驗證其工作。

@bcherny,2026 年 6 月

第五個技巧是那些炒作文章會跳過、而實務者會著迷的地方:一個迴圈的可信賴程度,完全取決於它檢查自身工作的能力。

這就是整個概念的縮影。你沒有編寫步驟。你編寫了意圖和停止行為,而迴圈會在每次滴答時對 Agent 下提示。在 TikTok 上,這個框架對一般觀眾來說非常清晰易懂。

「迴圈模式是最明確的跡象之一,表明 AI 程式設計正在從一次性提示轉向背景操作。」

@ai.native.founder 在 TikTok 上,2026 年 6 月

更深層的應用是 Steve Yegge's 的 Gas Town,於 1 月推出:由一個 Mayor Agent 協調二十到三十個 Claude Code 實例,搭配運行持續迴圈的巡邏 Agent,狀態儲存在 git 中,以便工作能在崩潰後存活。這就是 Trash Panda 試圖表達的那種監督其他執行緒的持續編排迴圈,已經發布且開源。

但在研究中,最實用的教訓是,一個迴圈的好壞取決於它檢查自身的能力。增長最快的主題不是編排,而是驗證。

「你的程式設計 Agent 可以快速行動,但糟糕的提交也會快速疊加。」

@DanKornas,2026 年 6 月

Kornas 正在推出 roborev,一個在背景審查每個提交並將發現回饋給 Agent 的工具,趁上下文還新鮮的時候。一個編寫程式碼但沒有回饋的開放式迴圈,就是一台產生自信錯誤的機器。一個編寫、運行、讀取結果並修正的迴圈,才是真正有效的東西。魔法不在於迴圈本身。在於其中的回饋。

劇情轉折:現在昂貴的部分是迴圈

這裡,研究從哲學問題變成了財務問題。對整個 Agent 神話最犀利的戳破來自一位在職工程師。

「我今年推出的每個 AI agent 就是一個 for 迴圈、一個 llm 呼叫,以及一個圍繞 json 解析的 try/catch。它唯一有 agent 特性的地方,就是月底的 Anthropic 帳單。」

@rohit_jsfreaky,2026 年 6 月

那筆帳單可不是開玩笑的。本月的帳單實例:Uber 在四個月內燒光了年度 AI 預算後,將其工程師使用 Claude Code 和 Cursor 的費用上限設定為每人每工具每月 1,500 美元。一旦模型幾乎免費地編寫程式碼,成本就轉移到了運行它的迴圈上。

「AI 程式設計中最昂貴的不再是編寫程式碼,而是管理 Agent 迴圈。」

@runes_leo,2026 年 6 月

而每個在生產環境中的人都害怕的失敗模式,就是一個不會停止的迴圈。

「沒有護欄,你就會得到無限迴圈和超出預算好幾個數量級的帳單驚喜。」

@cv_usk,2026 年 6 月

這就是為什麼每個 2026 年關於迴圈的嚴肅文章都收斂到同樣三個硬性停止條件:最大迭代次數、無進展檢測,以及 token 或金額預算上限。關於迴圈的浪漫版本是,你編寫迴圈,然後一千個 Agent 在一夜之間為你建立公司。生產版本則是,你編寫迴圈,而你大部分的工作是確保它們能停下來。Gartner 將 agentic AI 置於期望膨脹的高峰期,只有大約百分之十七的組織實際部署了 Agent。時間軸上的討論與實際帳單之間的差距,才是真正的現狀。

關鍵不在迴圈,在技能

這是我自己的看法,也是我在觀察了一週後得出的結論。迴圈是管道。真正的資產是它所呼叫的技能。

Steinberger 另一個反覆提到的觀點與迴圈觀點相輔相成,而且是更持久的一半:如果你做某件事超過一次,就把它變成自動化的技能;如果你做某件困難的事,事後也把它變成技能,這樣下次就是免費的了。一個內部沒有可重複使用技能的迴圈,只是一個圍繞陌生人的 while-true 迴圈。一個呼叫了精良、經過測試、有命名技能的函式庫的迴圈,是一個能產生複合效應的系統。那位真正在實踐的 Reddit 使用者說得最好。


「很多人在 Twitter 上翻白眼,但我可是豎起了耳朵。」

</blockquote>

r/ChatGPTCoding,2026 年 6 月

所以,對「WTF 是迴圈」這個問題的答案,不是關於提示工程已死的聳動言論。而是:停止成為迴圈中的那個東西。編寫一次迴圈,賦予它值得呼叫的技能和讓它能自我檢查的回饋,設定上限讓它能停止,然後讓它在 cron 上運行,而你則去決定接下來要構建什麼。Steinberger 和 Boris 從兩個側面描述了同一個東西。真正知道答案的,只有那些已經構建過一個的人。好消息是,從本月開始,入門方法只是一個斜線指令。

研究中的關鍵模式

迴圈是 cron 加上主體中的一個決策者:模型,而不是硬編碼的分支,在每次滴答時選擇下一個動作。

其發展脈絡是真實的:2022 年的 ReAct、2023 年的 AutoGPT、2025 年的 ralph、2026 年春季的 /goal,以及現在的編排迴圈。單一 Agent 的 ralph 已經過時;多 Agent 監督是新的層次。

迴圈的好壞取決於它的回饋。持續的審查和驗證關卡是讓迴圈值得信賴的關鍵。

昂貴的資源已從 token 轉移到迴圈管理。限制迭代次數、檢測無進展、設定金額預算。

迴圈內可重複使用的單位是技能,而不是提示。呼叫精良命名技能的迴圈會產生複合效應;每次都重新推導一切的迴圈只是在燒錢。

所有 Agent 回報完畢

Reddit:17 個聲音(r/ClaudeAI、r/AI_Agents、r/ExperiencedDevs),47 個討論串,34k 個讚

X:21 個聲音(steipete、bcherny、runes_leo),56 則貼文,175 次轉發

YouTube:4 個聲音(WorkOS、Lenny's Podcast、Y Combinator),演講逐字稿

TikTok:6 個聲音(ai.native.founder、nikpolale),34 個短片

Instagram:4 個聲音(sequenzy_com、ai.builders),14 個 Reels

Hacker News:12 個聲音,54 則故事,1k 則留言

GitHub:6 個儲存庫(gastownhall/gastown、NousResearch/hermes),steipete 259+ 個 PR

主要聲音:steipete、bcherny、runes_leo、rohit_jsfreaky、MatthewBerman

資料彙編自 2026-06-07 的 /last30days 搜尋。面向:設計對程式設計 Agent 下提示的迴圈、ai 迴圈、程式設計迴圈。

共同創辦了一家自駕烤箱公司(被 Weber 收購)以及後來成為 Lyft 的公司。正在再次創業,更多消息即將發布。我運行著在我睡覺時發布開源 PR 的迴圈,並且我在背景運行 /last30days 研究時編寫它們。

一鍵儲存

使用 YouMind AI 深度閱讀爆款文章

保存原文、追問細節、總結觀點,並在一個 AI 工作空間裡把爆款文章沉澱成可複用筆記。

了解 YouMind
寫給創作者

把你的 Markdown 變成乾淨的 𝕏 文章

圖片上傳、表格、程式碼區塊,往 𝕏 上手動重排太痛苦。YouMind 把整篇 Markdown 一鍵轉成乾淨、可直接發佈的 𝕏 文章草稿。

試試 Markdown 轉 𝕏

更多可拆解樣本

近期爆款文章

探索更多爆款文章