Was zum Teufel ist ein Loop? Peter Steinberger vs. Boris Cherny

@mvanhorn
ENGLISCHvor 2 Monaten · 08. Juni 2026
3.4M
4.8K
454
204
15.1K

TL;DR

KI-Coding entwickelt sich von manuellen Prompts hin zu autonomen Loops, die Agenten steuern und Code verifizieren. Erfahre, wie Vordenker wie Boris Cherny diese Systeme nutzen, um Hunderte von PRs automatisch zu mergen.

Der meistwiederholte Satz im KI-Coding dieser Woche ist sechs Wörter lang, und fast niemand, der ihn sagt, kann ihn definieren. Ein Tweet hatte diese Woche die gesamte Timeline im WĂŒrgegriff, also habe ich /last30days auf das Wort losgelassen, ĂŒber das alle gestritten haben. Die Antwort ist real, hat eine fĂŒnfjĂ€hrige Entwicklungsgeschichte, und der Clou ist, dass die Schleife, nicht das Modell, jetzt der teure Teil ist.

Der Tweet, der die Timeline im WĂŒrgegriff hĂ€lt

Ein Tweet hat diese Woche die gesamte KI-Coding-Timeline in Atem gehalten. Peter Steinberger postete ihn am 7. Juni, er knackte 2,2 Millionen Aufrufe, und die Antworten arteten in eine SchlĂ€gerei darĂŒber aus, was er eigentlich bedeutete.

„Hier ist deine monatliche Erinnerung, dass du keine Coding-Agenten mehr prompten solltest. Du solltest Schleifen entwerfen, die deine Agenten prompten.“

@steipete, 7. Juni 2026

Das ist der Satz, den alle zitieren. Die aufschlussreichste Antwort kam von Varadh Jain, der die einzig relevante Frage stellte: Wie sieht das in der Praxis aus? Und die Antwort, die die ganze Stimmung einfing, war die von Matthew Berman.

„Niemand weiß es außer ihm und Boris.“

@MatthewBerman, 7. Juni 2026

Das ist die wahre Geschichte. Nicht, dass Schleifen die Zukunft sind, sondern dass ein Sechs-Wörter-Satz zwei Millionen Aufrufe erzielte, wĂ€hrend die Leute, die ihn pushten, sich in den Antworten darĂŒber stritten, was er bedeutet. Ich habe nicht die Augen verdreht, denn ich lasse jede Nacht eine Schleife laufen, die wĂ€hrend ich schlafe, Pull-Requests in etwa dreißig Open-Source-Repos eröffnet. Neunzig Sekunden Recherche spuckten fĂŒnfzehn Reddit-Threads, einundzwanzig X-Posts und ein unbequemes Muster aus: Die lauteste Idee im KI-Coding ist eine, die die meisten, die sie wiederholen, nicht erklĂ€ren können. Ein Lager rief, dass Prompt-Engineering tot sei. Ein anderes Lager, das mit den HĂ€nden tatsĂ€chlich an der Tastatur, war vorsichtiger.

„Es sind keine Ralph/Goal-Schleifen, das ist inzwischen alter Hut. Es ist wahrscheinlich eine Art kontinuierliche Orchestrierungsschleife, die andere Threads/Agenten ĂŒberwacht.“

@trashpandaemoji, 7. Juni 2026

Diese Antwort kommt der richtigen Antwort, die jemand gepostet hat, am nÀchsten. Behalte sie im Hinterkopf.

Was eine Schleife eigentlich ist

Boris Cherny erstellte Claude Code im September 2024 als Nebenprojekt. Mittlerweile soll es hinter knapp vier Prozent aller öffentlichen Commits auf GitHub stecken. Auf der BĂŒhne des Acquired Unplugged Events, das von WorkOS am 2. Juni ausgerichtet wurde, gab er die klarste Definition einer Schleife, die du finden wirst.

„Jetzt hat es sich, glaube ich, wieder auf die nĂ€chste Abstraktionswelle hochgeschraubt, wo ich Claude nicht mehr prompte. Ich habe Schleifen, die laufen. Sie sind es, die Claude prompten und herausfinden, was zu tun ist. Mein Job ist es, Schleifen zu schreiben.“

Boris Cherny, WorkOS Acquired Unplugged, 2. Juni 2026

Also hier ist die einfache Version. Eine Schleife ist ein kleines Programm, das du schreibst, das den Coding-Agenten fĂŒr dich auffordert, liest, was es produziert hat, entscheidet, ob es fertig ist, und wenn nicht, es erneut auffordert. Du hörst auf, das Ding in der Schleife zu sein, das Prompts eintippt. Du wirst zum Autor der Schleife. Das Modell wird zu einer Unterroutine.

Boris erzĂ€hlt es als drei Stufen, und sich auf seiner Leiter zu positionieren, ist der schnellste Weg, es zu verstehen. Vor einem Jahr schrieb er Code von Hand mit AutovervollstĂ€ndigung. Dann fĂŒhrte er fĂŒnf bis zehn Claude-Sitzungen parallel aus und promptete jede einzelne. Jetzt promptet er gar nicht mehr. Er schreibt die Schleifen, die Claude prompten, und ein paar hundert Agenten lesen sein GitHub, Slack und Twitter und entscheiden, was als nĂ€chstes gebaut wird. Er hat den Beweis.

„In den letzten 30 Tagen wurden 100 % meiner BeitrĂ€ge zu Claude Code von Claude Code geschrieben. Ich habe 259 PRs abgeschlossen.“

Boris Cherny, via Simon Willison, Dezember 2025

Er löschte seine IDE im November und hat sie seitdem nicht mehr geöffnet. Die Nuance, die die „Prompt-Engineering-ist-tot“-Fraktion ĂŒberspringt: Er sagt nicht, dass Ingenieure ĂŒberflĂŒssig sind. Jemand muss immer noch entscheiden, was gebaut wird, mit Kunden sprechen und Teams koordinieren, und er sagt, großartige Ingenieure sind wichtiger denn je. Der Job ist nicht verschwunden. Er ist auf eine höhere Ebene gestiegen, vom Schreiben des Codes zum Schreiben des Dings, das den Code schreibt.

Das Spektrum: Von ReAct bis zur Orchestrierung

Die Antworten waren ein Chaos, weil „Schleife“ mindestens fĂŒnf verschiedene Dinge versteckt. Hier ist die Leiter, von der Ă€ltesten zur neuesten, damit du aufhörst, aneinander vorbeizureden.

Stufe eins ist die akademische While-Schleife. Das ReAct-Papier von 2022 formalisierte sie: Das Modell denkt, ruft ein Werkzeug auf, liest das Ergebnis, wiederholt, bis es fertig ist. Ein Modell, eine Schleife, ein zuschauender Mensch. Stufe zwei ist AutoGPT im Jahr 2023, das ihr ein Ziel gab und sie sich selbst prompten ließ, und das berĂŒhmt dafĂŒr wurde, ewig im Kreis zu laufen und nichts zu tun. Dieses Scheitern sĂ€te jahrelang „Agenten sind ein Spielzeug“.

Stufe drei ist die, die Trash Panda als alten Hut bezeichnete: die Ralph-Schleife, veröffentlicht von Geoffrey Huntley im Juli 2025. Sie ist fast schon beleidigend einfach, ein Bash-One-Liner, der dieselbe Prompt-Datei immer wieder in den Agenten pipet. Ihre eigentliche Innovation war Disziplin: Jede Iteration setzt den Kontext auf einen festen Satz von Ankerdateien zurĂŒck, anstatt das GesprĂ€ch wachsen zu lassen. Huntley baute mit ihr eine ganze Programmiersprache fĂŒr etwa 297 Dollar. Stufe vier produktionalisierte das: Im FrĂŒhjahr 2026 fĂŒgten sowohl Codex als auch Claude Code einen /goal-Befehl ein, der die Ralph-Schleife ausfĂŒhrt, bis ein kleines Validatormodell bestĂ€tigt, dass die Aufgabe erledigt ist.

Stufe fĂŒnf ist das, was Boris und Steinberger tatsĂ€chlich meinen, und sie ist wirklich neu, nicht nur umbenannt. Vier Dinge haben sich geĂ€ndert. Die Schleife wurde zur Arbeitseinheit, nicht die Aufgabe. Schleifen begannen, andere Schleifen zu ĂŒberwachen, gleichzeitig und nach einem Zeitplan. Die Zeitplanung ersetzte den menschlichen Anstoß, sodass die Schleife in der Infrastrukturzeit lĂ€uft, anstatt deiner Aufmerksamkeit. Und die Haltbarkeit wurde explizit, mit Git-gestĂŒtztem Zustand und Crash-Wiederherstellung, denn diese Dinge mĂŒssen einen Neustart ĂŒberleben. Ralph setzte voraus, dass dein Terminal offen bleibt. Die Version von 2026 setzt voraus, dass es das nicht tut. Also hatte Trash Panda zweimal recht: Die Einzel-Agenten-Ralph-Schleife ist alter Hut, und die Multi-Agenten-Orchestrierungsschleife obendrauf ist das Neue.

Es ist nur ein Cron-Job mit einem Hut

Die beste skeptische Zeile im gesamten Korpus bestand aus vier Wörtern, gepostet unter jemandem, der schwÀrmte, dass Schleifen die Zukunft seien.

„Cronjobs haben gerade ein lustiges Rebranding.“

X-Antwort, Schleifendiskurs, Juni 2026

Das verdient eine direkte Antwort, keine Ausweichmanöver, denn es ist zur HÀlfte richtig. Ja, die Planungsebene ist Cron. Boris lÀsst seine buchstÀblich per Cron laufen. Der /loop-Befehl in Claude Code verwendet Cron unter der Haube. Wenn deine ganze Definition einer Schleife ein Ding ist, das nach einem Timer lÀuft, dann ja, das haben wir 1975 erfunden und du kannst nach Hause gehen.

Was Cron nie hatte, ist der Teil in der Mitte. Ein Cron-Job fĂŒhrt ein festes Skript aus. Eine Schleife fĂŒhrt ein Modell aus, das den aktuellen Zustand betrachtet, entscheidet, was als nĂ€chstes zu tun ist, es tut, ĂŒberprĂŒft, ob es funktioniert hat, und entscheidet, ob es weitergeht. Die Entscheidung liegt beim Agenten, nicht bei dir, und ist kein fest codierter Zweig. Staple diese, lass eine Schleife andere dispatchen und ĂŒberwachen, gib ihnen dauerhaften gemeinsamen Zustand, und du hast etwas, das Cron nicht ausdrĂŒcken kann. Die ehrliche Darstellung ist weder, dass Schleifen neue Magie sind, noch dass Schleifen nur Cron sind. Es ist, dass Schleifen Cron plus eine Entscheidungsinstanz im Körper sind, und die interessante Technik ist alles, was du um diese Entscheidung herumwickelst, damit sie nicht ĂŒber die Kante lĂ€uft.

Wie es aussieht, wenn du tatsÀchlich eine baust

Genug Theorie. Die Einstiegsrampe ist eine Zeile. Claude Code hat /loop eingefĂŒhrt, und Boris' eigenes Beispiel ist der kanonische Starter. FĂŒge das ein und Ă€ndere die Nomen.

/loop babysit all my PRs. Auto-fix build issues, and when comments come in, use a worktree agent to fix them.

Und hier ist sein ausfĂŒhrlicheres Rezept. Tage spĂ€ter postete Boris fĂŒnf Tipps, um Opus stunden- oder tagelang autonom laufen zu lassen.

FĂŒnf Tipps, in seinen Worten: Verwende den Automatikmodus fĂŒr Berechtigungen, damit Claude nicht um Erlaubnis fragen muss; verwende dynamische Workflows, um Claude hunderte oder tausende Agenten orchestrieren zu lassen, um eine Aufgabe zu erledigen; verwende /goal oder /loop, um Claude anzustupsen, weiterzumachen, bis es fertig ist; verwende Claude Code in der Cloud, damit du deinen Laptop zumachen kannst; und stelle sicher, dass Claude eine Möglichkeit hat, seine Arbeit Ende-zu-Ende selbst zu verifizieren.

@bcherny, Juni 2026

Tipp fĂŒnf ist der, den der Hype ĂŒberspringt und den die Praktiker besessen verfolgen: Eine Schleife ist nur so vertrauenswĂŒrdig wie ihre FĂ€higkeit, ihre eigene Arbeit zu ĂŒberprĂŒfen.

Das ist die ganze Idee im Kleinen. Du hast nicht die Schritte geschrieben. Du hast die Absicht und das Stoppverhalten geschrieben, und die Schleife fordert den Agenten bei jedem Tick auf. Auf TikTok kam der Rahmen fĂŒr ein allgemeines Publikum klar an.

„Der Schleifenmodus ist eines der klarsten Anzeichen dafĂŒr, dass sich KI-Coding von einmaligen Prompts zu Hintergrundoperationen entwickelt.“

@ai.native.founder auf TikTok, Juni 2026

Das tiefe Ende ist Steve Yegges Gas Town, gestartet im Januar: Zwanzig bis dreißig Claude Code-Instanzen, koordiniert von einem Mayor-Agenten, mit Patrol-Agenten, die kontinuierliche Schleifen laufen lassen, und Zustand, der in Git gespeichert ist, sodass die Arbeit einen Absturz ĂŒberlebt. Das ist die kontinuierliche Orchestrierungsschleife, die andere Threads ĂŒberwacht, die Trash Panda zu erreichen versuchte, ausgeliefert und Open Source.

Aber die praktischste Lektion in der Recherche ist, dass eine Schleife nur so gut ist wie ihre FĂ€higkeit, sich selbst zu ĂŒberprĂŒfen. Das am schnellsten wachsende Unterthema war nicht Orchestrierung, sondern Verifikation.

„Dein Coding-Agent kann schnell sein, aber schlechte Commits summieren sich auch schnell.“

@DanKornas, Juni 2026

Kornas veröffentlicht roborev, ein Tool, das jeden Commit im Hintergrund ĂŒberprĂŒft und die Ergebnisse an den Agenten zurĂŒckmeldet, wĂ€hrend der Kontext noch frisch ist. Eine offene Schleife, die Code ohne Feedback schreibt, ist eine Maschine zur Erzeugung selbstbewusster Fehler. Eine Schleife, die schreibt, ausfĂŒhrt, das Ergebnis liest und korrigiert, ist das Ding, das tatsĂ€chlich funktioniert. Die Schleife ist nicht die Magie. Das Feedback in ihr ist es.

Die Wendung: Die Schleife ist jetzt der teure Teil

Hier schlug die Recherche einen Bogen von der Philosophie zu einem Finanzproblem. Die schÀrfste Entzauberung der gesamten Agenten-Mythologie kam von einem arbeitenden Ingenieur.

„Jeder KI-Agent, den ich dieses Jahr ausgeliefert habe, ist eine For-Schleife, ein LLM-Aufruf und ein Try/Catch um das JSON-Parsing herum. Das Einzige, was agentisch daran ist, ist die Anthropic-Rechnung am Ende des Monats.“

@rohit_jsfreaky, Juni 2026

Diese Rechnung ist kein Witz. Der Beleg des Monats: Uber begrenzte seine Ingenieure auf 1.500 Dollar pro Person pro Tool pro Monat fĂŒr Claude Code und Cursor, nachdem es sein jĂ€hrliches KI-Budget in vier Monaten aufgebraucht hatte. Sobald das Modell den Code fast kostenlos schreibt, verlagern sich die Kosten auf die Schleife, die es ausfĂŒhrt.

„Das Teuerste im KI-Coding ist nicht mehr das Schreiben von Code, sondern die Verwaltung der Agentenschleife.“

@runes_leo, Juni 2026

Und die Fehlerart, vor der jeder in der Produktion Angst hat, ist die Schleife, die nicht anhÀlt.

„Ohne Schutzmaßnahmen bekommst du Endlosschleifen und AbrechnungsĂŒberraschungen, die um GrĂ¶ĂŸenordnungen ĂŒber dem Budget liegen.“

@cv_usk, Juni 2026

Weshalb jeder ernsthafte Artikel von 2026 ĂŒber Schleifen auf denselben drei harten Stopps hinauslĂ€uft: eine maximale Iterationsanzahl, eine „kein Fortschritt“-Erkennung und eine Token- oder Dollarbudget-Obergrenze. Die romantische Version von Schleifen ist, dass du die Schleifen schreibst und tausend Agenten ĂŒber Nacht dein Unternehmen aufbauen. Die Produktionsversion ist, dass du die Schleifen schreibst und der Großteil deines Jobs darin besteht, sicherzustellen, dass sie anhalten. Gartner platziert agentische KI auf dem Höhepunkt der ĂŒberhöhten Erwartungen, wobei nur etwa siebzehn Prozent der Organisationen tatsĂ€chlich Agenten einsetzen. Die LĂŒcke zwischen der Timeline und den Belegen ist der wahre Stand der Dinge.

Es sind nicht Schleifen. Es sind FĂ€higkeiten.

Hier ist meine eigene Meinung, und es ist der Punkt, an dem ich nach einer Woche des Beobachtens lande. Die Schleife ist die Infrastruktur. Das Asset ist die FĂ€higkeit, die sie aufruft.

Steinbergers anderer wiederkehrender Punkt paart sich mit dem ĂŒber Schleifen und ist die haltbarere HĂ€lfte: Wenn du etwas mehr als einmal tust, mach daraus eine automatisierte FĂ€higkeit, und wenn du etwas Schwieriges tust, mach es hinterher zu einer FĂ€higkeit, damit es beim nĂ€chsten Mal kostenlos ist. Eine Schleife ohne wiederverwendbare FĂ€higkeiten in ihr ist nur eine While-True-Schleife um einen Fremden herum. Eine Schleife, die eine Bibliothek scharfer, getesteter, benannter FĂ€higkeiten aufruft, ist ein System, das sich selbst verstĂ€rkt. Der Reddit-Praktiker, der tatsĂ€chlich umsetzt, hat es am besten gesagt.

„Viele Leute verdrehen auf Twitter die Augen, aber meine Ohren sind gespitzt.“

r/ChatGPTCoding, Juni 2026

Also ist die Antwort auf „WTF ist eine Schleife“ kein heißer Take darĂŒber, dass Prompt-Engineering stirbt. Es ist dies: Hör auf, das Ding in der Schleife zu sein. Schreib die Schleife einmal, gib ihr FĂ€higkeiten, die es wert sind, aufgerufen zu werden, und RĂŒckmeldung, damit sie sich selbst ĂŒberprĂŒfen kann, begrenze sie, damit sie anhĂ€lt, und lass sie per Cron laufen, wĂ€hrend du gehst und entscheidest, was als nĂ€chstes gebaut wird. Steinberger und Boris beschreiben dasselbe Tier von zwei Seiten. Die Einzigen, die es wirklich wissen, sind die, die bereits eine gebaut haben. Die gute Nachricht ist, dass die Einstiegsrampe ab diesem Monat ein einziger SchrĂ€gstrich-Befehl ist.

Wichtige Muster aus der Recherche

Eine Schleife ist Cron plus eine Entscheidungsinstanz im Körper: Das Modell, nicht ein fest codierter Zweig, wÀhlt bei jedem Tick die nÀchste Aktion.

Die Entwicklungsgeschichte ist real: ReAct im Jahr 2022, AutoGPT im Jahr 2023, Ralph im Jahr 2025, /goal im FrĂŒhjahr 2026, Orchestrierungsschleifen jetzt. Die Einzel-Agenten-Ralph-Schleife ist alter Hut; die Multi-Agenten-Überwachung ist die neue Ebene.

Die Schleife ist nur so gut wie ihr Feedback. Kontinuierliche ÜberprĂŒfung und Validierungsgates machen eine Schleife vertrauenswĂŒrdig.

Die teure Ressource hat sich von Tokens zur Schleifenverwaltung verlagert. Begrenze Iterationen, erkenne fehlenden Fortschritt, setze ein Dollarbudget.

Die wiederverwendbare Einheit innerhalb der Schleife ist eine FĂ€higkeit, kein Prompt. Schleifen, die scharfe, benannte FĂ€higkeiten aufrufen, potenzieren sich; Schleifen, die alles neu ableiten, verbrennen nur Geld.

Alle Agenten haben berichtet

Reddit: 17 Stimmen (r/ClaudeAI, r/AI_Agents, r/ExperiencedDevs), 47 Threads, 34k Upvotes

X: 21 Stimmen (steipete, bcherny, runes_leo), 56 BeitrÀge, 175 Reposts

YouTube: 4 Stimmen (WorkOS, Lenny's Podcast, Y Combinator), GesprÀchstranskripte

TikTok: 6 Stimmen (ai.native.founder, nikpolale), 34 Clips

Instagram: 4 Stimmen (sequenzy_com, ai.builders), 14 Reels

Hacker News: 12 Stimmen, 54 Geschichten, 1k Kommentare

GitHub: 6 Repos (gastownhall/gastown, NousResearch/hermes), steipete 259+ PRs

Top-Stimmen: steipete, bcherny, runes_leo, rohit_jsfreaky, MatthewBerman

Zusammengestellt aus /last30days-LĂ€ufen vom 07.06.2026. Facetten: Entwerfen von Schleifen, die Coding-Agenten prompten, KI-Schleifen, Coding-Schleifen.

MitbegrĂŒnder eines selbstbackenden Ofenunternehmens (ĂŒbernommen von Weber) und des Unternehmens, das zu Lyft wurde. Baue wieder etwas auf, bald mehr. Ich lasse Schleifen laufen, die Open-Source-PRs ausliefern, wĂ€hrend ich schlafe, und ich schreibe sie mit /last30days-Recherche, die im Hintergrund lĂ€uft.

Mit einem Klick speichern

Virale Artikel mit YouMind per KI tief lesen

Speichere die Quelle, stelle gezielte Fragen, fasse die Argumentation zusammen und verwandle einen viralen Artikel in wiederverwendbare Notizen in einem einzigen KI-Arbeitsbereich.

YouMind entdecken
FĂŒr Creator

Verwandle dein Markdown in einen sauberen 𝕏-Artikel

Wenn du eigene Langtexte veröffentlichst, wird die 𝕏-Formatierung von Bildern, Tabellen und Codeblöcken mĂŒhsam. YouMind macht aus einem ganzen Markdown-Entwurf einen sauberen, sofort postbaren 𝕏-Artikel.

Markdown zu 𝕏 testen

Mehr Muster zum EntschlĂŒsseln

Aktuelle virale Artikel

Mehr virale Artikel entdecken