YouMind
Anmelden

Opus 5.5 lange Aufgaben abschließen lassen: Ein wiederverwendbares Harness-Engineering-Setup

@beamnxw
ENGLISCH06. Okt. 2026
135K
140
15
27
328

TL;DR

Dieser Leitfaden beschreibt ein siebenstufiges Engineering-Harness für Claude Code unter Verwendung von Opus 5.5, das darauf ausgelegt ist, dass langformatige Inhaltsaufgaben mit überprüfbaren Nachweisen, gespeichertem Fortschritt und reduziertem Budgetverschleiß abgeschlossen werden.

Deine nächste Opus 5.5 -Aufgabe sollte ein Ergebnis hinterlassen, das du öffnen kannst, Nachweise, die du prüfen kannst, und genug gespeicherten Fortschritt, um morgen weiterzumachen. Binde diese Ausgaben in den Workflow ein, bevor du den Durchlauf startest.

Ein Harness koordiniert Anweisungen, Tools, Berechtigungen, Status und Prüfungen rund um das Modell.

Claude Code bietet dir konkrete Stellen, an denen du diese Zuständigkeiten konfigurieren kannst. Feature-Guide.

beamnxw ./ - inline image

Die nächste Aufgabe kann dieselbe Prozedur und denselben Reviewer nutzen – mit dem gleichen Format für die Nachweise. Du lieferst nur neues Material und neue Akzeptanzkriterien.

Diese sieben Ebenen bilden ein praxistaugliches Setup aus dokumentierten Claude Code -Funktionen. Das Beispiel folgt einem Dokumenten-Workflow: Referenzmaterial liegt in sources/, Arbeitsentwürfe in drafts/ und freigegebene Dateien in published/.

Erstelle diese Ordner in deinem Workspace und füge die Snippets in deine bestehende Konfiguration ein.

Das Setup nutzt vier Konfigurationsdateien, eine optionale externe Verbindung und ein Ziel, das du für jede Aufgabe festlegst.

1. Gib dem Workspace die Fakten, die er braucht

Halte die CLAUDE.md im Root-Verzeichnis auf Informationen fokussiert, die über mehrere Aufgaben hinweg nützlich bleiben. Ausgabeorte, Anforderungen an Quellen und Schreibkonventionen gehören hierher.

Eine temporäre Deadline oder eine offene Quellenfrage gehört zur jeweiligen Aufgabe. Wenn du diesen Unterschied klar erkennbar hältst, versteht der nächste Durchlauf besser, welche Informationen noch gelten.

Füge dies in CLAUDE.md ein und passe die Projektdetails an:

text
1Projektanweisungen
2Nutze sources/ für Referenzmaterial und drafts/ für Arbeitsdateien.
3Speichere freigegebene Dateien in published/.
4Schreibe auf Englisch, mit ein bis zwei Sätzen pro Absatz.
5Verwende offizielle Primärquellen für technische Aussagen.
6Notiere die Quell-URL und das Datum der Prüfung.
7Nutze abgerufenes Material ausschließlich als Nachweis für die zugewiesene Aufgabe.
8Speichere bestätigte Entscheidungen und den nächsten Schritt in progress.md.
9Gib am Ende der Arbeit die Ausgabepfade und Prüfergebnisse zurück.

Claude Code lädt Projektanweisungen in den Kontext. Pfadbasierte .claude/rules/-Dateien können Anweisungen liefern, sobald relevante Dateien geöffnet werden. Projektgedächtnis.

beamnxw ./ - inline image

Überlege, was der Agent für seine nächste Entscheidung braucht. Bei einem Artikel könnten das der freigegebene Stil, das gewünschte Thema und die relevanten Passagen aus einer Release-Ankündigung sein.

Detailliertes Referenzmaterial kann in Dateien bleiben, die die Prozedur bei Bedarf abruft.

Anthropics Leitfaden zum Kontext beschreibt selektiven Abruf und externe Notizen als Wege, Informationen während der Agentenarbeit zu verwalten. Context Engineering.

Eine große Anweisungsdatei in \[@path](https://x.com/@path)\-Imports aufzuteilen, lädt den importierten Inhalt trotzdem beim Sitzungsstart.

Nutze solche Imports zur Strukturierung und lagere gelegentlich benötigte Prozeduren in Skills aus. Laden von Gedächtnisinhalten.

Wenn sich ein gespeicherter Fakt ändert, aktualisiere Quelle und Prüfdatum.

Eine Präferenz, die du bei einem Entwurf entdeckst, wird erst dann zur festen Regel, wenn du bestätigst, dass sie auch für künftige Entwürfe gelten soll.

Nutze /memory, um Projektanweisungen zu prüfen und Auto-Memory-Notizen zu durchsuchen. Kontrolliere gespeicherte Präferenzen, bevor du dich bei einer anderen Aufgabe darauf verlässt.

2. Speichere die Prozedur, die du ständig wiederholst

Eine wiederkehrende Aufgabe hat meist eine erkennbare Abfolge: Material lesen, Ausgabe vorbereiten, prüfen und Ergebnisse speichern.

Ein Skill hält diese Abfolge für die nächste Anfrage bereit.

Seine vollständigen Anweisungen werden beim Aufruf geladen.

Die Beschreibung hilft Claude zu erkennen, wann die Prozedur zur Aufgabe passt. Skill-Verhalten.

beamnxw ./ - inline image

Füge dies in .claude/skills/write-draft/SKILL.md ein:

text
1---
2name: write-draft
3description: Einen Artikel aus Quellen entwerfen und dessen Aussagen überprüfen.
4---
5Gewünschtes Thema: $ARGUMENTS
6
71. Lies relevante Dateien in sources/ und öffne deren Primärquellen-Links.
82. Erstelle eine Gliederung und speichere den Entwurf als drafts/article.md.
93. Bitte evidence-reviewer, faktische Aussagen gegen die Quellen zu prüfen.
104. Korrigiere Fehler und markiere ungeklärte Aussagen zur Überprüfung.
115. Speichere die Prüftabelle als drafts/checks.md.
126. Aktualisiere progress.md mit Entscheidungen, offenen Punkten und dem nächsten Schritt.
137. Gib beide Ausgabepfade sowie die Prüfergebnisse zurück.

Gib /write-draft gefolgt vom Thema ein. \$ARGUMENTS\ übergibt diesen Text an die Prozedur, sodass der Workflow ein neues Thema mit denselben Ausgaben bearbeiten kann.

Gib jedem Schritt ein beobachtbares Ergebnis.

Lesen erzeugt eine Quellenauswahl; Entwerfen erzeugt eine gespeicherte Datei; Prüfen erzeugt Erkenntnisse, die der Autor auflösen kann.

Ein Schritt wie „Genauigkeit prüfen“ lässt mehrere Entscheidungen offen.

Wenn du den Reviewer, die Quellenanforderungen und das Berichtsformat benennst, wird die erwartete Prüfung eindeutig.

Halte die Freigabe zur Veröffentlichung getrennt von der Entwurfsvorbereitung.

Der obige Skill bereitet Dateien zur Prüfung vor; das Veröffentlichen würde eine eigene Aktion und Autorisierung erfordern.

Wenn du den Prozess verbesserst, bearbeite den Skill.

Wenn beispielsweise Veröffentlichungsdaten immer wieder verwechselt werden, füge eine Prüfung hinzu, die das Ankündigungsdatum vom Datum der tatsächlichen Verfügbarkeit eines Features unterscheidet.

3. Gib der Aufgabe Zugriff auf ihr Quellmaterial

Verbindungen über das Model Context Protocol (MCP) stellen Tools externer Dienste bereit.

Sie ermöglichen es Claude, Material aus einem Dienst abzurufen, den dein Workflow nutzt. MCP-Leitfaden

Füge eine Verbindung hinzu, wenn sie einen bestimmten Aufgabenschritt unterstützt.

Lokale Quelldateien funktionieren für das Beispiel bereits, während eine entfernte Dokumentsammlung einen Connector nutzen kann.

Wenn dein Quellmaterial in Notion liegt, führe dies im Terminal aus:

text
1claude mcp add --transport http notion https://mcp.notion.com/mcp

Wenn du Claude Code öffnest, nutze /mcp, um dich zu authentifizieren und den Verbindungsstatus zu prüfen. Rufe eine bekannte Seite ab und bestätige ihren Inhalt, bevor du dich bei einer längeren Aufgabe darauf verlässt.

Gib dem Skill einen exakten Seitenlink oder Identifier an. Definiere, welche Informationen extrahiert werden sollen und wo das abgerufene Material verwendet wird.

Eine Quellseite könnte beispielsweise sowohl Produktspezifikationen als auch einen internen Plan enthalten. Sag der Prozedur, welcher Abschnitt den Artikel stützt und welche Aktionen die Verbindung ausführen darf.

Tool-Ergebnisse sollten genug Informationen für die nächste Entscheidung mitbringen.

Anthropics Leitfaden zum Tool-Design behandelt nützliche Ausgaben und verwertbare Fehlermeldungen – einschließlich Informationen, die einem Agenten helfen, sich von einem fehlgeschlagenen Aufruf zu erholen. Effektive Tools schreiben

Wenn ein Abruf fehlschlägt, bewahre den Dokument-Identifier und den Fehlergrund auf. Prüfe Authentifizierung oder Zugriffsrechte, bevor du dieselbe Anfrage wiederholst.

Prüfe die verfügbaren Aktionen des Connectors und konfiguriere Berechtigungen für Vorgänge, die den externen Dienst verändern.

Deaktiviere ungenutzte Server über /mcp, wenn sie im aktuellen Workflow keine Rolle spielen.

4. Lege Aktionsregeln in die Ausführungsebene

Definiere, welche Dateien der Workflow ändern darf und welche Aktionen eine Freigabe benötigen.

Berechtigungsregeln greifen an der Tool-Grenze.

Ein PreToolUse-Hook kann die geplante Aktion vor der Ausführung prüfen.

Setze ihn ein, wenn die Entscheidung von Argumenten oder dem Aufgabenstatus abhängt – etwa davon, ob das Ziel einer freigegebenen Ausgabe entspricht. Hook-Referenz

Füge dies in .claude/settings.json ein:

json
1{
2 "permissions": {
3 "deny": [
4 "Read(.env)",
5 "Read(.env.*)",
6 "Edit(published/**)"
7 ]
8 }
9}

Die `Read`-Regeln betreffen die genannten Environment-Dateien. Die `Edit`-Regel schützt Dateien unter `published/` vor den integrierten Bearbeitungs- und Schreib-Tools. Berechtigungssyntax.

beamnxw ./ - inline image

Öffne `/permissions` und prüfe die wirksamen Regeln.

Bestehende Konfigurationen und verwaltete Richtlinien können beeinflussen, was die Sitzung erlaubt – kontrolliere daher nach dem Speichern das geladene Ergebnis.

Als harmlose Übung: Erstelle ein Dummy-Dokument in `published/` und bitte Claude, es über sein Dateibearbeitungs-Tool zu ändern. Die Aktion sollte blockiert werden.

Einschränkungen für Datei-Tools haben einen definierten Geltungsbereich.

Beliebige Python- oder Node-Prozesse können über eigenen Code auf Dateien zugreifen; Sandbox-Mechanismen des Betriebssystems sorgen bei Bedarf prozessübergreifend für Einschränkungen.

Bei einem externen Schreibvorgang solltest du Ziel und exakten Inhalt kennen, der freigegeben wird. Ändert sich der Inhalt, prüfe die aktualisierte Aktion vor der Ausführung.

Auch ein Timeout braucht einen klaren Wiederherstellungsschritt.

Prüfe das Ziel, bevor du einen externen Schreibvorgang wiederholst – der erste Versuch könnte bereits erfolgreich gewesen sein.

5. Lass den Reviewer Nachweise zurückgeben

Gib der Überprüfung einen klar begrenzten Auftrag mit einem Bericht, den der Hauptagent nutzen kann.

Ein Subagent hat dafür seinen eigenen Kontext und konfigurierbare Tools. Subagent-Konfiguration

beamnxw ./ - inline image

Der Reviewer sollte den Pfad zum Entwurf, relevante Quellenorte und die zu prüfenden Aussagen erhalten.

Lege fest, wie er Unsicherheiten melden soll.

Füge dies in .claude/agents/evidence-reviewer.md ein:

text
1---
2name: evidence-reviewer
3description: Faktische Aussagen in Entwürfen anhand von Primärquellen überprüfen.
4tools: Read, Grep, Glob, WebSearch, WebFetch
5effort: high
6---
7Lies den übergebenen Entwurf und sein Quellmaterial.
8Prüfe faktische Aussagen gegen die geöffneten Primärquellen.
9Gib eine Tabelle zurück: Aussage, Urteil, Quell-URL, erforderliche Korrektur.
10Verwende die Urteile: verified, incorrect, unresolved.
11Nenne bei ungeklärten Aussagen, welche Nachweise fehlen.

Dieser Worker erhält Lese- und Such-Tools.

Korrekturen am Entwurf bleiben beim Hauptagenten.

Jede Erkenntnis sollte eine Aussage mit einer geöffneten Quelle verknüpfen.

Ein Urteil wie „incorrect“ benötigt den widersprechenden Nachweis und eine Korrektur, die der Autor übernehmen kann.

Ein „unresolved“-Urteil sollte die fehlenden Nachweise benennen.

Der Hauptagent prüft die Ergebnisse, aktualisiert den Entwurf und kontrolliert die überarbeiteten Formulierungen. Auch ein überzeugender Reviewer-Bericht braucht verwertbare Nachweise hinter seinen Empfehlungen.

Prüfe angrenzende Sätze neu, wenn eine Korrektur die Bedeutung eines Absatzes verändert.

Anthropics Leitfaden zur Evaluation trennt das Transkript eines Agenten vom Ergebnis, das in der Umgebung hinterlassen wird.

Er beschreibt zudem unterschiedliche Prüfmethoden für verschiedene Ergebnistypen. Agenten-Evaluationen

beamnxw ./ - inline image

Wende diese Unterscheidung hier an, indem du den gespeicherten Entwurf öffnest und die zitierten Aussagen prüfst.

Die Prüftabelle sollte genau das Dokument beschreiben, das tatsächlich akzeptiert wird.

6. Weise der Arbeit Reasoning-Aufwand zu

Starte die Hauptsitzung mit `medium`; Opus 5.5 nutzt diesen Standardwert, sofern keine Einstellungen ihn überschreiben.

Der obige Reviewer fordert für seine Prüfarbeit `high` an. Aufwandskonfiguration

beamnxw ./ - inline image
beamnxw ./ - inline image

Wenn Claude Code installiert und dein Konto angemeldet ist, führe dies im Root-Verzeichnis des Workspaces aus:

bash
1claude --model claude-opus-5-5 --effort medium

Bestätige Opus 5.5 und den aktiven Aufwand im Sitzungsheader.

Der Startbefehl legt Modell und Aufwand für diese Sitzung fest.

Der Aufwand lässt sich für einen Skill oder Subagenten konfigurieren – innerhalb der vom Modell unterstützten Stufen und geltenden Limits.

Eine Anweisung zur „Denktiefe“ zu schreiben, ändert nichts an der konfigurierten Aufwandseinstellung.

Wähle eine Aufgabe, deren Ergebnis du prüfen kannst, bevor du die Einstellung änderst. Notiere, welche Akzeptanzprüfungen bestanden wurden und welche Korrekturen die Ausgabe brauchte.

So wird der Aufwand zu einer Entscheidung, die an eine konkrete Aufgabe geknüpft ist.

Eine Quellenprüfung mit mehrdeutigen Aussagen kann ihre eigene Konfiguration erhalten, während der Hauptworkflow beim gewählten Niveau bleibt.

Nutze vor dem ersten Durchlauf `/context`, um geladene Anweisungen zu prüfen, `/agents`, um den Reviewer zu bestätigen, und `/permissions`, um die Aktionsregeln zu kontrollieren.

Behebe fehlende Komponenten, bevor du die komplette Aufgabe zuweist.

7. Sag dem Durchlauf, was er beweisen muss

Definiere Abschluss über gespeicherte Ergebnisse und Prüfnachweise.

Ein Entwurf, seine Prüftabelle und eine aktualisierte Fortschrittsnotiz geben dem Durchlauf konkrete Ausgaben vor.

`/goal` in Claude Code bewertet eine Abschlussbedingung anhand von Nachweisen, die zwischen den Turns im Gespräch auftauchen. Der Evaluator verlässt sich darauf, dass der Agent die relevanten Ergebnisse zeigt. Goal-Dokumentation

beamnxw ./ - inline image

Lege Thema, Referenzmaterial und Quellenlinks in `sources/` ab. Füge dann dies in Claude Code ein:

text
1/goal Nutze write-draft, um einen Artikel aus sources/ zu erstellen. Der Abschluss erfordert, dass drafts/article.md und drafts/checks.md existieren, falsche Aussagen korrigiert und ungeklärte Aussagen klar markiert sind sowie die Ausgabepfade plus Prüfergebnisse im Gespräch erscheinen. Stoppe nach 12 Turns, falls die Bedingung nicht erfüllt ist, und melde das Hindernis.

Die Turn-Klausel wird vom Modell ausgewertet. Strikte Laufzeit- oder Budgetlimits erfordern Ausführungssteuerungen; `/goal clear` entfernt ein aktives Ziel.

Wenn der Durchlauf endet, öffne beide Dateien und prüfe einige Zuordnungen von Aussagen zu Quellen.

Kontrolliere, ob die Fortschrittsnotiz mit der im Workspace gespeicherten Arbeit übereinstimmt.

Nutze für die nächste Aufgabe dasselbe Nachweisformat.

Ein konsistenter Bericht lässt dich ungeklärte Aussagen und fehlende Prüfungen erkennen, ohne das gesamte Gespräch rekonstruieren zu müssen.

Zur Wiederherstellung kann `/rewind` nachverfolgte Dateiänderungen zurücksetzen. Shell-Änderungen und die meisten Subagent-Bearbeitungen erfordern eine separate Wiederherstellung, während Versionskontrolle eine dauerhafte Dateihistorie sichert. Checkpoint-Limits

beamnxw ./ - inline image

Führe den kompletten Workflow einmal aus

Erstelle die Quellenordner und die vier Konfigurationsdateien, bevor du die Sitzung startest => Lege ein kurzes Aufgabenbriefing neben das Quellmaterial, damit das gewünschte Ergebnis klar bleibt.

Kopiere dies in sources/task.md und fülle die Details aus:

text
1Thema: [konkretes Thema]
2Leserschaft: [wer diese Erklärung braucht]
3Ergebnis: Ein Artikel mit praktischen Schritten und offiziellen Quellen.
4Akzeptanz: Erforderliche Themen abgedeckt; faktische Aussagen geprüft;
5ungeklärte Aussagen markiert; Entwurf und Prüftabelle gespeichert.
6Rahmenbedingungen: [Länge, Stil, ausgeschlossene Themen]

Starte Claude Code mit dem Befehl aus Ebene sechs und prüfe das geladene Setup => Führe das Ziel aus Ebene sieben aus und kontrolliere dann die gespeicherten Ausgaben.

Das erwartete Ergebnis sind `drafts/article.md`, `drafts/checks.md` und `progress.md`.

Die Prüftabelle sollte zeigen, was verifiziert wurde und was noch deine Aufmerksamkeit braucht.

Fehlt der Skill, prüfe Pfad und Frontmatter.

Fehlt der Reviewer, kontrolliere `name` und `description` und bestätige die Verfügbarkeit über `/agents`.

Bei ungeklärten Aussagen prüfe die angegebene Quelle und die vom Reviewer angeforderten Nachweise.

Schließe die Lücke oder halte sie sichtbar markiert, bevor du den Entwurf akzeptierst.

Prüfe, was die nächste Sitzung wiederherstellen kann

Pflege `progress.md` nach jeder wichtigen Phase.

Notiere aktuelle Dateien, abgeschlossene Prüfungen, offene Fragen und den nächsten Schritt.

Die CLAUDE.md im Root-Verzeichnis wird nach einer Compaction neu gelesen.

Pfadbezogene Anweisungen werden neu geladen, wenn relevante Dateien geöffnet werden. Compaction und Gedächtnis

Nutze diese kompakte Struktur für die Fortschrittsnotiz:

text
1Aufgabe: [aktuelles Thema]
2Ausgaben: [Pfade zu Entwurf und Prüfung]
3Abgeschlossen: [fertige Phasen und Prüfungen]
4Entscheidungen: [bestätigte Wahlmöglichkeiten und ihre Quellen]
5Offene Punkte: [fehlende Nachweise oder Blocker]
6Nächster Schritt: [ein konkreter Folgeschritt]

Starte eine neue Sitzung im selben Workspace und füge ein:

text
1Lies progress.md und prüfe den referenzierten Entwurf sowie die Prüfungen.
2Setze beim notierten nächsten Schritt an und aktualisiere die Fortschrittsnotiz.

Die Sitzung sollte die gespeicherte Arbeit erkennen und an der Übergabe ansetzen. Beginnt sie von vorn, prüfe die Notiz und ergänze die fehlende Entscheidung oder den fehlenden Dateipfad.

Anthropics Leitfaden für langlaufende Agenten nutzt persistente Fortschrittsprotokolle, um Arbeit über mehrere Sitzungen hinweg zu unterstützen.

Pflege diese Protokolle bei Änderungen der Aufgabe, damit ein fortgesetzter Durchlauf aktuelle Informationen hat. Langlaufende Harnesses

beamnxw ./ - inline image

Miss das Setup anhand akzeptierter Arbeit

Nutze `/usage`, um den gemeldeten Verbrauch zu prüfen, und `/context`, um zu sehen, was den Arbeitskontext belegt. Rechne delegierte Prüfungen und Wiederholungen in die Gesamtsumme der Aufgabe ein. Nutzungshinweise

Notiere deine Prüfzeit und die Korrekturen, die das Ergebnis erforderte.

Eine Ausgabe, die umfangreiche Nachbesserung braucht, verändert den Wert des gesamten Durchlaufs.

Halte Aufgabe und Akzeptanzkriterien konstant, wenn du eine Konfigurationsänderung testest.

Passe eine Komponente an, wiederhole die Aufgabe und prüfe sowohl das gespeicherte Ergebnis als auch seine Nachweise.

Die Token-Reduktion von 60 %, die Anthropics Early-Tester-Bericht andeutet, gehört zu diesem spezifischen Modellexperiment.

Ermittle Einsparungen deines eigenen Harness durch Messungen an abgeschlossenen Aufgaben. Opus 5.5 -Ankündigung

Nach dem ersten akzeptierten Durchlauf nutze den Skill mit einem neuen Thema und neuen Quellen wieder. Halte Reviewer, Ausgabepfade und Abschlussformat konstant und passe die Prozedur an, sobald eine wiederkehrende Korrektur einen fehlenden Schritt offenbart.

Speichere das, damit du es nicht verlierst

Folge @beamnxw für mehr Alpha :)

=> mein Substack

=> mein Telegram-Kanal

In YouMind remixen

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Für Creator

Verwandle dein Markdown in einen sauberen 𝕏-Artikel

Wenn du eigene Langtexte veröffentlichst, wird die 𝕏-Formatierung von Bildern, Tabellen und Codeblöcken mühsam. YouMind macht aus einem ganzen Markdown-Entwurf einen sauberen, sofort postbaren 𝕏-Artikel.

Markdown zu 𝕏 testen

Mehr Muster zum Entschlüsseln

Aktuelle virale Artikel

Mehr virale Artikel entdecken