Kimi K3 Swarm Max: So führen Sie 300 Forschungs-Agents mit einem einzigen Prompt aus

@choopyplug1
ENGLISCHvor 1 Tag · 22. Juli 2026
105K
46
5
7
74

TL;DR

Dieser Leitfaden erklärt, wie Sie die Swarm Max-Funktion von Kimi K3 nutzen, um 300 parallele Agents für komplexe Forschungsaufgaben auszuführen, wobei der Schwerpunkt auf strukturierten Spezifikationen und Verifizierungs-Gates liegt.

Kimi K3 wurde am 16. Juli 2026 veröffentlicht. 2,8 Billionen Parameter. 1 Million Token Kontext. Das größte je veröffentlichte Open-Weight-Modell.

Das herausragende Feature ist K3 Swarm Max: bis zu 300 Unter-Agenten, die parallel laufen, über 4.000 Schritte koordinieren und reale Dateien statt Chat-Antworten produzieren. Zwei Varianten teilen sich dasselbe Gehirn. K3 Max erledigt alltägliche Aufgaben. K3 Swarm Max richtet eine Flotte auf das Problem aus.

chuplung - inline image

Die meisten öffnen Kimi, tippen eine Frage ein, bekommen eine Antwort und schließen den Tab. Das sind etwa 10 % dessen, was das Produkt kann. Dieser Leitfaden behandelt die anderen 90 %.

chuplung - inline image

Der Schwarm ist kein nachträglicher Zusatz. Der Orchestrator ist eine erlernte Richtlinie, die mit Parallel-Agent Reinforcement Learning trainiert wurde. Du beschreibst das Ziel. Der Schwarm entscheidet, wie es aufgeteilt wird, wie viele Agenten erzeugt werden und wie die Ergebnisse wieder zusammengeführt werden. Schwärme glänzen bei breiten, parallelisierbaren Aufgaben: Recherche über 50+ Quellen, Batch-Analysen, Wettbewerbsmonitoring, Datensatzerstellung. Sie tun sich schwer bei tiefen, sequenziellen Aufgaben, bei denen Schritt 3 von Schritt 2 abhängt.

chuplung - inline image
  • Schreibe ein Pflichtenheft, keinen Prompt

"Den Fitness-App-Markt recherchieren" ist, wie du Credits verbrennst und Müll bekommst. Ein einzeiliger Prompt gibt dem Schwarm die Erlaubnis, alles zu entscheiden. Er wird falsch entscheiden.

chuplung - inline image

Behandle den Schwarm wie einen Auftragnehmer. Ein Pflichtenheft definiert, was zu sammeln ist, was als gültig gilt, welche Quellen erlaubt sind, das genaue Ausgabeformat und was bei Konflikten zu tun ist. Das Pflichtenheft ist das einzelne Artefakt mit der höchsten Hebelwirkung im gesamten Workflow, denn in Level 2 wird es zum Keim deiner wiederverwendbaren Skill.

text
1# PROJEKT: [Name]
2ZIEL: [ein Satz, das Ergebnis, nicht das Thema]
3UMFANG: [was drin ist, was explizit draußen ist]
4REGELN: [Validierung, was als bestätigter Befund gilt]
5QUELLEN: [offizielle Beiträge, Papers, nur Primärquellen, keine Aggregatoren]
6AUSGABE: [Dateityp / Anzahl / Benennung / Formatdetails]
7BEI KONFLIKT: die Zeile markieren, niemals stillschweigend auflösen
8ABB RUCHBEDINGUNG: [wann anhalten und melden, statt zu raten]
  • Lies den Zerlegungsplan, bevor du ausgibst

Nachdem du das Pflichtenheft eingereicht hast, zeigt dir Kimi den Ausführungsplan, bevor es losgeht: wie viele Unter-Agenten, was jeder bearbeitet, die Abhängigkeitsreihenfolge, das Schrittbudget. Das ist der Schritt, den Neulinge überspringen, und es ist der teuerste, den man überspringen kann.

chuplung - inline image

Ein falsch zerlegter 200-Agenten-Schwarm kostet echtes Geld. Den Plan zu prüfen, kostet nichts. Du achtest auf drei Dinge: Versteht er den Umfang, ist die Anzahl der Agenten für die Aufgabe angemessen, und entspricht der Ausgabeplan dem, was du tatsächlich brauchst.

text
1Zeig mir die vorgeschlagene Zerlegung vor der Ausführung:
2- wie viele Unter-Agenten und was jeder bearbeitet
3- die Abhängigkeitsreihenfolge (was blockiert was)
4- geschätztes Schrittbudget
5- wo das größte Qualitätsrisiko liegt
6Noch nicht ausführen. Warte auf meine Bestätigung.

Ein Detail, das wissenswert ist: Die 4.000 Schritte sind ein koordiniertes Gesamtbudget über den gesamten Schwarm, nicht 4.000 pro Agent. Ein 300-Agenten-Durchlauf kommt im Durchschnitt auf etwa 13 Schritte pro Agent. Das sagt dir, ob deine Aufgabe in die Form passt.

  • Führe es aus

Jetzt führst du aus. Bis zu 300 Unter-Agenten starten in parallelen Wellen, jeder in seinem eigenen abgegrenzten Kontext. Nur strukturierte Ausgaben fließen zurück zum Koordinator.

text
1Führe das Pflichtenheft von Anfang bis Ende aus.
2Parallelisiere, wo immer der Plan es zulässt.
3Melde jeden Blockierer sofort, umgehe ihn nicht stillschweigend.
4Führe alles in der im Pflichtenheft definierten AUSGABE zusammen.

Was du nach Level 1 hast

Eine einzelne Schwarmausgabe, erstellt aus deinem Pflichtenheft. Roh, ungeprüft, aber strukturiert. Die meisten hören hier auf. Der Wert beginnt in Level 2.

chuplung - inline image
  • Verlange echte Dateien, keine Chat-Antwort

"Ein umfassender Bericht" gibt Agenten die Erlaubnis, früh aufzuhören. "Ein 40-seitiges PDF + eine CSV mit 20.000 Zeilen + 14 exportierbare PNG-Diagramme" gibt ihnen ein Qualitätsziel.

Führe das Pflichtenheft immer mit der Ausgabe an. Spezifität auf der Ausgabeebene ist der Unterschied zwischen einem Forschungsteam und einem teuren Vorschlagskasten.

text
1# starke Ausgabebeispiele:
2AUSGABE: 1 .xlsx, eine Zeile pro Modell, + 200-Wörter-Kurzbericht
3AUSGABE: 30 HTML-Dateien, eine pro Geschäft, benannt nach Unternehmen
4AUSGABE: 40-seitiges PDF + 20.000-Zeilen-CSV + 14 PNG-Diagramme
  • Verlange echte Dateien, keine Chat-Antwort

"Ein umfassender Bericht" gibt Agenten die Erlaubnis, früh aufzuhören. "Ein 40-seitiges PDF + eine CSV mit 20.000 Zeilen + 14 exportierbare PNG-Diagramme" gibt ihnen ein Qualitätsziel. Führe das Pflichtenheft immer mit der Ausgabe an. Spezifität auf der Ausgabeebene ist der Unterschied zwischen einem Forschungsteam und einem teuren Vorschlagskasten.

text
1# starke Ausgabebeispiele:
2AUSGABE: 1 .xlsx, eine Zeile pro Modell, + 200-Wörter-Kurzbericht
3AUSGABE: 30 HTML-Dateien, eine pro Geschäft, benannt nach Unternehmen
4AUSGABE: 40-seitiges PDF + 20.000-Zeilen-CSV + 14 PNG-Diagramme
  • Richte ein separates Modell auf die Ausgabe

Der bekannte Fehler des Schwarms: Wenn du nicht explizit eine Überprüfung verlangst, produziert er selbstbewusste, schlecht belegte Behauptungen, und unabhängige Unter-Agenten widersprechen sich manchmal. "Sieht fertig aus" und "ist korrekt" sind zwei verschiedene Welten.

Verwende ein zweites Modell als Prüfstelle. Seine einzige Aufgabe: widerlegen, nicht loben. Du bezahlst keine Premium-Token zum Generieren. Du bezahlst sie, um den stillen Fehler zu fangen, bevor der nächste Schritt den Workflow als wiederverwendbare Skill speichert.

chuplung - inline image
text
1Du bist der PRÜFER. Ein Schwarm von Agenten hat die beigefügte Ausgabe erstellt.
2Deine einzige Aufgabe ist es, zu finden, was falsch ist.
3
4Prüfe:
5- Lässt sich jede behauptete Zahl auf eine benannte Quelle zurückführen?
6- Widersprechen sich zwei Abschnitte?
7- Wird etwas als Tatsache dargestellt, was eigentlich eine Schlussfolgerung ist?
8- Entspricht die Ausgabe den Formatvorgaben des Pflichtenhefts?
9
10Für jedes Problem: nenne die genaue Stelle und die Korrektur.
11Wenn alles hält: GENEHMIGT.
12Wenn etwas fehlschlägt: ABGELEHNT + die eine wichtigste Korrektur zuerst.
  • Speichere den gesamten Workflow als Skill

Führe nach einem geprüften Durchlauf Kimi aus, um den gesamten Workflow zu erfassen: Eingabeformat, Agentenschritte, Ausgabeformat, Validierungsregeln. Der erste Durchlauf dauert 20 Minuten. Jeder weitere Durchlauf dauert 30 Sekunden. Die Skill ist der Grund, warum sich das System aufbaut, anstatt jedes Mal neu zu starten.

text
1Speichere diesen gesamten Workflow als wiederverwendbare Skill: "[Name]"
2Erfasse:
3- das Eingabeformat (welche Dateien / welche Pflichtenheftform erwartet werden)
4- die Agentenschritte, die funktioniert haben
5- das Ausgabeformat und die Benennungskonvention
6- die Validierungsregeln aus dem Pflichtenheft
7Wenn ich dies das nächste Mal ausführe, hänge ich neue Dateien an und erhalte die gleiche Form.

Was du nach Level 2 hast

Eine geprüfte Ausgabe, der du vertrauen kannst, und eine gespeicherte Skill, die du abspielen kannst, ohne das Pflichtenheft neu erstellen zu müssen. Hier beginnt die Schleife, sich zu verzinsen.

chuplung - inline image
  • Füge deine eigenen Dokumente als Schwarmwissen hinzu

Skills erfassen den Prozess. Dokument-zu-Skill erfasst die Domäne. Lade deine beste Arbeit hoch und Kimi erfasst ihren strukturellen Fingerabdruck als eine Skill, die jeder zukünftige Schwarm anwendet.

chuplung - inline image

Jedes PDF, Transkript oder jede Tabelle, die du einfügst, wird zum Kontext, gegen den sich alle 300 Agenten absichern, anstatt auf Trainingsdaten zurückzugreifen. Je mehr du einfügst, desto mehr liest sich die Ausgabe wie deine Arbeit und nicht wie generische KI.

text
1Erfasse dieses Dokument als wiederverwendbare Skill. Identifiziere, was es funktionieren lässt:
2- Struktur und Abschnittsreihenfolge
3- Ton und Stimmregister
4- Analysetiefe pro Abschnitt
5Speichere es als "[Name]". Erstelle dann ein neues Dokument zu [anderem Thema]
6unter Verwendung der erfassten Skill. Erreiche die Qualitätslatte, nicht den Inhalt.
  • Verwandle jede Ablehnung in eine dauerhafte Regel

Der Prüfschritt fängt einen Fehler einmal. Dieser Schritt stellt sicher, dass der Schwarm ihn nie wieder macht. Destilliere das Feedback in harte Regeln und schreibe sie in eine Einschränkungsdatei, die der Schwarm liest, bevor er etwas tut.

text
1# CONSTRAINTS.md, wird automatisch geladen
2- jede behauptete Zahl muss auf eine Primärquelle zurückführbar sein oder markiert werden
3- keine stillschweigende Konfliktlösung: Widersprüche offenlegen
4- [Regel, destilliert aus dem Prüfer-Feedback des letzten Durchlaufs]
5- [der Fehler, den du nie wiederholt haben möchtest]
6Umfangsbegrenzung: nichts außerhalb des UMFANG-Blocks des Pflichtenhefts anfassen.
  • Spiele die Skill mit neuen Eingaben ab

Hier hört "Verzinsung" auf, ein Schlagwort zu sein, und zeigt sich auf der Rechnung. Durchlauf zwei beginnt nicht bei Null. Er beginnt mit der Skill, dem Schwarmwissen und der Einschränkungsdatei, die du oben erstellt hast. Gleicher Workflow, neue Dateien, ein Bruchteil des Setups.

Die Wirtschaftlichkeit verschiebt sich beim erneuten Abspielen drastisch. K3s Cache-Treffer-Preis fällt auf $0,30 pro Million Token für wiederholten Kontext, 10x günstiger als der Ersteingabe-Preis. Die Skill, die Einschränkungen und das Pflichtenheft sind alle wiederholter Kontext. Nur deine neuen Eingabedateien kosten den vollen Satz. Der erste Durchlauf ist eine Investition. Jeder nachfolgende Durchlauf erntet die Rendite.

chuplung - inline image

Die Ausgabe verbessert sich auch strukturell. Die Skill setzt das Format durch. Die Einschränkungen blockieren jeden Fehler, den der Prüfer bereits gefangen hat. Das Schwarmwissen verankert jeden Agenten an deinen tatsächlichen Dokumenten statt an Trainingsdaten. Durchlauf vier kostet nicht nur weniger als Durchlauf eins. Er liefert bessere Ergebnisse, weil das System aus drei Runden echten Feedbacks gelernt hat.

chuplung - inline image
text
1Führe die gespeicherte Skill "[Name]" mit diesen neuen Eingaben aus.
2Wende CONSTRAINTS.md an. Verwende das erfasste Ausgabeformat.
3[neue Dateien anhängen]
4
5Vergleiche die Ausgabe dieses Durchlaufs mit dem letzten Durchlauf.
6Berichte:
7- neue Erkenntnisse, die beim letzten Mal nicht vorhanden waren
8- Erkenntnisse, die sich seit dem letzten Durchlauf geändert haben
9- alles, was verschwunden ist (als potenzielle Lücke markieren)
10- Abweichungen von der erwarteten Form der Skill

Was du nach Level 3 hast

Eine sich selbst verbessernde Forschungspipeline. Jeder Durchlauf ist günstiger, schneller und genauer als der letzte, weil die Skill-Bibliothek, die Wissensbasis und die Einschränkungsdatei ständig wachsen.

chuplung - inline image
  • Befördere die Skill zu einem geplanten Agenten

Sobald die Schleife stabil und Skill-gestützt ist, startest du sie nicht mehr manuell. Weise Kimi auf einen Auslöser hin: einen Zeitplan, einen neuen Dateieingang, eine überwachte URL. Lass ihn den gesamten Schwarm proaktiv ausführen und nur das Ergebnis und die Abweichungen, die deine Aufmerksamkeit wert sind, präsentieren.

chuplung - inline image

Wettbewerbsmonitoring ist das saubere Beispiel. Durchlauf eins: Du baust und prüfst von Hand. Wenn es ein Hintergrundagent ist, überprüft er wöchentlich jeden Konkurrenten parallel und legt dir eine Kurzanalyse in den Posteingang, ohne zusätzlichen Zeitaufwand. Der einzige Mensch, der noch in der Schleife ist, ist die Frage, die du stellst, und die Entscheidung, die du auf der Grundlage der Antwort triffst.

text
1Führe die Skill "[Name]" wöchentlich nach Zeitplan aus.
2Auslöser: [Zeitplan / neue Datei / überwachte URL]
3Bei jedem Durchlauf: führe den Schwarm aus, wende CONSTRAINTS.md an,
4prüfe, dann liefere die AUSGABE + eine Differenz zum letzten Durchlauf.
5Benachrichtige mich nur, wenn eine Abweichung [Schwellenwert] überschreitet.

Was 2,8 Billionen Parameter nicht beheben

chuplung - inline image

Halluzination skaliert mit Parallelität. Mehr suchende Agenten bedeuten mehr selbstbewusste falsche Antworten, es sei denn, du führst einen Prüfdurchlauf durch. Der Schwarm prüft sich nicht selbst auf Fakten.

K3 kostet 3-4x mehr als K2.6. Eingabe: $3,00/M vs. $0,95/M. Ausgabe: $15,00/M vs. $4,00/M. Cache hilft bei Wiederholungen, aber der erste Durchlauf ist teuer. Für reine Kostenoptimierung ist K2.6 immer noch die Budgetlösung.

Open Weights sind noch nicht draußen. Moonshot hat sie bis zum 27. Juli 2026 versprochen. Bis dahin läuft K3 nur über die API und die Kimi-App.

Schwärme verstärken schlechte Pflichtenhefte. Ein vager Prompt durch einen Agenten verschwendet einen Kontextfenster. Durch 300 Agenten verschwendet er 300 gleichzeitig.

Die Kurzliste

  • Einzeilige Prompts. Der Schwarm entscheidet alles. Er entscheidet falsch.
  • Das Überspringen der Zerlegungsprüfung. Der teuerste Schritt, den man überspringen kann.
  • Kein Prüfdurchlauf. "Sieht fertig aus" ist nicht "ist korrekt."
  • Ungeprüfte Ausgabe als Skill speichern. Der Fehler verzinst sich bei jedem zukünftigen Durchlauf.
  • 300 Agenten bei einer sequenziellen Aufgabe. Ein Schwarm kann eine Gedankenkette nicht parallelisieren.
  • K3 verwenden, wo K2.6 ausreicht. Nicht jede Aufgabe braucht 2,8 Billionen Parameter.

Fazit

Die meisten werden Kimi öffnen, eine Frage tippen, den Tab schließen. Das ist die Chatbox. Es sind etwa 10 % dessen, was K3 kann.

Die anderen 90 % sind ein Forschungsteam, das du einmal aufbaust und für immer abspielst. Jede Stufe schaltet mehr Hebelwirkung frei: zuerst Ausführung, dann Vertrauen, dann Verzinsung, dann Autonomie. Du brauchst nicht alle vier am ersten Tag. Beginne auf Level 1 mit einem Pflichtenheft. Wenn die Ausgabe nützlich ist, gehe zu Level 2 und prüfe sie. Wenn du planst, sie erneut auszuführen, speichere die Skill. Das System wird von dort aus von selbst schärfer.

Schreibe das Pflichtenheft, nicht den Prompt. Prüfe, bevor du speicherst. Dann beobachte, wie jeder Durchlauf günstiger und schärfer wird als der letzte.

In YouMind remixen

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Für Creator

Verwandle dein Markdown in einen sauberen 𝕏-Artikel

Wenn du eigene Langtexte veröffentlichst, wird die 𝕏-Formatierung von Bildern, Tabellen und Codeblöcken mühsam. YouMind macht aus einem ganzen Markdown-Entwurf einen sauberen, sofort postbaren 𝕏-Artikel.

Markdown zu 𝕏 testen

Mehr Muster zum Entschlüsseln

Aktuelle virale Artikel

Mehr virale Artikel entdecken