Kimi K3 wurde am 16. Juli 2026 veröffentlicht. 2,8 Billionen Parameter. 1 Million Token Kontext. Das größte je veröffentlichte Open-Weight-Modell.
Das herausragende Feature ist K3 Swarm Max: bis zu 300 Unter-Agenten, die parallel laufen, über 4.000 Schritte koordinieren und reale Dateien statt Chat-Antworten produzieren. Zwei Varianten teilen sich dasselbe Gehirn. K3 Max erledigt alltägliche Aufgaben. K3 Swarm Max richtet eine Flotte auf das Problem aus.

Die meisten öffnen Kimi, tippen eine Frage ein, bekommen eine Antwort und schließen den Tab. Das sind etwa 10 % dessen, was das Produkt kann. Dieser Leitfaden behandelt die anderen 90 %.

Der Schwarm ist kein nachträglicher Zusatz. Der Orchestrator ist eine erlernte Richtlinie, die mit Parallel-Agent Reinforcement Learning trainiert wurde. Du beschreibst das Ziel. Der Schwarm entscheidet, wie es aufgeteilt wird, wie viele Agenten erzeugt werden und wie die Ergebnisse wieder zusammengeführt werden. Schwärme glänzen bei breiten, parallelisierbaren Aufgaben: Recherche über 50+ Quellen, Batch-Analysen, Wettbewerbsmonitoring, Datensatzerstellung. Sie tun sich schwer bei tiefen, sequenziellen Aufgaben, bei denen Schritt 3 von Schritt 2 abhängt.

- Schreibe ein Pflichtenheft, keinen Prompt
"Den Fitness-App-Markt recherchieren" ist, wie du Credits verbrennst und Müll bekommst. Ein einzeiliger Prompt gibt dem Schwarm die Erlaubnis, alles zu entscheiden. Er wird falsch entscheiden.

Behandle den Schwarm wie einen Auftragnehmer. Ein Pflichtenheft definiert, was zu sammeln ist, was als gültig gilt, welche Quellen erlaubt sind, das genaue Ausgabeformat und was bei Konflikten zu tun ist. Das Pflichtenheft ist das einzelne Artefakt mit der höchsten Hebelwirkung im gesamten Workflow, denn in Level 2 wird es zum Keim deiner wiederverwendbaren Skill.
1# PROJEKT: [Name]2ZIEL: [ein Satz, das Ergebnis, nicht das Thema]3UMFANG: [was drin ist, was explizit draußen ist]4REGELN: [Validierung, was als bestätigter Befund gilt]5QUELLEN: [offizielle Beiträge, Papers, nur Primärquellen, keine Aggregatoren]6AUSGABE: [Dateityp / Anzahl / Benennung / Formatdetails]7BEI KONFLIKT: die Zeile markieren, niemals stillschweigend auflösen8ABB RUCHBEDINGUNG: [wann anhalten und melden, statt zu raten]
- Lies den Zerlegungsplan, bevor du ausgibst
Nachdem du das Pflichtenheft eingereicht hast, zeigt dir Kimi den Ausführungsplan, bevor es losgeht: wie viele Unter-Agenten, was jeder bearbeitet, die Abhängigkeitsreihenfolge, das Schrittbudget. Das ist der Schritt, den Neulinge überspringen, und es ist der teuerste, den man überspringen kann.

Ein falsch zerlegter 200-Agenten-Schwarm kostet echtes Geld. Den Plan zu prüfen, kostet nichts. Du achtest auf drei Dinge: Versteht er den Umfang, ist die Anzahl der Agenten für die Aufgabe angemessen, und entspricht der Ausgabeplan dem, was du tatsächlich brauchst.
1Zeig mir die vorgeschlagene Zerlegung vor der Ausführung:2- wie viele Unter-Agenten und was jeder bearbeitet3- die Abhängigkeitsreihenfolge (was blockiert was)4- geschätztes Schrittbudget5- wo das größte Qualitätsrisiko liegt6Noch nicht ausführen. Warte auf meine Bestätigung.
Ein Detail, das wissenswert ist: Die 4.000 Schritte sind ein koordiniertes Gesamtbudget über den gesamten Schwarm, nicht 4.000 pro Agent. Ein 300-Agenten-Durchlauf kommt im Durchschnitt auf etwa 13 Schritte pro Agent. Das sagt dir, ob deine Aufgabe in die Form passt.
- Führe es aus
Jetzt führst du aus. Bis zu 300 Unter-Agenten starten in parallelen Wellen, jeder in seinem eigenen abgegrenzten Kontext. Nur strukturierte Ausgaben fließen zurück zum Koordinator.
1Führe das Pflichtenheft von Anfang bis Ende aus.2Parallelisiere, wo immer der Plan es zulässt.3Melde jeden Blockierer sofort, umgehe ihn nicht stillschweigend.4Führe alles in der im Pflichtenheft definierten AUSGABE zusammen.
Was du nach Level 1 hast
Eine einzelne Schwarmausgabe, erstellt aus deinem Pflichtenheft. Roh, ungeprüft, aber strukturiert. Die meisten hören hier auf. Der Wert beginnt in Level 2.

- Verlange echte Dateien, keine Chat-Antwort
"Ein umfassender Bericht" gibt Agenten die Erlaubnis, früh aufzuhören. "Ein 40-seitiges PDF + eine CSV mit 20.000 Zeilen + 14 exportierbare PNG-Diagramme" gibt ihnen ein Qualitätsziel.
Führe das Pflichtenheft immer mit der Ausgabe an. Spezifität auf der Ausgabeebene ist der Unterschied zwischen einem Forschungsteam und einem teuren Vorschlagskasten.
1# starke Ausgabebeispiele:2AUSGABE: 1 .xlsx, eine Zeile pro Modell, + 200-Wörter-Kurzbericht3AUSGABE: 30 HTML-Dateien, eine pro Geschäft, benannt nach Unternehmen4AUSGABE: 40-seitiges PDF + 20.000-Zeilen-CSV + 14 PNG-Diagramme
- Verlange echte Dateien, keine Chat-Antwort
"Ein umfassender Bericht" gibt Agenten die Erlaubnis, früh aufzuhören. "Ein 40-seitiges PDF + eine CSV mit 20.000 Zeilen + 14 exportierbare PNG-Diagramme" gibt ihnen ein Qualitätsziel. Führe das Pflichtenheft immer mit der Ausgabe an. Spezifität auf der Ausgabeebene ist der Unterschied zwischen einem Forschungsteam und einem teuren Vorschlagskasten.
1# starke Ausgabebeispiele:2AUSGABE: 1 .xlsx, eine Zeile pro Modell, + 200-Wörter-Kurzbericht3AUSGABE: 30 HTML-Dateien, eine pro Geschäft, benannt nach Unternehmen4AUSGABE: 40-seitiges PDF + 20.000-Zeilen-CSV + 14 PNG-Diagramme
- Richte ein separates Modell auf die Ausgabe
Der bekannte Fehler des Schwarms: Wenn du nicht explizit eine Überprüfung verlangst, produziert er selbstbewusste, schlecht belegte Behauptungen, und unabhängige Unter-Agenten widersprechen sich manchmal. "Sieht fertig aus" und "ist korrekt" sind zwei verschiedene Welten.
Verwende ein zweites Modell als Prüfstelle. Seine einzige Aufgabe: widerlegen, nicht loben. Du bezahlst keine Premium-Token zum Generieren. Du bezahlst sie, um den stillen Fehler zu fangen, bevor der nächste Schritt den Workflow als wiederverwendbare Skill speichert.

1Du bist der PRÜFER. Ein Schwarm von Agenten hat die beigefügte Ausgabe erstellt.2Deine einzige Aufgabe ist es, zu finden, was falsch ist.34Prüfe:5- Lässt sich jede behauptete Zahl auf eine benannte Quelle zurückführen?6- Widersprechen sich zwei Abschnitte?7- Wird etwas als Tatsache dargestellt, was eigentlich eine Schlussfolgerung ist?8- Entspricht die Ausgabe den Formatvorgaben des Pflichtenhefts?910Für jedes Problem: nenne die genaue Stelle und die Korrektur.11Wenn alles hält: GENEHMIGT.12Wenn etwas fehlschlägt: ABGELEHNT + die eine wichtigste Korrektur zuerst.
- Speichere den gesamten Workflow als Skill
Führe nach einem geprüften Durchlauf Kimi aus, um den gesamten Workflow zu erfassen: Eingabeformat, Agentenschritte, Ausgabeformat, Validierungsregeln. Der erste Durchlauf dauert 20 Minuten. Jeder weitere Durchlauf dauert 30 Sekunden. Die Skill ist der Grund, warum sich das System aufbaut, anstatt jedes Mal neu zu starten.
1Speichere diesen gesamten Workflow als wiederverwendbare Skill: "[Name]"2Erfasse:3- das Eingabeformat (welche Dateien / welche Pflichtenheftform erwartet werden)4- die Agentenschritte, die funktioniert haben5- das Ausgabeformat und die Benennungskonvention6- die Validierungsregeln aus dem Pflichtenheft7Wenn ich dies das nächste Mal ausführe, hänge ich neue Dateien an und erhalte die gleiche Form.
Was du nach Level 2 hast
Eine geprüfte Ausgabe, der du vertrauen kannst, und eine gespeicherte Skill, die du abspielen kannst, ohne das Pflichtenheft neu erstellen zu müssen. Hier beginnt die Schleife, sich zu verzinsen.

- Füge deine eigenen Dokumente als Schwarmwissen hinzu
Skills erfassen den Prozess. Dokument-zu-Skill erfasst die Domäne. Lade deine beste Arbeit hoch und Kimi erfasst ihren strukturellen Fingerabdruck als eine Skill, die jeder zukünftige Schwarm anwendet.

Jedes PDF, Transkript oder jede Tabelle, die du einfügst, wird zum Kontext, gegen den sich alle 300 Agenten absichern, anstatt auf Trainingsdaten zurückzugreifen. Je mehr du einfügst, desto mehr liest sich die Ausgabe wie deine Arbeit und nicht wie generische KI.
1Erfasse dieses Dokument als wiederverwendbare Skill. Identifiziere, was es funktionieren lässt:2- Struktur und Abschnittsreihenfolge3- Ton und Stimmregister4- Analysetiefe pro Abschnitt5Speichere es als "[Name]". Erstelle dann ein neues Dokument zu [anderem Thema]6unter Verwendung der erfassten Skill. Erreiche die Qualitätslatte, nicht den Inhalt.
- Verwandle jede Ablehnung in eine dauerhafte Regel
Der Prüfschritt fängt einen Fehler einmal. Dieser Schritt stellt sicher, dass der Schwarm ihn nie wieder macht. Destilliere das Feedback in harte Regeln und schreibe sie in eine Einschränkungsdatei, die der Schwarm liest, bevor er etwas tut.
1# CONSTRAINTS.md, wird automatisch geladen2- jede behauptete Zahl muss auf eine Primärquelle zurückführbar sein oder markiert werden3- keine stillschweigende Konfliktlösung: Widersprüche offenlegen4- [Regel, destilliert aus dem Prüfer-Feedback des letzten Durchlaufs]5- [der Fehler, den du nie wiederholt haben möchtest]6Umfangsbegrenzung: nichts außerhalb des UMFANG-Blocks des Pflichtenhefts anfassen.
- Spiele die Skill mit neuen Eingaben ab
Hier hört "Verzinsung" auf, ein Schlagwort zu sein, und zeigt sich auf der Rechnung. Durchlauf zwei beginnt nicht bei Null. Er beginnt mit der Skill, dem Schwarmwissen und der Einschränkungsdatei, die du oben erstellt hast. Gleicher Workflow, neue Dateien, ein Bruchteil des Setups.
Die Wirtschaftlichkeit verschiebt sich beim erneuten Abspielen drastisch. K3s Cache-Treffer-Preis fällt auf $0,30 pro Million Token für wiederholten Kontext, 10x günstiger als der Ersteingabe-Preis. Die Skill, die Einschränkungen und das Pflichtenheft sind alle wiederholter Kontext. Nur deine neuen Eingabedateien kosten den vollen Satz. Der erste Durchlauf ist eine Investition. Jeder nachfolgende Durchlauf erntet die Rendite.

Die Ausgabe verbessert sich auch strukturell. Die Skill setzt das Format durch. Die Einschränkungen blockieren jeden Fehler, den der Prüfer bereits gefangen hat. Das Schwarmwissen verankert jeden Agenten an deinen tatsächlichen Dokumenten statt an Trainingsdaten. Durchlauf vier kostet nicht nur weniger als Durchlauf eins. Er liefert bessere Ergebnisse, weil das System aus drei Runden echten Feedbacks gelernt hat.

1Führe die gespeicherte Skill "[Name]" mit diesen neuen Eingaben aus.2Wende CONSTRAINTS.md an. Verwende das erfasste Ausgabeformat.3[neue Dateien anhängen]45Vergleiche die Ausgabe dieses Durchlaufs mit dem letzten Durchlauf.6Berichte:7- neue Erkenntnisse, die beim letzten Mal nicht vorhanden waren8- Erkenntnisse, die sich seit dem letzten Durchlauf geändert haben9- alles, was verschwunden ist (als potenzielle Lücke markieren)10- Abweichungen von der erwarteten Form der Skill
Was du nach Level 3 hast
Eine sich selbst verbessernde Forschungspipeline. Jeder Durchlauf ist günstiger, schneller und genauer als der letzte, weil die Skill-Bibliothek, die Wissensbasis und die Einschränkungsdatei ständig wachsen.

- Befördere die Skill zu einem geplanten Agenten
Sobald die Schleife stabil und Skill-gestützt ist, startest du sie nicht mehr manuell. Weise Kimi auf einen Auslöser hin: einen Zeitplan, einen neuen Dateieingang, eine überwachte URL. Lass ihn den gesamten Schwarm proaktiv ausführen und nur das Ergebnis und die Abweichungen, die deine Aufmerksamkeit wert sind, präsentieren.

Wettbewerbsmonitoring ist das saubere Beispiel. Durchlauf eins: Du baust und prüfst von Hand. Wenn es ein Hintergrundagent ist, überprüft er wöchentlich jeden Konkurrenten parallel und legt dir eine Kurzanalyse in den Posteingang, ohne zusätzlichen Zeitaufwand. Der einzige Mensch, der noch in der Schleife ist, ist die Frage, die du stellst, und die Entscheidung, die du auf der Grundlage der Antwort triffst.
1Führe die Skill "[Name]" wöchentlich nach Zeitplan aus.2Auslöser: [Zeitplan / neue Datei / überwachte URL]3Bei jedem Durchlauf: führe den Schwarm aus, wende CONSTRAINTS.md an,4prüfe, dann liefere die AUSGABE + eine Differenz zum letzten Durchlauf.5Benachrichtige mich nur, wenn eine Abweichung [Schwellenwert] überschreitet.
Was 2,8 Billionen Parameter nicht beheben

Halluzination skaliert mit Parallelität. Mehr suchende Agenten bedeuten mehr selbstbewusste falsche Antworten, es sei denn, du führst einen Prüfdurchlauf durch. Der Schwarm prüft sich nicht selbst auf Fakten.
K3 kostet 3-4x mehr als K2.6. Eingabe: $3,00/M vs. $0,95/M. Ausgabe: $15,00/M vs. $4,00/M. Cache hilft bei Wiederholungen, aber der erste Durchlauf ist teuer. Für reine Kostenoptimierung ist K2.6 immer noch die Budgetlösung.
Open Weights sind noch nicht draußen. Moonshot hat sie bis zum 27. Juli 2026 versprochen. Bis dahin läuft K3 nur über die API und die Kimi-App.
Schwärme verstärken schlechte Pflichtenhefte. Ein vager Prompt durch einen Agenten verschwendet einen Kontextfenster. Durch 300 Agenten verschwendet er 300 gleichzeitig.
Die Kurzliste
- Einzeilige Prompts. Der Schwarm entscheidet alles. Er entscheidet falsch.
- Das Überspringen der Zerlegungsprüfung. Der teuerste Schritt, den man überspringen kann.
- Kein Prüfdurchlauf. "Sieht fertig aus" ist nicht "ist korrekt."
- Ungeprüfte Ausgabe als Skill speichern. Der Fehler verzinst sich bei jedem zukünftigen Durchlauf.
- 300 Agenten bei einer sequenziellen Aufgabe. Ein Schwarm kann eine Gedankenkette nicht parallelisieren.
- K3 verwenden, wo K2.6 ausreicht. Nicht jede Aufgabe braucht 2,8 Billionen Parameter.
Fazit
Die meisten werden Kimi öffnen, eine Frage tippen, den Tab schließen. Das ist die Chatbox. Es sind etwa 10 % dessen, was K3 kann.
Die anderen 90 % sind ein Forschungsteam, das du einmal aufbaust und für immer abspielst. Jede Stufe schaltet mehr Hebelwirkung frei: zuerst Ausführung, dann Vertrauen, dann Verzinsung, dann Autonomie. Du brauchst nicht alle vier am ersten Tag. Beginne auf Level 1 mit einem Pflichtenheft. Wenn die Ausgabe nützlich ist, gehe zu Level 2 und prüfe sie. Wenn du planst, sie erneut auszuführen, speichere die Skill. Das System wird von dort aus von selbst schärfer.
Schreibe das Pflichtenheft, nicht den Prompt. Prüfe, bevor du speicherst. Dann beobachte, wie jeder Durchlauf günstiger und schärfer wird als der letzte.





