YouMind
Anmelden

LLM Wiki = Aktualisierbare RAG

@AndrewK404
ENGLISCH26. Mai 2026
317K
88
5
0
67

TL;DR

Dieser Artikel erlĂ€utert die LLM-Wiki-Architektur und erklĂ€rt, wie ein KI-Agent einen Markdown-basierten Wissensgraphen pflegen und selbst prĂŒfen kann, um Informationsverluste in herkömmlichen RAG-Pipelines zu vermeiden.

Endlich habe ich Karpathys LLM Wiki Gist gelesen (ja, ich bin spÀt zum Hype-Zug aufgesprungen XD).

Und ehrlich gesagt, lĂ€uft die ganze Idee auf etwas ziemlich Einfaches hinaus: „aktualisierbares RAG".

1. Das Problem

Wenn LLMs mit Dokumenten arbeiten, sammelt sich nichts an. Bei jeder Abfrage ruft das Modell Textabschnitte ab, synthetisiert von Grund auf neu, vergisst. Wissen wird nie kompiliert. Und meiner Meinung nach noch wichtiger: Aus den Dialogen selbst wird fast keine nĂŒtzliche Information extrahiert.

RAG hilft teilweise (im weiteren Sinne – ein Ordner mit .md-Dateien ist auch RAG), aber die Standard-Pipeline (die jeder verwendet) hat keine eingebaute Aktualisierung, Destillation oder Selbstbereinigung. Wissen landet einmal im Index und liegt dann einfach ungenutzt herum. Diese LĂŒcke schließt LLM Wiki genau.

Karpathys Umkehrung: Zwischen den Rohquellen und dir liegt ein Markdown-Wiki, das der Agent schrittweise schreibt und pflegt. Einmal kompilieren, aktuell halten.

2. Architektur: 3 Schichten

Andrew Kuncevich - inline image
  • raw/ – Quellen, unverĂ€nderlich. Der Agent schreibt hier nicht hinein.
  • wiki/ – das Herz des Systems; Markdown-Seiten (EntitĂ€ten, Konzepte), die das LLM selbst schreibt und verlinkt. Im Grunde graphförmiges Wissen.
  • CLAUDE.md – nur das Handbuch, wie LLM Wiki ausgefĂŒhrt wird. EnthĂ€lt: Seitenformat, Link-Konventionen, Ingest-Ablauf, Lint-Regeln. Das Ding, das Claude von einem Chatbot zu einem disziplinierten Wiki-Verwalter macht.

Ausreichend fĂŒr Hunderte von Seiten ohne zusĂ€tzliches Feintuning:

Andrew Kuncevich - inline image

3. Operationen

Andrew Kuncevich - inline image

Drei Operationen – man möchte sie sofort als API-Funktionen darstellen:

  • Ingest -> add(source: file | list[file]). Eine Quelle ablegen -> Agent liest -> diskutiert mit dir -> schreibt Zusammenfassung -> aktualisiert Index -> bearbeitet verwandte EntitĂ€tsseiten -> hĂ€ngt an Log an. Eine Quelle berĂŒhrt 10–15 Seiten.
  • Query -> search(prompt: str). Die wichtigste Operation. Beantwortet deine Frage + (DER ENTSCHEIDENDE PUNKT) speichert die Synthese automatisch wieder im Wiki als neue Seiten. Exploration summiert sich, statt in der Chat-Historie zu sterben. Im Grunde ist es add(source=dialogue) unter der Haube.
  • Lint -> lint(). Keine Argumente. DurchlĂ€uft regelmĂ€ĂŸig das Wiki: WidersprĂŒche, verwaiste Seiten, veraltete Fakten, fehlende Querverweise. Auslöser – alle N Benutzernachrichten oder ein ZĂ€hler fĂŒr geĂ€nderte Zeilen. Einfach per /schedule anzuhĂ€ngen.

Erinnert stark an Claude Dreaming – ich denke, Dreaming ist teilweise von diesem Pattern inspiriert (obwohl der Funktionsumfang etwas anders ist).

4. Indizierung

Andrew Kuncevich - inline image

Zwei spezielle Dateien machen das Wiki navigierbar:

  • index.md – aktueller Zustand. Katalog jeder Seite mit einem Einzeiler. Der Agent liest ihn bei jeder Abfrage zuerst – das ist der minimale Kontext „Was gibt es ĂŒberhaupt in diesem Wiki?".
  • log.md – Log aller Ereignisse, freiformatig. Nur-AnhĂ€ngen-Zeitleiste. Wenn die Zeilen eine konsistente Form haben (z.B. \## [YYYY-MM-DD] ingest | titel\), lĂ€sst sich das Log sauber mit einfachen Unix-Tools durchsuchen – praktisch fĂŒr Audits.

index.md kann weiter skaliert werden (Vektorindex, BM25, GraphDB, ...) – das behandle ich in einem separaten Beitrag.

5. Zusammenfassung

So wĂŒrde ich es einordnen: Es ist keine Wahl zwischen RAG und LLM Wiki – sie sind zwei Punkte auf derselben Achse des „sich akkumulierenden GedĂ€chtnisses".

RAG muss keine Vektordatenbank sein – ein Ordner mit Markdown-Dateien ist auch RAG.

Man kann LLM Wiki also als RAG mit drei zusÀtzlichen Komponenten umformulieren:

  1. Eine Zusammenfassungsschicht.
  2. (Nahezu) freies Verfassen der Struktur auf dieser Zusammenfassungsebene.
  3. RegelmĂ€ĂŸige strukturelle ÜberprĂŒfung + Selbstverbesserung (CRON).
Mit einem Klick speichern

Virale Artikel mit YouMind per KI tief lesen

Speichere die Quelle, stelle gezielte Fragen, fasse die Argumentation zusammen und verwandle einen viralen Artikel in wiederverwendbare Notizen in einem einzigen KI-Arbeitsbereich.

YouMind entdecken
FĂŒr Creator

Verwandle dein Markdown in einen sauberen 𝕏-Artikel

Wenn du eigene Langtexte veröffentlichst, wird die 𝕏-Formatierung von Bildern, Tabellen und Codeblöcken mĂŒhsam. YouMind macht aus einem ganzen Markdown-Entwurf einen sauberen, sofort postbaren 𝕏-Artikel.

Markdown zu 𝕏 testen

Mehr Muster zum EntschlĂŒsseln

Aktuelle virale Artikel

Mehr virale Artikel entdecken