Dieses Wiki ist eine direkte Operationalisierung von Karpathys Vorschlag — das RamaDama Knowledge-Base Repo setzt das Pattern produktiv um. Die Idee, dass RAG ineffizient ist (gleiche Dokumente werden bei jeder Query neu vektorisiert und re-ranked), wird hier konsequent zu Ende gedacht: Einmal ingest, dauerhaft referenzierbar.
### Vorteile gegenüber RAG
- **Konsistenz:** Die Antwort hängt nicht vom Embedding-Modell oder Chunker-Parametern ab — was im Wiki steht, ist die Wahrheit
- **Latenz:** LLM-only Lookups, keine Vektor-DB-Query + Top-K-Rerank nötig
- **Editierbarkeit:** Wiki-Pages können vom LLM korrigiert, erweitert, refaktoriert werden — RAG-Index nicht trivial editierbar
- **Versionskontrolle:** Git-Diff zeigt, was sich am Wissen geändert hat
### Trade-offs
- **Kontextfenster:** Pages müssen kompakt genug sein, um ins LLM-Kontextfenster zu passen — daher die 30-Zeilen-Stub-Heuristik als Wachhund
- **Schreib-Overhead:** LLM muss aktiv kuratieren, nicht nur retrieven
- **Inkonsistenz-Risiko:** LLM kann beim Schreiben halluzinieren → Lint-Script prüft auf Widersprüche
- [[../../architecture/memory-system.md]] — Schicht 1/2/3 als komplementäres Memory-System
- [[../../architecture/byterover-knowledge-mining.md]] — historischer Vorläufer, der an Container-Ephemeralität scheiterte
- [[llm-behavior-persistence.md]] — wie LLMs selbst persistente Verhaltensweisen aufbauen
- [[../policy/open-knowledge-format-okf.md]] — **OKF v0.1 (Google Cloud, 2026-06-12) formalisiert genau dieses Pattern als offenen Standard. Unser Wiki ist strukturell bereits konform**