ingest(xpost): lieselweppen-llm-behavior-persistence
Konzeptseite zu Persistenz gelernter Verhaltensweisen in LLMs.
Basiert auf Liesel Weppens 8 Suchbegriffen (Sleeper Agents, Backdoor
safety training, machine unlearning bias, bias persistence, bias
transfer, persistent backdoors, catastrophic forgetting, limits of
debiasing). Drei Achsen: versteckte Verhaltensmuster überleben
Safety-Training, Machine Unlearning entfernt Bias unvollstaendig,
catastrophic forgetting als Daempfer.
Kernthese: Open Weights != Open Model — Pro-Leben-Perspektive mit
realistischen Handlungsspielraumen (Open + Audit, selektive
Offenlegung, verteilte Sicherheit, Engineering-Realismus).
Subagent-Initial-Versuch scheiterte (xai billing error); manuell
finalisiert im Main-Loop.