> *"Rechenleistung verliert an Wertschöpfung; lokaler Arbeitsspeicher (RAM) wird zur neuen digitalen Währung."*
> — OME21-01 Debrief, Club 77.7
## Kernthese
Die Ära der billigen Cloud-Miete endet. HP verdoppelt Hardware-Preise, Hetzner verdoppelt bis verdreifacht Cloud-Server-Kosten für US-Kunden. Gleichzeitig erreichen lokale MoE-Modelle auf Apple M-Series-Hardware Geschwindigkeiten auf Gemini-Flash-Niveau — komplett offline. Die Kombination aus Preisschock und lokaler Performance-Parität macht Cloud-Exit zur rationalen Strategie.
## Drei Treiber
### 1. Preisschock (Angebotsseite)
- **HP:** verdoppelt Hardware-Preise
- **Hetzner:** verdoppelt bis verdreifacht Cloud-Server-Kosten für US-Kunden
- Freibier der günstigen Miet-Server versiegt
- Siehe: [The Flat Curve Society](../llm/flat-curve-society.md) — Kosten-Druck als Beschleuniger
### 2. Lokale Performance-Parität (Nachfrageseite)
Lokale MoE-Modelle erreichen inference-Geschwindigkeiten, die Cloud-Modelle nicht mehr überlegen machen:
| Modell | Tokens/s | Typ | Hardware |
|--------|----------|-----|----------|
| NLS 2.5 | 150 | Mixture of Experts (1,5 Mrd. Parameter pro Expert) | MacBook Pro M-Series |
| Mac Mini Pro M4/M5 | 64 GB | ~2.000 EUR | Autarkie-Setup, MoE-Modelle |
| Mac Studio M-Series | 128 GB | ~4.500 EUR | Power-User, parallele Modelle |
## Verbindung zu anderen Wiki-Seiten
- **[Geopolitik der KI](../policy/ai-as-geopolitical-weapon.md)** — Open-Source-Beschleunigung als Reaktion auf Exportkontrollen; DeepSeek V1 und GLM 5.2 beweisen Skalierung ohne Nvidia-Monopol
- **[GLM 5.2](../llm/glm-5.2-zai-coding-model.md)** — Chinese Frontier Coding Model als lokaler Gamechanger