--- created: 2026-06-19 updated: 2026-06-19 sources: [other/2026-06-19_ome21-briefing-ki-fortschritte-lokale-modelle.md] tags: [concept, cloud-exit, local-models, hardware, moe, ram-as-currency, cost-shift] --- # Cloud-Exit & Lokale Überlegenheit > *"Rechenleistung verliert an Wertschöpfung; lokaler Arbeitsspeicher (RAM) wird zur neuen digitalen Währung."* > — OME21-01 Debrief, Club 77.7 ## Kernthese Die Ära der billigen Cloud-Miete endet. HP verdoppelt Hardware-Preise, Hetzner verdoppelt bis verdreifacht Cloud-Server-Kosten für US-Kunden. Gleichzeitig erreichen lokale MoE-Modelle auf Apple M-Series-Hardware Geschwindigkeiten auf Gemini-Flash-Niveau — komplett offline. Die Kombination aus Preisschock und lokaler Performance-Parität macht Cloud-Exit zur rationalen Strategie. ## Drei Treiber ### 1. Preisschock (Angebotsseite) - **HP:** verdoppelt Hardware-Preise - **Hetzner:** verdoppelt bis verdreifacht Cloud-Server-Kosten für US-Kunden - Freibier der günstigen Miet-Server versiegt - Siehe: [The Flat Curve Society](../llm/flat-curve-society.md) — Kosten-Druck als Beschleuniger ### 2. Lokale Performance-Parität (Nachfrageseite) Lokale MoE-Modelle erreichen inference-Geschwindigkeiten, die Cloud-Modelle nicht mehr überlegen machen: | Modell | Tokens/s | Typ | Hardware | |--------|----------|-----|----------| | NLS 2.5 | 150 | Mixture of Experts (1,5 Mrd. Parameter pro Expert) | MacBook Pro M-Series | | Qwen 3.5 Vision | 80 | Vision/OCR | MacBook Pro M-Series | Vergleichsmaßstab: Gemini 3.5 Flash Niveau — aber lokal und offline. ### 3. RAM als neue Währung - Rechenleistung (FLOPS) verliert an Wertschöpfung - **Arbeitsspeicher (RAM)** wird zum limitierenden Faktor — wer große Modelle lokal laufen lassen will, braucht RAM, nicht Cloud-Compute - M4/M5 Mac Mini Pro mit 64GB RAM für ca. 2.000 EUR = langfristige KI-Autarkie ohne Folgekosten - 48 GB RAM = kritische Untergrenze; 64-128 GB empfohlen - SSD-Caching (KV Caching) als Ergänzung ## Hardware-Empfehlung (Stand Juni 2026) | Setup | RAM | Preis (~) | Geeignet für | |-------|-----|-----------|-------------| | MacBook Pro M-Series | 48 GB | ~2.500 EUR | Einsteiger, kleinere Modelle | | Mac Mini Pro M4/M5 | 64 GB | ~2.000 EUR | Autarkie-Setup, MoE-Modelle | | Mac Studio M-Series | 128 GB | ~4.500 EUR | Power-User, parallele Modelle | ## Verbindung zu anderen Wiki-Seiten - **[Geopolitik der KI](../policy/ai-as-geopolitical-weapon.md)** — Open-Source-Beschleunigung als Reaktion auf Exportkontrollen; DeepSeek V1 und GLM 5.2 beweisen Skalierung ohne Nvidia-Monopol - **[GLM 5.2](../llm/glm-5.2-zai-coding-model.md)** — Chinese Frontier Coding Model als lokaler Gamechanger - **[Hardware-Frontier: Neuromorphe Chips](../hardware/neuromorphic-chips-und-quantencomputer.md)** — Langfristige Hardware-Entwicklung jenseits klassischer Chips - **[Model Routing](../../architecture/model-routing.md)** — OpenClaw-Pipeline mit GLM-5.2 auf Ollama Cloud - **[Intelligence Commoditization Thesis](../llm/ai-intelligence-commoditization-thesis.md)** — RAM als Währung = physische Manifestation der Kommoditisierung ## Community-Krallen im Einsatz (Beispiele aus OME21) | Operator | Anwendung | Modell/Tool | DSGVO | |----------|-----------|-------------|-------| | Rüdiger | Zeugniserstellung (Schulwesen) | Gemini 3.5 Flash lokal | 100% | | Andreas | E-Book-Vektorisierung (persönl. RAG) | Server-Pipeline | — | | Christian | SLA-Übersetzung (juristisch) | Kimi lokal | — | ## Quellen - [OME21-01 Debrief](../../../raw/other/2026-06-19_ome21-briefing-ki-fortschritte-lokale-modelle.md) — Seiten 2, 4, 5, 7 - [Aschenbrenner — Situational Awareness](../agi/aschenbrenner-situational-awareness.md) — Compute-Skalierung als Treiber