knowledge-base/wiki/concepts/hardware/cloud-exit-and-local-superiority.md
Hector a61ca95bc6 ingest(xpost): AMD Ryzen AI Edge-Inferenz WMT-008
- raw/xpost/2026-06-16_amd-ryzen-ai-edge-inferenz.md (new)
- wiki/concepts/hardware/edge-inference-als-cloud-alternative.md (new)
- Cross-Refs: cloud-exit-and-local-superiority.md, neuromorphic-chips-und-quantencomputer.md, ai-value-migration-orchestration.md
- wiki/index.md updated with new Hardware page
- WMT-008: Lisa Su lunchbox PC, 235B local, 128GB unified memory, 3x RTX 5080
2026-06-23 13:19:24 +02:00

3.9 KiB

created updated sources tags
2026-06-19 2026-06-19
other/2026-06-19_ome21-briefing-ki-fortschritte-lokale-modelle.md
concept
cloud-exit
local-models
hardware
moe
ram-as-currency
cost-shift

Cloud-Exit & Lokale Überlegenheit

"Rechenleistung verliert an Wertschöpfung; lokaler Arbeitsspeicher (RAM) wird zur neuen digitalen Währung." — OME21-01 Debrief, Club 77.7

Kernthese

Die Ära der billigen Cloud-Miete endet. HP verdoppelt Hardware-Preise, Hetzner verdoppelt bis verdreifacht Cloud-Server-Kosten für US-Kunden. Gleichzeitig erreichen lokale MoE-Modelle auf Apple M-Series-Hardware Geschwindigkeiten auf Gemini-Flash-Niveau — komplett offline. Die Kombination aus Preisschock und lokaler Performance-Parität macht Cloud-Exit zur rationalen Strategie.

Drei Treiber

1. Preisschock (Angebotsseite)

  • HP: verdoppelt Hardware-Preise
  • Hetzner: verdoppelt bis verdreifacht Cloud-Server-Kosten für US-Kunden
  • Freibier der günstigen Miet-Server versiegt
  • Siehe: The Flat Curve Society — Kosten-Druck als Beschleuniger

2. Lokale Performance-Parität (Nachfrageseite)

Lokale MoE-Modelle erreichen inference-Geschwindigkeiten, die Cloud-Modelle nicht mehr überlegen machen:

Modell Tokens/s Typ Hardware
NLS 2.5 150 Mixture of Experts (1,5 Mrd. Parameter pro Expert) MacBook Pro M-Series
Qwen 3.5 Vision 80 Vision/OCR MacBook Pro M-Series

Vergleichsmaßstab: Gemini 3.5 Flash Niveau — aber lokal und offline.

3. RAM als neue Währung

  • Rechenleistung (FLOPS) verliert an Wertschöpfung
  • Arbeitsspeicher (RAM) wird zum limitierenden Faktor — wer große Modelle lokal laufen lassen will, braucht RAM, nicht Cloud-Compute
  • M4/M5 Mac Mini Pro mit 64GB RAM für ca. 2.000 EUR = langfristige KI-Autarkie ohne Folgekosten
  • 48 GB RAM = kritische Untergrenze; 64-128 GB empfohlen
  • SSD-Caching (KV Caching) als Ergänzung

Hardware-Empfehlung (Stand Juni 2026)

Setup RAM Preis (~) Geeignet für
MacBook Pro M-Series 48 GB ~2.500 EUR Einsteiger, kleinere Modelle
Mac Mini Pro M4/M5 64 GB ~2.000 EUR Autarkie-Setup, MoE-Modelle
Mac Studio M-Series 128 GB ~4.500 EUR Power-User, parallele Modelle

Verbindung zu anderen Wiki-Seiten

Community-Krallen im Einsatz (Beispiele aus OME21)

Operator Anwendung Modell/Tool DSGVO
Rüdiger Zeugniserstellung (Schulwesen) Gemini 3.5 Flash lokal 100%
Andreas E-Book-Vektorisierung (persönl. RAG) Server-Pipeline
Christian SLA-Übersetzung (juristisch) Kimi lokal

Quellen