--- type: youtube source_url: https://www.youtube.com/watch?v=bN1QJi26kco retrieved: 2026-06-15 channel: "IAmFabian" duration_sec: 795 has_transcript: true tags: [glm-5.2, zhipu-ai, z-ai, coding-model, open-source, mit-license, coding-plan, opencode, claude-code, hermes, agentic-coding, price-comparison] --- # GLM 5.2: 10x billiger als Claude, aber wo ist der Haken? **Geteilt von:** @PWeber (Kai) in OME-Gruppe "News & Infos (X/YT/Substack etc.)"-Topic ## Quelle - **Titel:** Chinas neues GLM 5.2: So gut ist das billige Coding-Modell - **Channel:** [IAmFabian](https://www.youtube.com/@IchBinFabian) (7.8K Subscribers) - **Hochgeladen:** 14.06.2026 (eine Stunde nach Veröffentlichung in deutsch) - **Länge:** 13:15 - **Aufrufe:** 212 | **Likes:** 16 - **URL:** https://www.youtube.com/watch?v=bN1QJi26kco - **Beschreibung:** "GLM 5.2 von Z.ai ist da, mit 1 Million Token Kontext und rund 10x günstiger als Claude. Ich teste es live mit zwei Coding-Aufgaben und sage ehrlich, wo der Haken liegt." - **Tags:** GLM 5.2, Z.ai, Zhipu AI, GLM Coding Plan, Claude Alternative, AI Coding deutsch, Open Source LLM, 1 Million Token Kontext, OpenCode, Claude Code Alternative - **Andere Videos des Channels (Kontext):** - [Kimi K2.7 ist da: Das beste Open-Source Coding-Modell? (Live getestet)](https://www.youtube.com/watch?v=) — 6K views, 14h alt - [Lokaler KI-Agent, gratis und offline: Hermes mit Gemma 4](https://www.youtube.com/watch?v=) — 12K views - [Warum Claude, Codex und OpenAI alle auf Agent Skills setzen](https://www.youtube.com/watch?v=) — 5K views, 1 Monat alt ## Konzept: Chinese Coding Models & Pricing Tiers Ein **deutschsprachiger Deep-Dive auf GLM 5.2** — Release-Tempo, Distribution-Realität (Coding Plan als exklusiver Zugang), Open-Weight-Strategie, Preisvergleich, ehrliche Live-Tests, **ehrliche Einordnung von Datenschutz/Limits**. **Methodisch stärker als viele Reviews:** Fabian testet **live und selbst** (zwei HTML-Apps: Flappy Bird, Newton-Pendel), referenziert **externe Community-Benchmarks** (AI Code King), und ist explizit transparent über die **Nachteile** (Coding-Plan-Limits, schwankende Geschwindigkeit, Server-Kapazität). ## Das Modell: GLM 5.2 | Eigenschaft | Detail | |---|---| | Hersteller | Z.ai (Zhipu AI, China) | | Generation | 5.2 (Vorgänger: GLM 5.0 im Februar 2026, GLM 5.1 im März 2026) | | Release-Datum | 13.06.2026 | | **Kontext** | **1 Million Token** (Vorgänger: 200K → 5× größer) | | Denkstufen | "High" und "Max" (Thinking Mode, vergleichbar mit Anthropic extended thinking) | | **Open Weights** | **MIT-Lizenz** (kommerziell nutzbar, anpassbar, selbst hostbar) | | Release-Pfad | **Z.ai Coding Plan** (siehe unten) — auf OpenRouter, Standard-APIs etc. aktuell nicht verfügbar | | Open Weights Release | "nächste Woche" (laut Fabian, Stand 14.06.2026) | | Vergleich zu Anthropic | Ziel: "gegen Claude Opus 4.8 antreten" — 6% unter Opus 4.8 / Fable laut AI Code King Benchmarks | ### Release-Tempo (beeindruckend) - GLM 5.0: Februar 2026 - GLM 5.1: März 2026 - **GLM 5.2: 13.06.2026** - → **Drei Frontier-Generationen in 4 Monaten** ## Der Haken: Distribution via Z.ai Coding Plan Stand 14.06.2026 ist GLM 5.2 **nicht** verfügbar über: - OpenRouter (wo neue Modelle normalerweise sofort erscheinen) - Standard-API-Zugriff - Andere Drittanbieter-Plattformen **Einziger Zugang:** [Z.ai Coding Plan](https://z.ai/subscribe) — Abo-Modell (ab 18 USD/Monat für Light-Plan). Fabian spekuliert: "wahrscheinlich in den nächsten zwei Tagen online verfügbar". **Community-Realität** (per Reddit/HN-Berichte): - Lob: "GLM hat eine komplette App gebaut, fast der ganze Code vom Modell, ohne Verheddern" - Kritik: "Harte Nutzungslimits, schwankende Geschwindigkeit, 2-3× Kontingent-Verbrauch bei Stoßzeiten" - Fazit: "Gutes Modell, schrecklicher Coding-Plan" (wörtlich aus einem zitierten Video) ## Pricing & Plan-Architektur | Plan | Preis | Nutzung | Priorität | |---|---|---|---| | **Light** | ab 18 USD/Monat | mehr als bei Codex/Claude Code | **niedrig** (lange Wartezeiten in Stoßzeiten) | | **Pro/Max** | höher | deutlich mehr | höher | **10× günstiger als Claude** — direkter Vergleichswert aus Video-Titel und Community-Statements. ## Setup: Coding Helper Tool Z.ai bietet einen **Coding Helper** (`npx @z_ai/coding-helper`), der GLM 5.2 in bestehende Coding-Agent-Tools einbindet. **Unterstützte Tools** (per Coding Helper): - [Claude Code](https://claude.com/product/claude-code) (Anthropic) - [OpenCode](https://opencode.ai) — Open-Source, terminal-basiert - Crush - Factory Droid **Setup-Schritte** (zusammengefasst): 1. Z.ai Coding Plan abonnieren 2. API-Key in den Plan-Settings erstellen 3. `npx @z_ai/coding-helper` ausführen 4. Im Helper: Ziel-Tool auswählen (z.B. OpenCode, Claude Code) 5. API-Key eingeben → GLM 5.2 ist als Modell verfügbar → **Kernstrategie:** User muss gewohntes Tool nicht wechseln, nur das Modell im Hintergrund austauschen. ## Live-Tests (von Fabian) ### Test 1: Flappy Bird (Single-File HTML) **Prompt:** "Bau ein komplett funktionierendes Flappy Bird in einer einzelnen HTML-Datei. Keine externen Bibliotheken. Kollisionserkennung, Punktezähler, Start- und Game-Over-Screen." **Ergebnis:** - 481 Zeilen HTML-Code - **Fertig in 1:20** (überraschend schnell) - Funktioniert: Scoreboard, Bestenliste, Neustart per Mausklick oder Leertaste - Game läuft, aber **Gaming-Experience suboptimal** (zu schnell, zu schwer, Runterfallen zu rasant) - Formfaktor: "praktisch Handy-Format" statt Vollbild **Fazit Fabian:** "Ich bin beeindruckt, hat alles funktioniert. Man müsste an der Gaming-Experience feilen." ### Test 2: Newton-Pendel (Physik-Simulation) **Prompt:** "Bau eine realistische Newton-Pendel-Simulation in einer HTML-Datei. Echte Physik: Wenn eine Kugel einschlägt, fliegt auf der anderen Seite genau eine Kugel weg — nicht zwei, nicht drei." **Schwierigkeit:** Viele Modelle bauen nur "hübsche Animation" mit allen Kugeln synchron — hier muss echte Physik-Logik implementiert sein. **Ergebnis:** - 9:41 Gesamtdauer (8:27 davon nur Thinking-Process) - **Lange Wartezeit wegen Light-Plan + Stoßzeit-Last auf Z.ai-Servern** - **Fertig und funktioniert** (Fabian ist beeindruckt, exakte Physik-Logik umgesetzt) - Skool-Kommentar (Fabian): "Wenn wir das Modell selbst bezahlen würden, wäre das wahrscheinlich halb so lang" **Fazit Fabian:** Modell ist stark, **Plattform drumherum** (Coding Plan) ist der Engpass. ## Ehrliche Einordnung (Fabian) | Dimension | Bewertung | |---|---| | Modell-Qualität | **Top** — vergleichbar mit Opus 4.8, Frontier-Niveau | | Preis | **10× günstiger als Claude** — extrem attraktiv | | Distribution | **Miserabel** — nur über Coding Plan, nicht auf OpenRouter | | Open Weights | **MIT-Lizenz** (kommt nächste Woche) — Kimi K2.7 Code macht das genauso | | Kontext-Fenster | **1M Token** — eine komplette Codebase in einem Rutsch | | Datenschutz | ⚠️ Daten gehen zu Z.ai-Servern (Code = potenzielles IP) | | Geschwindigkeit | ⚠️ Light-Plan = lange Wartezeiten, Pro/Max vermutlich besser | | Limits | ⚠️ "Harte Nutzungslimits, 2-3× Verbrauch in Stoßzeiten" | **Fabians Fazit:** "Gutes Modell, schrecklicher Coding-Plan" (zitiert ein Community-Video). Er empfiehlt zu **warten, falls nicht Pro-Plan nötig** — Distribution bessert sich vermutlich bald. ## Verbindung zu [[concepts/real-world-coding-showdown.md]] Das Video von [IAmFabian](https://www.youtube.com/@IchBinFabian) ist eine **vertiefende Einzelprüfung** des Modells, das in der gestrigen [[concepts/real-world-coding-showdown.md]] Head-to-Head gegen Kimi K2.7 antrat: | Aspekt | Fabian-Video (14.06.2026) | Fahd-Mirza-Showdown (14.06.2026) | |---|---|---| | Fokus | **GLM 5.2 Solo** + Distribution + Preis | **Kimi K2.7 vs GLM 5.2** Head-to-Head | | Tests | Flappy Bird + Newton-Pendel | World-Cup-Bug-Fix + Siberian-Wind-HTML | | Methodik | Live-Coding + Community-Inputs | Real-World-Flask-App in Hermes Agent | | Beide Modelle getestet? | Nur GLM 5.2 | Ja, beide | | Fazit zu GLM 5.2 | "Top-Modell, schlechter Coding-Plan" | "Strong bei Animation/Detail" (Test 2) | **Synergie:** Beide Videos ergänzen sich — Fabian gibt **Preis-/Distributions-Tiefe**, Fahd gibt **Head-to-Head-Vergleich** unter kontrollierten Bedingungen. ## 🔥 Direkter Implikat für OpenClaw **Der [Z.ai Coding Plan](https://z.ai/subscribe) listet explizit `Clawdbot/OpenClaw`** als unterstütztes Agent-Environment:** > "Use GLM models like GLM-5.1 & GLM-5-Turbo for AI coding in Claude Code, Kilo Code, Cline, OpenCode, **Clawdbot/OpenClaw** and more. Plans from 18/month." → **Hector/OpenClaw ist namentlich in der Distribution-Strategie von Z.ai referenziert.** Das ist ein direkter Match für die [[architecture/model-routing.md]]-Planung: GLM 5.2 (oder 5.1 als günstigere Variante) als **spezialisierter Coding-Sub-Route** einbindbar, sobald Open Weights verfügbar sind (nächste Woche laut Fabian) oder über Z.ai Coding Plan als API-Alternative. **Setup-Vorschlag (zur späteren Diskussion):** 1. Warte auf Open Weights Release (nächste Woche) — Self-Hosting wird möglich 2. Falls schneller gewünscht: Z.ai Coding Plan (Light ~18 USD/Monat) + Coding Helper für schnelles Testing 3. Integration in OpenClaw-Routing als **Sub-Task-spezifischer Side-Branch** für Coding-Tasks 4. Perspektivisch: GLM als **eine der Panel-Stimmen** in [[concepts/llm-model-fusion-ensembles.md]]-Coding-Ensembles ## Verwandte Wiki-Seiten - [[concepts/real-world-coding-showdown.md]] — Kimi K2.7 vs GLM 5.2 Head-to-Head (Vortag) - [[concepts/llm-model-fusion-ensembles.md]] — Ensemble-Pattern: GLM 5.2 als Panel-Kandidat - [[concepts/ai-agents-2026.md]] — Agent-Frameworks; OpenClaw namentlich in Z.ai-Liste - [[tools/kimi-k2.7-code.md]] — direkter Konkurrent (Moonshot AI, ähnliche Strategie) - [[architecture/model-routing.md]] — Sub-Task-spezifisches Coding-Routing (Kimi / GLM) - [[concepts/llm-behavior-persistence.md]] — Bias-Persistenz (relevant für jeden Modell-Wechsel) - [[concepts/llm-knowledge-base.md]] — kuratierte Strukturen schlagen reine Inference ## Externe Ressourcen ### Video & Autor - [YouTube: GLM 5.2 10x billiger als Claude](https://www.youtube.com/watch?v=bN1QJi26kco) - [IAmFabian YouTube Channel](https://www.youtube.com/@IchBinFabian) (7.8K Subs) - [Fabian Instagram](https://www.instagram.com/ichbinfabiande/) - [Fabian Skool Community (Die KI-Werkstatt)](https://www.skool.com/die-ki-werkstatt-1779) - [Fabian Beratung / Termin-Buchung](https://ichbinfabian.com/termin) - [Fabians vorheriges Video zu Kimi K2.7](https://www.youtube.com/watch?v=) - [Fabians vorheriges Video zu Hermes + Gemma 4](https://www.youtube.com/watch?v=) ### Modell & Hersteller - [Z.ai (Hersteller)](https://z.ai/) - [Z.ai Coding Plan / Subscribe](https://z.ai/subscribe) - [Z.ai API Docs](https://docs.z.ai/) - [Zhipu AI (Mutterkonzern)](https://www.zhipuai.cn/) - [GLM 5 Open Weights (HuggingFace)](https://huggingface.co/zai-org/GLM-5) - [GLM-5 Open-Source Guide (nxcode.io)](https://www.nxcode.io/resources/news/glm-5-open-source-744b-model-complete-guide-2026) - [Truescho Review: GLM Coding Plan 2026](https://truescho.com/en/blog/glm-coding-plan-zai-2026) ### Coding Helper & unterstützte Tools - [Coding Helper NPM Package (@z_ai/coding-helper)](https://www.npmjs.com/package/@z_ai/coding-helper) - [OpenCode](https://opencode.ai) — Open-Source-Coding-Agent fürs Terminal - [Claude Code (Anthropic)](https://claude.com/product/claude-code) - [Cline (VS Code AI Agent)](https://github.com/cline/cline) - [Kilo Code](https://kilocode.ai/) - [Factory Droid](https://www.factory.ai/) - [Crush (Charm)](https://github.com/charmbracelet/crush) ### Konkurrenz & Kontext - [Anthropic Claude Opus 4.8](https://www.anthropic.com/claude) - [Kimi K2.7 Code (Ollama Cloud)](https://ollama.com/library/kimi-k2.7-code) - [OpenRouter](https://openrouter.ai/) (wo GLM 5.2 aktuell fehlt) - [GLM-5.2 auf chat.z.ai](https://chat.z.ai) - [GLM-Coding-Plan YouTuber "AI Code King" (zitiert in Video)](https://www.youtube.com/results?search_query=AI+Code+King)