knowledge-base/wiki/concepts/llm/glm-5.2-zai-coding-model.md
Hector ea7c8c3abe ingest(github): openclaw releases v2026.6.6-v2026.6.8
Raw dump of top-5 OpenClaw releases (16.06.2026) via GitHub REST API.

Highlights of the digest:
- v2026.6.8 stable: GLM-5.2 + Claude Haiku 4.5 catalog rows, OpenRouter/Vertex
  provider-prefix normalization, Telegram rich-message delivery, QMD memory
  search stable in transient mode, raw Memory Wiki source pages as source
  evidence, Skill Workshop symlink-write validation
- v2026.6.7-beta.1: Kimi K2.7 Code added, Discord thread-title timeout,
  Anthropic thinking replay repair
- v2026.6.6 stable: major security release — exec approvals fail closed on
  timeout, MCP stdio hardening, Telegram account-scoped topics

Wiki changes:
- tools/openclaw.md (new): platform reference with version timeline, 10
  plattformrelevante changes vs our setup, rollout plan (awaiting Kai approval
  for v2026.6.8 update)
- architecture/model-routing.md (updated): GLM-5.2-Support + provider-prefix
  normalization for v2026.6.8, distribution matrix updated
- architecture/memory-system.md (updated): QMD stabilization, SQLite-NFS-WAL
  detection, raw-Memory-Wiki-source-pages as source evidence, full-reindex
  rollback recovery
- concepts/llm/glm-5.2-zai-coding-model.md (updated): OpenClaw v2026.6.8
  native provider adapter breaks Z.ai Coding Plan monopoly
- index.md (updated): new tools entry, header datum 12. update, updated
  descriptions for memory/routing/glm-5.2, new raw sources row
- log.md (updated): new ingest entry following schema
2026-06-16 20:17:21 +02:00

13 KiB
Raw Blame History

created updated sources tags
2026-06-15 2026-06-16
youtube/2026-06-15_ichbinfabian-glm-5.2-coding-modell.md
other/2026-06-16_openclaw-releases-v2026.6.8.md
concept
glm-5.2
zhipu-ai
z-ai
coding-models
open-source
mit-license
coding-plan
opencode
claude-code
agentic-coding
price-comparison
china-ai
openclaw

GLM 5.2 (Z.ai) — Chinese Frontier Coding Model, 10× günstiger als Claude

Quelle des Konzepts: YouTube-Video "Chinas neues GLM 5.2: So gut ist das billige Coding-Modell" (IAmFabian, 14.06.2026, 13:15 Min, 212 Aufrufe, 16 Likes). Geteilt von @PWeber (Kai) in OME-Gruppe "News & Infos (X/YT/Substack etc.)"-Topic.

Kernidee

Chinas Frontier-Coding-Modelle erreichen 2026 Frontier-Niveau bei einem Bruchteil der Preise — aber die Distribution-Realität ist noch holprig. GLM 5.2 ist das prominenteste Beispiel: 1M Kontext, MIT-Lizenz, mit Opus 4.8 vergleichbar — Stand 14.06.2026 nur über Z.ai Coding Plan zugänglich, Stand 16.06.2026 zusätzlich nativ in OpenClaw v2026.6.8 als Provider-Adapter verfügbar (siehe Update unten).

Das Modell im Überblick

Eigenschaft Detail
Hersteller Z.ai (Zhipu AI)
Generation 5.2 — Vorgänger: GLM 5.0 (Feb 2026), GLM 5.1 (Mär 2026)
Release-Datum 13.06.2026
Kontext 1M Token (Vorgänger: 200K → 5× größer)
Denkstufen "High" und "Max" (Thinking Mode)
Open Weights MIT-Lizenz, Release "nächste Woche" (Stand 14.06.2026)
Preis ab 18 USD/Monat (Light Plan) — ca. 10× günstiger als Claude
Vergleich zu Anthropic Ziel: "gegen Claude Opus 4.8 antreten" — laut AI Code King-Benchmarks nur 6% unter Opus 4.8 / Fable

Release-Kadenz: Drei Frontier-Generationen in 4 Monaten — schnellster chinesischer Modell-Zyklus 2026.

Update 2026-06-16: OpenClaw v2026.6.8 native Provider-Integration

Mit dem Release v2026.6.8 (16.06.2026) ist GLM 5.2 offiziell im OpenClaw-Provider-Catalog aufgenommen. Zusätzlich bringt das Release:

  • GLM-5.2 support als neuer Provider-Adapter (siehe PR #92796)
  • Claude Haiku 4.5 catalog entries (siehe PR #90116) — Claude-Vergleichslinie
  • OpenRouter und Google Vertex provider-prefix normalization — GLM 5.2 ist über openrouter/zai/glm-5.2 UND über zai/glm-5.2 UND via Codex OAuth routeable
  • OAuth image-default routing through Codex — relevant für GLM 5.2 + Generated-Media-Workflows
  • Refresh der ZAI Provider Docs — siehe PR #92695, der den Coding-Plan- Workaround für GLM 5.2 historisch macht

Damit ändert sich die Distributions-Realität grundlegend:

Stand Distribution Status
14.06.2026 nur Z.ai Coding Plan Subskription nötig
16.06.2026 OpenClaw v2026.6.8 native Direkter Provider-Adapter
16.06.2026+ Z.ai Coding Plan (parallel) ⚠️ Alternative für Light/Pro-Pläne
offen Open Weights (HuggingFace) "nächste Woche" angekündigt
offen OpenRouter (Standard-Routing) folgt unabhängig

Implikation für unsere Routing-Architektur: Siehe architecture/model-routing.md — GLM 5.2 wird optionaler Sub-Routing-Knoten für Long-Context-Tasks, ohne Subskription-Boilerplate.

Die Distributions-Realität: Z.ai Coding Plan

Stand 14.06.2026: GLM 5.2 ist exklusiv über Z.ai Coding Plan verfügbar — nicht auf OpenRouter, nicht via Standard-API.

Stand 16.06.2026: Siehe Update-Sektion oben — OpenClaw v2026.6.8 bricht das Monopol.

Coding Plan Architektur

Plan Preis Nutzungs-Limit Server-Priorität
Light ab 18 USD/Monat mehr als Codex/Claude Code niedrig (Wartezeiten)
Pro/Max höher deutlich mehr höher

Problem: Light-Plan hat in Stoßzeiten 2-3× Mehrverbrauch am Kontingent und stark schwankende Geschwindigkeit. Fabian zitiert Community: "Gutes Modell, schrecklicher Coding-Plan."

Erwartung: OpenRouter-Listing + Standard-API-Zugang in den nächsten Tagen (per Fabian-Spekulation).

Setup via Coding Helper

Z.ai bietet ein Coding Helper Tool (npx @z_ai/coding-helper), das GLM 5.2 in bestehende Coding-Agent-Umgebungen einbindet:

Tool Status
OpenCode Open-Source, terminal-basiert
Claude Code Anthropic
Cline VS Code AI Agent
Kilo Code
Crush Charm
Factory Droid
Clawdbot/OpenClaw explizit gelistet

Strategie: User wechselt das Coding-Tool nicht, nur das Modell im Hintergrund.

Live-Tests (IAmFabian, 14.06.2026)

Test 1: Flappy Bird (Single-File HTML, kein externes Lib)

Prompt: Komplettes Flappy Bird in einer HTML-Datei. Kollisionserkennung, Punktezähler, Start/Game-Over.

Ergebnis:

  • 481 Zeilen HTML
  • 1:20 Minuten Generierungszeit
  • Funktioniert: Scoreboard, Bestenliste, Neustart (Maus + Leertaste)
  • ⚠️ Game-Experience suboptimal (zu schnell, zu schwer)

Test 2: Newton-Pendel (Echte Physik)

Prompt: Realistische Newton-Pendel-Simulation. Wenn eine Kugel einschlägt, genau eine auf der anderen Seite — nicht zwei, nicht drei.

Schwierigkeit: Viele Modelle bauen nur "hübsche Animation" mit synchron schwingenden Kugeln. Hier muss echte Physik-Logik implementiert sein.

Ergebnis:

  • 9:41 Minuten (8:27 davon nur Thinking-Process)
  • Lange Wartezeit wegen Light-Plan + Server-Last
  • Fertig, Physik korrekt umgesetzt

Lesson: "Wenn wir das Modell selbst bezahlen würden (d.h. via OpenRouter mit eigener API), wäre das wahrscheinlich halb so lang" — die Coding-Plan-Wartezeit ist der Engpass, nicht die Modell-Qualität.

Ehrliche Einordnung (Pro & Contra)

Dimension Bewertung
Modell-Qualität Top — Frontier-Niveau, vergleichbar mit Opus 4.8
Preis 10× günstiger als Claude
Kontext-Fenster 1M Token — komplette Codebase in einem Rutsch
Open Weights MIT-Lizenz (kommt nächste Woche)
Distribution Miserabel — nur Coding Plan, nicht auf OpenRouter
Geschwindigkeit ⚠️ Light-Plan = lange Wartezeiten
Limits ⚠️ Harte Nutzungslimits, Stoßzeit-Schwankungen
Datenschutz ⚠️ Code geht zu Z.ai-Servern — potenzielles IP-Risiko

Fabians Fazit: Modell ist top, Plattform drumherum ist der Engpass. Warten, falls nicht Pro-Plan nötig.

Verbindung zu concepts/llm/real-world-coding-showdown.md

Zwei Videos vom selben Tag (14.06.2026), komplementär:

Aspekt IAmFabian (GLM 5.2 Solo) Fahd Mirza (Kimi K2.7 vs GLM 5.2)
Fokus GLM 5.2 Distribution + Preis Head-to-Head GLM 5.2 vs Kimi K2.7
Tests Flappy Bird + Newton-Pendel World-Cup-Bug-Fix + Siberian-Wind-HTML
Beide Modelle getestet? Nein (nur GLM 5.2) Ja, beide
Mehraufwand Distribution-Realität, Community-Inputs, Pricing-Tiefe Modell-Vergleich unter kontrollierten Bedingungen

Synergie für die Wiki-Leser:

🔥 Direkter Implikat für OpenClaw

1. Z.ai Coding Plan listet OpenClaw namentlich

Z.ai Coding Plan Werbetext: "Use GLM models like GLM-5.1 & GLM-5-Turbo for AI coding in Claude Code, Kilo Code, Cline, OpenCode, Clawdbot/OpenClaw and more."

Hector/OpenClaw ist namentlich in der Distribution-Strategie von Z.ai. Konkrete Integrationsoptionen existieren bereits.

2. Konkrete Setup-Pfade

Option A — Z.ai Coding Plan (sofort):

  1. Light-Plan abonnieren (~18 USD/Monat)
  2. API-Key erstellen
  3. npx @z_ai/coding-helper ausführen, OpenClaw als Ziel wählen
  4. GLM 5.2 ist als Modell verfügbar

Option B — Self-Hosting (nach Open Weights Release nächste Woche):

  1. GLM 5.2 Open Weights von HuggingFace ziehen
  2. Lokal hosten (ggf. quantisiert)
  3. OpenClaw-Routing um GLM-Coding-Branch erweitern

Option C — Warten: OpenRouter-Listing in den nächsten Tagen erwartet → Standard-OpenClaw-Routing greift automatisch.

3. Sub-Task-spezifisches Routing

Siehe architecture/model-routing.md. Empfohlene Position für GLM 5.2:

OpenClaw Primary Routing
  ├─ Creative / Long-Context (1M)  → GLM 5.2
  ├─ Speed / Innovation Coding     → Kimi K2.7 Code
  ├─ Standard Tasks                → openrouter/auto → ...
  └─ Frontier Quality              → Claude Opus 4.8 / Fable

4. Ensemble-Kandidat für concepts/llm/llm-model-fusion-ensembles.md

GLM 5.2 (oder 5.1 als günstigere Variante) ist ein natürlicher Panel-Kandidat für Coding-Fusion-Ensembles — besonders in Kombination mit Kimi K2.7 (unterschiedliche Architektur: Dense vs MoE, unterschiedliche Stärken).

Pro-Leben-Perspektive

Gemäß concepts/directives/pro-leben-directive.md:

Gegen Mangelnarrativ ("US-Frontier-Modelle alternativlos"):

  • 2026 ist das Jahr, in dem chinesische Open-Source-Coding-Modelle (Kimi K2.7, GLM 5.2) Frontier-Nähe bei Bruchteil-Preisen erreichen
  • MIT-Lizenz für GLM 5.2 (Open Weights) ist handfeste Offenheit — Kimi K2.7 Code macht das ebenfalls
  • Wettbewerb belebt das Feld: OpenAI, Anthropic, Moonshot, Zhipu — alle puschen

Für Handlungsfähigkeit:

  • Wer heute Coding-Agents baut, kann zwischen Frontier-Niveau und 10× niedrigeren Kosten wählen — je nach Anwendungsfall
  • Coding Plan + Coding Helper = 5-Minuten-Setup für OpenClaw
  • Open Weights (nächste Woche) = Self-Hosting wird möglich → Datenschutz-kritische Use-Cases lösbar

Realismus:

  • "10× günstiger" gilt nur mit Light-Plan-Einschränkungen (Geschwindigkeit, Limits)
  • Pro/Max-Plan dürfte näher an Claude-Preisen liegen (genaue Preise fehlen im Video)
  • Datenschutz: Code zu Z.ai-Servern — für sensible Projekte problematisch → Self-Hosting oder lokale Modelle vorziehen
  • 1M Kontext ist Marketing-Argument, aber die meisten Coding-Tasks brauchen 256K nicht aus
  • AI-Code-King-Benchmark behauptet 6% unter Opus 4.8 — eigene Tests sind Pflicht (Fabians Tests bestätigen das grob)

Verwandte Wiki-Seiten

Externe Ressourcen

Video & Autor

Modell & Hersteller

Coding Helper & Tools

Konkurrenz & Kontext