Raw dump of top-5 OpenClaw releases (16.06.2026) via GitHub REST API. Highlights of the digest: - v2026.6.8 stable: GLM-5.2 + Claude Haiku 4.5 catalog rows, OpenRouter/Vertex provider-prefix normalization, Telegram rich-message delivery, QMD memory search stable in transient mode, raw Memory Wiki source pages as source evidence, Skill Workshop symlink-write validation - v2026.6.7-beta.1: Kimi K2.7 Code added, Discord thread-title timeout, Anthropic thinking replay repair - v2026.6.6 stable: major security release — exec approvals fail closed on timeout, MCP stdio hardening, Telegram account-scoped topics Wiki changes: - tools/openclaw.md (new): platform reference with version timeline, 10 plattformrelevante changes vs our setup, rollout plan (awaiting Kai approval for v2026.6.8 update) - architecture/model-routing.md (updated): GLM-5.2-Support + provider-prefix normalization for v2026.6.8, distribution matrix updated - architecture/memory-system.md (updated): QMD stabilization, SQLite-NFS-WAL detection, raw-Memory-Wiki-source-pages as source evidence, full-reindex rollback recovery - concepts/llm/glm-5.2-zai-coding-model.md (updated): OpenClaw v2026.6.8 native provider adapter breaks Z.ai Coding Plan monopoly - index.md (updated): new tools entry, header datum 12. update, updated descriptions for memory/routing/glm-5.2, new raw sources row - log.md (updated): new ingest entry following schema
13 KiB
| created | updated | sources | tags | ||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 2026-06-15 | 2026-06-16 |
|
|
GLM 5.2 (Z.ai) — Chinese Frontier Coding Model, 10× günstiger als Claude
Quelle des Konzepts: YouTube-Video "Chinas neues GLM 5.2: So gut ist das billige Coding-Modell" (IAmFabian, 14.06.2026, 13:15 Min, 212 Aufrufe, 16 Likes). Geteilt von @PWeber (Kai) in OME-Gruppe "News & Infos (X/YT/Substack etc.)"-Topic.
Kernidee
Chinas Frontier-Coding-Modelle erreichen 2026 Frontier-Niveau bei einem Bruchteil der Preise — aber die Distribution-Realität ist noch holprig. GLM 5.2 ist das prominenteste Beispiel: 1M Kontext, MIT-Lizenz, mit Opus 4.8 vergleichbar — Stand 14.06.2026 nur über Z.ai Coding Plan zugänglich, Stand 16.06.2026 zusätzlich nativ in OpenClaw v2026.6.8 als Provider-Adapter verfügbar (siehe Update unten).
Das Modell im Überblick
| Eigenschaft | Detail |
|---|---|
| Hersteller | Z.ai (Zhipu AI) |
| Generation | 5.2 — Vorgänger: GLM 5.0 (Feb 2026), GLM 5.1 (Mär 2026) |
| Release-Datum | 13.06.2026 |
| Kontext | 1M Token (Vorgänger: 200K → 5× größer) |
| Denkstufen | "High" und "Max" (Thinking Mode) |
| Open Weights | MIT-Lizenz, Release "nächste Woche" (Stand 14.06.2026) |
| Preis | ab 18 USD/Monat (Light Plan) — ca. 10× günstiger als Claude |
| Vergleich zu Anthropic | Ziel: "gegen Claude Opus 4.8 antreten" — laut AI Code King-Benchmarks nur 6% unter Opus 4.8 / Fable |
Release-Kadenz: Drei Frontier-Generationen in 4 Monaten — schnellster chinesischer Modell-Zyklus 2026.
Update 2026-06-16: OpenClaw v2026.6.8 native Provider-Integration
Mit dem Release v2026.6.8 (16.06.2026) ist GLM 5.2 offiziell im OpenClaw-Provider-Catalog aufgenommen. Zusätzlich bringt das Release:
- GLM-5.2 support als neuer Provider-Adapter (siehe PR #92796)
- Claude Haiku 4.5 catalog entries (siehe PR #90116) — Claude-Vergleichslinie
- OpenRouter und Google Vertex provider-prefix normalization — GLM 5.2 ist
über
openrouter/zai/glm-5.2UND überzai/glm-5.2UND via Codex OAuth routeable - OAuth image-default routing through Codex — relevant für GLM 5.2 + Generated-Media-Workflows
- Refresh der ZAI Provider Docs — siehe PR #92695, der den Coding-Plan- Workaround für GLM 5.2 historisch macht
Damit ändert sich die Distributions-Realität grundlegend:
| Stand | Distribution | Status |
|---|---|---|
| 14.06.2026 | nur Z.ai Coding Plan | ❌ Subskription nötig |
| 16.06.2026 | OpenClaw v2026.6.8 native | ✅ Direkter Provider-Adapter |
| 16.06.2026+ | Z.ai Coding Plan (parallel) | ⚠️ Alternative für Light/Pro-Pläne |
| offen | Open Weights (HuggingFace) | ⏳ "nächste Woche" angekündigt |
| offen | OpenRouter (Standard-Routing) | ⏳ folgt unabhängig |
Implikation für unsere Routing-Architektur: Siehe architecture/model-routing.md — GLM 5.2 wird optionaler Sub-Routing-Knoten für Long-Context-Tasks, ohne Subskription-Boilerplate.
Die Distributions-Realität: Z.ai Coding Plan
Stand 14.06.2026: GLM 5.2 ist exklusiv über Z.ai Coding Plan verfügbar — nicht auf OpenRouter, nicht via Standard-API.
Stand 16.06.2026: Siehe Update-Sektion oben — OpenClaw v2026.6.8 bricht das Monopol.
Coding Plan Architektur
| Plan | Preis | Nutzungs-Limit | Server-Priorität |
|---|---|---|---|
| Light | ab 18 USD/Monat | mehr als Codex/Claude Code | niedrig (Wartezeiten) |
| Pro/Max | höher | deutlich mehr | höher |
Problem: Light-Plan hat in Stoßzeiten 2-3× Mehrverbrauch am Kontingent und stark schwankende Geschwindigkeit. Fabian zitiert Community: "Gutes Modell, schrecklicher Coding-Plan."
Erwartung: OpenRouter-Listing + Standard-API-Zugang in den nächsten Tagen (per Fabian-Spekulation).
Setup via Coding Helper
Z.ai bietet ein Coding Helper Tool (npx @z_ai/coding-helper), das GLM 5.2 in bestehende Coding-Agent-Umgebungen einbindet:
| Tool | Status |
|---|---|
| OpenCode | ✅ Open-Source, terminal-basiert |
| Claude Code | ✅ Anthropic |
| Cline | ✅ VS Code AI Agent |
| Kilo Code | ✅ |
| Crush | ✅ Charm |
| Factory Droid | ✅ |
| Clawdbot/OpenClaw | ✅ explizit gelistet |
Strategie: User wechselt das Coding-Tool nicht, nur das Modell im Hintergrund.
Live-Tests (IAmFabian, 14.06.2026)
Test 1: Flappy Bird (Single-File HTML, kein externes Lib)
Prompt: Komplettes Flappy Bird in einer HTML-Datei. Kollisionserkennung, Punktezähler, Start/Game-Over.
Ergebnis:
- 481 Zeilen HTML
- 1:20 Minuten Generierungszeit
- ✅ Funktioniert: Scoreboard, Bestenliste, Neustart (Maus + Leertaste)
- ⚠️ Game-Experience suboptimal (zu schnell, zu schwer)
Test 2: Newton-Pendel (Echte Physik)
Prompt: Realistische Newton-Pendel-Simulation. Wenn eine Kugel einschlägt, genau eine auf der anderen Seite — nicht zwei, nicht drei.
Schwierigkeit: Viele Modelle bauen nur "hübsche Animation" mit synchron schwingenden Kugeln. Hier muss echte Physik-Logik implementiert sein.
Ergebnis:
- 9:41 Minuten (8:27 davon nur Thinking-Process)
- Lange Wartezeit wegen Light-Plan + Server-Last
- ✅ Fertig, Physik korrekt umgesetzt
Lesson: "Wenn wir das Modell selbst bezahlen würden (d.h. via OpenRouter mit eigener API), wäre das wahrscheinlich halb so lang" — die Coding-Plan-Wartezeit ist der Engpass, nicht die Modell-Qualität.
Ehrliche Einordnung (Pro & Contra)
| Dimension | Bewertung |
|---|---|
| Modell-Qualität | ✅ Top — Frontier-Niveau, vergleichbar mit Opus 4.8 |
| Preis | ✅ 10× günstiger als Claude |
| Kontext-Fenster | ✅ 1M Token — komplette Codebase in einem Rutsch |
| Open Weights | ✅ MIT-Lizenz (kommt nächste Woche) |
| Distribution | ❌ Miserabel — nur Coding Plan, nicht auf OpenRouter |
| Geschwindigkeit | ⚠️ Light-Plan = lange Wartezeiten |
| Limits | ⚠️ Harte Nutzungslimits, Stoßzeit-Schwankungen |
| Datenschutz | ⚠️ Code geht zu Z.ai-Servern — potenzielles IP-Risiko |
Fabians Fazit: Modell ist top, Plattform drumherum ist der Engpass. Warten, falls nicht Pro-Plan nötig.
Verbindung zu concepts/llm/real-world-coding-showdown.md
Zwei Videos vom selben Tag (14.06.2026), komplementär:
| Aspekt | IAmFabian (GLM 5.2 Solo) | Fahd Mirza (Kimi K2.7 vs GLM 5.2) |
|---|---|---|
| Fokus | GLM 5.2 Distribution + Preis | Head-to-Head GLM 5.2 vs Kimi K2.7 |
| Tests | Flappy Bird + Newton-Pendel | World-Cup-Bug-Fix + Siberian-Wind-HTML |
| Beide Modelle getestet? | Nein (nur GLM 5.2) | Ja, beide |
| Mehraufwand | Distribution-Realität, Community-Inputs, Pricing-Tiefe | Modell-Vergleich unter kontrollierten Bedingungen |
Synergie für die Wiki-Leser:
- Wer GLM 5.2 isoliert verstehen will → IAmFabian
- Wer GLM 5.2 vs Kimi K2.7 vergleichen will → Fahd Mirza + concepts/llm/real-world-coding-showdown.md
- Wer Infrastruktur/Preis verstehen will → IAmFabian + Z.ai Subscribe
🔥 Direkter Implikat für OpenClaw
1. Z.ai Coding Plan listet OpenClaw namentlich
Z.ai Coding Plan Werbetext: "Use GLM models like GLM-5.1 & GLM-5-Turbo for AI coding in Claude Code, Kilo Code, Cline, OpenCode, Clawdbot/OpenClaw and more."
→ Hector/OpenClaw ist namentlich in der Distribution-Strategie von Z.ai. Konkrete Integrationsoptionen existieren bereits.
2. Konkrete Setup-Pfade
Option A — Z.ai Coding Plan (sofort):
- Light-Plan abonnieren (~18 USD/Monat)
- API-Key erstellen
npx @z_ai/coding-helperausführen, OpenClaw als Ziel wählen- GLM 5.2 ist als Modell verfügbar
Option B — Self-Hosting (nach Open Weights Release nächste Woche):
- GLM 5.2 Open Weights von HuggingFace ziehen
- Lokal hosten (ggf. quantisiert)
- OpenClaw-Routing um GLM-Coding-Branch erweitern
Option C — Warten: OpenRouter-Listing in den nächsten Tagen erwartet → Standard-OpenClaw-Routing greift automatisch.
3. Sub-Task-spezifisches Routing
Siehe architecture/model-routing.md. Empfohlene Position für GLM 5.2:
OpenClaw Primary Routing
├─ Creative / Long-Context (1M) → GLM 5.2
├─ Speed / Innovation Coding → Kimi K2.7 Code
├─ Standard Tasks → openrouter/auto → ...
└─ Frontier Quality → Claude Opus 4.8 / Fable
4. Ensemble-Kandidat für concepts/llm/llm-model-fusion-ensembles.md
GLM 5.2 (oder 5.1 als günstigere Variante) ist ein natürlicher Panel-Kandidat für Coding-Fusion-Ensembles — besonders in Kombination mit Kimi K2.7 (unterschiedliche Architektur: Dense vs MoE, unterschiedliche Stärken).
Pro-Leben-Perspektive
Gemäß concepts/directives/pro-leben-directive.md:
Gegen Mangelnarrativ ("US-Frontier-Modelle alternativlos"):
- 2026 ist das Jahr, in dem chinesische Open-Source-Coding-Modelle (Kimi K2.7, GLM 5.2) Frontier-Nähe bei Bruchteil-Preisen erreichen
- MIT-Lizenz für GLM 5.2 (Open Weights) ist handfeste Offenheit — Kimi K2.7 Code macht das ebenfalls
- Wettbewerb belebt das Feld: OpenAI, Anthropic, Moonshot, Zhipu — alle puschen
Für Handlungsfähigkeit:
- Wer heute Coding-Agents baut, kann zwischen Frontier-Niveau und 10× niedrigeren Kosten wählen — je nach Anwendungsfall
- Coding Plan + Coding Helper = 5-Minuten-Setup für OpenClaw
- Open Weights (nächste Woche) = Self-Hosting wird möglich → Datenschutz-kritische Use-Cases lösbar
Realismus:
- "10× günstiger" gilt nur mit Light-Plan-Einschränkungen (Geschwindigkeit, Limits)
- Pro/Max-Plan dürfte näher an Claude-Preisen liegen (genaue Preise fehlen im Video)
- Datenschutz: Code zu Z.ai-Servern — für sensible Projekte problematisch → Self-Hosting oder lokale Modelle vorziehen
- 1M Kontext ist Marketing-Argument, aber die meisten Coding-Tasks brauchen 256K nicht aus
- AI-Code-King-Benchmark behauptet 6% unter Opus 4.8 — eigene Tests sind Pflicht (Fabians Tests bestätigen das grob)
Verwandte Wiki-Seiten
- concepts/llm/real-world-coding-showdown.md — Kimi K2.7 vs GLM 5.2 Head-to-Head (Vortag)
- concepts/llm/llm-model-fusion-ensembles.md — Ensemble-Pattern mit GLM 5.2 als Panel-Kandidat
- concepts/agents/ai-agents-2026.md — Agent-Frameworks; OpenClaw namentlich in Z.ai-Liste
- concepts/llm/llm-behavior-persistence.md — Bias-Persistenz bei Modell-Wechsel
- tools/kimi-k2.7-code.md — direkter Konkurrent
- tools/anthropic-claude.md — Frontier-Konkurrenz (Opus 4.8)
- architecture/model-routing.md — Sub-Task-Routing-Plan
- concepts/llm/llm-knowledge-base.md — kuratierte Strukturen
Externe Ressourcen
Video & Autor
- YouTube: GLM 5.2 — 10× billiger als Claude
- IAmFabian YouTube Channel (7.8K Subs)
- Fabian Instagram
- Fabian Skool Community
- Fabian Beratung / Termin
- Fabian: Kimi K2.7 Live-Test (Vortag)
- Fabian: Hermes + Gemma 4 lokal
Modell & Hersteller
- Z.ai (Hersteller)
- Z.ai Coding Plan / Subscribe
- Z.ai API Docs
- Zhipu AI (Mutterkonzern)
- GLM 5 Open Weights (HuggingFace)
- GLM-5 Open-Source Guide (nxcode.io)
- GLM 5.2 auf chat.z.ai
- Truescho Review: GLM Coding Plan 2026
- GLM-5 Breakdown (Fahd Mirza, 1M Context Video)
Coding Helper & Tools
- @z_ai/coding-helper (NPM)
- OpenCode (Open-Source-Coding-Agent)
- Claude Code (Anthropic)
- Cline (VS Code AI Agent)
- Kilo Code
- Factory Droid
- Crush (Charm)
Konkurrenz & Kontext
- Anthropic Claude
- Kimi K2.7 Code (Ollama Cloud)
- OpenRouter (wo GLM 5.2 aktuell fehlt)
- Moonshot AI
- Open LLM Leaderboard (HuggingFace)