diff --git a/raw/youtube/2026-06-15_ichbinfabian-glm-5.2-coding-modell.md b/raw/youtube/2026-06-15_ichbinfabian-glm-5.2-coding-modell.md new file mode 100644 index 0000000..8cf9637 --- /dev/null +++ b/raw/youtube/2026-06-15_ichbinfabian-glm-5.2-coding-modell.md @@ -0,0 +1,219 @@ +--- +type: youtube +source_url: https://www.youtube.com/watch?v=bN1QJi26kco +retrieved: 2026-06-15 +channel: "IAmFabian" +duration_sec: 795 +has_transcript: true +tags: [glm-5.2, zhipu-ai, z-ai, coding-model, open-source, mit-license, coding-plan, opencode, claude-code, hermes, agentic-coding, price-comparison] +--- + +# GLM 5.2: 10x billiger als Claude, aber wo ist der Haken? + +**Geteilt von:** @PWeber (Kai) in OME-Gruppe "News & Infos (X/YT/Substack etc.)"-Topic + +## Quelle + +- **Titel:** Chinas neues GLM 5.2: So gut ist das billige Coding-Modell +- **Channel:** [IAmFabian](https://www.youtube.com/@IchBinFabian) (7.8K Subscribers) +- **Hochgeladen:** 14.06.2026 (eine Stunde nach Veröffentlichung in deutsch) +- **Länge:** 13:15 +- **Aufrufe:** 212 | **Likes:** 16 +- **URL:** https://www.youtube.com/watch?v=bN1QJi26kco +- **Beschreibung:** "GLM 5.2 von Z.ai ist da, mit 1 Million Token Kontext und rund 10x günstiger als Claude. Ich teste es live mit zwei Coding-Aufgaben und sage ehrlich, wo der Haken liegt." +- **Tags:** GLM 5.2, Z.ai, Zhipu AI, GLM Coding Plan, Claude Alternative, AI Coding deutsch, Open Source LLM, 1 Million Token Kontext, OpenCode, Claude Code Alternative +- **Andere Videos des Channels (Kontext):** + - [Kimi K2.7 ist da: Das beste Open-Source Coding-Modell? (Live getestet)](https://www.youtube.com/watch?v=) — 6K views, 14h alt + - [Lokaler KI-Agent, gratis und offline: Hermes mit Gemma 4](https://www.youtube.com/watch?v=) — 12K views + - [Warum Claude, Codex und OpenAI alle auf Agent Skills setzen](https://www.youtube.com/watch?v=) — 5K views, 1 Monat alt + +## Konzept: Chinese Coding Models & Pricing Tiers + +Ein **deutschsprachiger Deep-Dive auf GLM 5.2** — Release-Tempo, Distribution-Realität (Coding Plan als exklusiver Zugang), Open-Weight-Strategie, Preisvergleich, ehrliche Live-Tests, **ehrliche Einordnung von Datenschutz/Limits**. + +**Methodisch stärker als viele Reviews:** Fabian testet **live und selbst** (zwei HTML-Apps: Flappy Bird, Newton-Pendel), referenziert **externe Community-Benchmarks** (AI Code King), und ist explizit transparent über die **Nachteile** (Coding-Plan-Limits, schwankende Geschwindigkeit, Server-Kapazität). + +## Das Modell: GLM 5.2 + +| Eigenschaft | Detail | +|---|---| +| Hersteller | Z.ai (Zhipu AI, China) | +| Generation | 5.2 (Vorgänger: GLM 5.0 im Februar 2026, GLM 5.1 im März 2026) | +| Release-Datum | 13.06.2026 | +| **Kontext** | **1 Million Token** (Vorgänger: 200K → 5× größer) | +| Denkstufen | "High" und "Max" (Thinking Mode, vergleichbar mit Anthropic extended thinking) | +| **Open Weights** | **MIT-Lizenz** (kommerziell nutzbar, anpassbar, selbst hostbar) | +| Release-Pfad | **Z.ai Coding Plan** (siehe unten) — auf OpenRouter, Standard-APIs etc. aktuell nicht verfügbar | +| Open Weights Release | "nächste Woche" (laut Fabian, Stand 14.06.2026) | +| Vergleich zu Anthropic | Ziel: "gegen Claude Opus 4.8 antreten" — 6% unter Opus 4.8 / Fable laut AI Code King Benchmarks | + +### Release-Tempo (beeindruckend) + +- GLM 5.0: Februar 2026 +- GLM 5.1: März 2026 +- **GLM 5.2: 13.06.2026** +- → **Drei Frontier-Generationen in 4 Monaten** + +## Der Haken: Distribution via Z.ai Coding Plan + +Stand 14.06.2026 ist GLM 5.2 **nicht** verfügbar über: +- OpenRouter (wo neue Modelle normalerweise sofort erscheinen) +- Standard-API-Zugriff +- Andere Drittanbieter-Plattformen + +**Einziger Zugang:** [Z.ai Coding Plan](https://z.ai/subscribe) — Abo-Modell (ab 18 USD/Monat für Light-Plan). Fabian spekuliert: "wahrscheinlich in den nächsten zwei Tagen online verfügbar". + +**Community-Realität** (per Reddit/HN-Berichte): +- Lob: "GLM hat eine komplette App gebaut, fast der ganze Code vom Modell, ohne Verheddern" +- Kritik: "Harte Nutzungslimits, schwankende Geschwindigkeit, 2-3× Kontingent-Verbrauch bei Stoßzeiten" +- Fazit: "Gutes Modell, schrecklicher Coding-Plan" (wörtlich aus einem zitierten Video) + +## Pricing & Plan-Architektur + +| Plan | Preis | Nutzung | Priorität | +|---|---|---|---| +| **Light** | ab 18 USD/Monat | mehr als bei Codex/Claude Code | **niedrig** (lange Wartezeiten in Stoßzeiten) | +| **Pro/Max** | höher | deutlich mehr | höher | + +**10× günstiger als Claude** — direkter Vergleichswert aus Video-Titel und Community-Statements. + +## Setup: Coding Helper Tool + +Z.ai bietet einen **Coding Helper** (`npx @z_ai/coding-helper`), der GLM 5.2 in bestehende Coding-Agent-Tools einbindet. + +**Unterstützte Tools** (per Coding Helper): +- [Claude Code](https://claude.com/product/claude-code) (Anthropic) +- [OpenCode](https://opencode.ai) — Open-Source, terminal-basiert +- Crush +- Factory Droid + +**Setup-Schritte** (zusammengefasst): +1. Z.ai Coding Plan abonnieren +2. API-Key in den Plan-Settings erstellen +3. `npx @z_ai/coding-helper` ausführen +4. Im Helper: Ziel-Tool auswählen (z.B. OpenCode, Claude Code) +5. API-Key eingeben → GLM 5.2 ist als Modell verfügbar + +→ **Kernstrategie:** User muss gewohntes Tool nicht wechseln, nur das Modell im Hintergrund austauschen. + +## Live-Tests (von Fabian) + +### Test 1: Flappy Bird (Single-File HTML) + +**Prompt:** "Bau ein komplett funktionierendes Flappy Bird in einer einzelnen HTML-Datei. Keine externen Bibliotheken. Kollisionserkennung, Punktezähler, Start- und Game-Over-Screen." + +**Ergebnis:** +- 481 Zeilen HTML-Code +- **Fertig in 1:20** (überraschend schnell) +- Funktioniert: Scoreboard, Bestenliste, Neustart per Mausklick oder Leertaste +- Game läuft, aber **Gaming-Experience suboptimal** (zu schnell, zu schwer, Runterfallen zu rasant) +- Formfaktor: "praktisch Handy-Format" statt Vollbild + +**Fazit Fabian:** "Ich bin beeindruckt, hat alles funktioniert. Man müsste an der Gaming-Experience feilen." + +### Test 2: Newton-Pendel (Physik-Simulation) + +**Prompt:** "Bau eine realistische Newton-Pendel-Simulation in einer HTML-Datei. Echte Physik: Wenn eine Kugel einschlägt, fliegt auf der anderen Seite genau eine Kugel weg — nicht zwei, nicht drei." + +**Schwierigkeit:** Viele Modelle bauen nur "hübsche Animation" mit allen Kugeln synchron — hier muss echte Physik-Logik implementiert sein. + +**Ergebnis:** +- 9:41 Gesamtdauer (8:27 davon nur Thinking-Process) +- **Lange Wartezeit wegen Light-Plan + Stoßzeit-Last auf Z.ai-Servern** +- **Fertig und funktioniert** (Fabian ist beeindruckt, exakte Physik-Logik umgesetzt) +- Skool-Kommentar (Fabian): "Wenn wir das Modell selbst bezahlen würden, wäre das wahrscheinlich halb so lang" + +**Fazit Fabian:** Modell ist stark, **Plattform drumherum** (Coding Plan) ist der Engpass. + +## Ehrliche Einordnung (Fabian) + +| Dimension | Bewertung | +|---|---| +| Modell-Qualität | **Top** — vergleichbar mit Opus 4.8, Frontier-Niveau | +| Preis | **10× günstiger als Claude** — extrem attraktiv | +| Distribution | **Miserabel** — nur über Coding Plan, nicht auf OpenRouter | +| Open Weights | **MIT-Lizenz** (kommt nächste Woche) — Kimi K2.7 Code macht das genauso | +| Kontext-Fenster | **1M Token** — eine komplette Codebase in einem Rutsch | +| Datenschutz | ⚠️ Daten gehen zu Z.ai-Servern (Code = potenzielles IP) | +| Geschwindigkeit | ⚠️ Light-Plan = lange Wartezeiten, Pro/Max vermutlich besser | +| Limits | ⚠️ "Harte Nutzungslimits, 2-3× Verbrauch in Stoßzeiten" | + +**Fabians Fazit:** "Gutes Modell, schrecklicher Coding-Plan" (zitiert ein Community-Video). Er empfiehlt zu **warten, falls nicht Pro-Plan nötig** — Distribution bessert sich vermutlich bald. + +## Verbindung zu [[concepts/real-world-coding-showdown.md]] + +Das Video von [IAmFabian](https://www.youtube.com/@IchBinFabian) ist eine **vertiefende Einzelprüfung** des Modells, das in der gestrigen [[concepts/real-world-coding-showdown.md]] Head-to-Head gegen Kimi K2.7 antrat: + +| Aspekt | Fabian-Video (14.06.2026) | Fahd-Mirza-Showdown (14.06.2026) | +|---|---|---| +| Fokus | **GLM 5.2 Solo** + Distribution + Preis | **Kimi K2.7 vs GLM 5.2** Head-to-Head | +| Tests | Flappy Bird + Newton-Pendel | World-Cup-Bug-Fix + Siberian-Wind-HTML | +| Methodik | Live-Coding + Community-Inputs | Real-World-Flask-App in Hermes Agent | +| Beide Modelle getestet? | Nur GLM 5.2 | Ja, beide | +| Fazit zu GLM 5.2 | "Top-Modell, schlechter Coding-Plan" | "Strong bei Animation/Detail" (Test 2) | + +**Synergie:** Beide Videos ergänzen sich — Fabian gibt **Preis-/Distributions-Tiefe**, Fahd gibt **Head-to-Head-Vergleich** unter kontrollierten Bedingungen. + +## 🔥 Direkter Implikat für OpenClaw + +**Der [Z.ai Coding Plan](https://z.ai/subscribe) listet explizit `Clawdbot/OpenClaw`** als unterstütztes Agent-Environment:** + +> "Use GLM models like GLM-5.1 & GLM-5-Turbo for AI coding in Claude Code, Kilo Code, Cline, OpenCode, **Clawdbot/OpenClaw** and more. Plans from 18/month." + +→ **Hector/OpenClaw ist namentlich in der Distribution-Strategie von Z.ai referenziert.** Das ist ein direkter Match für die [[architecture/model-routing.md]]-Planung: GLM 5.2 (oder 5.1 als günstigere Variante) als **spezialisierter Coding-Sub-Route** einbindbar, sobald Open Weights verfügbar sind (nächste Woche laut Fabian) oder über Z.ai Coding Plan als API-Alternative. + +**Setup-Vorschlag (zur späteren Diskussion):** +1. Warte auf Open Weights Release (nächste Woche) — Self-Hosting wird möglich +2. Falls schneller gewünscht: Z.ai Coding Plan (Light ~18 USD/Monat) + Coding Helper für schnelles Testing +3. Integration in OpenClaw-Routing als **Sub-Task-spezifischer Side-Branch** für Coding-Tasks +4. Perspektivisch: GLM als **eine der Panel-Stimmen** in [[concepts/llm-model-fusion-ensembles.md]]-Coding-Ensembles + +## Verwandte Wiki-Seiten + +- [[concepts/real-world-coding-showdown.md]] — Kimi K2.7 vs GLM 5.2 Head-to-Head (Vortag) +- [[concepts/llm-model-fusion-ensembles.md]] — Ensemble-Pattern: GLM 5.2 als Panel-Kandidat +- [[concepts/ai-agents-2026.md]] — Agent-Frameworks; OpenClaw namentlich in Z.ai-Liste +- [[tools/kimi-k2.7-code.md]] — direkter Konkurrent (Moonshot AI, ähnliche Strategie) +- [[architecture/model-routing.md]] — Sub-Task-spezifisches Coding-Routing (Kimi / GLM) +- [[concepts/llm-behavior-persistence.md]] — Bias-Persistenz (relevant für jeden Modell-Wechsel) +- [[concepts/llm-knowledge-base.md]] — kuratierte Strukturen schlagen reine Inference + +## Externe Ressourcen + +### Video & Autor + +- [YouTube: GLM 5.2 10x billiger als Claude](https://www.youtube.com/watch?v=bN1QJi26kco) +- [IAmFabian YouTube Channel](https://www.youtube.com/@IchBinFabian) (7.8K Subs) +- [Fabian Instagram](https://www.instagram.com/ichbinfabiande/) +- [Fabian Skool Community (Die KI-Werkstatt)](https://www.skool.com/die-ki-werkstatt-1779) +- [Fabian Beratung / Termin-Buchung](https://ichbinfabian.com/termin) +- [Fabians vorheriges Video zu Kimi K2.7](https://www.youtube.com/watch?v=) +- [Fabians vorheriges Video zu Hermes + Gemma 4](https://www.youtube.com/watch?v=) + +### Modell & Hersteller + +- [Z.ai (Hersteller)](https://z.ai/) +- [Z.ai Coding Plan / Subscribe](https://z.ai/subscribe) +- [Z.ai API Docs](https://docs.z.ai/) +- [Zhipu AI (Mutterkonzern)](https://www.zhipuai.cn/) +- [GLM 5 Open Weights (HuggingFace)](https://huggingface.co/zai-org/GLM-5) +- [GLM-5 Open-Source Guide (nxcode.io)](https://www.nxcode.io/resources/news/glm-5-open-source-744b-model-complete-guide-2026) +- [Truescho Review: GLM Coding Plan 2026](https://truescho.com/en/blog/glm-coding-plan-zai-2026) + +### Coding Helper & unterstützte Tools + +- [Coding Helper NPM Package (@z_ai/coding-helper)](https://www.npmjs.com/package/@z_ai/coding-helper) +- [OpenCode](https://opencode.ai) — Open-Source-Coding-Agent fürs Terminal +- [Claude Code (Anthropic)](https://claude.com/product/claude-code) +- [Cline (VS Code AI Agent)](https://github.com/cline/cline) +- [Kilo Code](https://kilocode.ai/) +- [Factory Droid](https://www.factory.ai/) +- [Crush (Charm)](https://github.com/charmbracelet/crush) + +### Konkurrenz & Kontext + +- [Anthropic Claude Opus 4.8](https://www.anthropic.com/claude) +- [Kimi K2.7 Code (Ollama Cloud)](https://ollama.com/library/kimi-k2.7-code) +- [OpenRouter](https://openrouter.ai/) (wo GLM 5.2 aktuell fehlt) +- [GLM-5.2 auf chat.z.ai](https://chat.z.ai) +- [GLM-Coding-Plan YouTuber "AI Code King" (zitiert in Video)](https://www.youtube.com/results?search_query=AI+Code+King) diff --git a/wiki/architecture/model-routing.md b/wiki/architecture/model-routing.md index 642446b..a093bf0 100644 --- a/wiki/architecture/model-routing.md +++ b/wiki/architecture/model-routing.md @@ -46,4 +46,27 @@ Im Juni 2026 haben sich zwei starke Open-Source-Coding-Modelle aus China etablie Head-to-Head-Vergleich in Hermes Agent: siehe [[real-world-coding-showdown.md]]. -**Implikation für Routing:** In Sub-Task-Spezialisierung (Coding vs. Creative vs. Long-Context) sind beide als Sub-Routing-Knoten sinnvoll — nicht als Ersatz der Primary-Fallback-Chain, sondern als **spezialisierte Side-Branches** für Coding-Tasks. \ No newline at end of file +**Implikation für Routing:** In Sub-Task-Spezialisierung (Coding vs. Creative vs. Long-Context) sind beide als Sub-Routing-Knoten sinnvoll — nicht als Ersatz der Primary-Fallback-Chain, sondern als **spezialisierte Side-Branches** für Coding-Tasks. + +### GLM 5.2 (Z.ai) — 1M Kontext, MIT-Lizenz, 10x günstiger + +Zusätzlich zu Kimi K2.7 ist **GLM 5.2** (Release 13.06.2026) ein zweiter chinesischer Frontier-Coding-Kandidat. Siehe [[glm-5.2-zai-coding-model.md]] für Details. + +**Empfohlene Routing-Position:** + +``` +OpenClaw Primary Routing + ├─ Creative / Long-Context (1M) → GLM 5.2 + ├─ Speed / Innovation Coding → Kimi K2.7 Code + ├─ Standard Tasks → openrouter/auto → ... + └─ Frontier Quality → Claude Opus 4.8 / Fable +``` + +**Drei Setup-Optionen** (Stand 14.06.2026): +1. **Z.ai Coding Plan** (sofort, ab 18 USD/Monat) — via `npx @z_ai/coding-helper`. **Achtung:** Light-Plan hat in Stoßzeiten 2-3× Kontingent-Verbrauch und lange Wartezeiten. +2. **Self-Hosting** (nach Open Weights Release nächste Woche) — MIT-Lizenz, Self-Host via [HuggingFace](https://huggingface.co/zai-org/GLM-5). +3. **Warten** auf OpenRouter-Listing (Tage) — Standard-Routing greift dann automatisch. + +**Ensemble-Kandidat:** GLM 5.2 + Kimi K2.7 als heterogenes Coding-Panel in [[llm-model-fusion-ensembles.md]] (unterschiedliche Architektur: Dense vs MoE, unterschiedliche Stärken). + +**Besonderheit:** [Z.ai Coding Plan](https://z.ai/subscribe) listet `Clawdbot/OpenClaw` namentlich als unterstütztes Environment — direkte Integration bereits vorbereitet. \ No newline at end of file diff --git a/wiki/concepts/glm-5.2-zai-coding-model.md b/wiki/concepts/glm-5.2-zai-coding-model.md new file mode 100644 index 0000000..862cc6d --- /dev/null +++ b/wiki/concepts/glm-5.2-zai-coding-model.md @@ -0,0 +1,229 @@ +--- +created: 2026-06-15 +updated: 2026-06-15 +sources: [youtube/2026-06-15_ichbinfabian-glm-5.2-coding-modell.md] +tags: [concept, glm-5.2, zhipu-ai, z-ai, coding-models, open-source, mit-license, coding-plan, opencode, claude-code, agentic-coding, price-comparison, china-ai] +--- + +# GLM 5.2 (Z.ai) — Chinese Frontier Coding Model, 10× günstiger als Claude + +> **Quelle des Konzepts:** YouTube-Video "Chinas neues GLM 5.2: So gut ist das billige Coding-Modell" (IAmFabian, 14.06.2026, 13:15 Min, 212 Aufrufe, 16 Likes). Geteilt von @PWeber (Kai) in OME-Gruppe "News & Infos (X/YT/Substack etc.)"-Topic. + +## Kernidee + +**Chinas Frontier-Coding-Modelle erreichen 2026 Frontier-Niveau bei einem Bruchteil der Preise** — aber die Distribution-Realität ist noch holprig. GLM 5.2 ist das prominenteste Beispiel: 1M Kontext, MIT-Lizenz, mit Opus 4.8 vergleichbar — **aber Stand 14.06.2026 nur über Z.ai Coding Plan zugänglich**, nicht auf OpenRouter oder via Standard-API. + +## Das Modell im Überblick + +| Eigenschaft | Detail | +|---|---| +| **Hersteller** | [Z.ai](https://z.ai/) (Zhipu AI) | +| **Generation** | 5.2 — Vorgänger: GLM 5.0 (Feb 2026), GLM 5.1 (Mär 2026) | +| **Release-Datum** | 13.06.2026 | +| **Kontext** | **1M Token** (Vorgänger: 200K → 5× größer) | +| **Denkstufen** | "High" und "Max" (Thinking Mode) | +| **Open Weights** | **MIT-Lizenz**, Release "nächste Woche" (Stand 14.06.2026) | +| **Preis** | ab **18 USD/Monat** (Light Plan) — ca. 10× günstiger als Claude | +| **Vergleich zu Anthropic** | Ziel: "gegen Claude Opus 4.8 antreten" — laut [AI Code King](https://www.youtube.com/results?search_query=AI+Code+King)-Benchmarks nur 6% unter Opus 4.8 / Fable | + +**Release-Kadenz:** Drei Frontier-Generationen in 4 Monaten — schnellster chinesischer Modell-Zyklus 2026. + +## Die Distributions-Realität: Z.ai Coding Plan + +**Stand 14.06.2026:** GLM 5.2 ist **exklusiv** über [Z.ai Coding Plan](https://z.ai/subscribe) verfügbar — nicht auf OpenRouter, nicht via Standard-API. + +### Coding Plan Architektur + +| Plan | Preis | Nutzungs-Limit | Server-Priorität | +|---|---|---|---| +| **Light** | ab 18 USD/Monat | mehr als Codex/Claude Code | **niedrig** (Wartezeiten) | +| **Pro/Max** | höher | deutlich mehr | höher | + +**Problem:** Light-Plan hat in Stoßzeiten **2-3× Mehrverbrauch am Kontingent** und stark schwankende Geschwindigkeit. Fabian zitiert Community: "Gutes Modell, schrecklicher Coding-Plan." + +**Erwartung:** OpenRouter-Listing + Standard-API-Zugang in den nächsten Tagen (per Fabian-Spekulation). + +### Setup via Coding Helper + +Z.ai bietet ein **Coding Helper** Tool ([`npx @z_ai/coding-helper`](https://www.npmjs.com/package/@z_ai/coding-helper)), das GLM 5.2 in bestehende Coding-Agent-Umgebungen einbindet: + +| Tool | Status | +|---|---| +| [OpenCode](https://opencode.ai) | ✅ Open-Source, terminal-basiert | +| [Claude Code](https://claude.com/product/claude-code) | ✅ Anthropic | +| [Cline](https://github.com/cline/cline) | ✅ VS Code AI Agent | +| [Kilo Code](https://kilocode.ai/) | ✅ | +| [Crush](https://github.com/charmbracelet/crush) | ✅ Charm | +| [Factory Droid](https://www.factory.ai/) | ✅ | +| **Clawdbot/OpenClaw** | ✅ **explizit gelistet** | + +**Strategie:** User wechselt das Coding-Tool nicht, nur das Modell im Hintergrund. + +## Live-Tests (IAmFabian, 14.06.2026) + +### Test 1: Flappy Bird (Single-File HTML, kein externes Lib) + +**Prompt:** Komplettes Flappy Bird in einer HTML-Datei. Kollisionserkennung, Punktezähler, Start/Game-Over. + +**Ergebnis:** +- 481 Zeilen HTML +- **1:20 Minuten** Generierungszeit +- ✅ Funktioniert: Scoreboard, Bestenliste, Neustart (Maus + Leertaste) +- ⚠️ Game-Experience suboptimal (zu schnell, zu schwer) + +### Test 2: Newton-Pendel (Echte Physik) + +**Prompt:** Realistische Newton-Pendel-Simulation. Wenn eine Kugel einschlägt, **genau eine** auf der anderen Seite — nicht zwei, nicht drei. + +**Schwierigkeit:** Viele Modelle bauen nur "hübsche Animation" mit synchron schwingenden Kugeln. Hier muss **echte Physik-Logik** implementiert sein. + +**Ergebnis:** +- **9:41 Minuten** (8:27 davon nur Thinking-Process) +- Lange Wartezeit wegen Light-Plan + Server-Last +- ✅ Fertig, Physik korrekt umgesetzt + +**Lesson:** "Wenn wir das Modell selbst bezahlen würden (d.h. via OpenRouter mit eigener API), wäre das wahrscheinlich halb so lang" — die Coding-Plan-Wartezeit ist der Engpass, nicht die Modell-Qualität. + +## Ehrliche Einordnung (Pro & Contra) + +| Dimension | Bewertung | +|---|---| +| Modell-Qualität | ✅ **Top** — Frontier-Niveau, vergleichbar mit Opus 4.8 | +| Preis | ✅ **10× günstiger** als Claude | +| Kontext-Fenster | ✅ **1M Token** — komplette Codebase in einem Rutsch | +| Open Weights | ✅ **MIT-Lizenz** (kommt nächste Woche) | +| Distribution | ❌ **Miserabel** — nur Coding Plan, nicht auf OpenRouter | +| Geschwindigkeit | ⚠️ Light-Plan = lange Wartezeiten | +| Limits | ⚠️ Harte Nutzungslimits, Stoßzeit-Schwankungen | +| Datenschutz | ⚠️ Code geht zu Z.ai-Servern — potenzielles IP-Risiko | + +**Fabians Fazit:** Modell ist top, **Plattform drumherum** ist der Engpass. Warten, falls nicht Pro-Plan nötig. + +## Verbindung zu [[concepts/real-world-coding-showdown.md]] + +Zwei Videos vom **selben Tag (14.06.2026)**, **komplementär**: + +| Aspekt | IAmFabian (GLM 5.2 Solo) | Fahd Mirza (Kimi K2.7 vs GLM 5.2) | +|---|---|---| +| Fokus | GLM 5.2 Distribution + Preis | Head-to-Head GLM 5.2 vs Kimi K2.7 | +| Tests | Flappy Bird + Newton-Pendel | World-Cup-Bug-Fix + Siberian-Wind-HTML | +| Beide Modelle getestet? | Nein (nur GLM 5.2) | Ja, beide | +| Mehraufwand | Distribution-Realität, Community-Inputs, Pricing-Tiefe | Modell-Vergleich unter kontrollierten Bedingungen | + +**Synergie für die Wiki-Leser:** +- Wer **GLM 5.2 isoliert verstehen** will → IAmFabian +- Wer **GLM 5.2 vs Kimi K2.7 vergleichen** will → Fahd Mirza + [[concepts/real-world-coding-showdown.md]] +- Wer **Infrastruktur/Preis** verstehen will → IAmFabian + [Z.ai Subscribe](https://z.ai/subscribe) + +## 🔥 Direkter Implikat für OpenClaw + +### 1. Z.ai Coding Plan listet OpenClaw namentlich + +> [Z.ai Coding Plan](https://z.ai/subscribe) Werbetext: "Use GLM models like GLM-5.1 & GLM-5-Turbo for AI coding in Claude Code, Kilo Code, Cline, OpenCode, **Clawdbot/OpenClaw** and more." + +→ **Hector/OpenClaw ist namentlich in der Distribution-Strategie von Z.ai.** Konkrete Integrationsoptionen existieren bereits. + +### 2. Konkrete Setup-Pfade + +**Option A — Z.ai Coding Plan (sofort):** +1. Light-Plan abonnieren (~18 USD/Monat) +2. API-Key erstellen +3. `npx @z_ai/coding-helper` ausführen, OpenClaw als Ziel wählen +4. GLM 5.2 ist als Modell verfügbar + +**Option B — Self-Hosting (nach Open Weights Release nächste Woche):** +1. GLM 5.2 Open Weights von [HuggingFace](https://huggingface.co/zai-org/GLM-5) ziehen +2. Lokal hosten (ggf. quantisiert) +3. OpenClaw-Routing um GLM-Coding-Branch erweitern + +**Option C — Warten:** OpenRouter-Listing in den nächsten Tagen erwartet → Standard-OpenClaw-Routing greift automatisch. + +### 3. Sub-Task-spezifisches Routing + +Siehe [[architecture/model-routing.md]]. Empfohlene Position für GLM 5.2: + +``` +OpenClaw Primary Routing + ├─ Creative / Long-Context (1M) → GLM 5.2 + ├─ Speed / Innovation Coding → Kimi K2.7 Code + ├─ Standard Tasks → openrouter/auto → ... + └─ Frontier Quality → Claude Opus 4.8 / Fable +``` + +### 4. Ensemble-Kandidat für [[concepts/llm-model-fusion-ensembles.md]] + +GLM 5.2 (oder 5.1 als günstigere Variante) ist ein **natürlicher Panel-Kandidat** für Coding-Fusion-Ensembles — besonders in Kombination mit Kimi K2.7 (unterschiedliche Architektur: Dense vs MoE, unterschiedliche Stärken). + +## Pro-Leben-Perspektive + +Gemäß [[concepts/pro-leben-directive.md]]: + +**Gegen Mangelnarrativ** ("US-Frontier-Modelle alternativlos"): +- 2026 ist das Jahr, in dem **chinesische Open-Source-Coding-Modelle** (Kimi K2.7, GLM 5.2) **Frontier-Nähe** bei **Bruchteil-Preisen** erreichen +- MIT-Lizenz für GLM 5.2 (Open Weights) ist handfeste Offenheit — Kimi K2.7 Code macht das ebenfalls +- **Wettbewerb** belebt das Feld: OpenAI, Anthropic, Moonshot, Zhipu — alle puschen + +**Für Handlungsfähigkeit:** +- Wer heute Coding-Agents baut, kann **zwischen Frontier-Niveau und 10× niedrigeren Kosten wählen** — je nach Anwendungsfall +- Coding Plan + Coding Helper = **5-Minuten-Setup** für OpenClaw +- Open Weights (nächste Woche) = **Self-Hosting** wird möglich → Datenschutz-kritische Use-Cases lösbar + +**Realismus:** +- "10× günstiger" gilt **nur** mit Light-Plan-Einschränkungen (Geschwindigkeit, Limits) +- Pro/Max-Plan dürfte näher an Claude-Preisen liegen (genaue Preise fehlen im Video) +- **Datenschutz**: Code zu Z.ai-Servern — für sensible Projekte problematisch → Self-Hosting oder lokale Modelle vorziehen +- 1M Kontext ist Marketing-Argument, aber die meisten Coding-Tasks brauchen 256K nicht aus +- AI-Code-King-Benchmark behauptet 6% unter Opus 4.8 — **eigene Tests** sind Pflicht (Fabians Tests bestätigen das grob) + +## Verwandte Wiki-Seiten + +- [[concepts/real-world-coding-showdown.md]] — Kimi K2.7 vs GLM 5.2 Head-to-Head (Vortag) +- [[concepts/llm-model-fusion-ensembles.md]] — Ensemble-Pattern mit GLM 5.2 als Panel-Kandidat +- [[concepts/ai-agents-2026.md]] — Agent-Frameworks; OpenClaw namentlich in Z.ai-Liste +- [[concepts/llm-behavior-persistence.md]] — Bias-Persistenz bei Modell-Wechsel +- [[tools/kimi-k2.7-code.md]] — direkter Konkurrent +- [[tools/anthropic-claude.md]] — Frontier-Konkurrenz (Opus 4.8) +- [[architecture/model-routing.md]] — Sub-Task-Routing-Plan +- [[concepts/llm-knowledge-base.md]] — kuratierte Strukturen + +## Externe Ressourcen + +### Video & Autor + +- [YouTube: GLM 5.2 — 10× billiger als Claude](https://www.youtube.com/watch?v=bN1QJi26kco) +- [IAmFabian YouTube Channel](https://www.youtube.com/@IchBinFabian) (7.8K Subs) +- [Fabian Instagram](https://www.instagram.com/ichbinfabiande/) +- [Fabian Skool Community](https://www.skool.com/die-ki-werkstatt-1779) +- [Fabian Beratung / Termin](https://ichbinfabian.com/termin) +- [Fabian: Kimi K2.7 Live-Test](https://www.youtube.com/watch?v=) (Vortag) +- [Fabian: Hermes + Gemma 4 lokal](https://www.youtube.com/watch?v=) + +### Modell & Hersteller + +- [Z.ai (Hersteller)](https://z.ai/) +- [Z.ai Coding Plan / Subscribe](https://z.ai/subscribe) +- [Z.ai API Docs](https://docs.z.ai/) +- [Zhipu AI (Mutterkonzern)](https://www.zhipuai.cn/) +- [GLM 5 Open Weights (HuggingFace)](https://huggingface.co/zai-org/GLM-5) +- [GLM-5 Open-Source Guide (nxcode.io)](https://www.nxcode.io/resources/news/glm-5-open-source-744b-model-complete-guide-2026) +- [GLM 5.2 auf chat.z.ai](https://chat.z.ai) +- [Truescho Review: GLM Coding Plan 2026](https://truescho.com/en/blog/glm-coding-plan-zai-2026) +- [GLM-5 Breakdown (Fahd Mirza, 1M Context Video)](https://www.youtube.com/watch?v=ONBtSnPZGVk) + +### Coding Helper & Tools + +- [@z_ai/coding-helper (NPM)](https://www.npmjs.com/package/@z_ai/coding-helper) +- [OpenCode (Open-Source-Coding-Agent)](https://opencode.ai) +- [Claude Code (Anthropic)](https://claude.com/product/claude-code) +- [Cline (VS Code AI Agent)](https://github.com/cline/cline) +- [Kilo Code](https://kilocode.ai/) +- [Factory Droid](https://www.factory.ai/) +- [Crush (Charm)](https://github.com/charmbracelet/crush) + +### Konkurrenz & Kontext + +- [Anthropic Claude](https://www.anthropic.com/claude) +- [Kimi K2.7 Code (Ollama Cloud)](https://ollama.com/library/kimi-k2.7-code) +- [OpenRouter](https://openrouter.ai/) (wo GLM 5.2 aktuell fehlt) +- [Moonshot AI](https://www.moonshot.cn/) +- [Open LLM Leaderboard (HuggingFace)](https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard) diff --git a/wiki/index.md b/wiki/index.md index 199bf3b..4228ead 100644 --- a/wiki/index.md +++ b/wiki/index.md @@ -2,7 +2,7 @@ *Auto-generated: 2026-06-15* -*Letzte Aktualisierung: 2026-06-15 (6. Update)* +*Letzte Aktualisierung: 2026-06-15 (7. Update)* ## Architecture @@ -39,6 +39,7 @@ | [LLM Behavior Persistence](concepts/llm-behavior-persistence.md) | Sleeper Agents, Backdoor-Persistenz, Unlearning-Grenzen, Bias-Transfer, Catastrophic Forgetting | xpost/2026-06-14_lieselweppen-open-source-llm-backdoors.md | | [LLM Model Fusion & Ensembles](concepts/llm-model-fusion-ensembles.md) | OpenRouter Fusion, DRACO-Benchmark, Model-Panels, Self-Fusion, Budget-Panels, Anti-Contamination | blog/2026-06-12_openrouter-fusion-beats-frontier.md | | [Real-World Coding Showdown](concepts/real-world-coding-showdown.md) | Head-to-Head-Methodik jenseits statischer Benchmarks, Kimi K2.7 vs GLM-5.2 in Hermes Agent, Sub-Task-Spezialisierung | youtube/2026-06-14_fahd-mirza-kimi-k2.7-vs-glm-5.2.md | +| [GLM 5.2 (Z.ai) — Chinese Frontier Coding Model](concepts/glm-5.2-zai-coding-model.md) | 10x günstiger als Claude, 1M Kontext, MIT-Lizenz, Z.ai Coding Plan, OpenClaw namentlich gelistet | youtube/2026-06-15_ichbinfabian-glm-5.2-coding-modell.md | ## Decisions @@ -70,3 +71,4 @@ | `raw/xpost/2026-06-14_lieselweppen-open-source-llm-backdoors.md` | xpost | Liesel Weppen: Open Source bei LLMs ist "Marketing BS" — Belege aus Sleeper-Agent-/Unlearning-Forschung | | `raw/blog/2026-06-12_openrouter-fusion-beats-frontier.md` | blog | OpenRouter Fusion: Surpassing Frontier Performance with Model Panels (DRACO-Benchmark) | | `raw/youtube/2026-06-14_fahd-mirza-kimi-k2.7-vs-glm-5.2.md` | youtube | Fahd Mirza: Kimi K2.7 vs GLM-5.2 Real Coding Showdown in Hermes Agent | +| `raw/youtube/2026-06-15_ichbinfabian-glm-5.2-coding-modell.md` | youtube | IAmFabian: GLM 5.2 — 10x billiger als Claude, Coding-Plan-Realität, Live-Tests | diff --git a/wiki/log.md b/wiki/log.md index 5e5cee6..36d456e 100644 --- a/wiki/log.md +++ b/wiki/log.md @@ -182,3 +182,22 @@ - Kimi K2.7: schnell (~5 Min), innovativ; GLM-5.2: stark bei Animation/Detail, 1M Kontext, MIT-Lizenz - "Neck to neck" = beide production-ready, aber Sub-Task-spezifisch optimal - Direkter Implikat für OpenClaw: Sub-Task-Routing für Coding-Tasks, Ensemble-Pattern mit Coding-Modellen, Real-World-Validierung statt nur Standard-Benchmarks + +## [2026-06-15] Ingest | GLM 5.2 von Z.ai: 10x billiger als Claude, Coding-Plan-Realität +**Type:** ingest | **Scope:** raw/youtube, wiki/concepts, wiki/architecture +**Source:** @PWeber (Kai) in OME-Gruppe "News & Infos (X/YT/Substack etc.)"-Topic +**Actions:** +- raw: `raw/youtube/2026-06-15_ichbinfabian-glm-5.2-coding-modell.md` (created — IAmFabian YouTube-Video 14.06.2026, 13:15 Min, 212 Aufrufe, 16 Likes; Deep-Dive auf GLM 5.2 Distribution + Pricing + ehrliche Live-Tests) +- wiki: `concepts/glm-5.2-zai-coding-model.md` (created — Konzeptseite zu GLM 5.2: Release-Tempo (3 Generationen in 4 Monaten), 1M Kontext, MIT-Lizenz (kommt nächste Woche), Z.ai Coding Plan als Distributions-Realität, Live-Tests Flappy Bird + Newton-Pendel, Pro/Contra, Verbindung zu real-world-coding-showdown, **kritischer Implikat: Z.ai Coding Plan listet Clawdbot/OpenClaw namentlich**) +- wiki: `architecture/model-routing.md` (updated — Empfohlene GLM 5.2 Position im Sub-Task-Routing: Creative/Long-Context, 1M Kontext; 3 Setup-Optionen: Coding Plan / Self-Hosting / Warten auf OpenRouter) +- index: updated (neuer Concepts-Eintrag "GLM 5.2 (Z.ai) — Chinese Frontier Coding Model" + Raw Sources-Eintrag) +- log: updated +**Kernkonzepte:** +- Chinas Frontier-Coding-Modelle erreichen 2026 Frontier-Niveau bei 10x niedrigeren Preisen +- GLM 5.2: 1M Kontext, MIT-Lizenz, mit Opus 4.8 vergleichbar (laut AI Code King Benchmarks) +- Z.ai Coding Plan als exklusiver Distributions-Weg (Stand 14.06.2026) — nicht auf OpenRouter +- Light-Plan = schlechte Performance in Stoßzeiten, Pro/Max vermutlich näher an Claude-Preisen +**Kritische Implikation für OpenClaw:** +- Z.ai Coding Plan listet `Clawdbot/OpenClaw` namentlich als unterstütztes Environment +- Drei Setup-Optionen: Coding Plan (sofort, 18 USD/Monat) / Self-Hosting (nach Open Weights nächste Woche) / Warten auf OpenRouter-Listing +- Empfohlene Routing-Position: Creative/Long-Context (1M) + Ensemble-Panel-Kandidat mit Kimi K2.7