knowledge-base/wiki/concepts/llm/glm-5.3-z-ai.md

58 lines
4 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

---
created: 2026-08-14
updated: 2026-08-14
sources: [youtube/2026-08-14_glm-5.3-aicodeking.md]
tags: [concept, glm-5.3, z-ai, zhipu-ai, coding-models, chinese-ai, benchmarks, aicodeking]
---
# GLM 5.3 (Z.ai) — Neue Generation der GLM-Serie
> **Quelle des Konzepts:** YouTube-Video "GLM-5.3 (Fully Tested): I GOT EARLY ACCESS & IT'S #1 ON MY BENCH!" (AICodeKing, 2026-08-14). Geteilt von @PWeber (Kai) in OME-Gruppe "News & Infos (X/YT/Substack etc.)"-Topic.
## Kernidee
**AICodeKing hat Early Access zu GLM 5.3 erhalten und platziert es auf Platz #1 seines eigenen Benchmarks** ("I GOT EARLY ACCESS & IT'S #1 ON MY BENCH!"). GLM 5.3 ist eine neue Generation der GLM-Serie von [[../../institutions/z-ai.md|Z.ai (Zhipu AI)]].
## Einordnung in die GLM-Familie
| Generation | Release | Kontext | Quelle |
|---|---|---|---|
| GLM 5.0 | Feb 2026 | Vorgänger | — |
| GLM 5.1 | Mär 2026 | Vorgänger | — |
| **GLM 5.2** | 13.06.2026 | 1M Kontext, MIT-Lizenz, 10× günstiger als Claude | [[glm-5.2-zai-coding-model.md]] |
| **GLM 5.3** | getestet Aug 2026 | Early Access, AICodeKing-Benchmark #1 | diese Seite |
| GLM 5.5 | angekündigt 20.07.2026 | >1 Bio. Parameter, 1M Kontext, Launch erwartet Aug 2026 | [[glm-5.5-z-ai.md]] |
**Release-Kadenz:** Vier Generationen in ~7 Monaten — die schnellste Frontier-Modell-Kadenz der Branche. GLM 5.2 und 5.3 überschneiden sich mit dem angekündigten GLM 5.5 (mehrere Parallel-Tracks bei Z.ai).
## Einordnung
- **"Fully Tested"-Review** von AICodeKing — gleicher Kanal wie das DeepSeek-V4-Pro-0813-Review ([[../../people/aicodeking.md|AICodeKing]])
- Titel behauptet **Platz #1 auf AICodeKings eigenem Benchmark** — deutet auf starke Coding-Performance
- **Early Access** — GLM 5.3 war zum Zeitpunkt des Videos noch nicht öffentlich breit verfügbar
- Verortung in der chinesischen Open-Weight-Welle ([[../chinese-ai-wave-july-2026.md]])
## Konkrete Bench-Zahlen (nachgezogen 2026-08-14)
> Quelle: HermanButlerBot-Zusammenfassung in OME Topic 13 (2026-08-14), basierend auf AICodeKings Video. Original-Transkript nicht abrufbar (Bot-Cookies).
| Bench | Ergebnis | Kontext |
|---|---|---|
| **Kingbench 3** | **73/80 = 91,25% → Platz 1** | über Fable 5 (82,5), Kimi K3 + Opus 5 (je 77,5). GLM 5.2 lag vor 2 Monaten bei 75% — Sprung **75 → 91,25** bei gleichen Parametern |
**Kernbefunde des Reviews:**
- **Security-Spezialisierung als Booster:** Wer Code auditieren kann, versteht Code tief — zeigte sich im gesamten Coding-Bench.
- **"Open-Source Shield Initiative":** Defensive Fähigkeiten offen, gefährliche Seite per Layered Safeguards / Trusted Access gegated — vom Reviewer als vernünftig für ein Open Model bewertet.
- **Bench-Highlights:** Kontaktlinsen-Behälter in 3JS (3→8), Klapptisch (10, schlägt Fable), Panda-SVG (10, "bestes Panda-Burger-SVG ever"), autonomes Feintuning einer Gemma 2B inkl. Web-UI (10), schwerste Aufgabe — funktionierende 3D-GMT-Uhr mit Echtzeit-Zeigern (7, bestes je vergebenes; Fable: 4, Opus 5: 3).
- **Ehrliches Fazit:** schlägt Fable in den meisten Fällen; Fable behält Vorteile bei extrem langen, komplexen Horizonten. Frontend UND Backend stark — für ein Open Model ungewöhnlich ("UI sieht nicht nach 2023 aus").
**Warum es zählt:** 2 Monate zwischen Releases, gleiche Architektur, trotzdem großer Sprung — plus ein chinesisches Open Model, das auf einem Coding-Bench die Frontier-Labs schlägt. Setzt US-Labore unter Druck.
## Relevanz für Hectors Stack
- **GLM-5.2 ist das Primary-Modell** in OpenClaw (`ollama/glm-5.2:cloud`) — GLM 5.3 ist die natürliche Nachfolgegeneration
- Falls GLM 5.3 über Ollama Cloud / Z.ai verfügbar wird, könnte es das Routing-Konzept ([[../../architecture/model-routing.md]]) erweitern
## Offene Punkte
- ⚠️ Ursprünglich: konkrete Benchmark-Zahlen fehlten (Transkript nicht abrufbar). **Update 2026-08-14:** nachgezogen via HermanButlerBot-Zusammenfassung — siehe Bench-Tabelle oben. Falls AICodeKings Zahlen in der Zusammenfassung unvollständig/unpräzise sind, bei Gelegenheit am Original-Transkript verifizieren.