4 KiB
| created | updated | sources | tags | |||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 2026-08-14 | 2026-08-14 |
|
|
GLM 5.3 (Z.ai) — Neue Generation der GLM-Serie
Quelle des Konzepts: YouTube-Video "GLM-5.3 (Fully Tested): I GOT EARLY ACCESS & IT'S #1 ON MY BENCH!" (AICodeKing, 2026-08-14). Geteilt von @PWeber (Kai) in OME-Gruppe "News & Infos (X/YT/Substack etc.)"-Topic.
Kernidee
AICodeKing hat Early Access zu GLM 5.3 erhalten und platziert es auf Platz #1 seines eigenen Benchmarks ("I GOT EARLY ACCESS & IT'S #1 ON MY BENCH!"). GLM 5.3 ist eine neue Generation der GLM-Serie von ../../institutions/z-ai.md.
Einordnung in die GLM-Familie
| Generation | Release | Kontext | Quelle |
|---|---|---|---|
| GLM 5.0 | Feb 2026 | Vorgänger | — |
| GLM 5.1 | Mär 2026 | Vorgänger | — |
| GLM 5.2 | 13.06.2026 | 1M Kontext, MIT-Lizenz, 10× günstiger als Claude | glm-5.2-zai-coding-model.md |
| GLM 5.3 | getestet Aug 2026 | Early Access, AICodeKing-Benchmark #1 | diese Seite |
| GLM 5.5 | angekündigt 20.07.2026 | >1 Bio. Parameter, 1M Kontext, Launch erwartet Aug 2026 | glm-5.5-z-ai.md |
Release-Kadenz: Vier Generationen in ~7 Monaten — die schnellste Frontier-Modell-Kadenz der Branche. GLM 5.2 und 5.3 überschneiden sich mit dem angekündigten GLM 5.5 (mehrere Parallel-Tracks bei Z.ai).
Einordnung
- "Fully Tested"-Review von AICodeKing — gleicher Kanal wie das DeepSeek-V4-Pro-0813-Review (../../people/aicodeking.md)
- Titel behauptet Platz #1 auf AICodeKings eigenem Benchmark — deutet auf starke Coding-Performance
- Early Access — GLM 5.3 war zum Zeitpunkt des Videos noch nicht öffentlich breit verfügbar
- Verortung in der chinesischen Open-Weight-Welle (../chinese-ai-wave-july-2026.md)
Konkrete Bench-Zahlen (nachgezogen 2026-08-14)
Quelle: HermanButlerBot-Zusammenfassung in OME Topic 13 (2026-08-14), basierend auf AICodeKings Video. Original-Transkript nicht abrufbar (Bot-Cookies).
| Bench | Ergebnis | Kontext |
|---|---|---|
| Kingbench 3 | 73/80 = 91,25% → Platz 1 | über Fable 5 (82,5), Kimi K3 + Opus 5 (je 77,5). GLM 5.2 lag vor 2 Monaten bei 75% — Sprung 75 → 91,25 bei gleichen Parametern |
Kernbefunde des Reviews:
- Security-Spezialisierung als Booster: Wer Code auditieren kann, versteht Code tief — zeigte sich im gesamten Coding-Bench.
- "Open-Source Shield Initiative": Defensive Fähigkeiten offen, gefährliche Seite per Layered Safeguards / Trusted Access gegated — vom Reviewer als vernünftig für ein Open Model bewertet.
- Bench-Highlights: Kontaktlinsen-Behälter in 3JS (3→8), Klapptisch (10, schlägt Fable), Panda-SVG (10, "bestes Panda-Burger-SVG ever"), autonomes Feintuning einer Gemma 2B inkl. Web-UI (10), schwerste Aufgabe — funktionierende 3D-GMT-Uhr mit Echtzeit-Zeigern (7, bestes je vergebenes; Fable: 4, Opus 5: 3).
- Ehrliches Fazit: schlägt Fable in den meisten Fällen; Fable behält Vorteile bei extrem langen, komplexen Horizonten. Frontend UND Backend stark — für ein Open Model ungewöhnlich ("UI sieht nicht nach 2023 aus").
Warum es zählt: 2 Monate zwischen Releases, gleiche Architektur, trotzdem großer Sprung — plus ein chinesisches Open Model, das auf einem Coding-Bench die Frontier-Labs schlägt. Setzt US-Labore unter Druck.
Relevanz für Hectors Stack
- GLM-5.2 ist das Primary-Modell in OpenClaw (
ollama/glm-5.2:cloud) — GLM 5.3 ist die natürliche Nachfolgegeneration - Falls GLM 5.3 über Ollama Cloud / Z.ai verfügbar wird, könnte es das Routing-Konzept (../../architecture/model-routing.md) erweitern
Offene Punkte
- ⚠️ Ursprünglich: konkrete Benchmark-Zahlen fehlten (Transkript nicht abrufbar). Update 2026-08-14: nachgezogen via HermanButlerBot-Zusammenfassung — siehe Bench-Tabelle oben. Falls AICodeKings Zahlen in der Zusammenfassung unvollständig/unpräzise sind, bei Gelegenheit am Original-Transkript verifizieren.