knowledge-base/wiki/concepts/llm/chinese-models-top-usage-charts.md

53 lines
2.9 KiB
Markdown
Raw Permalink Normal View History

---
created: 2026-08-14
updated: 2026-08-14
sources: [other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md]
tags: [concept, chinese-ai, usage-charts, token-usage, openrouter, kimi-k3, deepseek-v4-flash, moonshot-ai, market-share, chinese-ai-wave]
institutions: [moonshot-ai, deepseek]
---
# Chinesische Modelle räumen global die Usage-Charts ab
> **Quelle:** Perplexity-Search-Link (2026-08-14, geteilt von @PWeber/Kai in OME Topic 13). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (OpenRouter-Daten, CGTN, Pandaily) rekonstruiert.
## Kernidee
**Chinesische Modelle dominieren nicht nur Benchmarks, sondern die reale globale Token-Nutzung** — der Kimi-K3-Schock von Juli hallt nach und hat sich in Marktanteile übersetzt.
## Kernfakten (OpenRouter-Daten)
- **Top-5 der wöchentlichen Token-Nutzung (28.07.03.08.2026):** Chinesische Modelle belegen **alle fünf Plätze**
- **Gemeinsam verarbeitet:** **56,8 Billionen Tokens** in dieser Woche
- **15 Wochen in Folge:** Chinesische Modelle führen die globale Token-Nutzung an
- **DeepSeek-V4-Flash:** Platz 1 mit substanziellem WoW-Wachstum (Stand Anfang August 2026)
## Kimi-K3-Schock (Juli 2026)
- **Kimi K3** (Moonshot AI): API-Zugang 16.07.2026, volle Weights 27.07.2026
- **2,8 Billionen Parameter** — größtes je veröffentlichtes Open-Weight-Modell, erstes in der 3-Billionen-Klasse
- **Fähigkeiten:** Advanced Reasoning, Coding, agentic work, native visuelle Verständnis, >1M Token Kontext
- **Benchmark-Überraschung:** Hoch bei unabhängigen Benchmarks, dabei kostengünstiger als Claude Fable und GPT-5.6 Sol
- **Kapazitäts-Kollaps:** Moonshot stoppte neue Subscriptions innerhalb von 48h (GPU-Kapazität erschöpft)
- **Markt-Wirkung:** "Rattled" OpenAI und Anthropic; **PHLX-Semi-Index 20%**; Rufe nach mehr offenen US-Modellen
## Einordnung in die chinesische Open-Weight-Welle
| Datum | Release | Anbieter |
|---|---|---|
| 13.08.2026 | DeepSeek V4-Pro GA + Harness v0.1 | DeepSeek ([[deepseek-v4-pro-ga-harness-open-source.md]]) |
| 14.08.2026 | GLM-5.3 Review (AICodeKing Bench #1) | Z.ai ([[glm-5.3-z-ai.md]]) |
| 14.08.2026 | Qwen3.8-27B Release | Alibaba ([[qwen3.8-27b-alibaba.md]]) |
| laufend | **Globale Usage-Charts: Top-5 chinesisch** | DeepSeek/Moonshot u.a. (diese Seite) |
**Vierter Baustein in 24h** — jetzt auf Marktanteils-Ebene, nicht nur Qualität ([[../chinese-ai-wave-july-2026.md]]).
## Relevanz für Hectors Stack
- **DeepSeek-V4-Flash = Platz 1 der Usage-Charts** — DeepSeek ist in Hectors Setup ([[../../tools/ollama-cloud-deepseek-v4-flash-200tps-zdr.md]])
- **Kimi K3:** Volle Modell-Seite unter [[kimi-k3.md]]
- **Marktanteil vs. Qualität:** Chinesische Modelle gewinnen reale Nutzung — wirtschaftlicher Hebel, nicht nur Benchmark-Siege
## Offene Punkte
- ⚠️ Perplexity-Search-Inhalt nicht direkt abrufbar — über Web-Suche (OpenRouter/CGTN/Pandaily) rekonstruiert. Konkrete Chart-Details bei Gelegenheit am Original verifizieren.