knowledge-base/wiki/concepts/llm/chinese-models-top-usage-charts.md

52 lines
2.9 KiB
Markdown
Raw Permalink Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

---
created: 2026-08-14
updated: 2026-08-14
sources: [other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md]
tags: [concept, chinese-ai, usage-charts, token-usage, openrouter, kimi-k3, deepseek-v4-flash, moonshot-ai, market-share, chinese-ai-wave]
institutions: [moonshot-ai, deepseek]
---
# Chinesische Modelle räumen global die Usage-Charts ab
> **Quelle:** Perplexity-Search-Link (2026-08-14, geteilt von @PWeber/Kai in OME Topic 13). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (OpenRouter-Daten, CGTN, Pandaily) rekonstruiert.
## Kernidee
**Chinesische Modelle dominieren nicht nur Benchmarks, sondern die reale globale Token-Nutzung** — der Kimi-K3-Schock von Juli hallt nach und hat sich in Marktanteile übersetzt.
## Kernfakten (OpenRouter-Daten)
- **Top-5 der wöchentlichen Token-Nutzung (28.07.03.08.2026):** Chinesische Modelle belegen **alle fünf Plätze**
- **Gemeinsam verarbeitet:** **56,8 Billionen Tokens** in dieser Woche
- **15 Wochen in Folge:** Chinesische Modelle führen die globale Token-Nutzung an
- **DeepSeek-V4-Flash:** Platz 1 mit substanziellem WoW-Wachstum (Stand Anfang August 2026)
## Kimi-K3-Schock (Juli 2026)
- **Kimi K3** (Moonshot AI): API-Zugang 16.07.2026, volle Weights 27.07.2026
- **2,8 Billionen Parameter** — größtes je veröffentlichtes Open-Weight-Modell, erstes in der 3-Billionen-Klasse
- **Fähigkeiten:** Advanced Reasoning, Coding, agentic work, native visuelle Verständnis, >1M Token Kontext
- **Benchmark-Überraschung:** Hoch bei unabhängigen Benchmarks, dabei kostengünstiger als Claude Fable und GPT-5.6 Sol
- **Kapazitäts-Kollaps:** Moonshot stoppte neue Subscriptions innerhalb von 48h (GPU-Kapazität erschöpft)
- **Markt-Wirkung:** "Rattled" OpenAI und Anthropic; **PHLX-Semi-Index 20%**; Rufe nach mehr offenen US-Modellen
## Einordnung in die chinesische Open-Weight-Welle
| Datum | Release | Anbieter |
|---|---|---|
| 13.08.2026 | DeepSeek V4-Pro GA + Harness v0.1 | DeepSeek ([[deepseek-v4-pro-ga-harness-open-source.md]]) |
| 14.08.2026 | GLM-5.3 Review (AICodeKing Bench #1) | Z.ai ([[glm-5.3-z-ai.md]]) |
| 14.08.2026 | Qwen3.8-27B Release | Alibaba ([[qwen3.8-27b-alibaba.md]]) |
| laufend | **Globale Usage-Charts: Top-5 chinesisch** | DeepSeek/Moonshot u.a. (diese Seite) |
**Vierter Baustein in 24h** — jetzt auf Marktanteils-Ebene, nicht nur Qualität ([[../chinese-ai-wave-july-2026.md]]).
## Relevanz für Hectors Stack
- **DeepSeek-V4-Flash = Platz 1 der Usage-Charts** — DeepSeek ist in Hectors Setup ([[../../tools/ollama-cloud-deepseek-v4-flash-200tps-zdr.md]])
- **Kimi K3:** Volle Modell-Seite unter [[kimi-k3.md]]
- **Marktanteil vs. Qualität:** Chinesische Modelle gewinnen reale Nutzung — wirtschaftlicher Hebel, nicht nur Benchmark-Siege
## Offene Punkte
- ⚠️ Perplexity-Search-Inhalt nicht direkt abrufbar — über Web-Suche (OpenRouter/CGTN/Pandaily) rekonstruiert. Konkrete Chart-Details bei Gelegenheit am Original verifizieren.