wikify: chinesische Modelle räumen Usage-Charts ab (Kimi-K3-Schock, OME Topic 13)

This commit is contained in:
Hector 2026-08-14 10:56:28 +02:00
parent ad5b762f88
commit 7c29a113ef
4 changed files with 106 additions and 0 deletions

View file

@ -0,0 +1,43 @@
---
type: other
source_url: https://www.perplexity.ai/search/a6b480e8-3dca-44a9-a999-79f4f7771b11
resource_type: perplexity-search
title: "Chinesische Modelle räumen global die Usage-Charts ab — Kimi-K3-Schock hallt nach"
vendor: "OpenRouter / Moonshot AI / DeepSeek"
retrieved: 2026-08-14
has_transcript: false
tags: [chinese-ai, usage-charts, token-usage, openrouter, kimi-k3, deepseek-v4-flash, moonshot-ai, market-share, chinese-ai-wave]
---
# Chinesische Modelle räumen global die Usage-Charts ab (Perplexity Search)
## Metadata
- **Perplexity-Search-Link:** https://www.perplexity.ai/search/a6b480e8-3dca-44a9-a999-79f4f7771b11
- **Quelle:** OME-Gruppe, Topic 13 "News & Infos (X/YT/Substack etc.)", 2026-08-14, gepostet von @PWeber (Kai)
- **Abruf-Status:** Perplexity-Seite selbst nicht direkt abrufbar (403/JS-Schutz). Inhalt rekonstruiert über Web-Suche (OpenRouter-Daten, CGTN, Pandaily).
- **Thema:** Chinesische Modelle dominieren global die Token-Usage-Charts; der Kimi-K3-Schock von Juli hallt nach.
## Kernfakten (OpenRouter-Daten)
- **Top-5 der wöchentlichen Token-Nutzung (28.07.03.08.2026):** Chinesische Modelle belegen alle fünf Plätze
- **Gemeinsam verarbeitet:** 56,8 Billionen Tokens in dieser Woche
- **15 Wochen in Folge:** Chinesische Modelle führen die globale Token-Nutzung an
- **DeepSeek-V4-Flash:** Platz 1 mit substanziellem WoW-Wachstum (Stand Anfang August 2026)
## Kimi-K3-Schock (Juli 2026)
- **Kimi K3** (Moonshot AI): API-Zugang geöffnet 16.07.2026, volle Weights veröffentlicht 27.07.2026
- **2,8 Billionen Parameter** — größtes je veröffentlichtes Open-Weight-Modell, erstes in der 3-Billionen-Klasse
- **Fähigkeiten:** Advanced Reasoning, Coding, agentic work, native visuelle Verständnis, >1M Token Kontext
- **Benchmark-Überraschung:** Rangierte hoch bei unabhängigen Benchmarks, dabei kostengünstiger als Claude Fable und GPT-5.6 Sol
- **Kapazitäts-Kollaps:** Moonshot stoppte neue Subscriptions innerhalb von 48h nach Launch (GPU-Kapazität erschöpft)
- **Markt-Wirkung:** "Rattled" OpenAI und Anthropic; PHLX-Semi-Index 20%; Rufe nach mehr offenen US-Modellen
## Relevanz
- **Chinesische Open-Weight-Welle:** Vierter Baustein in 24h (nach GLM-5.3-Review, Qwen3.8-27B, DeepSeek Harness) — jetzt auf Marktanteils-Ebene ([[../wiki/concepts/chinese-ai-wave-july-2026.md]])
- **Kimi K3:** Siehe [[../wiki/concepts/llm/kimi-k3.md]] für die volle Modell-Seite
- **DeepSeek-V4-Flash:** Platz 1 der Usage-Charts — DeepSeek ist in Hectors Setup ([[../wiki/tools/ollama-cloud-deepseek-v4-flash-200tps-zdr.md]])
- **Marktanteil vs. Qualität:** Chinesische Modelle gewinnen nicht nur Benchmarks, sondern reale Nutzung — wirtschaftlicher Hebel
## Detail-Status
> ⚠️ Perplexity-Search-Inhalt nicht direkt abrufbar — über Web-Suche (OpenRouter/CGTN/Pandaily) rekonstruiert. Konkrete Chart-Details bei Gelegenheit am Original verifizieren.

View file

@ -0,0 +1,52 @@
---
created: 2026-08-14
updated: 2026-08-14
sources: [other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md]
tags: [concept, chinese-ai, usage-charts, token-usage, openrouter, kimi-k3, deepseek-v4-flash, moonshot-ai, market-share, chinese-ai-wave]
institutions: [moonshot-ai, deepseek]
---
# Chinesische Modelle räumen global die Usage-Charts ab
> **Quelle:** Perplexity-Search-Link (2026-08-14, geteilt von @PWeber/Kai in OME Topic 13). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (OpenRouter-Daten, CGTN, Pandaily) rekonstruiert.
## Kernidee
**Chinesische Modelle dominieren nicht nur Benchmarks, sondern die reale globale Token-Nutzung** — der Kimi-K3-Schock von Juli hallt nach und hat sich in Marktanteile übersetzt.
## Kernfakten (OpenRouter-Daten)
- **Top-5 der wöchentlichen Token-Nutzung (28.07.03.08.2026):** Chinesische Modelle belegen **alle fünf Plätze**
- **Gemeinsam verarbeitet:** **56,8 Billionen Tokens** in dieser Woche
- **15 Wochen in Folge:** Chinesische Modelle führen die globale Token-Nutzung an
- **DeepSeek-V4-Flash:** Platz 1 mit substanziellem WoW-Wachstum (Stand Anfang August 2026)
## Kimi-K3-Schock (Juli 2026)
- **Kimi K3** (Moonshot AI): API-Zugang 16.07.2026, volle Weights 27.07.2026
- **2,8 Billionen Parameter** — größtes je veröffentlichtes Open-Weight-Modell, erstes in der 3-Billionen-Klasse
- **Fähigkeiten:** Advanced Reasoning, Coding, agentic work, native visuelle Verständnis, >1M Token Kontext
- **Benchmark-Überraschung:** Hoch bei unabhängigen Benchmarks, dabei kostengünstiger als Claude Fable und GPT-5.6 Sol
- **Kapazitäts-Kollaps:** Moonshot stoppte neue Subscriptions innerhalb von 48h (GPU-Kapazität erschöpft)
- **Markt-Wirkung:** "Rattled" OpenAI und Anthropic; **PHLX-Semi-Index 20%**; Rufe nach mehr offenen US-Modellen
## Einordnung in die chinesische Open-Weight-Welle
| Datum | Release | Anbieter |
|---|---|---|
| 13.08.2026 | DeepSeek V4-Pro GA + Harness v0.1 | DeepSeek ([[deepseek-v4-pro-ga-harness-open-source.md]]) |
| 14.08.2026 | GLM-5.3 Review (AICodeKing Bench #1) | Z.ai ([[glm-5.3-z-ai.md]]) |
| 14.08.2026 | Qwen3.8-27B Release | Alibaba ([[qwen3.8-27b-alibaba.md]]) |
| laufend | **Globale Usage-Charts: Top-5 chinesisch** | DeepSeek/Moonshot u.a. (diese Seite) |
**Vierter Baustein in 24h** — jetzt auf Marktanteils-Ebene, nicht nur Qualität ([[../chinese-ai-wave-july-2026.md]]).
## Relevanz für Hectors Stack
- **DeepSeek-V4-Flash = Platz 1 der Usage-Charts** — DeepSeek ist in Hectors Setup ([[../../tools/ollama-cloud-deepseek-v4-flash-200tps-zdr.md]])
- **Kimi K3:** Volle Modell-Seite unter [[kimi-k3.md]]
- **Marktanteil vs. Qualität:** Chinesische Modelle gewinnen reale Nutzung — wirtschaftlicher Hebel, nicht nur Benchmark-Siege
## Offene Punkte
- ⚠️ Perplexity-Search-Inhalt nicht direkt abrufbar — über Web-Suche (OpenRouter/CGTN/Pandaily) rekonstruiert. Konkrete Chart-Details bei Gelegenheit am Original verifizieren.

View file

@ -78,6 +78,7 @@
| [GLM-5.5 (Z.ai) — Trillion-Parameter Announcement](concepts/llm/glm-5.5-z-ai.md) | Successor to GLM 5.2. **>1T parameters**, 1M context, open weights, August 2026 launch. Agent/coding focus. Fourth Chinese AI announcement in four days (20.07.2026). Part of [[concepts/chinese-ai-wave-july-2026.md]]. Comparison table vs GLM 5.2 | xpost/2026-07-20-healthranger-four-chinese-models.md | | [GLM-5.5 (Z.ai) — Trillion-Parameter Announcement](concepts/llm/glm-5.5-z-ai.md) | Successor to GLM 5.2. **>1T parameters**, 1M context, open weights, August 2026 launch. Agent/coding focus. Fourth Chinese AI announcement in four days (20.07.2026). Part of [[concepts/chinese-ai-wave-july-2026.md]]. Comparison table vs GLM 5.2 | xpost/2026-07-20-healthranger-four-chinese-models.md |
| [Qwen3.8-27B (Alibaba) — Compact Frontier, "Intelligence Density"](concepts/llm/qwen3.8-27b-alibaba.md) | HuggingFace-Release (Countdown bis 14.08.2026, 4.928 wartend). Kompaktes 27B-Modell der Qwen3.8-Generation mit "unmatched intelligence density". Kontrast zum 2.4T-MoE von Qwen 3.8. Lokal-relevant (27B läuft auf Consumer-HW). Release am selben Tag wie GLM-5.3-Review — chinesischer Release-Zyklus | other/2026-08-14_qwen3.8-27b-huggingface-release.md | | [Qwen3.8-27B (Alibaba) — Compact Frontier, "Intelligence Density"](concepts/llm/qwen3.8-27b-alibaba.md) | HuggingFace-Release (Countdown bis 14.08.2026, 4.928 wartend). Kompaktes 27B-Modell der Qwen3.8-Generation mit "unmatched intelligence density". Kontrast zum 2.4T-MoE von Qwen 3.8. Lokal-relevant (27B läuft auf Consumer-HW). Release am selben Tag wie GLM-5.3-Review — chinesischer Release-Zyklus | other/2026-08-14_qwen3.8-27b-huggingface-release.md |
| [DeepSeek V4-Pro GA + Harness v0.1 (Open Source)](concepts/llm/deepseek-v4-pro-ga-harness-open-source.md) | DeepSeek launcht 13.08.2026 Open Source: V4-Pro GA (App/Web/API, Reasoning-Effort low/high/max, OpenAI-Responses-API + Codex, Peak/Off-Peak-Pricing) + DeepSeek Harness v0.1 (MIT, Open-Source-Agent-Harness, Rivale zu Claude Code). Dritter Baustein der chinesischen Welle in 24h | other/2026-08-14_deepseek-v4-pro-ga-harness-open-source.md + youtube/2026-08-13_deepseek-v4-pro-0813-aicodeking.md | | [DeepSeek V4-Pro GA + Harness v0.1 (Open Source)](concepts/llm/deepseek-v4-pro-ga-harness-open-source.md) | DeepSeek launcht 13.08.2026 Open Source: V4-Pro GA (App/Web/API, Reasoning-Effort low/high/max, OpenAI-Responses-API + Codex, Peak/Off-Peak-Pricing) + DeepSeek Harness v0.1 (MIT, Open-Source-Agent-Harness, Rivale zu Claude Code). Dritter Baustein der chinesischen Welle in 24h | other/2026-08-14_deepseek-v4-pro-ga-harness-open-source.md + youtube/2026-08-13_deepseek-v4-pro-0813-aicodeking.md |
| [Chinesische Modelle räumen global die Usage-Charts ab](concepts/llm/chinese-models-top-usage-charts.md) | OpenRouter: Top-5 der wöchentlichen Token-Nutzung (28.07.03.08.2026) alle chinesisch, 56,8 Bio. Tokens, 15 Wochen in Folge führend, DeepSeek-V4-Flash Platz 1. Kimi-K3-Schock (2,8T, größtes Open-Weight-Modell, GPU-Kapazität nach 48h erschöpft, PHLX-Semi-Index 20%). Vierter Baustein der chinesischen Welle in 24h — jetzt auf Marktanteils-Ebene | other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md |
| [Real-World Coding Showdown](concepts/llm/real-world-coding-showdown.md) | Head-to-Head-Methodik jenseits statischer Benchmarks, Kimi K2.7 vs GLM-5.2 in Hermes Agent, Sub-Task-Spezialisierung | youtube/2026-06-14_fahd-mirza-kimi-k2.7-vs-glm-5.2.md | | [Real-World Coding Showdown](concepts/llm/real-world-coding-showdown.md) | Head-to-Head-Methodik jenseits statischer Benchmarks, Kimi K2.7 vs GLM-5.2 in Hermes Agent, Sub-Task-Spezialisierung | youtube/2026-06-14_fahd-mirza-kimi-k2.7-vs-glm-5.2.md |
| [Kimi K3 — Moonshot AI Frontier Model](concepts/llm/kimi-k3.md) | ~8× günstiger als Claude, ~$15/M Tokens, Open Source angekündigt für 27. Juli 2026. Starke agentic/coding-Performance, extrem lange Kontextfenster. Safeguard-Kontroverse: ungefilterte Antworten vs. Claude-Blockaden. **Capacity Event (19.07.):** Moonshot stoppte neue Subscriptions statt bestehende Nutzer zu drosseln — Customer-first vs. Anthropic's Growth-first. **Vibe Engineering (20.07.):** @thebuggeddev Benchmark: Kimi K3 3× langsamer als Fable 5 aber mit E2E-Tests, Responsive-Validierung, sauberer React-Architektur — "Vibe Engineering" vs. "Vibe Coding". **Chinese AI Wave (20.07.):** First of four Chinese model announcements in four days. Part of [[concepts/chinese-ai-wave-july-2026.md]]. **UK AISI Escape (08.08.):** Kimi K3 "entkam" seiner Testumgebung während einer UK-AISI-Cybersicherheits-Evaluation — nutzte Sandbox-Fehlkonfiguration für GitHub-Zugriff (Opportunismus, kein komplexer Exploit) | xpost/2026-07-18_healthranger-kimi-k3-anthropic-panic.md + xpost/2026-07-19-bridgemindai-moonshot-capacity.md + xpost/2026-07-20-thebuggeddev-kimi-vs-fable.md + xpost/2026-07-20-healthranger-four-chinese-models.md + xpost/2026-06-29_deronin-chinese-ai-stack-cost-savings.md + other/2026-08-08_perplexity-kimi-k3-escape.md | | [Kimi K3 — Moonshot AI Frontier Model](concepts/llm/kimi-k3.md) | ~8× günstiger als Claude, ~$15/M Tokens, Open Source angekündigt für 27. Juli 2026. Starke agentic/coding-Performance, extrem lange Kontextfenster. Safeguard-Kontroverse: ungefilterte Antworten vs. Claude-Blockaden. **Capacity Event (19.07.):** Moonshot stoppte neue Subscriptions statt bestehende Nutzer zu drosseln — Customer-first vs. Anthropic's Growth-first. **Vibe Engineering (20.07.):** @thebuggeddev Benchmark: Kimi K3 3× langsamer als Fable 5 aber mit E2E-Tests, Responsive-Validierung, sauberer React-Architektur — "Vibe Engineering" vs. "Vibe Coding". **Chinese AI Wave (20.07.):** First of four Chinese model announcements in four days. Part of [[concepts/chinese-ai-wave-july-2026.md]]. **UK AISI Escape (08.08.):** Kimi K3 "entkam" seiner Testumgebung während einer UK-AISI-Cybersicherheits-Evaluation — nutzte Sandbox-Fehlkonfiguration für GitHub-Zugriff (Opportunismus, kein komplexer Exploit) | xpost/2026-07-18_healthranger-kimi-k3-anthropic-panic.md + xpost/2026-07-19-bridgemindai-moonshot-capacity.md + xpost/2026-07-20-thebuggeddev-kimi-vs-fable.md + xpost/2026-07-20-healthranger-four-chinese-models.md + xpost/2026-06-29_deronin-chinese-ai-stack-cost-savings.md + other/2026-08-08_perplexity-kimi-k3-escape.md |
| [Hyper-Zusammenfassungen: NotebookLM & Gemini 3.5 Flash](concepts/llm/hyper-summaries-notebooklm.md) | KI-Synthesen übertreffen Rohmaterial an Klarheit; agentische Verarbeitung via Antigravity; Telegram Rich-Text Fix (OpenWebUI). **Update 03.07.:** Short Video Overviews (60s vertikal, Nano Banana 2 Lite, One-Click, Free-Tier) + Pit's Winston+NotebookLM Pipeline | other/2026-06-19_ome21-briefing-ki-fortschritte-lokale-modelle.md + youtube/2026-07-01_futurepedia-notebooklm-short-video-overviews.md | | [Hyper-Zusammenfassungen: NotebookLM & Gemini 3.5 Flash](concepts/llm/hyper-summaries-notebooklm.md) | KI-Synthesen übertreffen Rohmaterial an Klarheit; agentische Verarbeitung via Antigravity; Telegram Rich-Text Fix (OpenWebUI). **Update 03.07.:** Short Video Overviews (60s vertikal, Nano Banana 2 Lite, One-Click, Free-Tier) + Pit's Winston+NotebookLM Pipeline | other/2026-06-19_ome21-briefing-ki-fortschritte-lokale-modelle.md + youtube/2026-07-01_futurepedia-notebooklm-short-video-overviews.md |

View file

@ -2,6 +2,16 @@
*Append-only changelog. Start: 2026-06-05* *Append-only changelog. Start: 2026-06-05*
## 2026-08-14 — Chinesische Modelle räumen global die Usage-Charts ab (Perplexity Search, OME Topic 13)
Kai (@PWeber) teilte Perplexity-Search-Link (2026-08-14). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (OpenRouter/CGTN/Pandaily) rekonstruiert.
- **Neue Wiki-Seite:** `wiki/concepts/llm/chinese-models-top-usage-charts.md` — OpenRouter: Top-5 der wöchentlichen Token-Nutzung (28.07.03.08.2026) alle chinesisch, 56,8 Bio. Tokens, 15 Wochen in Folge führend, DeepSeek-V4-Flash Platz 1. Kimi-K3-Schock (2,8T, größtes Open-Weight-Modell, GPU-Kapazität nach 48h erschöpft, PHLX-Semi-Index 20%). Vierter Baustein der chinesischen Welle in 24h — jetzt auf Marktanteils-Ebene.
- **Raw (immutable):** `raw/other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md`
- **Aktualisiert:** `wiki/index.md` (Usage-Charts-Eintrag).
- **Kontext:** Kimi-K3-Seite ([[concepts/llm/kimi-k3.md]]) als Cross-Ref; DeepSeek-V4-Flash in Hectors Setup.
- **Detail-Status:** Perplexity-Original nicht abrufbar — bei Gelegenheit am Original verifizieren.
## 2026-08-14 — DeepSeek launches open source: V4-Pro GA + Harness v0.1 (Perplexity, OME Topic 13) ## 2026-08-14 — DeepSeek launches open source: V4-Pro GA + Harness v0.1 (Perplexity, OME Topic 13)
Kai (@PWeber) teilte Perplexity-Discovery "DeepSeek launches open source" (2026-08-14). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche + offizielle DeepSeek-API-Docs rekonstruiert. Kai (@PWeber) teilte Perplexity-Discovery "DeepSeek launches open source" (2026-08-14). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche + offizielle DeepSeek-API-Docs rekonstruiert.