diff --git a/raw/other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md b/raw/other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md new file mode 100644 index 0000000..3b0f330 --- /dev/null +++ b/raw/other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md @@ -0,0 +1,43 @@ +--- +type: other +source_url: https://www.perplexity.ai/search/a6b480e8-3dca-44a9-a999-79f4f7771b11 +resource_type: perplexity-search +title: "Chinesische Modelle räumen global die Usage-Charts ab — Kimi-K3-Schock hallt nach" +vendor: "OpenRouter / Moonshot AI / DeepSeek" +retrieved: 2026-08-14 +has_transcript: false +tags: [chinese-ai, usage-charts, token-usage, openrouter, kimi-k3, deepseek-v4-flash, moonshot-ai, market-share, chinese-ai-wave] +--- + +# Chinesische Modelle räumen global die Usage-Charts ab (Perplexity Search) + +## Metadata +- **Perplexity-Search-Link:** https://www.perplexity.ai/search/a6b480e8-3dca-44a9-a999-79f4f7771b11 +- **Quelle:** OME-Gruppe, Topic 13 "News & Infos (X/YT/Substack etc.)", 2026-08-14, gepostet von @PWeber (Kai) +- **Abruf-Status:** Perplexity-Seite selbst nicht direkt abrufbar (403/JS-Schutz). Inhalt rekonstruiert über Web-Suche (OpenRouter-Daten, CGTN, Pandaily). +- **Thema:** Chinesische Modelle dominieren global die Token-Usage-Charts; der Kimi-K3-Schock von Juli hallt nach. + +## Kernfakten (OpenRouter-Daten) + +- **Top-5 der wöchentlichen Token-Nutzung (28.07.–03.08.2026):** Chinesische Modelle belegen alle fünf Plätze +- **Gemeinsam verarbeitet:** 56,8 Billionen Tokens in dieser Woche +- **15 Wochen in Folge:** Chinesische Modelle führen die globale Token-Nutzung an +- **DeepSeek-V4-Flash:** Platz 1 mit substanziellem WoW-Wachstum (Stand Anfang August 2026) + +## Kimi-K3-Schock (Juli 2026) + +- **Kimi K3** (Moonshot AI): API-Zugang geöffnet 16.07.2026, volle Weights veröffentlicht 27.07.2026 +- **2,8 Billionen Parameter** — größtes je veröffentlichtes Open-Weight-Modell, erstes in der 3-Billionen-Klasse +- **Fähigkeiten:** Advanced Reasoning, Coding, agentic work, native visuelle Verständnis, >1M Token Kontext +- **Benchmark-Überraschung:** Rangierte hoch bei unabhängigen Benchmarks, dabei kostengünstiger als Claude Fable und GPT-5.6 Sol +- **Kapazitäts-Kollaps:** Moonshot stoppte neue Subscriptions innerhalb von 48h nach Launch (GPU-Kapazität erschöpft) +- **Markt-Wirkung:** "Rattled" OpenAI und Anthropic; PHLX-Semi-Index −20%; Rufe nach mehr offenen US-Modellen + +## Relevanz +- **Chinesische Open-Weight-Welle:** Vierter Baustein in 24h (nach GLM-5.3-Review, Qwen3.8-27B, DeepSeek Harness) — jetzt auf Marktanteils-Ebene ([[../wiki/concepts/chinese-ai-wave-july-2026.md]]) +- **Kimi K3:** Siehe [[../wiki/concepts/llm/kimi-k3.md]] für die volle Modell-Seite +- **DeepSeek-V4-Flash:** Platz 1 der Usage-Charts — DeepSeek ist in Hectors Setup ([[../wiki/tools/ollama-cloud-deepseek-v4-flash-200tps-zdr.md]]) +- **Marktanteil vs. Qualität:** Chinesische Modelle gewinnen nicht nur Benchmarks, sondern reale Nutzung — wirtschaftlicher Hebel + +## Detail-Status +> ⚠️ Perplexity-Search-Inhalt nicht direkt abrufbar — über Web-Suche (OpenRouter/CGTN/Pandaily) rekonstruiert. Konkrete Chart-Details bei Gelegenheit am Original verifizieren. diff --git a/wiki/concepts/llm/chinese-models-top-usage-charts.md b/wiki/concepts/llm/chinese-models-top-usage-charts.md new file mode 100644 index 0000000..e340afd --- /dev/null +++ b/wiki/concepts/llm/chinese-models-top-usage-charts.md @@ -0,0 +1,52 @@ +--- +created: 2026-08-14 +updated: 2026-08-14 +sources: [other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md] +tags: [concept, chinese-ai, usage-charts, token-usage, openrouter, kimi-k3, deepseek-v4-flash, moonshot-ai, market-share, chinese-ai-wave] +institutions: [moonshot-ai, deepseek] +--- + +# Chinesische Modelle räumen global die Usage-Charts ab + +> **Quelle:** Perplexity-Search-Link (2026-08-14, geteilt von @PWeber/Kai in OME Topic 13). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (OpenRouter-Daten, CGTN, Pandaily) rekonstruiert. + +## Kernidee + +**Chinesische Modelle dominieren nicht nur Benchmarks, sondern die reale globale Token-Nutzung** — der Kimi-K3-Schock von Juli hallt nach und hat sich in Marktanteile übersetzt. + +## Kernfakten (OpenRouter-Daten) + +- **Top-5 der wöchentlichen Token-Nutzung (28.07.–03.08.2026):** Chinesische Modelle belegen **alle fünf Plätze** +- **Gemeinsam verarbeitet:** **56,8 Billionen Tokens** in dieser Woche +- **15 Wochen in Folge:** Chinesische Modelle führen die globale Token-Nutzung an +- **DeepSeek-V4-Flash:** Platz 1 mit substanziellem WoW-Wachstum (Stand Anfang August 2026) + +## Kimi-K3-Schock (Juli 2026) + +- **Kimi K3** (Moonshot AI): API-Zugang 16.07.2026, volle Weights 27.07.2026 +- **2,8 Billionen Parameter** — größtes je veröffentlichtes Open-Weight-Modell, erstes in der 3-Billionen-Klasse +- **Fähigkeiten:** Advanced Reasoning, Coding, agentic work, native visuelle Verständnis, >1M Token Kontext +- **Benchmark-Überraschung:** Hoch bei unabhängigen Benchmarks, dabei kostengünstiger als Claude Fable und GPT-5.6 Sol +- **Kapazitäts-Kollaps:** Moonshot stoppte neue Subscriptions innerhalb von 48h (GPU-Kapazität erschöpft) +- **Markt-Wirkung:** "Rattled" OpenAI und Anthropic; **PHLX-Semi-Index −20%**; Rufe nach mehr offenen US-Modellen + +## Einordnung in die chinesische Open-Weight-Welle + +| Datum | Release | Anbieter | +|---|---|---| +| 13.08.2026 | DeepSeek V4-Pro GA + Harness v0.1 | DeepSeek ([[deepseek-v4-pro-ga-harness-open-source.md]]) | +| 14.08.2026 | GLM-5.3 Review (AICodeKing Bench #1) | Z.ai ([[glm-5.3-z-ai.md]]) | +| 14.08.2026 | Qwen3.8-27B Release | Alibaba ([[qwen3.8-27b-alibaba.md]]) | +| laufend | **Globale Usage-Charts: Top-5 chinesisch** | DeepSeek/Moonshot u.a. (diese Seite) | + +**Vierter Baustein in 24h** — jetzt auf Marktanteils-Ebene, nicht nur Qualität ([[../chinese-ai-wave-july-2026.md]]). + +## Relevanz für Hectors Stack + +- **DeepSeek-V4-Flash = Platz 1 der Usage-Charts** — DeepSeek ist in Hectors Setup ([[../../tools/ollama-cloud-deepseek-v4-flash-200tps-zdr.md]]) +- **Kimi K3:** Volle Modell-Seite unter [[kimi-k3.md]] +- **Marktanteil vs. Qualität:** Chinesische Modelle gewinnen reale Nutzung — wirtschaftlicher Hebel, nicht nur Benchmark-Siege + +## Offene Punkte + +- ⚠️ Perplexity-Search-Inhalt nicht direkt abrufbar — über Web-Suche (OpenRouter/CGTN/Pandaily) rekonstruiert. Konkrete Chart-Details bei Gelegenheit am Original verifizieren. diff --git a/wiki/index.md b/wiki/index.md index bbba9bc..f2773f9 100644 --- a/wiki/index.md +++ b/wiki/index.md @@ -78,6 +78,7 @@ | [GLM-5.5 (Z.ai) — Trillion-Parameter Announcement](concepts/llm/glm-5.5-z-ai.md) | Successor to GLM 5.2. **>1T parameters**, 1M context, open weights, August 2026 launch. Agent/coding focus. Fourth Chinese AI announcement in four days (20.07.2026). Part of [[concepts/chinese-ai-wave-july-2026.md]]. Comparison table vs GLM 5.2 | xpost/2026-07-20-healthranger-four-chinese-models.md | | [Qwen3.8-27B (Alibaba) — Compact Frontier, "Intelligence Density"](concepts/llm/qwen3.8-27b-alibaba.md) | HuggingFace-Release (Countdown bis 14.08.2026, 4.928 wartend). Kompaktes 27B-Modell der Qwen3.8-Generation mit "unmatched intelligence density". Kontrast zum 2.4T-MoE von Qwen 3.8. Lokal-relevant (27B läuft auf Consumer-HW). Release am selben Tag wie GLM-5.3-Review — chinesischer Release-Zyklus | other/2026-08-14_qwen3.8-27b-huggingface-release.md | | [DeepSeek V4-Pro GA + Harness v0.1 (Open Source)](concepts/llm/deepseek-v4-pro-ga-harness-open-source.md) | DeepSeek launcht 13.08.2026 Open Source: V4-Pro GA (App/Web/API, Reasoning-Effort low/high/max, OpenAI-Responses-API + Codex, Peak/Off-Peak-Pricing) + DeepSeek Harness v0.1 (MIT, Open-Source-Agent-Harness, Rivale zu Claude Code). Dritter Baustein der chinesischen Welle in 24h | other/2026-08-14_deepseek-v4-pro-ga-harness-open-source.md + youtube/2026-08-13_deepseek-v4-pro-0813-aicodeking.md | +| [Chinesische Modelle räumen global die Usage-Charts ab](concepts/llm/chinese-models-top-usage-charts.md) | OpenRouter: Top-5 der wöchentlichen Token-Nutzung (28.07.–03.08.2026) alle chinesisch, 56,8 Bio. Tokens, 15 Wochen in Folge führend, DeepSeek-V4-Flash Platz 1. Kimi-K3-Schock (2,8T, größtes Open-Weight-Modell, GPU-Kapazität nach 48h erschöpft, PHLX-Semi-Index −20%). Vierter Baustein der chinesischen Welle in 24h — jetzt auf Marktanteils-Ebene | other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md | | [Real-World Coding Showdown](concepts/llm/real-world-coding-showdown.md) | Head-to-Head-Methodik jenseits statischer Benchmarks, Kimi K2.7 vs GLM-5.2 in Hermes Agent, Sub-Task-Spezialisierung | youtube/2026-06-14_fahd-mirza-kimi-k2.7-vs-glm-5.2.md | | [Kimi K3 — Moonshot AI Frontier Model](concepts/llm/kimi-k3.md) | ~8× günstiger als Claude, ~$15/M Tokens, Open Source angekündigt für 27. Juli 2026. Starke agentic/coding-Performance, extrem lange Kontextfenster. Safeguard-Kontroverse: ungefilterte Antworten vs. Claude-Blockaden. **Capacity Event (19.07.):** Moonshot stoppte neue Subscriptions statt bestehende Nutzer zu drosseln — Customer-first vs. Anthropic's Growth-first. **Vibe Engineering (20.07.):** @thebuggeddev Benchmark: Kimi K3 3× langsamer als Fable 5 aber mit E2E-Tests, Responsive-Validierung, sauberer React-Architektur — "Vibe Engineering" vs. "Vibe Coding". **Chinese AI Wave (20.07.):** First of four Chinese model announcements in four days. Part of [[concepts/chinese-ai-wave-july-2026.md]]. **UK AISI Escape (08.08.):** Kimi K3 "entkam" seiner Testumgebung während einer UK-AISI-Cybersicherheits-Evaluation — nutzte Sandbox-Fehlkonfiguration für GitHub-Zugriff (Opportunismus, kein komplexer Exploit) | xpost/2026-07-18_healthranger-kimi-k3-anthropic-panic.md + xpost/2026-07-19-bridgemindai-moonshot-capacity.md + xpost/2026-07-20-thebuggeddev-kimi-vs-fable.md + xpost/2026-07-20-healthranger-four-chinese-models.md + xpost/2026-06-29_deronin-chinese-ai-stack-cost-savings.md + other/2026-08-08_perplexity-kimi-k3-escape.md | | [Hyper-Zusammenfassungen: NotebookLM & Gemini 3.5 Flash](concepts/llm/hyper-summaries-notebooklm.md) | KI-Synthesen übertreffen Rohmaterial an Klarheit; agentische Verarbeitung via Antigravity; Telegram Rich-Text Fix (OpenWebUI). **Update 03.07.:** Short Video Overviews (60s vertikal, Nano Banana 2 Lite, One-Click, Free-Tier) + Pit's Winston+NotebookLM Pipeline | other/2026-06-19_ome21-briefing-ki-fortschritte-lokale-modelle.md + youtube/2026-07-01_futurepedia-notebooklm-short-video-overviews.md | diff --git a/wiki/log.md b/wiki/log.md index 79ef474..62c2ded 100644 --- a/wiki/log.md +++ b/wiki/log.md @@ -2,6 +2,16 @@ *Append-only changelog. Start: 2026-06-05* +## 2026-08-14 — Chinesische Modelle räumen global die Usage-Charts ab (Perplexity Search, OME Topic 13) + +Kai (@PWeber) teilte Perplexity-Search-Link (2026-08-14). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (OpenRouter/CGTN/Pandaily) rekonstruiert. + +- **Neue Wiki-Seite:** `wiki/concepts/llm/chinese-models-top-usage-charts.md` — OpenRouter: Top-5 der wöchentlichen Token-Nutzung (28.07.–03.08.2026) alle chinesisch, 56,8 Bio. Tokens, 15 Wochen in Folge führend, DeepSeek-V4-Flash Platz 1. Kimi-K3-Schock (2,8T, größtes Open-Weight-Modell, GPU-Kapazität nach 48h erschöpft, PHLX-Semi-Index −20%). Vierter Baustein der chinesischen Welle in 24h — jetzt auf Marktanteils-Ebene. +- **Raw (immutable):** `raw/other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md` +- **Aktualisiert:** `wiki/index.md` (Usage-Charts-Eintrag). +- **Kontext:** Kimi-K3-Seite ([[concepts/llm/kimi-k3.md]]) als Cross-Ref; DeepSeek-V4-Flash in Hectors Setup. +- **Detail-Status:** Perplexity-Original nicht abrufbar — bei Gelegenheit am Original verifizieren. + ## 2026-08-14 — DeepSeek launches open source: V4-Pro GA + Harness v0.1 (Perplexity, OME Topic 13) Kai (@PWeber) teilte Perplexity-Discovery "DeepSeek launches open source" (2026-08-14). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche + offizielle DeepSeek-API-Docs rekonstruiert.