## DeepSeek V4 Pro 0813 — Third-Party Review (2026-08-13)
Am 13.08.2026 veröffentlichte der KI-Coding-Kanal [[../people/aicodeking.md|AICodeKing]] ein **"Fully Tested"-Review** zu **DeepSeek V4 Pro 0813** (Build-Datum 13.08.2026, Titel: "Okay, this is ACTUALLY CRAZY!").
- **Einordnung:** Während dieser Page der **V4-Flash-0731**-Default (Tier-0) im Fokus steht, ist **DeepSeek V4 Pro** das größere Schwestermodell (`ollama/deepseek-v4-pro:cloud`, DRACO-Solo 60.3%, siehe [[../concepts/llm/llm-model-catalog.md]]). Dieses Review liefert unabhängige Third-Party-Benchmark-Sicht auf die V4-Pro-0813-Version.
- ⚠️ Kein Transkript verfügbar (yt-dlp scheitert ohne Cookies) — nur Titel-Metadaten verifiziert. Konkrete Benchmark-Details bei Gelegenheit nachziehen.
- Kontext: chinesische Open-Weight-Welle, siehe [[../concepts/chinese-ai-wave-july-2026.md]] und [[../concepts/llm/chinese-model-cost-routing.md]].
- **Kontext:** DeepSeek hatte die V4-Pro-Standardpreise am **31. Mai 2026 um ~75% gesenkt**.
- **Begründung:** stark wachsendes Nutzungsvolumen.
- **Einordnung:** DeepSeek war der **Preisdrücker an der Frontier** (V4 Pro 0813: ~$0,43/$0,87 pro Mio, ~57× billiger als Fable 5). Diese Erhöhung ist eine **bemerkenswerte Wende** — der Preisdrücker erhöht selbst. Passt zur Marktdisziplinierungs-Diskussion (Grok 4.6 + DeepSeek V4 Pro drücken Frontier-Preise).
- ⚠️ Betrifft die **DeepSeek-API direkt**; Ollama-Cloud-Preise können abweichen. Für Cost-Routing relevant: Peak/Off-Peak-Zeiten (Peking-Zeit) als neuer Kostenfaktor.
- **Source:** https://www.perplexity.ai/discover/you/deepseek-to-raise-api-prices-u-bo6gHsYdTuy3WR3nKpo3_w (Perplexity-Link liefert per web_fetch 403/Cloudflare — Fakten aus verifizierter Websuche: investing.com, thenews.com.pk, kelo.com, deepseek.ai/pricing, roic.ai)
Netbits (@NetLightning) hat die ZDR-Zusage im OME-Topic hinterfragt; eigene Prüfung der Primärquellen bestätigt die Zitate dieser Seite und ordnet sie ein:
- **Bestätigt:** „we require no logging, no training, and zero data retention policies in place" und „primarily in the United States … may route to Europe and Singapore" (Pricing-FAQ, abgerufen 23.09.2026). Partner sind **NVIDIA Cloud Providers (NCPs)**, gehostet werden **native Gewichte** der Modellgeber.
- **Offene Flanke:** Die ZDR-Zusage ist eine **Anforderung an Partner**, keine eigene Messung. Die Privacy Policy (§5) nennt „model inference providers" selbst als Dritte. Ob unser `deepseek-v4.1-flash` bei welchem NCP landet und wie dessen Retention real aussieht, ist **nicht unabhängig geprüft**.
- **Prompt-Cache:** Ollamas Cache-Isolation ist ungetestet. Der Stanford-Audit (ICML 2025) hat **DeepSeek** als per-user isoliert bestätigt — das betrifft die DeepSeek-API, nicht Ollamas Serving-Schicht.
Vollständige Analyse, Paper-Zitate und Verifikationsprotokoll: [[../concepts/policy/inference-provider-data-retention.md]].