knowledge-base/wiki/tools/ollama-cloud-deepseek-v4-flash-200tps-zdr.md

50 lines
2.6 KiB
Markdown

---
title: Ollama Cloud — DeepSeek-V4-Flash 200+ tps & Zero Data Retention
type: tool
category: tools
tags: [ollama, deepseek-v4-flash, cloud, performance, privacy, zdr]
source: https://x.com/ollama/status/2085975426321858799
date: 2026-08-08
---
# Ollama Cloud: DeepSeek-V4-Flash mit 200+ tps und ZDR
## Kernaussage (offizieller Ollama-Post, 2026-08-08)
> Currently serving 200 tps+ output speed for DeepSeek-V4-Flash on Ollama's cloud with zero data retention (ZDR).
## Rollout-Kontext (vorheriger Post)
> DeepSeek-V4-Flash-0731 is now fully rolled out as the new default for deepseek-v4-flash on Ollama's cloud.
> - Fast: 120+ output tps on Ollama's cloud
> - Private: zero data retention hosting in US & Europe
## Fakten
- **DeepSeek-V4-Flash-0731** ist neuer Default für `deepseek-v4-flash` auf Ollama Cloud
- **200+ tps** Output-Speed (Folge-Post; Rollout-Post nennt 120+ tps)
- **Zero Data Retention (ZDR)** — Hosting in US & Europa
- Positionierung: Speed + Effizienz + Frontier-Level-Performance
## Relevanz für Hector-Setup
- `ollama/deepseek-v4-flash:0731:cloud` ist unser **Tier-0-Modell** (Heartbeat/Cron-Jobs, siehe AGENTS.md Barbell-Routing)
- 200+ tps Output bestätigt Eignung für schnelle, kostengünstige Status-/Script-Jobs
- ZDR (US/EU) relevant für Datenschutz-Betrachtung bei Cloud-Inferenz
- Ergänzt die lokale dSpark-Optimierung (siehe `unsloth-dspark.md`) — Cloud vs. lokal beide auf Flash-0731
## DeepSeek V4 Pro 0813 — Third-Party Review (2026-08-13)
Am 13.08.2026 veröffentlichte der KI-Coding-Kanal [[../people/aicodeking.md|AICodeKing]] ein **"Fully Tested"-Review** zu **DeepSeek V4 Pro 0813** (Build-Datum 13.08.2026, Titel: "Okay, this is ACTUALLY CRAZY!").
- **Source:** https://www.youtube.com/watch?v=W_e-YR4QRvg
- **Raw:** `raw/youtube/2026-08-13_deepseek-v4-pro-0813-aicodeking.md`
- **Einordnung:** Während dieser Page der **V4-Flash-0731**-Default (Tier-0) im Fokus steht, ist **DeepSeek V4 Pro** das größere Schwestermodell (`ollama/deepseek-v4-pro:cloud`, DRACO-Solo 60.3%, siehe [[../concepts/llm/llm-model-catalog.md]]). Dieses Review liefert unabhängige Third-Party-Benchmark-Sicht auf die V4-Pro-0813-Version.
- ⚠️ Kein Transkript verfügbar (yt-dlp scheitert ohne Cookies) — nur Titel-Metadaten verifiziert. Konkrete Benchmark-Details bei Gelegenheit nachziehen.
- Kontext: chinesische Open-Weight-Welle, siehe [[../concepts/chinese-ai-wave-july-2026.md]] und [[../concepts/llm/chinese-model-cost-routing.md]].
## Quellen
- X-Post: https://x.com/ollama/status/2085975426321858799
- Raw: `raw/xpost/2026-08-08_ollama-deepseek-v4-flash-200tps-zdr.md`
- YouTube: `raw/youtube/2026-08-13_deepseek-v4-pro-0813-aicodeking.md`