knowledge-base/raw/other/2026-08-13_deepseek-api-preiserhoehung.md
2026-08-13 17:13:40 +02:00

2.4 KiB
Raw Permalink Blame History

type source_url retrieved title tags
other https://www.perplexity.ai/discover/you/deepseek-to-raise-api-prices-u-bo6gHsYdTuy3WR3nKpo3_w 2026-08-13 DeepSeek erhöht API-Preise (V4 Pro + V4 Flash) ab 17.08.2026
deepseek
deepseek-v4-pro
deepseek-v4-flash
pricing
api
chinese-ai
cost-routing

DeepSeek erhöht API-Preise (V4 Pro + V4 Flash) ab 17.08.2026

Quelle & Verifikations-Hinweis

Fakten

  • DeepSeek erhöht die API-Preise für V4-Pro und V4-Flash, wirksam ab 17. August 2026.
  • Erhöhung um 50% bis 1.100% über den aktuellen Preisen, je nach Modell, Token-Typ und Nutzungszeit.
  • Neue Peak/Off-Peak-Preise. Peak-Zeiten täglich 9:0012:00 und 14:0018:00 Peking-Zeit.
  • V4-Pro uncached Input Peak: 3 → 9 Yuan/Mio Tokens; Output Peak: 6 → 27 Yuan/Mio.
  • V4-Pro Off-Peak: 4,5 Yuan Input / 13,5 Yuan Output pro Mio Tokens.
  • V4-Flash: 1,5 Yuan Input / 4,5 Yuan Output pro Mio Tokens.
  • Kontext: DeepSeek hatte die V4-Pro-Standardpreise am 31. Mai 2026 um ~75% gesenkt.
  • Begründung: stark wachsendes Nutzungsvolumen.

Einordnung

  • DeepSeek war der Preisdrücker an der Frontier (V4 Pro 0813: ~$0,43/$0,87 pro Mio, ~57× billiger als Fable 5).
  • Diese Erhöhung ist eine bemerkenswerte Wende — der Preisdrücker erhöht selbst, wegen wachsender Nutzung.
  • Passt zur Marktdisziplinierungs-Diskussion (Grok 4.6 + DeepSeek V4 Pro drücken Frontier-Preise).

Relevanz für Hector-Setup

  • ollama/deepseek-v4-flash:0731:cloud ist unser Tier-0-Modell (Heartbeat/Cron-Jobs, siehe AGENTS.md Barbell-Routing).
  • ollama/deepseek-v4-pro:cloud ist das größere Schwestermodell (DRACO-Solo 60.3%, siehe wiki/concepts/llm/llm-model-catalog.md).
  • Preiserhöhung betrifft die DeepSeek-API direkt; Ollama-Cloud-Preise können davon abweichen. Für Cost-Routing relevant: Peak/Off-Peak-Zeiten (Peking-Zeit) als neuer Kostenfaktor.