- raw: raw/youtube/2026-07-07_berman-model-routing.md - wiki/tools/model-routing.md (new) — Cost-saving routing patterns - wiki/architecture/model-routing.md (update) — Berman patterns section - wiki/index.md — 67. Update with new tool + architecture update - wiki/log.md — changelog entry
3 KiB
| created | updated | sources | tags | ||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 2026-07-05 | 2026-07-05 |
|
|
Claude Sonnet 5 — Anthropic's neues Default-Modell mit Cost-Inefficiency-Problem
TL;DR: Anthropic lanciert Claude Sonnet 5 als neues Default-Modell für alle gratis/Pro User — 1M Kontextfenster, Performance auf Opus 4.8 Niveau. Doch im Cost-to-Run ist Sonnet 5 teurer als Fable 5 und damit "enorm ineffizient" — der ganze Sinn eines leichtgewichtigeren Modells wird widerlegt.
Spezifikationen
| Eigenschaft | Wert |
|---|---|
| Vendor | Anthropic |
| Kontextfenster | 1 Million Tokens |
| Performance | ~Opus 4.8 Niveau ("vielleicht ein bisschen günstiger") |
| Default-Modell | Ja — für alle gratis und Pro User |
| Claude Code | Verfügbar |
| Pricing | Standardpricing |
| Sicherheit | Offiziell "sicherer als Sonnet 4.6" |
| Versionssprung | 4.6 → 5 (direkt, größer als üblich) |
Verbesserungen (laut Anthropic)
- Reasoning
- Tool Use
- Coding
- Wissensarbeit
Cost-to-Run Problem
Artificial Analysis Cost to Run Index: Sonnet 5 bei ~$6.000 — teurer als Claude Fable 5.
| Modell | Cost to Run | vs Sonnet 5 |
|---|---|---|
| Sonnet 5 | ~$6.000 | — |
| Fable 5 | niedriger | günstiger |
| GPT 5.5 Extra Hype | <50% von Sonnet 5 | ~halbe Kosten |
Kritik (Leo Schmedding):
- "Man darf nicht auf offizielle Kostenangaben schauen"
- Reasoning-Prozess ist ineffizient → viele Output-Tokens → reale Kosten viel höher
- "Das ist exakt nicht der Fall bei Sonnet 5" — der Sinn eines Sonnet-Modells (leichtgewichtiger, günstiger) wird widerlegt
- "Der ganze Sinn und Zweck eines Modells wird widersinnig"
Einordnung
Sonnet 5 richtet sich als Default-Modell an den Massenmarkt, scheitert aber an der Cost-Efficiency-Premise. Wer Preis-Leistung sucht, ist mit GPT 5.5 (~halbe Kosten) besser bedient. Wer Frontier-Qualität will, nutzt Fable 5 (das im Cost-to-Run günstiger ist als Sonnet 5 — eine Ironie).
Parallele zu fable-5-anthropic.md: Auch Fable 5 hatte ein Pricing-Problem (39× teurer als GLM 5.2 im atomic.chat Benchmark). Sonnet 5 hat das umgekehrte Problem: Es sollte das "günstige" Modell sein, ist aber teurer als das Premium-Modell Fable 5.
Cross-References
- ../../tools/anthropic-claude.md — Anthropic Claude Modellübersicht
- fable-5-anthropic.md — Fable 5 (günstiger im Cost-to-Run als Sonnet 5)
- coding-benchmark-price-performance.md — atomic.chat Benchmark
- chinese-model-cost-routing.md — Cost-Routing-These (chinesische Modelle als Alternative)
- ../../institutions/anthropic.md — Anthropic Institutionenseite