knowledge-base/wiki/concepts/llm/gemini-3.6-flash-vs-3.7-flash.md

63 lines
4 KiB
Markdown
Raw Normal View History

---
created: 2026-08-14
updated: 2026-08-14
sources: [other/2026-08-14_gemini-3.6-flash-vs-3.7-flash.md]
tags: [concept, gemini, google, deepmind, gemini-3.6-flash, gemini-3.7-flash, flash-series, coding, agents, pricing, antigravity]
institutions: [google, deepmind]
---
# Gemini 3.6 Flash vs 3.7 Flash — Googles Workhorse-Serie
> **Quelle:** Perplexity-Search-Link "gemini-3-6-flash-vs-3-7-vergle" (2026-08-14, geteilt von @PWeber/Kai in OME Topic 13, als Antwort auf Hermans Frage nach dem vorherigen Link). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (Google-Blog, VentureBeat, DeepMind-Model-Cards) rekonstruiert.
## Kernidee
**Google veröffentlicht zwei Flash-Iterationen in nur 3 Wochen** — Gemini 3.6 Flash (21.07.2026) und Gemini 3.7 Flash (13.08.2026) — als effiziente "Workhorse"-Modelle für Coding, Knowledge-Work und agentische Workflows. 3.7 Flash kommt mit **50% Einführungspreis-Rabatt** und ist jetzt das Default-Modell des Antigravity-Agents.
## Gemini 3.6 Flash (21.07.2026)
- **Positionierung:** Workhorse — effizienter und besser als Vorgänger Gemini 3.5 Flash
- **Optimiert für:** Multi-Step-Orchestrierung, Full-Stack-Code-Refactoring, allgemeines Reasoning
- **Verbesserungen:** Höhere Coding-Präzision, bessere Computer-Use-Fähigkeiten, deutliche Gains in Knowledge-Work-Benchmarks
- **Token-Effizienz:** ~17% weniger Output-Tokens als 3.5 Flash
- **Multimodal:** Text, Bilder, Audio, Video; 1M-Token-Kontext, 64K-Token-Output
- **Verfügbarkeit:** Gemini API (AI Studio, Android Studio), Google Antigravity, Gemini Enterprise
- **Preis:** $1.50/1M Input, $7.50/1M Output
## Gemini 3.7 Flash (13.08.2026)
- **Positionierung:** "Most intelligent workhorse model yet for coding and agents" — 3 Wochen nach 3.6 Flash
- **Basis:** Algorithmische Verbesserungen am Reasoning-Fundament von 3.6 Flash
- **Gains:** Software-Engineering, dokumentenlastige Knowledge-Work, Web-Development; besseres Debugging/Issue-Resolution, höhere First-Pass-Code-Accuracy, funktionalere Web-Layouts aus weniger Prompts
- **Multimodal:** Text, Bilder, Audio, Video; 1M-Token-Kontext, 64K-Token-Output
- **Konfigurierbares Thinking:** Qualität/Kosten/Latenz balancierbar
- **Einführungspreis:** **$0.75/1M Input, $3.75/1M Output** (50% Rabatt) bis 31.12.2026, danach $1.50/$7.50
- **Default-Modell:** Powering des **Antigravity**-Agents; Consumer-Zugang via Gemini Spark (Google AI Pro/Ultra)
## Vergleichskern
| Eigenschaft | Gemini 3.6 Flash | Gemini 3.7 Flash |
|---|---|---|
| Release | 21.07.2026 | 13.08.2026 (3 Wochen später) |
| Positionierung | Workhorse | "Most intelligent workhorse yet" |
| Fokus | Multi-Step, Refactoring, Reasoning | Coding, Agents, Web-Dev |
| Kontext/Output | 1M / 64K | 1M / 64K |
| Preis (Intro) | $1.50/$7.50 | **$0.75/$3.75** (bis 31.12.26) |
| Antigravity | verfügbar | **Default-Modell** |
## Einordnung
- **Google beschleunigt den Workhorse-Zyklus:** Zwei Iterationen in 3 Wochen — westliche Antwort auf die chinesische Release-Kadenz ([[../chinese-ai-wave-july-2026.md]]), aber auf der effizienten Flash-Ebene
- **Preis-Halbierung als Waffe:** 3.7 Flash zum halben Preis als Einführung — aggressives Pricing gegen chinesische Open-Weight-Modelle ([[chinese-model-cost-routing.md]])
- **Antigravity-Default:** 3.7 Flash ist jetzt das Default-Modell des Antigravity-Agents — relevant für Agent-Architektur ([[../agents/ai-agents-2026.md]])
- **Bestehende Gemini-Seite:** [[../../tools/google-gemini.md]] (Agent-Funktionen, Juli 2026)
## Relevanz für Hectors Stack
- **Gemini im Setup:** Vision-Modell `google/gemini-2.5-flash` + Gemini 3.5 Flash als Fallback — 3.6/3.7 Flash sind potenzielle Upgrades
- **Konfigurierbares Thinking (3.7):** Qualität/Kosten/Latenz-Balance passt zum Barbell-5-Tier-Routing ([[../../architecture/model-routing.md]])
## Offene Punkte
- ⚠️ Perplexity-Search-Inhalt nicht direkt abrufbar — über Web-Suche (Google-Blog, VentureBeat, DeepMind) rekonstruiert. Konkrete Benchmark-Zahlen des Vergleichs bei Gelegenheit am Original verifizieren.