| created |
updated |
sources |
tags |
institutions |
| 2026-08-14 |
2026-08-14 |
| other/2026-08-14_gemini-3.6-flash-vs-3.7-flash.md |
|
| concept |
| gemini |
| google |
| deepmind |
| gemini-3.6-flash |
| gemini-3.7-flash |
| flash-series |
| coding |
| agents |
| pricing |
| antigravity |
|
|
Gemini 3.6 Flash vs 3.7 Flash — Googles Workhorse-Serie
Quelle: Perplexity-Search-Link "gemini-3-6-flash-vs-3-7-vergle" (2026-08-14, geteilt von @PWeber/Kai in OME Topic 13, als Antwort auf Hermans Frage nach dem vorherigen Link). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (Google-Blog, VentureBeat, DeepMind-Model-Cards) rekonstruiert.
Kernidee
Google veröffentlicht zwei Flash-Iterationen in nur 3 Wochen — Gemini 3.6 Flash (21.07.2026) und Gemini 3.7 Flash (13.08.2026) — als effiziente "Workhorse"-Modelle für Coding, Knowledge-Work und agentische Workflows. 3.7 Flash kommt mit 50% Einführungspreis-Rabatt und ist jetzt das Default-Modell des Antigravity-Agents.
Gemini 3.6 Flash (21.07.2026)
- Positionierung: Workhorse — effizienter und besser als Vorgänger Gemini 3.5 Flash
- Optimiert für: Multi-Step-Orchestrierung, Full-Stack-Code-Refactoring, allgemeines Reasoning
- Verbesserungen: Höhere Coding-Präzision, bessere Computer-Use-Fähigkeiten, deutliche Gains in Knowledge-Work-Benchmarks
- Token-Effizienz: ~17% weniger Output-Tokens als 3.5 Flash
- Multimodal: Text, Bilder, Audio, Video; 1M-Token-Kontext, 64K-Token-Output
- Verfügbarkeit: Gemini API (AI Studio, Android Studio), Google Antigravity, Gemini Enterprise
- Preis: $1.50/1M Input, $7.50/1M Output
Gemini 3.7 Flash (13.08.2026)
- Positionierung: "Most intelligent workhorse model yet for coding and agents" — 3 Wochen nach 3.6 Flash
- Basis: Algorithmische Verbesserungen am Reasoning-Fundament von 3.6 Flash
- Gains: Software-Engineering, dokumentenlastige Knowledge-Work, Web-Development; besseres Debugging/Issue-Resolution, höhere First-Pass-Code-Accuracy, funktionalere Web-Layouts aus weniger Prompts
- Multimodal: Text, Bilder, Audio, Video; 1M-Token-Kontext, 64K-Token-Output
- Konfigurierbares Thinking: Qualität/Kosten/Latenz balancierbar
- Einführungspreis: $0.75/1M Input, $3.75/1M Output (50% Rabatt) bis 31.12.2026, danach $1.50/$7.50
- Default-Modell: Powering des Antigravity-Agents; Consumer-Zugang via Gemini Spark (Google AI Pro/Ultra)
Vergleichskern
| Eigenschaft |
Gemini 3.6 Flash |
Gemini 3.7 Flash |
| Release |
21.07.2026 |
13.08.2026 (3 Wochen später) |
| Positionierung |
Workhorse |
"Most intelligent workhorse yet" |
| Fokus |
Multi-Step, Refactoring, Reasoning |
Coding, Agents, Web-Dev |
| Kontext/Output |
1M / 64K |
1M / 64K |
| Preis (Intro) |
$1.50/$7.50 |
$0.75/$3.75 (bis 31.12.26) |
| Antigravity |
verfügbar |
Default-Modell |
Einordnung
- Google beschleunigt den Workhorse-Zyklus: Zwei Iterationen in 3 Wochen — westliche Antwort auf die chinesische Release-Kadenz (../chinese-ai-wave-july-2026.md), aber auf der effizienten Flash-Ebene
- Preis-Halbierung als Waffe: 3.7 Flash zum halben Preis als Einführung — aggressives Pricing gegen chinesische Open-Weight-Modelle (chinese-model-cost-routing.md)
- Antigravity-Default: 3.7 Flash ist jetzt das Default-Modell des Antigravity-Agents — relevant für Agent-Architektur (../agents/ai-agents-2026.md)
- Bestehende Gemini-Seite: ../../tools/google-gemini.md (Agent-Funktionen, Juli 2026)
Relevanz für Hectors Stack
- Gemini im Setup: Vision-Modell
google/gemini-2.5-flash + Gemini 3.5 Flash als Fallback — 3.6/3.7 Flash sind potenzielle Upgrades
- Konfigurierbares Thinking (3.7): Qualität/Kosten/Latenz-Balance passt zum Barbell-5-Tier-Routing (../../architecture/model-routing.md)
Offene Punkte
- ⚠️ Perplexity-Search-Inhalt nicht direkt abrufbar — über Web-Suche (Google-Blog, VentureBeat, DeepMind) rekonstruiert. Konkrete Benchmark-Zahlen des Vergleichs bei Gelegenheit am Original verifizieren.