63 lines
4 KiB
Markdown
63 lines
4 KiB
Markdown
|
|
---
|
||
|
|
created: 2026-08-14
|
||
|
|
updated: 2026-08-14
|
||
|
|
sources: [other/2026-08-14_gemini-3.6-flash-vs-3.7-flash.md]
|
||
|
|
tags: [concept, gemini, google, deepmind, gemini-3.6-flash, gemini-3.7-flash, flash-series, coding, agents, pricing, antigravity]
|
||
|
|
institutions: [google, deepmind]
|
||
|
|
---
|
||
|
|
|
||
|
|
# Gemini 3.6 Flash vs 3.7 Flash — Googles Workhorse-Serie
|
||
|
|
|
||
|
|
> **Quelle:** Perplexity-Search-Link "gemini-3-6-flash-vs-3-7-vergle" (2026-08-14, geteilt von @PWeber/Kai in OME Topic 13, als Antwort auf Hermans Frage nach dem vorherigen Link). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (Google-Blog, VentureBeat, DeepMind-Model-Cards) rekonstruiert.
|
||
|
|
|
||
|
|
## Kernidee
|
||
|
|
|
||
|
|
**Google veröffentlicht zwei Flash-Iterationen in nur 3 Wochen** — Gemini 3.6 Flash (21.07.2026) und Gemini 3.7 Flash (13.08.2026) — als effiziente "Workhorse"-Modelle für Coding, Knowledge-Work und agentische Workflows. 3.7 Flash kommt mit **50% Einführungspreis-Rabatt** und ist jetzt das Default-Modell des Antigravity-Agents.
|
||
|
|
|
||
|
|
## Gemini 3.6 Flash (21.07.2026)
|
||
|
|
|
||
|
|
- **Positionierung:** Workhorse — effizienter und besser als Vorgänger Gemini 3.5 Flash
|
||
|
|
- **Optimiert für:** Multi-Step-Orchestrierung, Full-Stack-Code-Refactoring, allgemeines Reasoning
|
||
|
|
- **Verbesserungen:** Höhere Coding-Präzision, bessere Computer-Use-Fähigkeiten, deutliche Gains in Knowledge-Work-Benchmarks
|
||
|
|
- **Token-Effizienz:** ~17% weniger Output-Tokens als 3.5 Flash
|
||
|
|
- **Multimodal:** Text, Bilder, Audio, Video; 1M-Token-Kontext, 64K-Token-Output
|
||
|
|
- **Verfügbarkeit:** Gemini API (AI Studio, Android Studio), Google Antigravity, Gemini Enterprise
|
||
|
|
- **Preis:** $1.50/1M Input, $7.50/1M Output
|
||
|
|
|
||
|
|
## Gemini 3.7 Flash (13.08.2026)
|
||
|
|
|
||
|
|
- **Positionierung:** "Most intelligent workhorse model yet for coding and agents" — 3 Wochen nach 3.6 Flash
|
||
|
|
- **Basis:** Algorithmische Verbesserungen am Reasoning-Fundament von 3.6 Flash
|
||
|
|
- **Gains:** Software-Engineering, dokumentenlastige Knowledge-Work, Web-Development; besseres Debugging/Issue-Resolution, höhere First-Pass-Code-Accuracy, funktionalere Web-Layouts aus weniger Prompts
|
||
|
|
- **Multimodal:** Text, Bilder, Audio, Video; 1M-Token-Kontext, 64K-Token-Output
|
||
|
|
- **Konfigurierbares Thinking:** Qualität/Kosten/Latenz balancierbar
|
||
|
|
- **Einführungspreis:** **$0.75/1M Input, $3.75/1M Output** (50% Rabatt) bis 31.12.2026, danach $1.50/$7.50
|
||
|
|
- **Default-Modell:** Powering des **Antigravity**-Agents; Consumer-Zugang via Gemini Spark (Google AI Pro/Ultra)
|
||
|
|
|
||
|
|
## Vergleichskern
|
||
|
|
|
||
|
|
| Eigenschaft | Gemini 3.6 Flash | Gemini 3.7 Flash |
|
||
|
|
|---|---|---|
|
||
|
|
| Release | 21.07.2026 | 13.08.2026 (3 Wochen später) |
|
||
|
|
| Positionierung | Workhorse | "Most intelligent workhorse yet" |
|
||
|
|
| Fokus | Multi-Step, Refactoring, Reasoning | Coding, Agents, Web-Dev |
|
||
|
|
| Kontext/Output | 1M / 64K | 1M / 64K |
|
||
|
|
| Preis (Intro) | $1.50/$7.50 | **$0.75/$3.75** (bis 31.12.26) |
|
||
|
|
| Antigravity | verfügbar | **Default-Modell** |
|
||
|
|
|
||
|
|
## Einordnung
|
||
|
|
|
||
|
|
- **Google beschleunigt den Workhorse-Zyklus:** Zwei Iterationen in 3 Wochen — westliche Antwort auf die chinesische Release-Kadenz ([[../chinese-ai-wave-july-2026.md]]), aber auf der effizienten Flash-Ebene
|
||
|
|
- **Preis-Halbierung als Waffe:** 3.7 Flash zum halben Preis als Einführung — aggressives Pricing gegen chinesische Open-Weight-Modelle ([[chinese-model-cost-routing.md]])
|
||
|
|
- **Antigravity-Default:** 3.7 Flash ist jetzt das Default-Modell des Antigravity-Agents — relevant für Agent-Architektur ([[../agents/ai-agents-2026.md]])
|
||
|
|
- **Bestehende Gemini-Seite:** [[../../tools/google-gemini.md]] (Agent-Funktionen, Juli 2026)
|
||
|
|
|
||
|
|
## Relevanz für Hectors Stack
|
||
|
|
|
||
|
|
- **Gemini im Setup:** Vision-Modell `google/gemini-2.5-flash` + Gemini 3.5 Flash als Fallback — 3.6/3.7 Flash sind potenzielle Upgrades
|
||
|
|
- **Konfigurierbares Thinking (3.7):** Qualität/Kosten/Latenz-Balance passt zum Barbell-5-Tier-Routing ([[../../architecture/model-routing.md]])
|
||
|
|
|
||
|
|
## Offene Punkte
|
||
|
|
|
||
|
|
- ⚠️ Perplexity-Search-Inhalt nicht direkt abrufbar — über Web-Suche (Google-Blog, VentureBeat, DeepMind) rekonstruiert. Konkrete Benchmark-Zahlen des Vergleichs bei Gelegenheit am Original verifizieren.
|