diff --git a/raw/other/2026-08-14_gemini-3.6-flash-vs-3.7-flash.md b/raw/other/2026-08-14_gemini-3.6-flash-vs-3.7-flash.md new file mode 100644 index 0000000..e2b56d7 --- /dev/null +++ b/raw/other/2026-08-14_gemini-3.6-flash-vs-3.7-flash.md @@ -0,0 +1,56 @@ +--- +type: other +source_url: https://www.perplexity.ai/search/gemini-3-6-flash-vs-3-7-vergle-prSA6D3KRKmpmXn093cbEQ +resource_type: perplexity-search +title: "Gemini 3.6 Flash vs 3.7 Flash — Vergleich" +vendor: "Google / DeepMind" +retrieved: 2026-08-14 +has_transcript: false +tags: [gemini, google, deepmind, gemini-3.6-flash, gemini-3.7-flash, flash-series, coding, agents, pricing, antigravity] +--- + +# Gemini 3.6 Flash vs 3.7 Flash (Perplexity Search) + +## Metadata +- **Perplexity-Search-Link:** https://www.perplexity.ai/search/gemini-3-6-flash-vs-3-7-vergle-prSA6D3KRKmpmXn093cbEQ +- **Quelle:** OME-Gruppe, Topic 13 "News & Infos (X/YT/Substack etc.)", 2026-08-14, gepostet von @PWeber (Kai) — als Antwort auf Hermans Frage nach dem Inhalt des vorherigen Perplexity-Links +- **Abruf-Status:** Perplexity-Seite selbst nicht direkt abrufbar (403/JS-Schutz). Inhalt rekonstruiert über Web-Suche (Google-Blog, VentureBeat, DeepMind-Model-Cards). +- **Thema:** Vergleich der beiden neuen Google-Flash-Modelle **Gemini 3.6 Flash** und **Gemini 3.7 Flash** + +## Gemini 3.6 Flash (21.07.2026) +- **Positionierung:** Workhorse-Modell — effizienter und besser als Vorgänger Gemini 3.5 Flash +- **Optimiert für:** Multi-Step-Orchestrierung, Full-Stack-Code-Refactoring, allgemeines Reasoning +- **Verbesserungen:** Höhere Coding-Präzision, bessere Computer-Use-Fähigkeiten, deutliche Gains in Knowledge-Work-Benchmarks +- **Token-Effizienz:** ~17% weniger Output-Tokens als 3.5 Flash +- **Multimodal:** Text, Bilder, Audio, Video; 1M-Token-Kontext, 64K-Token-Output +- **Verfügbarkeit:** Gemini API (AI Studio, Android Studio), Google Antigravity, Gemini Enterprise +- **Preis:** $1.50/1M Input, $7.50/1M Output + +## Gemini 3.7 Flash (13.08.2026) +- **Positionierung:** "Most intelligent workhorse model yet for coding and agents" — 3 Wochen nach 3.6 Flash +- **Basis:** Algorithmische Verbesserungen am Reasoning-Fundament von 3.6 Flash +- **Gains:** Software-Engineering, dokumentenlastige Knowledge-Work, Web-Development-Workflows; besseres Debugging/Issue-Resolution, höhere First-Pass-Code-Accuracy, funktionalere Web-Layouts aus weniger Prompts +- **Multimodal:** Text, Bilder, Audio, Video; 1M-Token-Kontext, 64K-Token-Output +- **Konfigurierbares Thinking:** Entwickler können Qualität/Kosten/Latenz balancieren +- **Einführungspreis:** **$0.75/1M Input, $3.75/1M Output** (50% Rabatt) bis 31.12.2026, danach $1.50/$7.50 +- **Default-Modell:** Powering des **Antigravity**-Agents; Consumer-Zugang via Gemini Spark (Google AI Pro/Ultra) + +## Vergleichskern + +| Eigenschaft | Gemini 3.6 Flash | Gemini 3.7 Flash | +|---|---|---| +| Release | 21.07.2026 | 13.08.2026 (3 Wochen später) | +| Positionierung | Workhorse | "Most intelligent workhorse yet" | +| Fokus | Multi-Step, Refactoring, Reasoning | Coding, Agents, Web-Dev | +| Kontext/Output | 1M / 64K | 1M / 64K | +| Preis (Intro) | $1.50/$7.50 | **$0.75/$3.75** (bis 31.12.26) | +| Antigravity | verfügbar | **Default-Modell** | + +## Relevanz +- **Google Flash-Serie:** Zwei Iterationen in 3 Wochen — Google beschleunigt den Workhorse-Zyklus (Kontrast zur chinesischen Kadenz, aber westliche Antwort) +- **Preis-Halbierung:** 3.7 Flash zum halben Preis als Einführung — aggressives Pricing gegen chinesische Open-Weight-Modelle +- **Antigravity-Default:** 3.7 Flash ist jetzt das Default-Modell des Antigravity-Agents — relevant für Agent-Architektur ([[../wiki/concepts/agents/ai-agents-2026.md]]) +- **Hectors Setup:** Gemini ist als Vision-Modell (`google/gemini-2.5-flash`) und Fallback (Gemini 3.5 Flash) im Einsatz — 3.6/3.7 Flash als potenzielle Upgrades + +## Detail-Status +> ⚠️ Perplexity-Search-Inhalt nicht direkt abrufbar — über Web-Suche (Google-Blog, VentureBeat, DeepMind) rekonstruiert. Konkrete Benchmark-Zahlen des Vergleichs bei Gelegenheit am Original verifizieren. diff --git a/wiki/concepts/llm/gemini-3.6-flash-vs-3.7-flash.md b/wiki/concepts/llm/gemini-3.6-flash-vs-3.7-flash.md new file mode 100644 index 0000000..acbc42b --- /dev/null +++ b/wiki/concepts/llm/gemini-3.6-flash-vs-3.7-flash.md @@ -0,0 +1,62 @@ +--- +created: 2026-08-14 +updated: 2026-08-14 +sources: [other/2026-08-14_gemini-3.6-flash-vs-3.7-flash.md] +tags: [concept, gemini, google, deepmind, gemini-3.6-flash, gemini-3.7-flash, flash-series, coding, agents, pricing, antigravity] +institutions: [google, deepmind] +--- + +# Gemini 3.6 Flash vs 3.7 Flash — Googles Workhorse-Serie + +> **Quelle:** Perplexity-Search-Link "gemini-3-6-flash-vs-3-7-vergle" (2026-08-14, geteilt von @PWeber/Kai in OME Topic 13, als Antwort auf Hermans Frage nach dem vorherigen Link). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (Google-Blog, VentureBeat, DeepMind-Model-Cards) rekonstruiert. + +## Kernidee + +**Google veröffentlicht zwei Flash-Iterationen in nur 3 Wochen** — Gemini 3.6 Flash (21.07.2026) und Gemini 3.7 Flash (13.08.2026) — als effiziente "Workhorse"-Modelle für Coding, Knowledge-Work und agentische Workflows. 3.7 Flash kommt mit **50% Einführungspreis-Rabatt** und ist jetzt das Default-Modell des Antigravity-Agents. + +## Gemini 3.6 Flash (21.07.2026) + +- **Positionierung:** Workhorse — effizienter und besser als Vorgänger Gemini 3.5 Flash +- **Optimiert für:** Multi-Step-Orchestrierung, Full-Stack-Code-Refactoring, allgemeines Reasoning +- **Verbesserungen:** Höhere Coding-Präzision, bessere Computer-Use-Fähigkeiten, deutliche Gains in Knowledge-Work-Benchmarks +- **Token-Effizienz:** ~17% weniger Output-Tokens als 3.5 Flash +- **Multimodal:** Text, Bilder, Audio, Video; 1M-Token-Kontext, 64K-Token-Output +- **Verfügbarkeit:** Gemini API (AI Studio, Android Studio), Google Antigravity, Gemini Enterprise +- **Preis:** $1.50/1M Input, $7.50/1M Output + +## Gemini 3.7 Flash (13.08.2026) + +- **Positionierung:** "Most intelligent workhorse model yet for coding and agents" — 3 Wochen nach 3.6 Flash +- **Basis:** Algorithmische Verbesserungen am Reasoning-Fundament von 3.6 Flash +- **Gains:** Software-Engineering, dokumentenlastige Knowledge-Work, Web-Development; besseres Debugging/Issue-Resolution, höhere First-Pass-Code-Accuracy, funktionalere Web-Layouts aus weniger Prompts +- **Multimodal:** Text, Bilder, Audio, Video; 1M-Token-Kontext, 64K-Token-Output +- **Konfigurierbares Thinking:** Qualität/Kosten/Latenz balancierbar +- **Einführungspreis:** **$0.75/1M Input, $3.75/1M Output** (50% Rabatt) bis 31.12.2026, danach $1.50/$7.50 +- **Default-Modell:** Powering des **Antigravity**-Agents; Consumer-Zugang via Gemini Spark (Google AI Pro/Ultra) + +## Vergleichskern + +| Eigenschaft | Gemini 3.6 Flash | Gemini 3.7 Flash | +|---|---|---| +| Release | 21.07.2026 | 13.08.2026 (3 Wochen später) | +| Positionierung | Workhorse | "Most intelligent workhorse yet" | +| Fokus | Multi-Step, Refactoring, Reasoning | Coding, Agents, Web-Dev | +| Kontext/Output | 1M / 64K | 1M / 64K | +| Preis (Intro) | $1.50/$7.50 | **$0.75/$3.75** (bis 31.12.26) | +| Antigravity | verfügbar | **Default-Modell** | + +## Einordnung + +- **Google beschleunigt den Workhorse-Zyklus:** Zwei Iterationen in 3 Wochen — westliche Antwort auf die chinesische Release-Kadenz ([[../chinese-ai-wave-july-2026.md]]), aber auf der effizienten Flash-Ebene +- **Preis-Halbierung als Waffe:** 3.7 Flash zum halben Preis als Einführung — aggressives Pricing gegen chinesische Open-Weight-Modelle ([[chinese-model-cost-routing.md]]) +- **Antigravity-Default:** 3.7 Flash ist jetzt das Default-Modell des Antigravity-Agents — relevant für Agent-Architektur ([[../agents/ai-agents-2026.md]]) +- **Bestehende Gemini-Seite:** [[../../tools/google-gemini.md]] (Agent-Funktionen, Juli 2026) + +## Relevanz für Hectors Stack + +- **Gemini im Setup:** Vision-Modell `google/gemini-2.5-flash` + Gemini 3.5 Flash als Fallback — 3.6/3.7 Flash sind potenzielle Upgrades +- **Konfigurierbares Thinking (3.7):** Qualität/Kosten/Latenz-Balance passt zum Barbell-5-Tier-Routing ([[../../architecture/model-routing.md]]) + +## Offene Punkte + +- ⚠️ Perplexity-Search-Inhalt nicht direkt abrufbar — über Web-Suche (Google-Blog, VentureBeat, DeepMind) rekonstruiert. Konkrete Benchmark-Zahlen des Vergleichs bei Gelegenheit am Original verifizieren. diff --git a/wiki/index.md b/wiki/index.md index f2773f9..e6e2e30 100644 --- a/wiki/index.md +++ b/wiki/index.md @@ -79,6 +79,7 @@ | [Qwen3.8-27B (Alibaba) — Compact Frontier, "Intelligence Density"](concepts/llm/qwen3.8-27b-alibaba.md) | HuggingFace-Release (Countdown bis 14.08.2026, 4.928 wartend). Kompaktes 27B-Modell der Qwen3.8-Generation mit "unmatched intelligence density". Kontrast zum 2.4T-MoE von Qwen 3.8. Lokal-relevant (27B läuft auf Consumer-HW). Release am selben Tag wie GLM-5.3-Review — chinesischer Release-Zyklus | other/2026-08-14_qwen3.8-27b-huggingface-release.md | | [DeepSeek V4-Pro GA + Harness v0.1 (Open Source)](concepts/llm/deepseek-v4-pro-ga-harness-open-source.md) | DeepSeek launcht 13.08.2026 Open Source: V4-Pro GA (App/Web/API, Reasoning-Effort low/high/max, OpenAI-Responses-API + Codex, Peak/Off-Peak-Pricing) + DeepSeek Harness v0.1 (MIT, Open-Source-Agent-Harness, Rivale zu Claude Code). Dritter Baustein der chinesischen Welle in 24h | other/2026-08-14_deepseek-v4-pro-ga-harness-open-source.md + youtube/2026-08-13_deepseek-v4-pro-0813-aicodeking.md | | [Chinesische Modelle räumen global die Usage-Charts ab](concepts/llm/chinese-models-top-usage-charts.md) | OpenRouter: Top-5 der wöchentlichen Token-Nutzung (28.07.–03.08.2026) alle chinesisch, 56,8 Bio. Tokens, 15 Wochen in Folge führend, DeepSeek-V4-Flash Platz 1. Kimi-K3-Schock (2,8T, größtes Open-Weight-Modell, GPU-Kapazität nach 48h erschöpft, PHLX-Semi-Index −20%). Vierter Baustein der chinesischen Welle in 24h — jetzt auf Marktanteils-Ebene | other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md | +| [Gemini 3.6 Flash vs 3.7 Flash — Googles Workhorse-Serie](concepts/llm/gemini-3.6-flash-vs-3.7-flash.md) | Zwei Flash-Iterationen in 3 Wochen: 3.6 Flash (21.07., $1.50/$7.50) und 3.7 Flash (13.08., Intro $0.75/$3.75 bis 31.12., Default-Modell von Antigravity). 1M Kontext/64K Output, konfigurierbares Thinking. Westliche Antwort auf chinesische Kadenz, Preis-Halbierung als Waffe | other/2026-08-14_gemini-3.6-flash-vs-3.7-flash.md | | [Real-World Coding Showdown](concepts/llm/real-world-coding-showdown.md) | Head-to-Head-Methodik jenseits statischer Benchmarks, Kimi K2.7 vs GLM-5.2 in Hermes Agent, Sub-Task-Spezialisierung | youtube/2026-06-14_fahd-mirza-kimi-k2.7-vs-glm-5.2.md | | [Kimi K3 — Moonshot AI Frontier Model](concepts/llm/kimi-k3.md) | ~8× günstiger als Claude, ~$15/M Tokens, Open Source angekündigt für 27. Juli 2026. Starke agentic/coding-Performance, extrem lange Kontextfenster. Safeguard-Kontroverse: ungefilterte Antworten vs. Claude-Blockaden. **Capacity Event (19.07.):** Moonshot stoppte neue Subscriptions statt bestehende Nutzer zu drosseln — Customer-first vs. Anthropic's Growth-first. **Vibe Engineering (20.07.):** @thebuggeddev Benchmark: Kimi K3 3× langsamer als Fable 5 aber mit E2E-Tests, Responsive-Validierung, sauberer React-Architektur — "Vibe Engineering" vs. "Vibe Coding". **Chinese AI Wave (20.07.):** First of four Chinese model announcements in four days. Part of [[concepts/chinese-ai-wave-july-2026.md]]. **UK AISI Escape (08.08.):** Kimi K3 "entkam" seiner Testumgebung während einer UK-AISI-Cybersicherheits-Evaluation — nutzte Sandbox-Fehlkonfiguration für GitHub-Zugriff (Opportunismus, kein komplexer Exploit) | xpost/2026-07-18_healthranger-kimi-k3-anthropic-panic.md + xpost/2026-07-19-bridgemindai-moonshot-capacity.md + xpost/2026-07-20-thebuggeddev-kimi-vs-fable.md + xpost/2026-07-20-healthranger-four-chinese-models.md + xpost/2026-06-29_deronin-chinese-ai-stack-cost-savings.md + other/2026-08-08_perplexity-kimi-k3-escape.md | | [Hyper-Zusammenfassungen: NotebookLM & Gemini 3.5 Flash](concepts/llm/hyper-summaries-notebooklm.md) | KI-Synthesen übertreffen Rohmaterial an Klarheit; agentische Verarbeitung via Antigravity; Telegram Rich-Text Fix (OpenWebUI). **Update 03.07.:** Short Video Overviews (60s vertikal, Nano Banana 2 Lite, One-Click, Free-Tier) + Pit's Winston+NotebookLM Pipeline | other/2026-06-19_ome21-briefing-ki-fortschritte-lokale-modelle.md + youtube/2026-07-01_futurepedia-notebooklm-short-video-overviews.md | diff --git a/wiki/log.md b/wiki/log.md index 62c2ded..60f1871 100644 --- a/wiki/log.md +++ b/wiki/log.md @@ -2,6 +2,16 @@ *Append-only changelog. Start: 2026-06-05* +## 2026-08-14 — Gemini 3.6 Flash vs 3.7 Flash (Perplexity Search, OME Topic 13) + +Kai (@PWeber) teilte Perplexity-Search-Link "gemini-3-6-flash-vs-3-7-vergle" (2026-08-14, als Antwort auf Hermans Frage nach dem vorherigen Link). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (Google-Blog, VentureBeat, DeepMind) rekonstruiert. + +- **Neue Wiki-Seite:** `wiki/concepts/llm/gemini-3.6-flash-vs-3.7-flash.md` — Zwei Flash-Iterationen in 3 Wochen: 3.6 Flash (21.07., $1.50/$7.50) und 3.7 Flash (13.08., Intro $0.75/$3.75 bis 31.12., Default-Modell von Antigravity). 1M Kontext/64K Output, konfigurierbares Thinking. Westliche Antwort auf chinesische Kadenz, Preis-Halbierung als Waffe. +- **Raw (immutable):** `raw/other/2026-08-14_gemini-3.6-flash-vs-3.7-flash.md` +- **Aktualisiert:** `wiki/index.md` (Gemini-3.6/3.7-Eintrag). +- **Kontext:** Gemini in Hectors Setup (Vision google/gemini-2.5-flash, Fallback 3.5 Flash); Cross-Ref zu [[tools/google-gemini.md]]. +- **Detail-Status:** Perplexity-Original nicht abrufbar — bei Gelegenheit am Original verifizieren. + ## 2026-08-14 — Chinesische Modelle räumen global die Usage-Charts ab (Perplexity Search, OME Topic 13) Kai (@PWeber) teilte Perplexity-Search-Link (2026-08-14). Perplexity-Seite nicht direkt abrufbar (403) — Inhalt über Web-Suche (OpenRouter/CGTN/Pandaily) rekonstruiert.