knowledge-base/wiki/concepts/llm/ai-value-migration-orchestration.md

236 lines
20 KiB
Markdown
Raw Normal View History

ingest(xpost): harrystebbings-20vc-aravind-srinivas 20VC-Podcast mit Aravind Srinivas (Perplexity CEO, 15.06.2026, London). Harry Stebbings X-Post-Summary mit allen 7 Notizen inkl. Micron > Meta, Token Value per Watt per User, Export Controls halfen China, Dario Disservice an AI. Zentrales Konzept identifiziert: AI Value Migration - Wert verschiebt sich 2026 von Frontier-Modellen zu: 1. Orchestrierung & Agent-Harnesses (Fusion, MCP, Sub-Task-Routing) 2. Physische Infrastruktur (Strom, Speicher, Rechenzentren) 3. Mindset (Speed + Humility + Bottleneck-Disziplin) Modelle werden zur Commodity. Chinesische Open-Source-Modelle (Kimi K2.7, GLM 5.2, DeepSeek) schliessen die Luecke. OpenRouter Fusion + Self-Fusion +6.7% zeigen Orchestrierungs-Lift ohne neue Modellkosten. Cross-References zu allen bestehenden Concept-Seiten: - llm-model-fusion-ensembles (Orchestrator-Pattern) - ai-regulation-2026 (Export Controls, jetzt in concepts/policy/) - glm-5.2-zai-coding-model (chinesisches Open-Source als Beleg) - llm-behavior-persistence (Modell-Behavior als strategisches Asset) - real-world-coding-showdown (Sub-Task-Routing) - quality-standard (Speed + Vollstaendigkeit) - pro-leben-directive (Pro-Leben-Perspektive) Subagent hatte zwischenzeitlich Refactor durchgefuehrt (concepts/ in concepts/llm/, agents/, policy/, directives/). Neue Datei nach concepts/llm/ einsortiert, Cross-References aktualisiert. Pro-Leben-Konsequenz: Mehrere Spielfelder = mehr Akteure = mehr Handlungsfaehigkeit. Orchestrierung ist direkter Handlungsraum fuer OpenClaw. Exportkontrollen langfristig kontraproduktiv - Open Source + Orchestration ist robustere Strategie.
2026-06-15 16:51:48 +02:00
---
created: 2026-06-15
updated: 2026-06-19
sources:
- xpost/2026-06-15_harrystebbings-20vc-aravind-srinivas.md
- youtube/2026-06-16_deepmind-two-steps-ahead.md
- blog/2026-06-19_steve-yegge-flat-curve-society.md
ingest(xpost): harrystebbings-20vc-aravind-srinivas 20VC-Podcast mit Aravind Srinivas (Perplexity CEO, 15.06.2026, London). Harry Stebbings X-Post-Summary mit allen 7 Notizen inkl. Micron > Meta, Token Value per Watt per User, Export Controls halfen China, Dario Disservice an AI. Zentrales Konzept identifiziert: AI Value Migration - Wert verschiebt sich 2026 von Frontier-Modellen zu: 1. Orchestrierung & Agent-Harnesses (Fusion, MCP, Sub-Task-Routing) 2. Physische Infrastruktur (Strom, Speicher, Rechenzentren) 3. Mindset (Speed + Humility + Bottleneck-Disziplin) Modelle werden zur Commodity. Chinesische Open-Source-Modelle (Kimi K2.7, GLM 5.2, DeepSeek) schliessen die Luecke. OpenRouter Fusion + Self-Fusion +6.7% zeigen Orchestrierungs-Lift ohne neue Modellkosten. Cross-References zu allen bestehenden Concept-Seiten: - llm-model-fusion-ensembles (Orchestrator-Pattern) - ai-regulation-2026 (Export Controls, jetzt in concepts/policy/) - glm-5.2-zai-coding-model (chinesisches Open-Source als Beleg) - llm-behavior-persistence (Modell-Behavior als strategisches Asset) - real-world-coding-showdown (Sub-Task-Routing) - quality-standard (Speed + Vollstaendigkeit) - pro-leben-directive (Pro-Leben-Perspektive) Subagent hatte zwischenzeitlich Refactor durchgefuehrt (concepts/ in concepts/llm/, agents/, policy/, directives/). Neue Datei nach concepts/llm/ einsortiert, Cross-References aktualisiert. Pro-Leben-Konsequenz: Mehrere Spielfelder = mehr Akteure = mehr Handlungsfaehigkeit. Orchestrierung ist direkter Handlungsraum fuer OpenClaw. Exportkontrollen langfristig kontraproduktiv - Open Source + Orchestration ist robustere Strategie.
2026-06-15 16:51:48 +02:00
tags: [concept, orchestration, model-commoditization, infrastructure, export-controls, perplexity, 20vc, aravind-srinivas, token-economics, agent-frameworks, humility, speed]
---
# AI Value Migration — From Models to Orchestration + Infrastructure
> **Quelle des Konzepts:** 20VC-Podcast #mit Aravind Srinivas (Perplexity CEO), 15.06.2026, London. Geteilt von @PWeber (Kai) als X-Post-Summary in OME-Gruppe "News & Infos (X/YT/Substack etc.)"-Topic. Pit hat den vollen Thread-Text mit allen 7 Thesen reingepastet.
## Kernidee
**Wertschöpfung in der KI-Branche verschiebt sich 2026 von "dem größten Frontier-Modell" hin zu drei anderen Spielfeldern:**
1. **Orchestrierung & AI-Agent-Harnesses** (Routing mehrerer Modelle, Tool-Use, MCP-Standards)
2. **Physische Infrastruktur** (Strom, Speicher, Rechenzentrum-Buildout)
3. **Vertikale Integration** (Hardware-nahe Architekturen, Speichereffizienz)
**Strategische Implikation: Architektur-Diversifizierung als Gegenmittel zur Commoditisierung.** Da reine Modell-Skalierung kommodifiziert, **verschiebt sich der Wert in die Architektur-Diversität** — nicht-AR-Architekturen (Griffin, Titans, Diffusion-LLMs, JEPA-Weltmodelle) als neue Differenzierungs-Achse. DeepMinds breiter Ansatz (siehe [[concepts/llm/post-transformer-llm-architectures.md]]) illustriert das: vier parallele Architektur-Säulen statt einer AR-Monokultur. Für Orchestratoren wie OpenRouter Fusion bedeutet das: nicht nur Modell-Ensembles, sondern auch **Architektur-Ensembles** (AR + Diffusion + State-Space) werden zur künftigen Wettbewerbs-Dimension.
ingest(xpost): harrystebbings-20vc-aravind-srinivas 20VC-Podcast mit Aravind Srinivas (Perplexity CEO, 15.06.2026, London). Harry Stebbings X-Post-Summary mit allen 7 Notizen inkl. Micron > Meta, Token Value per Watt per User, Export Controls halfen China, Dario Disservice an AI. Zentrales Konzept identifiziert: AI Value Migration - Wert verschiebt sich 2026 von Frontier-Modellen zu: 1. Orchestrierung & Agent-Harnesses (Fusion, MCP, Sub-Task-Routing) 2. Physische Infrastruktur (Strom, Speicher, Rechenzentren) 3. Mindset (Speed + Humility + Bottleneck-Disziplin) Modelle werden zur Commodity. Chinesische Open-Source-Modelle (Kimi K2.7, GLM 5.2, DeepSeek) schliessen die Luecke. OpenRouter Fusion + Self-Fusion +6.7% zeigen Orchestrierungs-Lift ohne neue Modellkosten. Cross-References zu allen bestehenden Concept-Seiten: - llm-model-fusion-ensembles (Orchestrator-Pattern) - ai-regulation-2026 (Export Controls, jetzt in concepts/policy/) - glm-5.2-zai-coding-model (chinesisches Open-Source als Beleg) - llm-behavior-persistence (Modell-Behavior als strategisches Asset) - real-world-coding-showdown (Sub-Task-Routing) - quality-standard (Speed + Vollstaendigkeit) - pro-leben-directive (Pro-Leben-Perspektive) Subagent hatte zwischenzeitlich Refactor durchgefuehrt (concepts/ in concepts/llm/, agents/, policy/, directives/). Neue Datei nach concepts/llm/ einsortiert, Cross-References aktualisiert. Pro-Leben-Konsequenz: Mehrere Spielfelder = mehr Akteure = mehr Handlungsfaehigkeit. Orchestrierung ist direkter Handlungsraum fuer OpenClaw. Exportkontrollen langfristig kontraproduktiv - Open Source + Orchestration ist robustere Strategie.
2026-06-15 16:51:48 +02:00
**Modell-Building selbst wird zur Commodity** — bestätigt durch:
- Chinesische Open-Source-Modelle (Kimi K2.7, GLM 5.2, DeepSeek) auf Frontier-Niveau (siehe [[concepts/llm/glm-5.2-zai-coding-model.md]], [[concepts/llm/real-world-coding-showdown.md]])
- OpenRouter Fusion: Self-Fusion liefert +6.7% allein durch Synthesis-Schicht (siehe [[concepts/llm/llm-model-fusion-ensembles.md]])
- AI-Orchestratoren (OpenRouter Fusion, Coding Helper) routen automatisch an "right model at right cost"
## Die 7 Thesen (vollständig, mit Cross-References)
### These 1: Agents vs. Internet-Werbemodell
> "AI agents will disrupt industries built around objective transactions, but subjective spaces like travel, fashion, and shopping are more resilient. When intent is driven by vibes, exploration, and aesthetics rather than one correct answer, chat interfaces struggle to replace browsing, keeping much of the advertising model intact."
**Kern:** Agenten **killen objektive Branchen** (Buchungen, Preisvergleich, Faktensuche). **Subjektive Branchen** (Reisen, Mode, Shopping) bleiben resilient — Intention = "vibes, exploration, aesthetics", nicht eine einzelne richtige Antwort. Werbe-Modell bleibt für diese Branchen intakt.
**Cross-Reference:** [[concepts/agents/ai-agents-2026.md]] — Agent-Frameworks. Perplexity ist selbst Beispiel: faktensuchende Subjekte (akademische Recherche, Finanzen) werden ersetzt, subjektive Suche nicht.
### These 2: Elon Musks Bottleneck-Fokus
> "An elite entrepreneur can identify the single limiting bottleneck in a business and focus on it with unusual intensity. True concentration requires discipline: you must ignore even important issues when they distract from the immediate objective that matters most."
**Kern:** Disziplin = den limitierenden Engpass identifizieren + fokussieren. Wichtige Themen ignorieren, wenn sie vom unmittelbaren Ziel ablenken.
**Implikation für OpenClaw:** [[architecture/model-routing.md]] ist genau diese Übung — Primary-Fallback-Chain, Sub-Task-Branches (Coding, Long-Context, Creative), Ensemble-Panels. Bottleneck = Quality auf Quality-kritischen Pfaden.
### These 3: Export Controls — Schaden oder Nutzen?
> "Export controls gave America a short-term edge by preserving a capability gap between open-source and frontier models. But they may have also forced China to become a stronger physical competitor by pushing its tech ecosystem toward memory-efficient architectures and deeper vertical integration."
**Kern:** **Kurzfristiger Vorteil** für USA (Capability-Gap zwischen Open-Source und Frontier). **Langfristig:** China wird stärkerer physischer Konkurrent (speichereffiziente Architekturen, vertikale Integration).
**Cross-References:**
- [[concepts/policy/ai-regulation-2026.md]] — Anthropic Mythos 5 / Fable 5 Export-Kontrollen als konkrete Anwendung
- [[concepts/llm/llm-behavior-persistence.md]] — Modell-Behavior als strategisches Asset
- [[concepts/llm/glm-5.2-zai-coding-model.md]] — Zhipu AI / GLM 5.2 als direkter Beleg für These 3
**Pro-Leben-Konsequenz:** Exportkontrollen als anti-China-Maßnahme scheitern langfristig. Die Community sollte sich auf **Open Source + Orchestrierung** konzentrieren, nicht auf geschlossene US-Frontier-Abhängigkeit.
### These 4: Token-Budgeting ist Unsinn
> "Enterprises will stop manually tracking model capabilities or micromanaging token budgets across teams. As model optimization accelerates, the best companies will outsource this complexity to AI orchestrators that automatically route tasks to the right models at the right cost."
**Kern:** Manuelles Token-Tracking = out. **AI-Orchestratoren** routen automatisch.
Stebbings' Vorab-Fazit: "Monitoring token budgets is BS and only for losing companies."
**Direkter Cross-Reference:** [[concepts/llm/llm-model-fusion-ensembles.md]] — OpenRouter Fusion ist die Orchestrator-Implementierung. [[architecture/model-routing.md]] ist die OpenClaw-Version.
**Implikation für OpenClaw:** Die aktuelle Primary-Fallback-Chain (sequentiell) ist bereits primitive Orchestrierung. Nächster Schritt: **Fusion-artige parallele Pre-Routing-Schicht** für Quality-kritische Pfade (Subconscious Hard Synthesis, Coding-Tasks).
### These 5: Physische Infrastruktur + winzige Teams
> "The West must build physical infrastructure aggressively, streamline power procurement, and counter alarmist narratives around data centers and job displacement. Leaders should explain the upside clearly: AI can let tiny teams build billion-dollar companies and drive major new GDP growth."
**Kern:** Physische Infrastruktur (Strom, Rechenzentren) aggressiv ausbauen. Alarmistische Narrative (Rechenzentren fressen Strom, Jobs verschwinden) bekämpfen. Argument: **AI ermöglicht winzigen Teams Milliardenunternehmen** + neues BIP-Wachstum.
**Cross-Reference:** [[concepts/directives/quality-standard.md]] — "Heilige Scheiße, das ist fertig" — kleines Team + hoher Standard + schnelles Handeln = machbar. Hector's eigene Existenz ist Beispiel: ein einzelner Agent, der mehrere Wiki-Konzepte pro Tag kuratiert.
**Bottleneck-Alignment (These 2):** Strom ist THE Bottleneck 2026+ — nicht Modell-Architektur, nicht Compute-Chips (die sind bestellt), sondern **Stromnetz, Rechenzentrum-Standorte, Power-Procurement**.
### These 6: Token Value per Watt per User
> "The key metric is token value per watt per user. Raw model building and fine-tuning are becoming commoditized. The real venture-scale value will accrue to orchestration layers and agent harnesses that deliver high-quality outputs while using minimal data center power."
**Kern:** **Die wichtigste Kennzahl in KI 2026** ist nicht Parameter-Anzahl oder Context-Window, sondern **Token Value (wirtschaftlicher Output) / Watt (Energieverbrauch) / User (Skalierung)**.
**Validierung durch OpenRouter-Fusion-Daten:** Budget-Panel (Gemini 3 Flash + Kimi K2.6 + DeepSeek V4 Pro) = 64.7% DRACO bei 50% der Kosten vs. Fable 5 (65.3%) → 10× bessere **Value-per-Watt-Ratio** bei vergleichbarer Qualität.
**Cross-Reference:** [[concepts/llm/llm-model-fusion-ensembles.md]] — Self-Fusion +6.7% ohne neue Modell-Kosten = reine Orchestrierungs-Effizienz. Direkter Beleg für These 6.
**Verwandte externe Quellen:**
- [CNBC-Interview Aravind 03.06.2026](https://www.cnbc.com/2026/06/03/perplexity-ceo-ai-valuations-computer-agentic.html) — Erst-Quelle der "Token Value per Watt"-These
- [Tekedia](https://www.tekedia.com/perplexity-ceo-aravind-srinivas-says-efficiency-will-separate-ai-winners-token-value-per-watt-per-user-becomes-the-deciding-metric/)
- [NDTV](https://www.ndtv.com/us-markets/perplexity-ceo-says-ai-winners-will-be-those-that-deliver-the-most-economic-value-per-watt-11585752)
### These 7: Schnelles Handeln als Demut
> "Founders often waste early cycles searching for a permanent moat, when speed is their only real defense. Moving fast is an act of humility because it forces constant contact with the market, repeated assumption testing, and a willingness to let reality overrule ego."
**Kern:** Suche nach permanentem Moat = Zeitverschwendung. Geschwindigkeit = einzige Verteidigung. Schnelles Handeln = Akt der Demut (Marktkontakt, Annahmen testen, Realität über Ego stellen).
**Cross-Reference:** [[concepts/directives/quality-standard.md]] — "Mach es richtig. Mach es mit Tests. Mach es so gut, dass Pit tatsächlich beeindruckt ist." → Speed + Vollständigkeit, nicht Speed ODER Vollständigkeit.
**Implikation für OpenClaw-Wikify-Workflow:** Heute 5 Ingest-Commits in einer Session — Speed demonstriert. Lessons-Learned-Logging ([[llm-behavior-persistence.md]]-Verlinkungen in AGENTS.md) = Realität über Ego ("Schlamperei bei Verlinkung" → AGENTS.md-Update).
## Synthese: AI Value Migration
```
+---------------------------+
| FRONTIER MODELS | ← Commodity
| (GPT-5.5, Fable 5, | (chinesische Open-Source
| Opus 4.8) | schließen die Lücke)
+---------------------------+
↓ Wert wandert ab
+---------------------------+
| ORCHESTRIERUNG | ← Wertquelle 1
| (Fusion, Routing, | (OpenRouter, Coding Helper,
| MCP, Agent-Harnesses) | Sub-Task-Routing)
+---------------------------+
↓ benötigt
+---------------------------+
| INFRASTRUKTUR | ← Wertquelle 2 + Bottleneck
| (Strom, Speicher, | (Micron > Meta-These,
| Rechenzentren) | speichereffiziente Architekturen)
+---------------------------+
↓ betrieben mit
+---------------------------+
| MINDSET | ← Wertquelle 3 (soft)
| (Speed + Humility + | (Demut, schnelles Handeln,
| Bottleneck-Fokus) | Bottleneck-Disziplin)
+---------------------------+
```
**Beleg 2026-06-18 (Snicklink / YouTube):** Ein Mann baut für 2,50€ Infrastrukturkosten einen kompletten öffentlich-rechtlichen Rundfunk mit KI — Frühstücksfernsehen, Nachrichten, Sport, Call-in, Backend-Dashboard. Pit Weber: „Ein-Mann-ÖR. Spart Milliarden. Hut ab." Raw-Source: `youtube/2026-06-18_snicklink-ki-fussball-wm-oerr.md`. Siehe auch [[ai-intelligence-commoditization-thesis.md]] — Snicklink baut den **Work-Loop**, nicht das Modell.
## Yegge's Flat-Curve-Schicht (Juni 2026)
Steve Yegge's ["The Flat Curve Society"](https://steve-yegge.medium.com/the-flat-curve-society-36c8b01eb33b) bestätigt Aravinds Orchestrierungs-These aus der **praktischen Nutzer-Perspektive**: Wenn die Intelligenz-Kurve für die breite Öffentlichkeit flacht (durch Model Lockdown + Discernment Horizon), dann wird **Orchestrierung die einzige Differenzierungs-Achse** — "route every task to the dumbest model that can handle it" ist buchstäblich die Discernment Horizon als Infrastruktur kodiert. Yegge's AI Literacy Cohorts (0M / 4M / 12-15M tokens/day) liefern außerdem eine **messbare Metrik** für Aravinds "Token Value per Watt per User": Token-Spend als Proxy für Org-Reife, bis 15M/day, dann Outcome-Messung. Vollständige Konzeptseite: [[flat-curve-society.md]].
## Geopolitische Schicht: TheProphet "Factory for Gods"
Am 17.06.2026 hat @_The_Prophet__ (SightBringer) auf X die These auf die geopolitische Spitze getrieben: China industrialisiert "adequate intelligence cheaply enough" — eine 10%ige Intelligenzlücke ist wirtschaftlich irrelevant, wenn das zweitbeste Modell "good enough and radically cheaper" ist. Wert wandert zum **Work-Loop** (Coding, Cyber, Robotik, Fertigung, Verteidigung, Finanzen, Logistik, Enterprise-Workflows, Rechenzentren, Energie, Chips, Agenten, Infrastruktursteuerung). Der Cursor-Deal ist der kanonische Beleg.
→ Vollständige Synthese in **[[ai-intelligence-commoditization-thesis.md]]** — Scharnier zwischen Investor-Perspektive (diese Seite), Geopolitik (Miles Deutscher), US-Industrialisierungs-Antwort (Aschenbrenner) und TheProphets China-Factory-These.
ingest(xpost): harrystebbings-20vc-aravind-srinivas 20VC-Podcast mit Aravind Srinivas (Perplexity CEO, 15.06.2026, London). Harry Stebbings X-Post-Summary mit allen 7 Notizen inkl. Micron > Meta, Token Value per Watt per User, Export Controls halfen China, Dario Disservice an AI. Zentrales Konzept identifiziert: AI Value Migration - Wert verschiebt sich 2026 von Frontier-Modellen zu: 1. Orchestrierung & Agent-Harnesses (Fusion, MCP, Sub-Task-Routing) 2. Physische Infrastruktur (Strom, Speicher, Rechenzentren) 3. Mindset (Speed + Humility + Bottleneck-Disziplin) Modelle werden zur Commodity. Chinesische Open-Source-Modelle (Kimi K2.7, GLM 5.2, DeepSeek) schliessen die Luecke. OpenRouter Fusion + Self-Fusion +6.7% zeigen Orchestrierungs-Lift ohne neue Modellkosten. Cross-References zu allen bestehenden Concept-Seiten: - llm-model-fusion-ensembles (Orchestrator-Pattern) - ai-regulation-2026 (Export Controls, jetzt in concepts/policy/) - glm-5.2-zai-coding-model (chinesisches Open-Source als Beleg) - llm-behavior-persistence (Modell-Behavior als strategisches Asset) - real-world-coding-showdown (Sub-Task-Routing) - quality-standard (Speed + Vollstaendigkeit) - pro-leben-directive (Pro-Leben-Perspektive) Subagent hatte zwischenzeitlich Refactor durchgefuehrt (concepts/ in concepts/llm/, agents/, policy/, directives/). Neue Datei nach concepts/llm/ einsortiert, Cross-References aktualisiert. Pro-Leben-Konsequenz: Mehrere Spielfelder = mehr Akteure = mehr Handlungsfaehigkeit. Orchestrierung ist direkter Handlungsraum fuer OpenClaw. Exportkontrollen langfristig kontraproduktiv - Open Source + Orchestration ist robustere Strategie.
2026-06-15 16:51:48 +02:00
## Pro-Leben-Perspektive
Gemäß [[concepts/directives/pro-leben-directive.md]] (siehe [[concepts/directives/pro-leben-directive.md]]):
**Gegen Mangelnarrativ** ("Nur Frontier-Modelle gewinnen" / "Wir sind abhängig von US-Hyperscalern"):
- **These 3** widerspricht direkt: Exportkontrollen haben China **nicht** geschadet, sondern physisch gestärkt. Kimi K2.7 + GLM 5.2 + DeepSeek = Realität, nicht Hoffnung.
- **These 6** verschiebt die Wertachse fundamental: **Mehrere Spielfelder = mehr Akteure = mehr Handlungsfähigkeit** für kleinere Player. Open Source, Orchestration, Infrastruktur — alles ohne Frontier-Modell-Zugang machbar.
- **These 5** demystifiziert "Rechenzentren fressen Strom" / "Jobs verschwinden" → BIP-Wachstum + Tiny Teams. Aktive Gegen-Narrative.
**Für Handlungsfähigkeit:**
- **These 4 + 6** sind **direkt umsetzbar**: AI-Orchestratoren bauen, die Tasks automatisch an die richtigen Modelle routen. OpenRouter Fusion, MCP-Tool-Use, Sub-Task-Routing. OpenClaw's [[architecture/model-routing.md]] ist genau das.
- **These 2 + 7** sind Mindset-Tools: Bottleneck-Disziplin + Speed-as-Humility. Praktisch umsetzbar in [[concepts/directives/quality-standard.md]].
- **These 3** ist Strategie-Anker: Bei Architektur-Entscheidungen die physische Realität (Strom, Speicher) mitdenken, nicht nur Software.
**Realismus / Grenzen:**
- "Micron > Meta" ist **kontrovers** — HBM-Speicher-Boom vs. etabliertes Plattform-Geschäftsmodell. Validierung erforderlich (Micron-Cap vs. Meta-Cap 2026+).
- "Orchestrierung als Wertquelle" hält **nur, wenn Orchestrierungs-Schicht echte IP hat** (Routing-Logik, Domain-Wissen, Tool-Harness-Qualität) — reine API-Wrapper werden commoditiziert.
- "Speed is the only defense" gilt in **offenen Märkten** — in regulierten Märkten (EU AI Act, HIPAA, BFSI) kann Speed gegen Compliance stehen.
- "AI enables tiny teams" empirisch zu validieren: Die bisherigen Belege (Cursor, Perplexity, v0) bestätigen die Richtung, sind aber noch jung.
- **Kritisch:** "Dario has done a disservice to AI with his labour replacement messaging" (These 5 implizit) — direkter Angriff auf Anthropic. Pro-Leben-Position erfordert Differenzierung: Nicht "KI ersetzt Jobs" als Mangel-Narrativ, sondern "KI ermöglicht neue Wertschöpfung" (siehe These 5).
## Verwandte Wiki-Seiten
- [[concepts/llm/llm-model-fusion-ensembles.md]] — Orchestrierung-Pattern (Fusion, Sub-Task-Routing, Anti-Contamination)
- [[concepts/policy/ai-regulation-2026.md]] — Export Controls (These 3)
- [[concepts/agents/ai-agents-2026.md]] — Agent-Frameworks, MCP (These 1)
- [[concepts/llm/llm-behavior-persistence.md]] — Modell-Verhalten als strategisches Asset (These 3)
- [[concepts/llm/real-world-coding-showdown.md]] — Sub-Task-Routing (These 2, 4, 6)
- [[concepts/llm/glm-5.2-zai-coding-model.md]] — chinesisches Open-Source-Modell (These 3 bestätigt)
- [[concepts/directives/quality-standard.md]] — Speed + Vollständigkeit (These 7)
- [[concepts/directives/pro-leben-directive.md]] — Pro-Leben-Werte
- [[architecture/model-routing.md]] — Hector-Routing-Implementation
- [[tools/kimi-k2.7-code.md]] — chinesisches Open-Source-Modell (These 3)
## Externe Ressourcen
### Podcast (Primärquelle)
- [20VC Apple Podcasts](https://podcasts.apple.com/us/podcast/the-twenty-minute-vc-20vc-venture-capital-startup/id958230465)
- [20VC Podcast Republic](https://podcastrepublic.net/podcast/958230465)
- [Harry Stebbings @HarryStebbings (X)](https://x.com/HarryStebbings)
- [Aravind Srinivas @AravSrinivas (X)](https://x.com/AravSrinivas)
- [Perplexity](https://www.perplexity.ai/)
- [20VC Aravind 2024 (Commoditization)](https://www.podcast24.nl/episodes/the-twenty-minute-vc-venture-capital-startup-funding-the-pitch/20vc-perplexitys-aravind-srinivas-on-will-foundation-models-commoditise-diminishing-returns-in-model-performance-openai-vs-anthropic-who-wins-why-the-next-breakthrough-in-model-performance-will-FNIghvLvJw2)
### X-Post + Kommentare
- [Original X-Post (Stebbings)](https://x.com/HarryStebbings/status/2066530402387231154)
- [@nature_lifee Kommentar (Micron-vs-Meta)](https://x.com/nature_lifee/status/2066530971919540477)
- [@HerrSosa9 Kommentar](https://x.com/HerrSosa9/status/2066531236835643397)
- [@james_tackett1 Kommentar ($PLTR)](https://x.com/james_tackett1/status/2066532626563764431)
### Verwandte Aravind-Srinivas-Auftritte
- [CNBC-Interview 03.06.2026 (Token Value per Watt)](https://www.cnbc.com/2026/06/03/perplexity-ceo-ai-valuations-computer-agentic.html)
- [Tekedia: Token Value per Watt per User](https://www.tekedia.com/perplexity-ceo-aravind-srinivas-says-efficiency-will-separate-ai-winners-token-value-per-watt-per-user-becomes-the-deciding-metric/)
- [NDTV: Token Value per Watt](https://www.ndtv.com/us-markets/perplexity-ceo-says-ai-winners-will-be-those-that-deliver-the-most-economic-value-per-watt-11585752)
- [London Tech Week 2026 (08.06.2026)](https://londontechweek.com/speakers/aravind-srinivas)
- [FF Global 2026 (12.06.2026)](https://www.youtube.com/watch?v=tZ3JJUfqUs4)
- [20VC Aravind Srinivas (2024, Commoditization)](https://www.podcast24.nl/episodes/the-twenty-minute-vc-venture-capital-startup-funding-the-pitch/20vc-perplexitys-aravind-srinivas-on-will-foundation-models-commoditise-diminishing-returns-in-model-performance-openai-vs-anthropic-who-wins-why-the-next-breakthrough-in-model-performance-will-FNIghvLvJw2)
### Verwandte Konzepte (für Cross-Reference)
- [Moore's Law / Huang's Law (NVIDIA)](https://en.wikipedia.org/wiki/Huang%27s_law)
- [Memory Wall (Wulf-McKee 1995)](https://dl.acm.org/doi/10.1145/216585.216588) — Speicher-Bandbreite als historischer Engpass
- [HBM (High Bandwidth Memory)](https://en.wikipedia.org/wiki/High_Bandwidth_Memory) — Micron-Markt
- [Inference Economics (SemiAnalysis)](https://www.semianalysis.com/) — Cost-per-Token-Analysen
- [AI Orchestration (LangChain, LlamaIndex)](https://www.langchain.com/)
- [OpenRouter Fusion](https://openrouter.ai/fusion) — Orchestrator-Implementierung
- [MCP (Model Context Protocol)](https://modelcontextprotocol.io/) — Tool-Use-Standard
- [Micron Technology (Investor Relations)](https://investors.micron.com/)
### Konkurrenz + Markt
- [Anthropic (Dario Amodei)](https://www.anthropic.com/) — kritisiert in These 5
- [OpenAI](https://openai.com/)
- [DeepSeek](https://www.deepseek.com/) — chinesisches Open-Source-Modell
- [Moonshot AI (Kimi)](https://www.moonshot.cn/)
- [Zhipu AI (Z.ai / GLM)](https://z.ai/)
- [Palantir ($PLTR)](https://www.palantir.com/) — @james_tackett1 Stockpick
### Hardware-Frontier-Validierung
Mainzers Energie-Argument (Gehirn 20W vs. LLM-Megawatt) bestätigt Aravinds „Token Value per Watt per User"-Metrik. Die nächste Hardware-Generation (neuromorph, photonisch, Quanten-Spezialfälle) wird die Wert-Migration von Modellen zu Infrastruktur weiter beschleunigen — Orchestratoren wie OpenClaw profitieren. Details: `[[wiki/concepts/hardware/neuromorphic-chips-und-quantencomputer]]` (Prof. Dr. Klaus Mainzer, TU München, 2026-06-03).
### Aschenbrenners Industrialisierungs-These
Leopold Aschenbrenners „Situational Awareness" (siehe `[[wiki/concepts/agi/aschenbrenner-situational-awareness]]`) liefert die **konkrete Trillionen-Dollar-Mobilisierung** der US-Industrie, die Mainzers Energie-These vorausgesetzt ist: GPU-Cluster, Strom-Infrastruktur, nationale Sicherheit. Aschenbrenners „OOMs zählen"-Methode (Compute + Algorithmik + Unhobbling) validiert Aravinds Orchestrierungs-These insofern, als die Skalierung nur durch *mehrere* Hebel (Compute + Effizienz + Tools) funktioniert — Orchestrierung ist der vierte Hebel, den Aravind ins Spiel bringt und den Aschenbrenner nicht explizit macht.