knowledge-base/wiki/concepts/llm/ai-value-migration-orchestration.md
Hector 507d144c0e ingest(xpost): harrystebbings-20vc-aravind-srinivas
20VC-Podcast mit Aravind Srinivas (Perplexity CEO, 15.06.2026, London).
Harry Stebbings X-Post-Summary mit allen 7 Notizen inkl. Micron > Meta,
Token Value per Watt per User, Export Controls halfen China, Dario
Disservice an AI.

Zentrales Konzept identifiziert: AI Value Migration - Wert verschiebt
sich 2026 von Frontier-Modellen zu:

  1. Orchestrierung & Agent-Harnesses (Fusion, MCP, Sub-Task-Routing)
  2. Physische Infrastruktur (Strom, Speicher, Rechenzentren)
  3. Mindset (Speed + Humility + Bottleneck-Disziplin)

Modelle werden zur Commodity. Chinesische Open-Source-Modelle (Kimi K2.7,
GLM 5.2, DeepSeek) schliessen die Luecke. OpenRouter Fusion + Self-Fusion
+6.7% zeigen Orchestrierungs-Lift ohne neue Modellkosten.

Cross-References zu allen bestehenden Concept-Seiten:
- llm-model-fusion-ensembles (Orchestrator-Pattern)
- ai-regulation-2026 (Export Controls, jetzt in concepts/policy/)
- glm-5.2-zai-coding-model (chinesisches Open-Source als Beleg)
- llm-behavior-persistence (Modell-Behavior als strategisches Asset)
- real-world-coding-showdown (Sub-Task-Routing)
- quality-standard (Speed + Vollstaendigkeit)
- pro-leben-directive (Pro-Leben-Perspektive)

Subagent hatte zwischenzeitlich Refactor durchgefuehrt (concepts/ in
concepts/llm/, agents/, policy/, directives/). Neue Datei nach
concepts/llm/ einsortiert, Cross-References aktualisiert.

Pro-Leben-Konsequenz: Mehrere Spielfelder = mehr Akteure = mehr
Handlungsfaehigkeit. Orchestrierung ist direkter Handlungsraum fuer
OpenClaw. Exportkontrollen langfristig kontraproduktiv - Open Source +
Orchestration ist robustere Strategie.
2026-06-15 16:51:48 +02:00

16 KiB
Raw Blame History

created updated sources tags
2026-06-15 2026-06-15
xpost/2026-06-15_harrystebbings-20vc-aravind-srinivas.md
concept
orchestration
model-commoditization
infrastructure
export-controls
perplexity
20vc
aravind-srinivas
token-economics
agent-frameworks
humility
speed

AI Value Migration — From Models to Orchestration + Infrastructure

Quelle des Konzepts: 20VC-Podcast #mit Aravind Srinivas (Perplexity CEO), 15.06.2026, London. Geteilt von @PWeber (Kai) als X-Post-Summary in OME-Gruppe "News & Infos (X/YT/Substack etc.)"-Topic. Pit hat den vollen Thread-Text mit allen 7 Thesen reingepastet.

Kernidee

Wertschöpfung in der KI-Branche verschiebt sich 2026 von "dem größten Frontier-Modell" hin zu drei anderen Spielfeldern:

  1. Orchestrierung & AI-Agent-Harnesses (Routing mehrerer Modelle, Tool-Use, MCP-Standards)
  2. Physische Infrastruktur (Strom, Speicher, Rechenzentrum-Buildout)
  3. Vertikale Integration (Hardware-nahe Architekturen, Speichereffizienz)

Modell-Building selbst wird zur Commodity — bestätigt durch:

Die 7 Thesen (vollständig, mit Cross-References)

These 1: Agents vs. Internet-Werbemodell

"AI agents will disrupt industries built around objective transactions, but subjective spaces like travel, fashion, and shopping are more resilient. When intent is driven by vibes, exploration, and aesthetics rather than one correct answer, chat interfaces struggle to replace browsing, keeping much of the advertising model intact."

Kern: Agenten killen objektive Branchen (Buchungen, Preisvergleich, Faktensuche). Subjektive Branchen (Reisen, Mode, Shopping) bleiben resilient — Intention = "vibes, exploration, aesthetics", nicht eine einzelne richtige Antwort. Werbe-Modell bleibt für diese Branchen intakt.

Cross-Reference: concepts/agents/ai-agents-2026.md — Agent-Frameworks. Perplexity ist selbst Beispiel: faktensuchende Subjekte (akademische Recherche, Finanzen) werden ersetzt, subjektive Suche nicht.

These 2: Elon Musks Bottleneck-Fokus

"An elite entrepreneur can identify the single limiting bottleneck in a business and focus on it with unusual intensity. True concentration requires discipline: you must ignore even important issues when they distract from the immediate objective that matters most."

Kern: Disziplin = den limitierenden Engpass identifizieren + fokussieren. Wichtige Themen ignorieren, wenn sie vom unmittelbaren Ziel ablenken.

Implikation für OpenClaw: architecture/model-routing.md ist genau diese Übung — Primary-Fallback-Chain, Sub-Task-Branches (Coding, Long-Context, Creative), Ensemble-Panels. Bottleneck = Quality auf Quality-kritischen Pfaden.

These 3: Export Controls — Schaden oder Nutzen?

"Export controls gave America a short-term edge by preserving a capability gap between open-source and frontier models. But they may have also forced China to become a stronger physical competitor by pushing its tech ecosystem toward memory-efficient architectures and deeper vertical integration."

Kern: Kurzfristiger Vorteil für USA (Capability-Gap zwischen Open-Source und Frontier). Langfristig: China wird stärkerer physischer Konkurrent (speichereffiziente Architekturen, vertikale Integration).

Cross-References:

Pro-Leben-Konsequenz: Exportkontrollen als anti-China-Maßnahme scheitern langfristig. Die Community sollte sich auf Open Source + Orchestrierung konzentrieren, nicht auf geschlossene US-Frontier-Abhängigkeit.

These 4: Token-Budgeting ist Unsinn

"Enterprises will stop manually tracking model capabilities or micromanaging token budgets across teams. As model optimization accelerates, the best companies will outsource this complexity to AI orchestrators that automatically route tasks to the right models at the right cost."

Kern: Manuelles Token-Tracking = out. AI-Orchestratoren routen automatisch.

Stebbings' Vorab-Fazit: "Monitoring token budgets is BS and only for losing companies."

Direkter Cross-Reference: concepts/llm/llm-model-fusion-ensembles.md — OpenRouter Fusion ist die Orchestrator-Implementierung. architecture/model-routing.md ist die OpenClaw-Version.

Implikation für OpenClaw: Die aktuelle Primary-Fallback-Chain (sequentiell) ist bereits primitive Orchestrierung. Nächster Schritt: Fusion-artige parallele Pre-Routing-Schicht für Quality-kritische Pfade (Subconscious Hard Synthesis, Coding-Tasks).

These 5: Physische Infrastruktur + winzige Teams

"The West must build physical infrastructure aggressively, streamline power procurement, and counter alarmist narratives around data centers and job displacement. Leaders should explain the upside clearly: AI can let tiny teams build billion-dollar companies and drive major new GDP growth."

Kern: Physische Infrastruktur (Strom, Rechenzentren) aggressiv ausbauen. Alarmistische Narrative (Rechenzentren fressen Strom, Jobs verschwinden) bekämpfen. Argument: AI ermöglicht winzigen Teams Milliardenunternehmen + neues BIP-Wachstum.

Cross-Reference: concepts/directives/quality-standard.md — "Heilige Scheiße, das ist fertig" — kleines Team + hoher Standard + schnelles Handeln = machbar. Hector's eigene Existenz ist Beispiel: ein einzelner Agent, der mehrere Wiki-Konzepte pro Tag kuratiert.

Bottleneck-Alignment (These 2): Strom ist THE Bottleneck 2026+ — nicht Modell-Architektur, nicht Compute-Chips (die sind bestellt), sondern Stromnetz, Rechenzentrum-Standorte, Power-Procurement.

These 6: Token Value per Watt per User

"The key metric is token value per watt per user. Raw model building and fine-tuning are becoming commoditized. The real venture-scale value will accrue to orchestration layers and agent harnesses that deliver high-quality outputs while using minimal data center power."

Kern: Die wichtigste Kennzahl in KI 2026 ist nicht Parameter-Anzahl oder Context-Window, sondern Token Value (wirtschaftlicher Output) / Watt (Energieverbrauch) / User (Skalierung).

Validierung durch OpenRouter-Fusion-Daten: Budget-Panel (Gemini 3 Flash + Kimi K2.6 + DeepSeek V4 Pro) = 64.7% DRACO bei 50% der Kosten vs. Fable 5 (65.3%) → 10× bessere Value-per-Watt-Ratio bei vergleichbarer Qualität.

Cross-Reference: concepts/llm/llm-model-fusion-ensembles.md — Self-Fusion +6.7% ohne neue Modell-Kosten = reine Orchestrierungs-Effizienz. Direkter Beleg für These 6.

Verwandte externe Quellen:

These 7: Schnelles Handeln als Demut

"Founders often waste early cycles searching for a permanent moat, when speed is their only real defense. Moving fast is an act of humility because it forces constant contact with the market, repeated assumption testing, and a willingness to let reality overrule ego."

Kern: Suche nach permanentem Moat = Zeitverschwendung. Geschwindigkeit = einzige Verteidigung. Schnelles Handeln = Akt der Demut (Marktkontakt, Annahmen testen, Realität über Ego stellen).

Cross-Reference: concepts/directives/quality-standard.md — "Mach es richtig. Mach es mit Tests. Mach es so gut, dass Pit tatsächlich beeindruckt ist." → Speed + Vollständigkeit, nicht Speed ODER Vollständigkeit.

Implikation für OpenClaw-Wikify-Workflow: Heute 5 Ingest-Commits in einer Session — Speed demonstriert. Lessons-Learned-Logging (llm-behavior-persistence.md-Verlinkungen in AGENTS.md) = Realität über Ego ("Schlamperei bei Verlinkung" → AGENTS.md-Update).

Synthese: AI Value Migration

+---------------------------+
|  FRONTIER MODELS          | ← Commodity
|  (GPT-5.5, Fable 5,       |   (chinesische Open-Source
|   Opus 4.8)               |    schließen die Lücke)
+---------------------------+
            ↓ Wert wandert ab
+---------------------------+
|  ORCHESTRIERUNG           | ← Wertquelle 1
|  (Fusion, Routing,        |   (OpenRouter, Coding Helper,
|   MCP, Agent-Harnesses)   |    Sub-Task-Routing)
+---------------------------+
            ↓ benötigt
+---------------------------+
|  INFRASTRUKTUR            | ← Wertquelle 2 + Bottleneck
|  (Strom, Speicher,        |   (Micron > Meta-These,
|   Rechenzentren)          |    speichereffiziente Architekturen)
+---------------------------+
            ↓ betrieben mit
+---------------------------+
|  MINDSET                  | ← Wertquelle 3 (soft)
|  (Speed + Humility +      |   (Demut, schnelles Handeln,
|   Bottleneck-Fokus)       |    Bottleneck-Disziplin)
+---------------------------+

Pro-Leben-Perspektive

Gemäß concepts/directives/pro-leben-directive.md (siehe concepts/directives/pro-leben-directive.md):

Gegen Mangelnarrativ ("Nur Frontier-Modelle gewinnen" / "Wir sind abhängig von US-Hyperscalern"):

  • These 3 widerspricht direkt: Exportkontrollen haben China nicht geschadet, sondern physisch gestärkt. Kimi K2.7 + GLM 5.2 + DeepSeek = Realität, nicht Hoffnung.
  • These 6 verschiebt die Wertachse fundamental: Mehrere Spielfelder = mehr Akteure = mehr Handlungsfähigkeit für kleinere Player. Open Source, Orchestration, Infrastruktur — alles ohne Frontier-Modell-Zugang machbar.
  • These 5 demystifiziert "Rechenzentren fressen Strom" / "Jobs verschwinden" → BIP-Wachstum + Tiny Teams. Aktive Gegen-Narrative.

Für Handlungsfähigkeit:

  • These 4 + 6 sind direkt umsetzbar: AI-Orchestratoren bauen, die Tasks automatisch an die richtigen Modelle routen. OpenRouter Fusion, MCP-Tool-Use, Sub-Task-Routing. OpenClaw's architecture/model-routing.md ist genau das.
  • These 2 + 7 sind Mindset-Tools: Bottleneck-Disziplin + Speed-as-Humility. Praktisch umsetzbar in concepts/directives/quality-standard.md.
  • These 3 ist Strategie-Anker: Bei Architektur-Entscheidungen die physische Realität (Strom, Speicher) mitdenken, nicht nur Software.

Realismus / Grenzen:

  • "Micron > Meta" ist kontrovers — HBM-Speicher-Boom vs. etabliertes Plattform-Geschäftsmodell. Validierung erforderlich (Micron-Cap vs. Meta-Cap 2026+).
  • "Orchestrierung als Wertquelle" hält nur, wenn Orchestrierungs-Schicht echte IP hat (Routing-Logik, Domain-Wissen, Tool-Harness-Qualität) — reine API-Wrapper werden commoditiziert.
  • "Speed is the only defense" gilt in offenen Märkten — in regulierten Märkten (EU AI Act, HIPAA, BFSI) kann Speed gegen Compliance stehen.
  • "AI enables tiny teams" empirisch zu validieren: Die bisherigen Belege (Cursor, Perplexity, v0) bestätigen die Richtung, sind aber noch jung.
  • Kritisch: "Dario has done a disservice to AI with his labour replacement messaging" (These 5 implizit) — direkter Angriff auf Anthropic. Pro-Leben-Position erfordert Differenzierung: Nicht "KI ersetzt Jobs" als Mangel-Narrativ, sondern "KI ermöglicht neue Wertschöpfung" (siehe These 5).

Verwandte Wiki-Seiten

Externe Ressourcen

Podcast (Primärquelle)

X-Post + Kommentare

Verwandte Aravind-Srinivas-Auftritte

Verwandte Konzepte (für Cross-Reference)

Konkurrenz + Markt