knowledge-base/wiki/architecture/model-routing.md

926 B

Model Routing

Migriert aus ByteRover context-tree (April 2026)

Two-Model-Pipeline

Für mehrstufige Aufgaben: Grok 4.20 → Gemini 2.5 Flash

Phase Modell Stärke
Ideation Grok 4.20 Kreative Exploration, Brainstorming, divergentes Denken
Synthesis Gemini 2.5 Flash Strukturierte Ausgabe, schnelle Synthese, konvergent

Dieses Pattern wird sowohl im allgemeinen Routing als auch im Subconscious Agent (Hard Synthesis) verwendet, aber nie als Shared Primitive formalisiert.

GPT-5.4 Konfiguration

  • Alias: GPT-5.4
  • Route: openrouter/openai/gpt-5.4
  • Context: 200k Tokens
  • Output: 32k Tokens
  • Reasoning/Thinking: Deaktiviert (per Claire Vo-Empfehlung)

Fallback-Chain (Hector Primary)

openrouter/auto
  → zai/glm-5-turbo
    → moonshot/moonshot-v1-auto
      → moonshot/kimi-k2.5
        → ollama/minimax-m2.7