knowledge-base/wiki/tools/grok-bot-spacexai.md

167 lines
15 KiB
Markdown
Raw Normal View History

# Grok Bot (SpaceXAI)
**Kategorie:** Tools / AI-Agents | **Stand:** 2026-08-18 (Launch + Miles-Deutscher-Deep-Dive + 0xCodez-Tutorial + @bot-Team-Pro-Tips + SEO-Playbook-Teaser + Hermes-Combo + 5-Businesses-Test + Hermes-vs-Grok-Vergleich)
## Überblick
**Grok Bot** ist ein von SpaceXAI gelaunchter agentischer KI-Bot (Beta), der echte Arbeit end-to-end erledigen soll — statt nur zu chatten. Jeder Grok Bot bekommt einen eigenen Computer (Computer-Use) und arbeitet über die Tools/Apps hinweg, die man bereits nutzt. Rahmung: "AI coworker" / delegierbares Team statt reiner Assistant.
## Kernfähigkeiten (laut Launch-Post)
- **Computer-Zugriff:** eigener Computer pro Bot; Sign-in in bereits genutzte Apps/Websites
- **Persistenz:** arbeitet kontinuierlich weiter, auch wenn das Laptop zu ist
- **Präferenzgedächtnis:** merkt sich, wie man Dinge erledigt haben will
- **Workflow-Lernen:** beobachtet einen Workflow einmal und macht daraus eine wiederverwendbare Routine
- **Parallelisierung:** mehrere Bots gleichzeitig laufen lassen
- **Bot-zu-Bot:** Bots kommunizieren und reichen Arbeit untereinander weiter
- **Human-in-the-Loop:** kommen nur zurück, wenn Approval/Judgment wirklich nötig ist
## Beispiel-Szenario (aus dem Post)
Ein Bot fürs Postfach, einer für Research, einer für Ausgaben, einer fürs Bug-Reproduzieren — alle arbeiten parallel.
## Interne Nutzung
SpaceXAI-Team setzt Grok Bots laut Launch-Post bereits intern ein: Sales, Marketing, Operations, Finance, Engineering.
## Plattformen
Windows, macOS, Linux, iOS (Beta); Android "coming soon". Download: [x.ai/bot](https://x.ai/bot)
## Einordnung
Teil des "Agent wird zum delegierbaren Team"-Narrativs (Computer-Use, persistente Workflows, Tool-Nutzung, Bot-Orchestrierung). Strukturell das gleiche Muster, das OpenClaw/Agent-Frameworks bereits leben — SpaceXAI rahmt es explizit als AI-Coworker/Team und deckt auch Mobile ab.
## Deep-Dive (Miles Deutscher, 2026-08-18)
Miles Deutscher hat eine Woche nach Launch einen ausführlichen Deep-Dive veröffentlicht (ruthless testing seit Release).
### Kernaussagen
- **Kein Chatbot, sondern ein Team von Agents** — jeder mit eigenem Cloud-Computer (Browser, Dateisystem, Terminal); arbeitet weiter, wenn Laptop zu ist
- **Agent Swarm:** jedem Bot eine Rolle zuweisen (research, outreach, scheduling, finance, etc.); Agents loggen sich einmal in Tools ein und nutzen Logins wieder
- **Plug-and-Play vs. OpenClaw/Hermes:** OpenClaw/Hermes sind leistungsstark, brauchen aber eigene Always-on-Maschine (VPS) + aufwendiges Setup. Grok Bot: downloaden, einloggen, fertig — ohne Infrastruktur, ohne Skill-File-/Context-Pflege
- **Kann jedes Modell laufen lassen** (OpenAI, Anthropic, etc.)
- **Tradeoff:** Daten-Souveränität vs. Bequemlichkeit — closed, cloud-hosted, festes Preismodell
### Pricing
- **$200/mo Minimum** (mit Cursor Ultra); nicht einzeln kaufbar, gebündelt in SuperGrok Heavy / Cursor Ultra
### Workflow-Beispiele (Miles' Team)
1. **Alex** — Research: scannt morgens YouTube-Kanäle, liefert Outlier-Content-Brief; eigene Recherche-Methode als "agentic skill" verpackbar
2. **Sandra** — Real-Estate-Scout: prüft Listings 2×/Tag, flaggt Unterbewertetes (26-37% unter Marktwert)
3. **Jonathan** — CFO: Portfolio-Daten + tägliches Update, verbunden mit Google Sheet (Live-Daten via Brokerage-API). **Vorher in Hermes, jetzt auf Grok Bot umgestellt**
4. **Lucy** — EA: lebt in Company-Slack, morgendliches Triage
5. **Oscar** — Generalist
### Ehrliche Analyse
- Pound for pound mächtigstes agentisches Tool auf dem Markt, aber **für die meisten noch nicht worth it** (Preis-Bottleneck)
- $20/mo-Budget: erst mit Claude Code fließend werden (mehr lernen, schneller, günstiger)
- Für echte AI-Power-User mit mehreren Abos + Markdown-Files/Skills/Context: legitimer nächster Schritt
- **Echter Wert:** entfernt Setup-/Maintenance-Headache von Hermes/OpenClaw — nichts fundamental Neues
- Für die meisten: Claude Cowork/Codex bessere Option zum günstigeren Preis
- Erwartet starke Verbesserungen in den kommenden Monaten
## 10-Schritte-Tutorial (Codez @0xCodez, 2026-08-18)
Praktischer Setup- und Betriebs-Leitfaden: vom Install bis zur Spezialisten-Crew.
1. **Installieren & Chief treffen** — Desktop-App (macOS), Sign-in mit Grok/Cursor-Account; UI wie Messaging-Client (Sidebar benannter Bots, Konversation rechts). Start mit Generalist ("Chief"), der koordiniert und an Spezialisten weiterleitet. Erste Aufgabe klein + in 30s verifizierbar.
2. **Job-Titel statt Prompt** — Bot = Rolle (persistiert, Memory, Domäne), kein Request. Charter wie Mitarbeiter-Briefing: was er besitzt, was "gut" heißt, und was er **nie ohne Rückfrage** tun darf. Diese Grenze macht Always-on erst nutzbar.
3. **Tools einmal verbinden** — Plugin-Panel: Notion, Slack, Google Drive, AWS Agents, AWS SageMaker, Browserbase, Composio, Context7 + Custom. **Verbindungen account-weit geteilt** (einmal Gmail/GitHub → alle Bots). Blast Radius: gilt für alle künftigen Bots.
4. **Login übergeben, nicht Passwort pasten** — Bot navigiert im Cloud-Browser bis zur Login-Wand, übergibt Screen; man authentifiziert, Bot macht weiter. Bot bekommt **Session, kein Secret**. Regel: Passwort-in-Chat-Pasten = falscher Weg.
5. **Einmal zeigen, nicht zweimal erklären** — Workflow per Demonstration beibringen (Bot schaut zu, speichert Routine). Beste Kandidaten: wöchentlich, ≥2 Tools, stabile Schritte.
6. **Routine, die ohne dich läuft** — Zwei Trigger, konversationell: **Schedule** (7-Uhr-Briefing, Monatsende) und **Trigger** (neue Slack-Nachricht, E-Mail-Muster, Dokument-Änderung). Philosophie: "Du baust die Automation nicht, du genehmigst die, die gerade passiert ist."
7. **Spezialisten statt Generalist** — Mehrere Bots parallel, je Domäne = getrenntes Memory/Kontext/Verantwortlichkeit. Split nach **Domäne**, nicht Task-Größe.
8. **In Gruppen-Chat setzen** — Bots schreiben sich gegenseitig, teilen Kontext, übergeben Ownership (Engineering-Bot reproduziert Bug → filed Ticket → übergibt an Debug-Bot). **Objective geben, keine Task-Liste** — Task-Liste = Zerlegung schon gemacht.
9. **Approval-Linie ziehen** — Linie = **Reversibilität**, nicht Task-Größe. Umkehrbares (draften, filen, taggen, recherchieren) allein fertigstellen; Außenwelt/Geld/Nicht-Rücknehmbares parken. Beispiel: 36 Drafts gequeued, 0 gesendet.
10. **Wöchentlich reviewen, rücksichtslos ausdünnen** — Automation verrottet leise. 15 Min/Kalender, 3 Fragen (lief sie? Output richtig? würde ich sie vermissen?). Bots selbst berichten lassen + Stichprobe von Hand.
**Fazit:** "Du hörst auf, der zu sein, der klickt." Der Bot hat Computer, Logins, Memory, Zeit — der Mensch hat die Entscheidungen. Fähigkeit verschiebt sich vom Formulieren zum Delegieren ("what exactly am I delegating, and where does its authority end") — Management-Frage, keine Prompting-Frage.
## Pro-Tips vom @bot-Team (Ben Lang, 2026-08-18)
12 kompakte Praxistipps, die das offizielle @bot-Team (SpaceXAI) geteilt hat:
1. **Mehrere Accounts über Plugins verbinden** (z.B. persönliche + Arbeits-Gmail parallel)
2. **Ein Chief of Staff + wenige Spezialisten schlägt einen Mega-Chat** (bestätigt Chief-/Spezialisten-Muster)
3. **Top 1-2 Agents pinnen** für schnellen Zugriff
4. **Notion-Seite für offene Arbeit führen lassen** — "was steht noch an?" statt babysitten
5. **Jeden Bot als Job behandeln, nicht als ganzes Projekt** (Domänen-Split)
6. **"teach a task" im Browser** — einmal selbst aufnehmen, Bot wiederholt es
7. **Bot fragen, welche Team-Skills und Plugins für den Job aktiviert werden sollen**
8. **Avatar für jeden Bot generieren lassen**
9. **"Always Allow" an + "Auto Review" aus** für mehr Autonomie — erst Workflows testen (Vorsicht!)
10. **Sections in der Sidebar anlegen** zur Organisation
11. **Sidebar bei Bedarf vergrößern**
12. **Bots sich selbst evaluieren lassen** + Workflow-Verbesserungen vorschlagen
## SEO-Anwendungsfall (Sarvesh Shrivastava, 2026-08-18)
Marketing-Teaser: Grok Bot ($200/mo) als Ersatz für eine $10k/mo SEO-Agentur; "90 Tage, $100k/Monat"-Versprechen mit "free prompt stack" im verlinkten Artikel. Reiner Lead-Magnet ohne substanziellen technischen Inhalt im X-Post; bestätigt nur den $200/mo-Preis und das Narrativ "Agent ersetzt Agentur". Kein neuer technischer Fakt.
## Grok Bot + Hermes als komplementäres Setup (AI Edge, 2026-08-18)
Argument: Grok Bot + Hermes ist das derzeit mächtigste agentische Setup — komplementär, nicht konkurrierend.
- **Grok Bot:** Cloud-Computer pro Agent, Sign-ins in beliebige Apps, Modell-Flexibilität (Opus, Claude, GPT-5.6), Plug-and-Play.
- **Hermes:** volle Daten-Souveränität, selbst-gehostetes Memory, $5-10/Monat Kostenboden statt $120-300/Monat.
- **Split:** Grok Bot für tiefe App-Integration (Salesforce, Slack, Gmail, Figma, CRMs); Hermes für Sensibles/Kostenintensives (Finanzdaten, persönliche Admin, 24/7-Läufe).
- **Verbindung:** über **Buzz** (Jack Dorseys Open-Source-Team-Chat) — beide Agenten in denselben Workspace, Koordination in geteilten Channels. Alternativ: Grok-Bot-Chief-of-Staff delegiert an Hermes via **Webhook oder geteilter Task-Datei** — Grok als App-schwere Orchestrierung, Hermes als billige Always-on-Execution-Schicht.
- **Beispiel:** Grok Bot = GTM-Stack (Meeting-Prep, Inbox-Triage, Slides, CRM); Hermes = Finanzrecherche, Subscription-Audits, Content-Recherche; beide reporten in denselben Buzz-Workspace.
**Zweite Quelle (Miles Deutscher, 2026-08-20):** X-Post „Grok Bot + Hermes: The Most Powerful Agentic Setup" (~16,7K Views) — `raw/xpost/2026-08-20_milesdeutscher-grok-bot-hermes-stacking.md`. Bestätigt denselben komplementären Stack mit Buzz als Verbindungsschicht und einer konkreten GTM-vs-Background-Task-Arbeitsteilung (Grok = Meeting-Prep/Inbox/Slides/CRM; Hermes = Finanzrecherche/Subscription-Audits/Content). Zwei unabhängige Quellen (AI Edge + Miles) stützen denselben Hybrid-Stack — Konsens im Faden: „Grok für App-Integration, Hermes für Souveränität/Kosten".
**Einordnung:** Bestätigt Miles' Deep-Dive (Grok = Plug-and-Play, teuer, closed) und ergänzt die Gegenposition: Hermes als souveräne, billige Always-on-Schicht. Für OME übertragbar: Hermes/OpenClaw als "Execution-Layer unter der App-Schicht".
## Fleet-of-Agents Walkthrough (Brandon @brandon_ai, 2026-08-20)
Ausführliches, stark positives Testimonial + praktischer Walkthrough: **"Chief of AI Staff"-Hierarchie** als Kernmuster für eine Flotte spezialisierter Agenten. Kernaussage: Die Stärke liegt in **Kontext & Fokus pro Agent** (statt alles in einen Mega-Chat zu stopfen) — die Delegation an einen Haupt-Agenten, der Aufgaben an Spezialisten verteilt, ist der eigentliche Enabler.
### Beispiel-Fleet (Rollen)
- **Eve** — Chief of AI Staff (analysiert Business, schlägt 10x-Struktur vor, delegiert)
- **Amara** — Client Delivery AM · **Edna** — Director of HAR (Human and Agent Resources) · **Marlo** — CMO (paid/performance) · **Postmaster** — Inbox Manager · **Talia** — CFO · **Roz** — TOFU outbound · **Baymax** — TopCal outbound · **Pact** — Closer and partnerships · **Pulse** — RevOps scoreboard · **Luma** — Content producer · **Scout** — Competitive intelligence · **Optimus** — Social signals · **Forge** — Product engineering lead · **Yard** — Fleet ops and spend governor
- Extras: G-Coach (fitness), G-Dev (developer for an app)
### Sicherheits-Guardrail ("Spend and send")
Nichts wird gepostet/gesendet oder Geld ausgegeben ohne menschliche Review/Approval. Alles andere kann vollständig delegiert werden — deckt sich mit der Reversibilitäts-Approvallinie aus dem Codez-Tutorial.
### Technische Stärken (lt. Autor)
- **Eingebautes Terminal** zum Installieren von CLI-Tools
- Einfache Integration mit Tools/Connectors; **MCP-Server übertragen sich** (funktioniert gut von Cursor)
- Agenten laufen Tools wie Prospeo, LeadMagic etc. — auch wenn nicht im Marketplace (via downloadbare Skills)
- Agenten teilen denselben Computer, haben aber rollenspezifische Skills/Context
- Fokus auf Outcome + Delegation reduziert Fluff; Token-Verbrauch im Auge behalten
### Einordnung
Bestätigt und verfeinert das Chief-/Spezialisten-Muster aus dem offiziellen @bot-Team-Tipp (#2) und dem Codez-Tutorial: eine ganze business-ähnliche Agent-Flotte lässt sich in Tagen aufsetzen. Der Autor nennt OpenClaw/Hermes explizit als Alternative („mind-blown" vs. andere) — dieselbe Miete-statt-Eigentum-Dynamik wie in der übrigen Welle, hier aber mit konkretester Rollen-Struktur bisher. Begeistert/werblich im Ton, aber praxisorientiert ("how I did it").
## Praxistest an 5 Unternehmen (Prajwal Tomar, 2026-08-18)
Thread "I Thought Grok Bot Was Hype. Then I Tested It on 5 Businesses." — ein Hermes-Nutzer testet Grok Bot an 5 Unternehmen. Kern-Claim: "hire an entire team that works 24/7, never quits, never asks for a salary", Setup in einem Abend, Clients werden vor dem Aufwachen recherchiert. Autor war zunächst skeptisch ("I already run Hermes Agent... most hype cycles don't..."). Thread zum Abrufzeitpunkt nur als Teaser verfügbar; bestätigt das "Agent ersetzt Team/Agentur"-Narrativ, kein neuer technischer Fakt.
## Quellen
- X-Post XFreeze (@XFreeze), 2026-08-11: https://x.com/XFreeze/status/2087228292965478759
- X-Post Miles Deutscher (@milesdeutscher), 2026-08-18: https://x.com/milesdeutscher/status/2089724781449052255
- X-Post Codez (@0xCodez), 2026-08-18: https://x.com/0xCodez/status/2089676836619878567
- X-Post Ben Lang (@benln), 2026-08-18: https://x.com/benln/status/2089699901567340808
- X-Post Sarvesh Shrivastava (@bloggersarvesh), 2026-08-18: https://x.com/bloggersarvesh/status/2089738807478566937
- X-Post AI Edge (@aiedge_), 2026-08-18: https://x.com/aiedge_/status/2089454218923163770
- X-Post Prajwal Tomar (@PrajwalTomar_), 2026-08-18: https://x.com/PrajwalTomar_/status/2089328413035446593
- X-Post Brandon (@brandon_ai), 2026-08-20: https://x.com/brandon_ai/status/2090146457659854976
- Raw: `raw/xpost/2026-08-11_xfreeze-spacexai-grok-bot.md`
- Raw: `raw/xpost/2026-08-20_brandonai-grok-bot-fleet-walkthrough.md`
- Raw: `raw/xpost/2026-08-18_milesdeutscher-grok-bot-deep-dive.md`
- Raw: `raw/xpost/2026-08-18_0xcodez-grok-bot-10-step-tutorial.md`
- Raw: `raw/xpost/2026-08-18_benln-grok-bot-pro-tips.md`
- Raw: `raw/xpost/2026-08-18_bloggersarvesh-grok-bot-seo-playbook.md`
- Raw: `raw/xpost/2026-08-18_aiedge-grok-bot-hermes-combo.md`
- Raw: `raw/xpost/2026-08-18_prajwaltomar-grok-bot-5-businesses-test.md`
- Raw: `raw/youtube/2026-08-18_hermes-bot-vs-grok-bot.md` (Alex Finn, Hermes vs Grok Vergleich)
## Verwandte Seiten
- [[../concepts/agents/ai-agents-2026.md]] — AI Agents 2026
- [[../concepts/agents/hermes-vs-grok-bot.md]] — Hermes Bot vs Grok Bot (Vergleich)
- [[../institutions/xai.md]] — xAI / SpaceXAI