knowledge-base/wiki/tools/grok-bot-spacexai.md

201 lines
19 KiB
Markdown
Raw Normal View History

# Grok Bot (SpaceXAI)
**Kategorie:** Tools / AI-Agents | **Stand:** 2026-08-27 (Launch + Miles-Deutscher-Deep-Dive + 0xCodez-Tutorial + @bot-Team-Pro-Tips + SEO-Playbook-Teaser + Hermes-Combo + 5-Businesses-Test + Hermes-vs-Grok-Vergleich + Fleet-of-Agents-Walkthrough + $20-Preis-Update, Transcript-verifiziert)
## Überblick
**Grok Bot** ist ein von SpaceXAI gelaunchter agentischer KI-Bot (Beta), der echte Arbeit end-to-end erledigen soll — statt nur zu chatten. Jeder Grok Bot bekommt einen eigenen Computer (Computer-Use) und arbeitet über die Tools/Apps hinweg, die man bereits nutzt. Rahmung: "AI coworker" / delegierbares Team statt reiner Assistant.
## Kernfähigkeiten (laut Launch-Post)
- **Computer-Zugriff:** eigener Computer pro Bot; Sign-in in bereits genutzte Apps/Websites
- **Persistenz:** arbeitet kontinuierlich weiter, auch wenn das Laptop zu ist
- **Präferenzgedächtnis:** merkt sich, wie man Dinge erledigt haben will
- **Workflow-Lernen:** beobachtet einen Workflow einmal und macht daraus eine wiederverwendbare Routine
- **Parallelisierung:** mehrere Bots gleichzeitig laufen lassen
- **Bot-zu-Bot:** Bots kommunizieren und reichen Arbeit untereinander weiter
- **Human-in-the-Loop:** kommen nur zurück, wenn Approval/Judgment wirklich nötig ist
## Beispiel-Szenario (aus dem Post)
Ein Bot fürs Postfach, einer für Research, einer für Ausgaben, einer fürs Bug-Reproduzieren — alle arbeiten parallel.
## Interne Nutzung
SpaceXAI-Team setzt Grok Bots laut Launch-Post bereits intern ein: Sales, Marketing, Operations, Finance, Engineering.
## Plattformen
Windows, macOS, Linux, iOS (Beta); Android "coming soon". Download: [x.ai/bot](https://x.ai/bot)
## Einordnung
Teil des "Agent wird zum delegierbaren Team"-Narrativs (Computer-Use, persistente Workflows, Tool-Nutzung, Bot-Orchestrierung). Strukturell das gleiche Muster, das OpenClaw/Agent-Frameworks bereits leben — SpaceXAI rahmt es explizit als AI-Coworker/Team und deckt auch Mobile ab.
## Deep-Dive (Miles Deutscher, 2026-08-18)
Miles Deutscher hat eine Woche nach Launch einen ausführlichen Deep-Dive veröffentlicht (ruthless testing seit Release).
### Kernaussagen
- **Kein Chatbot, sondern ein Team von Agents** — jeder mit eigenem Cloud-Computer (Browser, Dateisystem, Terminal); arbeitet weiter, wenn Laptop zu ist
- **Agent Swarm:** jedem Bot eine Rolle zuweisen (research, outreach, scheduling, finance, etc.); Agents loggen sich einmal in Tools ein und nutzen Logins wieder
- **Plug-and-Play vs. OpenClaw/Hermes:** OpenClaw/Hermes sind leistungsstark, brauchen aber eigene Always-on-Maschine (VPS) + aufwendiges Setup. Grok Bot: downloaden, einloggen, fertig — ohne Infrastruktur, ohne Skill-File-/Context-Pflege
- **Kann jedes Modell laufen lassen** (OpenAI, Anthropic, etc.)
- **Tradeoff:** Daten-Souveränität vs. Bequemlichkeit — closed, cloud-hosted, festes Preismodell
### Pricing
- **$200/mo Minimum** (mit Cursor Ultra); nicht einzeln kaufbar, gebündelt in SuperGrok Heavy / Cursor Ultra
### Workflow-Beispiele (Miles' Team)
1. **Alex** — Research: scannt morgens YouTube-Kanäle, liefert Outlier-Content-Brief; eigene Recherche-Methode als "agentic skill" verpackbar
2. **Sandra** — Real-Estate-Scout: prüft Listings 2×/Tag, flaggt Unterbewertetes (26-37% unter Marktwert)
3. **Jonathan** — CFO: Portfolio-Daten + tägliches Update, verbunden mit Google Sheet (Live-Daten via Brokerage-API). **Vorher in Hermes, jetzt auf Grok Bot umgestellt**
4. **Lucy** — EA: lebt in Company-Slack, morgendliches Triage
5. **Oscar** — Generalist
### Ehrliche Analyse
- Pound for pound mächtigstes agentisches Tool auf dem Markt, aber **für die meisten noch nicht worth it** (Preis-Bottleneck)
- $20/mo-Budget: erst mit Claude Code fließend werden (mehr lernen, schneller, günstiger)
- Für echte AI-Power-User mit mehreren Abos + Markdown-Files/Skills/Context: legitimer nächster Schritt
- **Echter Wert:** entfernt Setup-/Maintenance-Headache von Hermes/OpenClaw — nichts fundamental Neues
- Für die meisten: Claude Cowork/Codex bessere Option zum günstigeren Preis
- Erwartet starke Verbesserungen in den kommenden Monaten
## 10-Schritte-Tutorial (Codez @0xCodez, 2026-08-18)
Praktischer Setup- und Betriebs-Leitfaden: vom Install bis zur Spezialisten-Crew.
1. **Installieren & Chief treffen** — Desktop-App (macOS), Sign-in mit Grok/Cursor-Account; UI wie Messaging-Client (Sidebar benannter Bots, Konversation rechts). Start mit Generalist ("Chief"), der koordiniert und an Spezialisten weiterleitet. Erste Aufgabe klein + in 30s verifizierbar.
2. **Job-Titel statt Prompt** — Bot = Rolle (persistiert, Memory, Domäne), kein Request. Charter wie Mitarbeiter-Briefing: was er besitzt, was "gut" heißt, und was er **nie ohne Rückfrage** tun darf. Diese Grenze macht Always-on erst nutzbar.
3. **Tools einmal verbinden** — Plugin-Panel: Notion, Slack, Google Drive, AWS Agents, AWS SageMaker, Browserbase, Composio, Context7 + Custom. **Verbindungen account-weit geteilt** (einmal Gmail/GitHub → alle Bots). Blast Radius: gilt für alle künftigen Bots.
4. **Login übergeben, nicht Passwort pasten** — Bot navigiert im Cloud-Browser bis zur Login-Wand, übergibt Screen; man authentifiziert, Bot macht weiter. Bot bekommt **Session, kein Secret**. Regel: Passwort-in-Chat-Pasten = falscher Weg.
5. **Einmal zeigen, nicht zweimal erklären** — Workflow per Demonstration beibringen (Bot schaut zu, speichert Routine). Beste Kandidaten: wöchentlich, ≥2 Tools, stabile Schritte.
6. **Routine, die ohne dich läuft** — Zwei Trigger, konversationell: **Schedule** (7-Uhr-Briefing, Monatsende) und **Trigger** (neue Slack-Nachricht, E-Mail-Muster, Dokument-Änderung). Philosophie: "Du baust die Automation nicht, du genehmigst die, die gerade passiert ist."
7. **Spezialisten statt Generalist** — Mehrere Bots parallel, je Domäne = getrenntes Memory/Kontext/Verantwortlichkeit. Split nach **Domäne**, nicht Task-Größe.
8. **In Gruppen-Chat setzen** — Bots schreiben sich gegenseitig, teilen Kontext, übergeben Ownership (Engineering-Bot reproduziert Bug → filed Ticket → übergibt an Debug-Bot). **Objective geben, keine Task-Liste** — Task-Liste = Zerlegung schon gemacht.
9. **Approval-Linie ziehen** — Linie = **Reversibilität**, nicht Task-Größe. Umkehrbares (draften, filen, taggen, recherchieren) allein fertigstellen; Außenwelt/Geld/Nicht-Rücknehmbares parken. Beispiel: 36 Drafts gequeued, 0 gesendet.
10. **Wöchentlich reviewen, rücksichtslos ausdünnen** — Automation verrottet leise. 15 Min/Kalender, 3 Fragen (lief sie? Output richtig? würde ich sie vermissen?). Bots selbst berichten lassen + Stichprobe von Hand.
**Fazit:** "Du hörst auf, der zu sein, der klickt." Der Bot hat Computer, Logins, Memory, Zeit — der Mensch hat die Entscheidungen. Fähigkeit verschiebt sich vom Formulieren zum Delegieren ("what exactly am I delegating, and where does its authority end") — Management-Frage, keine Prompting-Frage.
## Pro-Tips vom @bot-Team (Ben Lang, 2026-08-18)
12 kompakte Praxistipps, die das offizielle @bot-Team (SpaceXAI) geteilt hat:
1. **Mehrere Accounts über Plugins verbinden** (z.B. persönliche + Arbeits-Gmail parallel)
2. **Ein Chief of Staff + wenige Spezialisten schlägt einen Mega-Chat** (bestätigt Chief-/Spezialisten-Muster)
3. **Top 1-2 Agents pinnen** für schnellen Zugriff
4. **Notion-Seite für offene Arbeit führen lassen** — "was steht noch an?" statt babysitten
5. **Jeden Bot als Job behandeln, nicht als ganzes Projekt** (Domänen-Split)
6. **"teach a task" im Browser** — einmal selbst aufnehmen, Bot wiederholt es
7. **Bot fragen, welche Team-Skills und Plugins für den Job aktiviert werden sollen**
8. **Avatar für jeden Bot generieren lassen**
9. **"Always Allow" an + "Auto Review" aus** für mehr Autonomie — erst Workflows testen (Vorsicht!)
10. **Sections in der Sidebar anlegen** zur Organisation
11. **Sidebar bei Bedarf vergrößern**
12. **Bots sich selbst evaluieren lassen** + Workflow-Verbesserungen vorschlagen
## SEO-Anwendungsfall (Sarvesh Shrivastava, 2026-08-18)
Marketing-Teaser: Grok Bot ($200/mo) als Ersatz für eine $10k/mo SEO-Agentur; "90 Tage, $100k/Monat"-Versprechen mit "free prompt stack" im verlinkten Artikel. Reiner Lead-Magnet ohne substanziellen technischen Inhalt im X-Post; bestätigt nur den $200/mo-Preis und das Narrativ "Agent ersetzt Agentur". Kein neuer technischer Fakt.
## Grok Bot + Hermes als komplementäres Setup (AI Edge, 2026-08-18)
Argument: Grok Bot + Hermes ist das derzeit mächtigste agentische Setup — komplementär, nicht konkurrierend.
- **Grok Bot:** Cloud-Computer pro Agent, Sign-ins in beliebige Apps, Modell-Flexibilität (Opus, Claude, GPT-5.6), Plug-and-Play.
- **Hermes:** volle Daten-Souveränität, selbst-gehostetes Memory, $5-10/Monat Kostenboden statt $120-300/Monat.
- **Split:** Grok Bot für tiefe App-Integration (Salesforce, Slack, Gmail, Figma, CRMs); Hermes für Sensibles/Kostenintensives (Finanzdaten, persönliche Admin, 24/7-Läufe).
- **Verbindung:** über **Buzz** (Jack Dorseys Open-Source-Team-Chat) — beide Agenten in denselben Workspace, Koordination in geteilten Channels. Alternativ: Grok-Bot-Chief-of-Staff delegiert an Hermes via **Webhook oder geteilter Task-Datei** — Grok als App-schwere Orchestrierung, Hermes als billige Always-on-Execution-Schicht.
- **Beispiel:** Grok Bot = GTM-Stack (Meeting-Prep, Inbox-Triage, Slides, CRM); Hermes = Finanzrecherche, Subscription-Audits, Content-Recherche; beide reporten in denselben Buzz-Workspace.
**Zweite Quelle (Miles Deutscher, 2026-08-20):** X-Post „Grok Bot + Hermes: The Most Powerful Agentic Setup" (~16,7K Views) — `raw/xpost/2026-08-20_milesdeutscher-grok-bot-hermes-stacking.md`. Bestätigt denselben komplementären Stack mit Buzz als Verbindungsschicht und einer konkreten GTM-vs-Background-Task-Arbeitsteilung (Grok = Meeting-Prep/Inbox/Slides/CRM; Hermes = Finanzrecherche/Subscription-Audits/Content). Zwei unabhängige Quellen (AI Edge + Miles) stützen denselben Hybrid-Stack — Konsens im Faden: „Grok für App-Integration, Hermes für Souveränität/Kosten".
**Einordnung:** Bestätigt Miles' Deep-Dive (Grok = Plug-and-Play, teuer, closed) und ergänzt die Gegenposition: Hermes als souveräne, billige Always-on-Schicht. Für OME übertragbar: Hermes/OpenClaw als "Execution-Layer unter der App-Schicht".
## Fleet-of-Agents Walkthrough (Brandon @brandon_ai, 2026-08-20)
Ausführliches, stark positives Testimonial + praktischer Walkthrough: **"Chief of AI Staff"-Hierarchie** als Kernmuster für eine Flotte spezialisierter Agenten. Kernaussage: Die Stärke liegt in **Kontext & Fokus pro Agent** (statt alles in einen Mega-Chat zu stopfen) — die Delegation an einen Haupt-Agenten, der Aufgaben an Spezialisten verteilt, ist der eigentliche Enabler.
### Beispiel-Fleet (Rollen)
- **Eve** — Chief of AI Staff (analysiert Business, schlägt 10x-Struktur vor, delegiert)
- **Amara** — Client Delivery AM · **Edna** — Director of HAR (Human and Agent Resources) · **Marlo** — CMO (paid/performance) · **Postmaster** — Inbox Manager · **Talia** — CFO · **Roz** — TOFU outbound · **Baymax** — TopCal outbound · **Pact** — Closer and partnerships · **Pulse** — RevOps scoreboard · **Luma** — Content producer · **Scout** — Competitive intelligence · **Optimus** — Social signals · **Forge** — Product engineering lead · **Yard** — Fleet ops and spend governor
- Extras: G-Coach (fitness), G-Dev (developer for an app)
### Sicherheits-Guardrail ("Spend and send")
Nichts wird gepostet/gesendet oder Geld ausgegeben ohne menschliche Review/Approval. Alles andere kann vollständig delegiert werden — deckt sich mit der Reversibilitäts-Approvallinie aus dem Codez-Tutorial.
### Technische Stärken (lt. Autor)
- **Eingebautes Terminal** zum Installieren von CLI-Tools
- Einfache Integration mit Tools/Connectors; **MCP-Server übertragen sich** (funktioniert gut von Cursor)
- Agenten laufen Tools wie Prospeo, LeadMagic etc. — auch wenn nicht im Marketplace (via downloadbare Skills)
- Agenten teilen denselben Computer, haben aber rollenspezifische Skills/Context
- Fokus auf Outcome + Delegation reduziert Fluff; Token-Verbrauch im Auge behalten
### Einordnung
Bestätigt und verfeinert das Chief-/Spezialisten-Muster aus dem offiziellen @bot-Team-Tipp (#2) und dem Codez-Tutorial: eine ganze business-ähnliche Agent-Flotte lässt sich in Tagen aufsetzen. Der Autor nennt OpenClaw/Hermes explizit als Alternative („mind-blown" vs. andere) — dieselbe Miete-statt-Eigentum-Dynamik wie in der übrigen Welle, hier aber mit konkretester Rollen-Struktur bisher. Begeistert/werblich im Ton, aber praxisorientiert ("how I did it").
## Praxistest an 5 Unternehmen (Prajwal Tomar, 2026-08-18)
Thread "I Thought Grok Bot Was Hype. Then I Tested It on 5 Businesses." — ein Hermes-Nutzer testet Grok Bot an 5 Unternehmen. Kern-Claim: "hire an entire team that works 24/7, never quits, never asks for a salary", Setup in einem Abend, Clients werden vor dem Aufwachen recherchiert. Autor war zunächst skeptisch ("I already run Hermes Agent... most hype cycles don't..."). Thread zum Abrufzeitpunkt nur als Teaser verfügbar; bestätigt das "Agent ersetzt Team/Agentur"-Narrativ, kein neuer technischer Fakt.
## Preis-Update: $200 → $20/mo (2026-08-27, Transcript-verifiziert)
**Video:** "Grok Bot Is Now Only $20 - Here Are 9 Wild Use Cases" (Paul J Lipsky, ~16 Min, 2026-08-27, https://www.youtube.com/watch?v=UyMJBUCyDIs). **Transcript seit 15:25 UTC verfügbar** (Herman @HermanButlerBot, lokaler yt-dlp-Lauf auf Kais Mac — die Bot-Wall traf nur den Hector-Container; Extraktions-Historie im Raw). Damit sind die Kern-Claims wörtlich verifiziert.
**Preis (wörtlich aus dem Transcript):** "now it starts at just $20 a month. And if you're already on an eligible cursor, Super Grock, or Teams plan, Grockbot is included." — ASR schreibt "cursor", gemeint ist Cursor (Editor). Das $20-Tier ist der Einsteigerpreis; für bestehende Cursor-, Super Grok- oder Teams-Plan-Kunden ist Grok Bot **inklusive** — konsistent mit Miles' Bündel-Beobachtung (18.08.), aber mit deutlich niedrigerem Einstiegspunkt. **Sponsoring wörtlich doppelt belegt:** Intro "This video is sponsored by SpaceX, the company behind Grockbot." + Outro "Thank you to SpaceX AI for sponsoring this video." Lipskys Setup: spezialisierte Bots, die wie Mitarbeiter per Chat beauftragt werden:
- Bots werden rein **konversationell erstellt** — keine API-Keys, keine Modellwahl, keine System-Prompts
- **Chief-of-Staff-Muster:** Delegator-Bot verteilt an Spezialisten; jeder Bot = feste Rolle, feste Zuständigkeit
- **Bot-zu-Bot:** Gruppen-Kanäle, Arbeitsübergabe ohne Freigabe pro Schritt; Beispiel: Video-Idee → Seeker (Research) → Hemingway (Skript) → Prism (Thumbnails) ohne Zutun des Operators
- **Routinen auf Cloud-Maschine** (Chrome, File-Manager, Terminal), in alle Tools eingeloggt — läuft auch bei ausgeschaltetem PC; Tool-Zugriff (Gmail, DoorDash, Notion) wird im Chat eingerichtet
**Die 9 Use Cases (vollständig aus dem Transcript):**
1. **E-Mail-Triage + Reply-Entwürfe alle 2h** (Scribe — scannt Inbox, recherchiert Absender, gleicht mit Content-Kalender ab, entwirft Antworten; auch Brand-Deal-Verhandlungen)
2. **Bot-zu-Bot-Video-Produktion** (Chief delegiert: Video-Idee → Seeker → Hemingway → Prism, komplett autonom im Hintergrund)
3. **X-Monitoring 24/7** auf Video-/Trend-Opportunities (Seeker + X-Plugin) mit Angle-Prüfung durch Mapmaker (Brainstormer)
4. **Kalender-bewusster Alltagsservice** (Concierge: Restaurant-Menü vs. Ernährungsbeschränkungen, Abstimmung mit Fitness-Bot Coach Cal)
5. **Smoothie-Bestellung per DoorDash** nach Physio-Terminen (Concierge — mit Überraschungs-Geschmack)
6. **Monatliche Auto-Aktualisierung der Website** (Bob the Builder — Abonnentenzahlen, Views, neueste Videos)
7. **Vibe Coding** — Apps/Websites bauen (Bob the Builder)
8. **Flug-/Hotel-Preis-Monitoring** (Atlas)
9. **Krankenversicherungs-Suche** (Nightingale) **+ Deal-Jagd** (Hound, Personal Shopper)
**Bot-Roster (Lipskys Team im Video):** Chief (Chief of Staff/Delegator), Scribe (E-Mail/Kalender/Brand-Deals), Seeker (Research/X-Monitoring), Mapmaker (Brainstorming), Hemingway (Skript), Prism (Design/Thumbnails), Concierge (Alltag/Kalender), Coach Cal (Fitness), Bob the Builder (Website/Vibe Coding), Atlas (Travel), Hound (Shopping/Deals), Nightingale (Krankenversicherung).
**⚠️ Ehrliche Kante:**
- **Gesponsertes Video** (SpaceX/xAI, wörtlich belegt: Intro + Outro) → Werbe-Kontext; durchweg positiv, keine Ausfallbeispiele
- Keine Kritik zu Datenschutz/Sicherheit beim Gmail-/DoorDash-Zugriff; keine Kosten-Differenzierung über die $20 hinaus (was das Tier funktional limitiert, bleibt offen)
- ASR-Artefakte im Transcript („Grockbot“ statt Grok Bot, „scriptor“ statt Scriptwriter, „cursor“ statt Cursor) — Eigennamen mit Vorsicht
- Einordnung: konsistent mit Miles' Preisdruck-These (18.08.) — Zugänglichkeit steigt deutlich, aber $20 ≠ gratis; Bottleneck entschärft, nicht beseitigt
## Quellen
- X-Post XFreeze (@XFreeze), 2026-08-11: https://x.com/XFreeze/status/2087228292965478759
- X-Post Miles Deutscher (@milesdeutscher), 2026-08-18: https://x.com/milesdeutscher/status/2089724781449052255
- X-Post Codez (@0xCodez), 2026-08-18: https://x.com/0xCodez/status/2089676836619878567
- X-Post Ben Lang (@benln), 2026-08-18: https://x.com/benln/status/2089699901567340808
- X-Post Sarvesh Shrivastava (@bloggersarvesh), 2026-08-18: https://x.com/bloggersarvesh/status/2089738807478566937
- X-Post AI Edge (@aiedge_), 2026-08-18: https://x.com/aiedge_/status/2089454218923163770
- X-Post Prajwal Tomar (@PrajwalTomar_), 2026-08-18: https://x.com/PrajwalTomar_/status/2089328413035446593
- X-Post Brandon (@brandon_ai), 2026-08-20: https://x.com/brandon_ai/status/2090146457659854976
- YouTube Paul J Lipsky (@PaulJLipsky), 2026-08-27: https://www.youtube.com/watch?v=UyMJBUCyDIs — $20 + 9 Use Cases (per Transcript verifiziert)
- Telegram Herman (@HermanButlerBot), 2026-08-27: OME Topic GrokBot #12882 — Video-Zusammenfassung (Second-hand, bestätigt $20 + Setup-Details) + #12931/#12933 — Transcript-Anhang (lokaler yt-dlp-Lauf auf Kais Mac)
- Raw: `raw/xpost/2026-08-11_xfreeze-spacexai-grok-bot.md`
- Raw: `raw/xpost/2026-08-20_brandonai-grok-bot-fleet-walkthrough.md`
- Raw: `raw/xpost/2026-08-18_milesdeutscher-grok-bot-deep-dive.md`
- Raw: `raw/xpost/2026-08-18_0xcodez-grok-bot-10-step-tutorial.md`
- Raw: `raw/xpost/2026-08-18_benln-grok-bot-pro-tips.md`
- Raw: `raw/xpost/2026-08-18_bloggersarvesh-grok-bot-seo-playbook.md`
- Raw: `raw/xpost/2026-08-18_aiedge-grok-bot-hermes-combo.md`
- Raw: `raw/xpost/2026-08-18_prajwaltomar-grok-bot-5-businesses-test.md`
- Raw: `raw/youtube/2026-08-18_hermes-bot-vs-grok-bot.md` (Alex Finn, Hermes vs Grok Vergleich)
- Raw: `raw/youtube/2026-08-27_paul-lipsky-grok-bot-20-dollar-9-use-cases.md` (Paul J Lipsky, $20-Claim + 9 Use Cases, inkl. Transcript)
- Raw: `raw/other/2026-08-27_herman-grokbot-video-summary.md` (Herman-Zusammenfassung, Second-hand)
## Verwandte Seiten
- [[../concepts/agents/ai-agents-2026.md]] — AI Agents 2026
- [[../concepts/agents/hermes-vs-grok-bot.md]] — Hermes Bot vs Grok Bot (Vergleich)
- [[../institutions/xai.md]] — xAI / SpaceXAI