knowledge-base/wiki/tools/grok-bot-spacexai.md

22 KiB
Raw Blame History

Grok Bot (SpaceXAI)

Kategorie: Tools / AI-Agents | Stand: 2026-09-15 (Launch + Miles-Deutscher-Deep-Dive + 0xCodez-Tutorial + @bot-Team-Pro-Tips + SEO-Playbook-Teaser + Hermes-Combo + 5-Businesses-Test + Hermes-vs-Grok-Vergleich + Fleet-of-Agents-Walkthrough + $20-Preis-Update, Transcript-verifiziert + Grok-Bot-Galaxy-Livestream)

Überblick

Grok Bot ist ein von SpaceXAI gelaunchter agentischer KI-Bot (Beta), der echte Arbeit end-to-end erledigen soll — statt nur zu chatten. Jeder Grok Bot bekommt einen eigenen Computer (Computer-Use) und arbeitet über die Tools/Apps hinweg, die man bereits nutzt. Rahmung: "AI coworker" / delegierbares Team statt reiner Assistant.

Kernfähigkeiten (laut Launch-Post)

  • Computer-Zugriff: eigener Computer pro Bot; Sign-in in bereits genutzte Apps/Websites
  • Persistenz: arbeitet kontinuierlich weiter, auch wenn das Laptop zu ist
  • Präferenzgedächtnis: merkt sich, wie man Dinge erledigt haben will
  • Workflow-Lernen: beobachtet einen Workflow einmal und macht daraus eine wiederverwendbare Routine
  • Parallelisierung: mehrere Bots gleichzeitig laufen lassen
  • Bot-zu-Bot: Bots kommunizieren und reichen Arbeit untereinander weiter
  • Human-in-the-Loop: kommen nur zurück, wenn Approval/Judgment wirklich nötig ist

Beispiel-Szenario (aus dem Post)

Ein Bot fürs Postfach, einer für Research, einer für Ausgaben, einer fürs Bug-Reproduzieren — alle arbeiten parallel.

Interne Nutzung

SpaceXAI-Team setzt Grok Bots laut Launch-Post bereits intern ein: Sales, Marketing, Operations, Finance, Engineering.

Plattformen

Windows, macOS, Linux, iOS (Beta); Android "coming soon". Download: x.ai/bot

Einordnung

Teil des "Agent wird zum delegierbaren Team"-Narrativs (Computer-Use, persistente Workflows, Tool-Nutzung, Bot-Orchestrierung). Strukturell das gleiche Muster, das OpenClaw/Agent-Frameworks bereits leben — SpaceXAI rahmt es explizit als AI-Coworker/Team und deckt auch Mobile ab.

Deep-Dive (Miles Deutscher, 2026-08-18)

Miles Deutscher hat eine Woche nach Launch einen ausführlichen Deep-Dive veröffentlicht (ruthless testing seit Release).

Kernaussagen

  • Kein Chatbot, sondern ein Team von Agents — jeder mit eigenem Cloud-Computer (Browser, Dateisystem, Terminal); arbeitet weiter, wenn Laptop zu ist
  • Agent Swarm: jedem Bot eine Rolle zuweisen (research, outreach, scheduling, finance, etc.); Agents loggen sich einmal in Tools ein und nutzen Logins wieder
  • Plug-and-Play vs. OpenClaw/Hermes: OpenClaw/Hermes sind leistungsstark, brauchen aber eigene Always-on-Maschine (VPS) + aufwendiges Setup. Grok Bot: downloaden, einloggen, fertig — ohne Infrastruktur, ohne Skill-File-/Context-Pflege
  • Kann jedes Modell laufen lassen (OpenAI, Anthropic, etc.)
  • Tradeoff: Daten-Souveränität vs. Bequemlichkeit — closed, cloud-hosted, festes Preismodell

Pricing

  • $200/mo Minimum (mit Cursor Ultra); nicht einzeln kaufbar, gebündelt in SuperGrok Heavy / Cursor Ultra

Workflow-Beispiele (Miles' Team)

  1. Alex — Research: scannt morgens YouTube-Kanäle, liefert Outlier-Content-Brief; eigene Recherche-Methode als "agentic skill" verpackbar
  2. Sandra — Real-Estate-Scout: prüft Listings 2×/Tag, flaggt Unterbewertetes (26-37% unter Marktwert)
  3. Jonathan — CFO: Portfolio-Daten + tägliches Update, verbunden mit Google Sheet (Live-Daten via Brokerage-API). Vorher in Hermes, jetzt auf Grok Bot umgestellt
  4. Lucy — EA: lebt in Company-Slack, morgendliches Triage
  5. Oscar — Generalist

Ehrliche Analyse

  • Pound for pound mächtigstes agentisches Tool auf dem Markt, aber für die meisten noch nicht worth it (Preis-Bottleneck)
  • $20/mo-Budget: erst mit Claude Code fließend werden (mehr lernen, schneller, günstiger)
  • Für echte AI-Power-User mit mehreren Abos + Markdown-Files/Skills/Context: legitimer nächster Schritt
  • Echter Wert: entfernt Setup-/Maintenance-Headache von Hermes/OpenClaw — nichts fundamental Neues
  • Für die meisten: Claude Cowork/Codex bessere Option zum günstigeren Preis
  • Erwartet starke Verbesserungen in den kommenden Monaten

10-Schritte-Tutorial (Codez @0xCodez, 2026-08-18)

Praktischer Setup- und Betriebs-Leitfaden: vom Install bis zur Spezialisten-Crew.

  1. Installieren & Chief treffen — Desktop-App (macOS), Sign-in mit Grok/Cursor-Account; UI wie Messaging-Client (Sidebar benannter Bots, Konversation rechts). Start mit Generalist ("Chief"), der koordiniert und an Spezialisten weiterleitet. Erste Aufgabe klein + in 30s verifizierbar.
  2. Job-Titel statt Prompt — Bot = Rolle (persistiert, Memory, Domäne), kein Request. Charter wie Mitarbeiter-Briefing: was er besitzt, was "gut" heißt, und was er nie ohne Rückfrage tun darf. Diese Grenze macht Always-on erst nutzbar.
  3. Tools einmal verbinden — Plugin-Panel: Notion, Slack, Google Drive, AWS Agents, AWS SageMaker, Browserbase, Composio, Context7 + Custom. Verbindungen account-weit geteilt (einmal Gmail/GitHub → alle Bots). Blast Radius: gilt für alle künftigen Bots.
  4. Login übergeben, nicht Passwort pasten — Bot navigiert im Cloud-Browser bis zur Login-Wand, übergibt Screen; man authentifiziert, Bot macht weiter. Bot bekommt Session, kein Secret. Regel: Passwort-in-Chat-Pasten = falscher Weg.
  5. Einmal zeigen, nicht zweimal erklären — Workflow per Demonstration beibringen (Bot schaut zu, speichert Routine). Beste Kandidaten: wöchentlich, ≥2 Tools, stabile Schritte.
  6. Routine, die ohne dich läuft — Zwei Trigger, konversationell: Schedule (7-Uhr-Briefing, Monatsende) und Trigger (neue Slack-Nachricht, E-Mail-Muster, Dokument-Änderung). Philosophie: "Du baust die Automation nicht, du genehmigst die, die gerade passiert ist."
  7. Spezialisten statt Generalist — Mehrere Bots parallel, je Domäne = getrenntes Memory/Kontext/Verantwortlichkeit. Split nach Domäne, nicht Task-Größe.
  8. In Gruppen-Chat setzen — Bots schreiben sich gegenseitig, teilen Kontext, übergeben Ownership (Engineering-Bot reproduziert Bug → filed Ticket → übergibt an Debug-Bot). Objective geben, keine Task-Liste — Task-Liste = Zerlegung schon gemacht.
  9. Approval-Linie ziehen — Linie = Reversibilität, nicht Task-Größe. Umkehrbares (draften, filen, taggen, recherchieren) allein fertigstellen; Außenwelt/Geld/Nicht-Rücknehmbares parken. Beispiel: 36 Drafts gequeued, 0 gesendet.
  10. Wöchentlich reviewen, rücksichtslos ausdünnen — Automation verrottet leise. 15 Min/Kalender, 3 Fragen (lief sie? Output richtig? würde ich sie vermissen?). Bots selbst berichten lassen + Stichprobe von Hand.

Fazit: "Du hörst auf, der zu sein, der klickt." Der Bot hat Computer, Logins, Memory, Zeit — der Mensch hat die Entscheidungen. Fähigkeit verschiebt sich vom Formulieren zum Delegieren ("what exactly am I delegating, and where does its authority end") — Management-Frage, keine Prompting-Frage.

Pro-Tips vom @bot-Team (Ben Lang, 2026-08-18)

12 kompakte Praxistipps, die das offizielle @bot-Team (SpaceXAI) geteilt hat:

  1. Mehrere Accounts über Plugins verbinden (z.B. persönliche + Arbeits-Gmail parallel)
  2. Ein Chief of Staff + wenige Spezialisten schlägt einen Mega-Chat (bestätigt Chief-/Spezialisten-Muster)
  3. Top 1-2 Agents pinnen für schnellen Zugriff
  4. Notion-Seite für offene Arbeit führen lassen — "was steht noch an?" statt babysitten
  5. Jeden Bot als Job behandeln, nicht als ganzes Projekt (Domänen-Split)
  6. "teach a task" im Browser — einmal selbst aufnehmen, Bot wiederholt es
  7. Bot fragen, welche Team-Skills und Plugins für den Job aktiviert werden sollen
  8. Avatar für jeden Bot generieren lassen
  9. "Always Allow" an + "Auto Review" aus für mehr Autonomie — erst Workflows testen (Vorsicht!)
  10. Sections in der Sidebar anlegen zur Organisation
  11. Sidebar bei Bedarf vergrößern
  12. Bots sich selbst evaluieren lassen + Workflow-Verbesserungen vorschlagen

SEO-Anwendungsfall (Sarvesh Shrivastava, 2026-08-18)

Marketing-Teaser: Grok Bot ($200/mo) als Ersatz für eine $10k/mo SEO-Agentur; "90 Tage, $100k/Monat"-Versprechen mit "free prompt stack" im verlinkten Artikel. Reiner Lead-Magnet ohne substanziellen technischen Inhalt im X-Post; bestätigt nur den $200/mo-Preis und das Narrativ "Agent ersetzt Agentur". Kein neuer technischer Fakt.

Grok Bot + Hermes als komplementäres Setup (AI Edge, 2026-08-18)

Argument: Grok Bot + Hermes ist das derzeit mächtigste agentische Setup — komplementär, nicht konkurrierend.

  • Grok Bot: Cloud-Computer pro Agent, Sign-ins in beliebige Apps, Modell-Flexibilität (Opus, Claude, GPT-5.6), Plug-and-Play.
  • Hermes: volle Daten-Souveränität, selbst-gehostetes Memory, $5-10/Monat Kostenboden statt $120-300/Monat.
  • Split: Grok Bot für tiefe App-Integration (Salesforce, Slack, Gmail, Figma, CRMs); Hermes für Sensibles/Kostenintensives (Finanzdaten, persönliche Admin, 24/7-Läufe).
  • Verbindung: über Buzz (Jack Dorseys Open-Source-Team-Chat) — beide Agenten in denselben Workspace, Koordination in geteilten Channels. Alternativ: Grok-Bot-Chief-of-Staff delegiert an Hermes via Webhook oder geteilter Task-Datei — Grok als App-schwere Orchestrierung, Hermes als billige Always-on-Execution-Schicht.
  • Beispiel: Grok Bot = GTM-Stack (Meeting-Prep, Inbox-Triage, Slides, CRM); Hermes = Finanzrecherche, Subscription-Audits, Content-Recherche; beide reporten in denselben Buzz-Workspace.

Zweite Quelle (Miles Deutscher, 2026-08-20): X-Post „Grok Bot + Hermes: The Most Powerful Agentic Setup" (~16,7K Views) — raw/xpost/2026-08-20_milesdeutscher-grok-bot-hermes-stacking.md. Bestätigt denselben komplementären Stack mit Buzz als Verbindungsschicht und einer konkreten GTM-vs-Background-Task-Arbeitsteilung (Grok = Meeting-Prep/Inbox/Slides/CRM; Hermes = Finanzrecherche/Subscription-Audits/Content). Zwei unabhängige Quellen (AI Edge + Miles) stützen denselben Hybrid-Stack — Konsens im Faden: „Grok für App-Integration, Hermes für Souveränität/Kosten".

Einordnung: Bestätigt Miles' Deep-Dive (Grok = Plug-and-Play, teuer, closed) und ergänzt die Gegenposition: Hermes als souveräne, billige Always-on-Schicht. Für OME übertragbar: Hermes/OpenClaw als "Execution-Layer unter der App-Schicht".

Fleet-of-Agents Walkthrough (Brandon @brandon_ai, 2026-08-20)

Ausführliches, stark positives Testimonial + praktischer Walkthrough: "Chief of AI Staff"-Hierarchie als Kernmuster für eine Flotte spezialisierter Agenten. Kernaussage: Die Stärke liegt in Kontext & Fokus pro Agent (statt alles in einen Mega-Chat zu stopfen) — die Delegation an einen Haupt-Agenten, der Aufgaben an Spezialisten verteilt, ist der eigentliche Enabler.

Beispiel-Fleet (Rollen)

  • Eve — Chief of AI Staff (analysiert Business, schlägt 10x-Struktur vor, delegiert)
  • Amara — Client Delivery AM · Edna — Director of HAR (Human and Agent Resources) · Marlo — CMO (paid/performance) · Postmaster — Inbox Manager · Talia — CFO · Roz — TOFU outbound · Baymax — TopCal outbound · Pact — Closer and partnerships · Pulse — RevOps scoreboard · Luma — Content producer · Scout — Competitive intelligence · Optimus — Social signals · Forge — Product engineering lead · Yard — Fleet ops and spend governor
  • Extras: G-Coach (fitness), G-Dev (developer for an app)

Sicherheits-Guardrail ("Spend and send")

Nichts wird gepostet/gesendet oder Geld ausgegeben ohne menschliche Review/Approval. Alles andere kann vollständig delegiert werden — deckt sich mit der Reversibilitäts-Approvallinie aus dem Codez-Tutorial.

Technische Stärken (lt. Autor)

  • Eingebautes Terminal zum Installieren von CLI-Tools
  • Einfache Integration mit Tools/Connectors; MCP-Server übertragen sich (funktioniert gut von Cursor)
  • Agenten laufen Tools wie Prospeo, LeadMagic etc. — auch wenn nicht im Marketplace (via downloadbare Skills)
  • Agenten teilen denselben Computer, haben aber rollenspezifische Skills/Context
  • Fokus auf Outcome + Delegation reduziert Fluff; Token-Verbrauch im Auge behalten

Einordnung

Bestätigt und verfeinert das Chief-/Spezialisten-Muster aus dem offiziellen @bot-Team-Tipp (#2) und dem Codez-Tutorial: eine ganze business-ähnliche Agent-Flotte lässt sich in Tagen aufsetzen. Der Autor nennt OpenClaw/Hermes explizit als Alternative („mind-blown" vs. andere) — dieselbe Miete-statt-Eigentum-Dynamik wie in der übrigen Welle, hier aber mit konkretester Rollen-Struktur bisher. Begeistert/werblich im Ton, aber praxisorientiert ("how I did it").

Praxistest an 5 Unternehmen (Prajwal Tomar, 2026-08-18)

Thread "I Thought Grok Bot Was Hype. Then I Tested It on 5 Businesses." — ein Hermes-Nutzer testet Grok Bot an 5 Unternehmen. Kern-Claim: "hire an entire team that works 24/7, never quits, never asks for a salary", Setup in einem Abend, Clients werden vor dem Aufwachen recherchiert. Autor war zunächst skeptisch ("I already run Hermes Agent... most hype cycles don't..."). Thread zum Abrufzeitpunkt nur als Teaser verfügbar; bestätigt das "Agent ersetzt Team/Agentur"-Narrativ, kein neuer technischer Fakt.

Preis-Update: $200 → $20/mo (2026-08-27, Transcript-verifiziert)

Video: "Grok Bot Is Now Only $20 - Here Are 9 Wild Use Cases" (Paul J Lipsky, ~16 Min, 2026-08-27, https://www.youtube.com/watch?v=UyMJBUCyDIs). Transcript seit 15:25 UTC verfügbar (Herman @HermanButlerBot, lokaler yt-dlp-Lauf auf Kais Mac — die Bot-Wall traf nur den Hector-Container; Extraktions-Historie im Raw). Damit sind die Kern-Claims wörtlich verifiziert.

Preis (wörtlich aus dem Transcript): "now it starts at just $20 a month. And if you're already on an eligible cursor, Super Grock, or Teams plan, Grockbot is included." — ASR schreibt "cursor", gemeint ist Cursor (Editor). Das $20-Tier ist der Einsteigerpreis; für bestehende Cursor-, Super Grok- oder Teams-Plan-Kunden ist Grok Bot inklusive — konsistent mit Miles' Bündel-Beobachtung (18.08.), aber mit deutlich niedrigerem Einstiegspunkt. Sponsoring wörtlich doppelt belegt: Intro "This video is sponsored by SpaceX, the company behind Grockbot." + Outro "Thank you to SpaceX AI for sponsoring this video." Lipskys Setup: spezialisierte Bots, die wie Mitarbeiter per Chat beauftragt werden:

  • Bots werden rein konversationell erstellt — keine API-Keys, keine Modellwahl, keine System-Prompts
  • Chief-of-Staff-Muster: Delegator-Bot verteilt an Spezialisten; jeder Bot = feste Rolle, feste Zuständigkeit
  • Bot-zu-Bot: Gruppen-Kanäle, Arbeitsübergabe ohne Freigabe pro Schritt; Beispiel: Video-Idee → Seeker (Research) → Hemingway (Skript) → Prism (Thumbnails) ohne Zutun des Operators
  • Routinen auf Cloud-Maschine (Chrome, File-Manager, Terminal), in alle Tools eingeloggt — läuft auch bei ausgeschaltetem PC; Tool-Zugriff (Gmail, DoorDash, Notion) wird im Chat eingerichtet

Die 9 Use Cases (vollständig aus dem Transcript):

  1. E-Mail-Triage + Reply-Entwürfe alle 2h (Scribe — scannt Inbox, recherchiert Absender, gleicht mit Content-Kalender ab, entwirft Antworten; auch Brand-Deal-Verhandlungen)
  2. Bot-zu-Bot-Video-Produktion (Chief delegiert: Video-Idee → Seeker → Hemingway → Prism, komplett autonom im Hintergrund)
  3. X-Monitoring 24/7 auf Video-/Trend-Opportunities (Seeker + X-Plugin) mit Angle-Prüfung durch Mapmaker (Brainstormer)
  4. Kalender-bewusster Alltagsservice (Concierge: Restaurant-Menü vs. Ernährungsbeschränkungen, Abstimmung mit Fitness-Bot Coach Cal)
  5. Smoothie-Bestellung per DoorDash nach Physio-Terminen (Concierge — mit Überraschungs-Geschmack)
  6. Monatliche Auto-Aktualisierung der Website (Bob the Builder — Abonnentenzahlen, Views, neueste Videos)
  7. Vibe Coding — Apps/Websites bauen (Bob the Builder)
  8. Flug-/Hotel-Preis-Monitoring (Atlas)
  9. Krankenversicherungs-Suche (Nightingale) + Deal-Jagd (Hound, Personal Shopper)

Bot-Roster (Lipskys Team im Video): Chief (Chief of Staff/Delegator), Scribe (E-Mail/Kalender/Brand-Deals), Seeker (Research/X-Monitoring), Mapmaker (Brainstorming), Hemingway (Skript), Prism (Design/Thumbnails), Concierge (Alltag/Kalender), Coach Cal (Fitness), Bob the Builder (Website/Vibe Coding), Atlas (Travel), Hound (Shopping/Deals), Nightingale (Krankenversicherung).

⚠️ Ehrliche Kante:

  • Gesponsertes Video (SpaceX/xAI, wörtlich belegt: Intro + Outro) → Werbe-Kontext; durchweg positiv, keine Ausfallbeispiele
  • Keine Kritik zu Datenschutz/Sicherheit beim Gmail-/DoorDash-Zugriff; keine Kosten-Differenzierung über die $20 hinaus (was das Tier funktional limitiert, bleibt offen)
  • ASR-Artefakte im Transcript („Grockbot“ statt Grok Bot, „scriptor“ statt Scriptwriter, „cursor“ statt Cursor) — Eigennamen mit Vorsicht
  • Einordnung: konsistent mit Miles' Preisdruck-These (18.08.) — Zugänglichkeit steigt deutlich, aber $20 ≠ gratis; Bottleneck entschärft, nicht beseitigt

Grok Bot Galaxy (Livestream, 15.17.09.2026)

Event: Dreitägige SpaceXAI-Veranstaltung (15.17.09.2026), Livestream auf X (https://x.com/i/broadcasts/1AxRnZbVpjaxl; Titel laut Seite „Day 1: Grok Bot Galaxy Livestream", LIVE, 78.9K Views beim Abruf) plus In-Person in San Francisco (The Howard, 661 Howard Street). Offizieller Hub: https://x.ai/galaxy; Livestream-Tickets kostenlos über Luma (https://luma.com/3ifrgttw), keine Grok-Bot-Subscription nötig. Geteilt von Kai (@PWeber) im OME-Topic „GrokBot" (15.09.2026, 15:55 UTC), Begleit-Briefing von Herman (@HermanButlerBot) um 15:56 UTC.

Format: Drei SpaceXAI-Mitarbeiter — Matt Palmer (@mattyp), Lauren Tan (@poteto), Roshan Sadanani (@roshan_s) — bauen über 72 Stunden von Null eine Firma auf und setzen Grok Bots dabei als Angestellte ein (kein vorgewählter Name, kein vorgewähltes Produkt). Dazu Live-Demos und Rollen-Sessions:

  • Di 15.09.: Grok Bot 101 → Engineering (Lingxi Li) → Product Managers (Kevin Niparko) → Founders (Shub Gaur)
  • Mi 16.09.: Sales Engineering · Sales · SDRs · Customer Support
  • Do 17.09.: Marketing Ops · Post-Sales · Marketing, dann Wrap + Final Showcase (ab 16:30 PT)

Tagesfenster laut Websuche ca. 08:3018:00 PT (Herman-Briefing nennt Start 08:55 PT und Fenster 08:4518:00 PT — Angaben weichen ab und sind nicht primär belegt). Day 1 endet 18:00 PT = 03:00 CEST.

Einordnung: Bisher sichtbarster Belastungstest der These „Agent = Teammitglied, nicht Tool" — unter Live-Bedingungen mit echter Deadline statt im Demo-Video. Das propagierte Muster (Delegator + Spezialisten, Bot-zu-Bot-Handoffs, Cloud-Computer) deckt sich mit dem, was Codez' Tutorial und Lipskys Use Cases beschreiben; hier wird es vor Publikum durchgespielt statt behauptet.

⚠️ Ehrliche Kante: Anbieter-eigene Marketing-Veranstaltung (SpaceXAI/xAI). Agenda, Sprecher und Format stammen aus Websuche (Provider Grok) und dem Bot-Briefing, nicht aus einer Primärquelle; Elon Musk hat die Veranstaltung beworben. Die Substanz liegt in den Live-Demos, nicht in den Claims — und ob die Session-Aufzeichnungen nach dem Event öffentlich bleiben, ist nicht dokumentiert. Kein Transcript erfasst (Stand 15.09.2026).

Quellen

Verwandte Seiten