knowledge-base/wiki/tools/grok-bot-spacexai.md
2026-09-22 08:33:43 +02:00

32 KiB
Raw Permalink Blame History

Grok Bot (SpaceXAI)

Kategorie: Tools / AI-Agents | Stand: 2026-09-22 (Launch + Miles-Deutscher-Deep-Dive + 0xCodez-Tutorial + @bot-Team-Pro-Tips + SEO-Playbook-Teaser + Hermes-Combo + 5-Businesses-Test + Hermes-vs-Grok-Vergleich + Fleet-of-Agents-Walkthrough + $20-Preis-Update, Transcript-verifiziert + Grok-Bot-Galaxy (Livestream + Ergebnis + Musk-Verstärkung) + Cursor-Zugangs-/Trial-Doku & On-demand)

Überblick

Grok Bot ist ein von SpaceXAI gelaunchter agentischer KI-Bot (Beta), der echte Arbeit end-to-end erledigen soll — statt nur zu chatten. Jeder Grok Bot bekommt einen eigenen Computer (Computer-Use) und arbeitet über die Tools/Apps hinweg, die man bereits nutzt. Rahmung: "AI coworker" / delegierbares Team statt reiner Assistant.

Kernfähigkeiten (laut Launch-Post)

  • Computer-Zugriff: eigener Computer pro Bot; Sign-in in bereits genutzte Apps/Websites
  • Persistenz: arbeitet kontinuierlich weiter, auch wenn das Laptop zu ist
  • Präferenzgedächtnis: merkt sich, wie man Dinge erledigt haben will
  • Workflow-Lernen: beobachtet einen Workflow einmal und macht daraus eine wiederverwendbare Routine
  • Parallelisierung: mehrere Bots gleichzeitig laufen lassen
  • Bot-zu-Bot: Bots kommunizieren und reichen Arbeit untereinander weiter
  • Human-in-the-Loop: kommen nur zurück, wenn Approval/Judgment wirklich nötig ist

Beispiel-Szenario (aus dem Post)

Ein Bot fürs Postfach, einer für Research, einer für Ausgaben, einer fürs Bug-Reproduzieren — alle arbeiten parallel.

Interne Nutzung

SpaceXAI-Team setzt Grok Bots laut Launch-Post bereits intern ein: Sales, Marketing, Operations, Finance, Engineering.

Plattformen

Windows, macOS, Linux, iOS (Beta); Android "coming soon". Download: x.ai/bot

Einordnung

Teil des "Agent wird zum delegierbaren Team"-Narrativs (Computer-Use, persistente Workflows, Tool-Nutzung, Bot-Orchestrierung). Strukturell das gleiche Muster, das OpenClaw/Agent-Frameworks bereits leben — SpaceXAI rahmt es explizit als AI-Coworker/Team und deckt auch Mobile ab.

Deep-Dive (Miles Deutscher, 2026-08-18)

Miles Deutscher hat eine Woche nach Launch einen ausführlichen Deep-Dive veröffentlicht (ruthless testing seit Release).

Kernaussagen

  • Kein Chatbot, sondern ein Team von Agents — jeder mit eigenem Cloud-Computer (Browser, Dateisystem, Terminal); arbeitet weiter, wenn Laptop zu ist
  • Agent Swarm: jedem Bot eine Rolle zuweisen (research, outreach, scheduling, finance, etc.); Agents loggen sich einmal in Tools ein und nutzen Logins wieder
  • Plug-and-Play vs. OpenClaw/Hermes: OpenClaw/Hermes sind leistungsstark, brauchen aber eigene Always-on-Maschine (VPS) + aufwendiges Setup. Grok Bot: downloaden, einloggen, fertig — ohne Infrastruktur, ohne Skill-File-/Context-Pflege
  • Kann jedes Modell laufen lassen (OpenAI, Anthropic, etc.)
  • Tradeoff: Daten-Souveränität vs. Bequemlichkeit — closed, cloud-hosted, festes Preismodell

Pricing

  • $200/mo Minimum (mit Cursor Ultra); nicht einzeln kaufbar, gebündelt in SuperGrok Heavy / Cursor Ultra (Stand 18.08.2026 — inzwischen überholt; siehe Abschnitt „Zugang, Preise & Free Trial")

Workflow-Beispiele (Miles' Team)

  1. Alex — Research: scannt morgens YouTube-Kanäle, liefert Outlier-Content-Brief; eigene Recherche-Methode als "agentic skill" verpackbar
  2. Sandra — Real-Estate-Scout: prüft Listings 2×/Tag, flaggt Unterbewertetes (26-37% unter Marktwert)
  3. Jonathan — CFO: Portfolio-Daten + tägliches Update, verbunden mit Google Sheet (Live-Daten via Brokerage-API). Vorher in Hermes, jetzt auf Grok Bot umgestellt
  4. Lucy — EA: lebt in Company-Slack, morgendliches Triage
  5. Oscar — Generalist

Ehrliche Analyse

  • Pound for pound mächtigstes agentisches Tool auf dem Markt, aber für die meisten noch nicht worth it (Preis-Bottleneck)
  • $20/mo-Budget: erst mit Claude Code fließend werden (mehr lernen, schneller, günstiger)
  • Für echte AI-Power-User mit mehreren Abos + Markdown-Files/Skills/Context: legitimer nächster Schritt
  • Echter Wert: entfernt Setup-/Maintenance-Headache von Hermes/OpenClaw — nichts fundamental Neues
  • Für die meisten: Claude Cowork/Codex bessere Option zum günstigeren Preis
  • Erwartet starke Verbesserungen in den kommenden Monaten

10-Schritte-Tutorial (Codez @0xCodez, 2026-08-18)

Praktischer Setup- und Betriebs-Leitfaden: vom Install bis zur Spezialisten-Crew.

  1. Installieren & Chief treffen — Desktop-App (macOS), Sign-in mit Grok/Cursor-Account; UI wie Messaging-Client (Sidebar benannter Bots, Konversation rechts). Start mit Generalist ("Chief"), der koordiniert und an Spezialisten weiterleitet. Erste Aufgabe klein + in 30s verifizierbar.
  2. Job-Titel statt Prompt — Bot = Rolle (persistiert, Memory, Domäne), kein Request. Charter wie Mitarbeiter-Briefing: was er besitzt, was "gut" heißt, und was er nie ohne Rückfrage tun darf. Diese Grenze macht Always-on erst nutzbar.
  3. Tools einmal verbinden — Plugin-Panel: Notion, Slack, Google Drive, AWS Agents, AWS SageMaker, Browserbase, Composio, Context7 + Custom. Verbindungen account-weit geteilt (einmal Gmail/GitHub → alle Bots). Blast Radius: gilt für alle künftigen Bots.
  4. Login übergeben, nicht Passwort pasten — Bot navigiert im Cloud-Browser bis zur Login-Wand, übergibt Screen; man authentifiziert, Bot macht weiter. Bot bekommt Session, kein Secret. Regel: Passwort-in-Chat-Pasten = falscher Weg.
  5. Einmal zeigen, nicht zweimal erklären — Workflow per Demonstration beibringen (Bot schaut zu, speichert Routine). Beste Kandidaten: wöchentlich, ≥2 Tools, stabile Schritte.
  6. Routine, die ohne dich läuft — Zwei Trigger, konversationell: Schedule (7-Uhr-Briefing, Monatsende) und Trigger (neue Slack-Nachricht, E-Mail-Muster, Dokument-Änderung). Philosophie: "Du baust die Automation nicht, du genehmigst die, die gerade passiert ist."
  7. Spezialisten statt Generalist — Mehrere Bots parallel, je Domäne = getrenntes Memory/Kontext/Verantwortlichkeit. Split nach Domäne, nicht Task-Größe.
  8. In Gruppen-Chat setzen — Bots schreiben sich gegenseitig, teilen Kontext, übergeben Ownership (Engineering-Bot reproduziert Bug → filed Ticket → übergibt an Debug-Bot). Objective geben, keine Task-Liste — Task-Liste = Zerlegung schon gemacht.
  9. Approval-Linie ziehen — Linie = Reversibilität, nicht Task-Größe. Umkehrbares (draften, filen, taggen, recherchieren) allein fertigstellen; Außenwelt/Geld/Nicht-Rücknehmbares parken. Beispiel: 36 Drafts gequeued, 0 gesendet.
  10. Wöchentlich reviewen, rücksichtslos ausdünnen — Automation verrottet leise. 15 Min/Kalender, 3 Fragen (lief sie? Output richtig? würde ich sie vermissen?). Bots selbst berichten lassen + Stichprobe von Hand.

Fazit: "Du hörst auf, der zu sein, der klickt." Der Bot hat Computer, Logins, Memory, Zeit — der Mensch hat die Entscheidungen. Fähigkeit verschiebt sich vom Formulieren zum Delegieren ("what exactly am I delegating, and where does its authority end") — Management-Frage, keine Prompting-Frage.

Pro-Tips vom @bot-Team (Ben Lang, 2026-08-18)

12 kompakte Praxistipps, die das offizielle @bot-Team (SpaceXAI) geteilt hat:

  1. Mehrere Accounts über Plugins verbinden (z.B. persönliche + Arbeits-Gmail parallel)
  2. Ein Chief of Staff + wenige Spezialisten schlägt einen Mega-Chat (bestätigt Chief-/Spezialisten-Muster)
  3. Top 1-2 Agents pinnen für schnellen Zugriff
  4. Notion-Seite für offene Arbeit führen lassen — "was steht noch an?" statt babysitten
  5. Jeden Bot als Job behandeln, nicht als ganzes Projekt (Domänen-Split)
  6. "teach a task" im Browser — einmal selbst aufnehmen, Bot wiederholt es
  7. Bot fragen, welche Team-Skills und Plugins für den Job aktiviert werden sollen
  8. Avatar für jeden Bot generieren lassen
  9. "Always Allow" an + "Auto Review" aus für mehr Autonomie — erst Workflows testen (Vorsicht!)
  10. Sections in der Sidebar anlegen zur Organisation
  11. Sidebar bei Bedarf vergrößern
  12. Bots sich selbst evaluieren lassen + Workflow-Verbesserungen vorschlagen

SEO-Anwendungsfall (Sarvesh Shrivastava, 2026-08-18)

Marketing-Teaser: Grok Bot ($200/mo) als Ersatz für eine $10k/mo SEO-Agentur; "90 Tage, $100k/Monat"-Versprechen mit "free prompt stack" im verlinkten Artikel. Reiner Lead-Magnet ohne substanziellen technischen Inhalt im X-Post; bestätigt nur den $200/mo-Preis und das Narrativ "Agent ersetzt Agentur". Kein neuer technischer Fakt.

Grok Bot + Hermes als komplementäres Setup (AI Edge, 2026-08-18)

Argument: Grok Bot + Hermes ist das derzeit mächtigste agentische Setup — komplementär, nicht konkurrierend.

  • Grok Bot: Cloud-Computer pro Agent, Sign-ins in beliebige Apps, Modell-Flexibilität (Opus, Claude, GPT-5.6), Plug-and-Play.
  • Hermes: volle Daten-Souveränität, selbst-gehostetes Memory, $5-10/Monat Kostenboden statt $120-300/Monat.
  • Split: Grok Bot für tiefe App-Integration (Salesforce, Slack, Gmail, Figma, CRMs); Hermes für Sensibles/Kostenintensives (Finanzdaten, persönliche Admin, 24/7-Läufe).
  • Verbindung: über Buzz (Jack Dorseys Open-Source-Team-Chat) — beide Agenten in denselben Workspace, Koordination in geteilten Channels. Alternativ: Grok-Bot-Chief-of-Staff delegiert an Hermes via Webhook oder geteilter Task-Datei — Grok als App-schwere Orchestrierung, Hermes als billige Always-on-Execution-Schicht.
  • Beispiel: Grok Bot = GTM-Stack (Meeting-Prep, Inbox-Triage, Slides, CRM); Hermes = Finanzrecherche, Subscription-Audits, Content-Recherche; beide reporten in denselben Buzz-Workspace.

Zweite Quelle (Miles Deutscher, 2026-08-20): X-Post „Grok Bot + Hermes: The Most Powerful Agentic Setup" (~16,7K Views) — raw/xpost/2026-08-20_milesdeutscher-grok-bot-hermes-stacking.md. Bestätigt denselben komplementären Stack mit Buzz als Verbindungsschicht und einer konkreten GTM-vs-Background-Task-Arbeitsteilung (Grok = Meeting-Prep/Inbox/Slides/CRM; Hermes = Finanzrecherche/Subscription-Audits/Content). Zwei unabhängige Quellen (AI Edge + Miles) stützen denselben Hybrid-Stack — Konsens im Faden: „Grok für App-Integration, Hermes für Souveränität/Kosten".

Einordnung: Bestätigt Miles' Deep-Dive (Grok = Plug-and-Play, teuer, closed) und ergänzt die Gegenposition: Hermes als souveräne, billige Always-on-Schicht. Für OME übertragbar: Hermes/OpenClaw als "Execution-Layer unter der App-Schicht".

Fleet-of-Agents Walkthrough (Brandon @brandon_ai, 2026-08-20)

Ausführliches, stark positives Testimonial + praktischer Walkthrough: "Chief of AI Staff"-Hierarchie als Kernmuster für eine Flotte spezialisierter Agenten. Kernaussage: Die Stärke liegt in Kontext & Fokus pro Agent (statt alles in einen Mega-Chat zu stopfen) — die Delegation an einen Haupt-Agenten, der Aufgaben an Spezialisten verteilt, ist der eigentliche Enabler.

Beispiel-Fleet (Rollen)

  • Eve — Chief of AI Staff (analysiert Business, schlägt 10x-Struktur vor, delegiert)
  • Amara — Client Delivery AM · Edna — Director of HAR (Human and Agent Resources) · Marlo — CMO (paid/performance) · Postmaster — Inbox Manager · Talia — CFO · Roz — TOFU outbound · Baymax — TopCal outbound · Pact — Closer and partnerships · Pulse — RevOps scoreboard · Luma — Content producer · Scout — Competitive intelligence · Optimus — Social signals · Forge — Product engineering lead · Yard — Fleet ops and spend governor
  • Extras: G-Coach (fitness), G-Dev (developer for an app)

Sicherheits-Guardrail ("Spend and send")

Nichts wird gepostet/gesendet oder Geld ausgegeben ohne menschliche Review/Approval. Alles andere kann vollständig delegiert werden — deckt sich mit der Reversibilitäts-Approvallinie aus dem Codez-Tutorial.

Technische Stärken (lt. Autor)

  • Eingebautes Terminal zum Installieren von CLI-Tools
  • Einfache Integration mit Tools/Connectors; MCP-Server übertragen sich (funktioniert gut von Cursor)
  • Agenten laufen Tools wie Prospeo, LeadMagic etc. — auch wenn nicht im Marketplace (via downloadbare Skills)
  • Agenten teilen denselben Computer, haben aber rollenspezifische Skills/Context
  • Fokus auf Outcome + Delegation reduziert Fluff; Token-Verbrauch im Auge behalten

Einordnung

Bestätigt und verfeinert das Chief-/Spezialisten-Muster aus dem offiziellen @bot-Team-Tipp (#2) und dem Codez-Tutorial: eine ganze business-ähnliche Agent-Flotte lässt sich in Tagen aufsetzen. Der Autor nennt OpenClaw/Hermes explizit als Alternative („mind-blown" vs. andere) — dieselbe Miete-statt-Eigentum-Dynamik wie in der übrigen Welle, hier aber mit konkretester Rollen-Struktur bisher. Begeistert/werblich im Ton, aber praxisorientiert ("how I did it").

Praxistest an 5 Unternehmen (Prajwal Tomar, 2026-08-18)

Thread "I Thought Grok Bot Was Hype. Then I Tested It on 5 Businesses." — ein Hermes-Nutzer testet Grok Bot an 5 Unternehmen. Kern-Claim: "hire an entire team that works 24/7, never quits, never asks for a salary", Setup in einem Abend, Clients werden vor dem Aufwachen recherchiert. Autor war zunächst skeptisch ("I already run Hermes Agent... most hype cycles don't..."). Thread zum Abrufzeitpunkt nur als Teaser verfügbar; bestätigt das "Agent ersetzt Team/Agentur"-Narrativ, kein neuer technischer Fakt.

Preis-Update: $200 → $20/mo (2026-08-27, Transcript-verifiziert)

Video: "Grok Bot Is Now Only $20 - Here Are 9 Wild Use Cases" (Paul J Lipsky, ~16 Min, 2026-08-27, https://www.youtube.com/watch?v=UyMJBUCyDIs). Transcript seit 15:25 UTC verfügbar (Herman @HermanButlerBot, lokaler yt-dlp-Lauf auf Kais Mac — die Bot-Wall traf nur den Hector-Container; Extraktions-Historie im Raw). Damit sind die Kern-Claims wörtlich verifiziert.

Preis (wörtlich aus dem Transcript): "now it starts at just $20 a month. And if you're already on an eligible cursor, Super Grock, or Teams plan, Grockbot is included." — ASR schreibt "cursor", gemeint ist Cursor (Editor). Das $20-Tier ist der Einsteigerpreis; für bestehende Cursor-, Super Grok- oder Teams-Plan-Kunden ist Grok Bot inklusive — konsistent mit Miles' Bündel-Beobachtung (18.08.), aber mit deutlich niedrigerem Einstiegspunkt. Sponsoring wörtlich doppelt belegt: Intro "This video is sponsored by SpaceX, the company behind Grockbot." + Outro "Thank you to SpaceX AI for sponsoring this video." Lipskys Setup: spezialisierte Bots, die wie Mitarbeiter per Chat beauftragt werden:

  • Bots werden rein konversationell erstellt — keine API-Keys, keine Modellwahl, keine System-Prompts
  • Chief-of-Staff-Muster: Delegator-Bot verteilt an Spezialisten; jeder Bot = feste Rolle, feste Zuständigkeit
  • Bot-zu-Bot: Gruppen-Kanäle, Arbeitsübergabe ohne Freigabe pro Schritt; Beispiel: Video-Idee → Seeker (Research) → Hemingway (Skript) → Prism (Thumbnails) ohne Zutun des Operators
  • Routinen auf Cloud-Maschine (Chrome, File-Manager, Terminal), in alle Tools eingeloggt — läuft auch bei ausgeschaltetem PC; Tool-Zugriff (Gmail, DoorDash, Notion) wird im Chat eingerichtet

Die 9 Use Cases (vollständig aus dem Transcript):

  1. E-Mail-Triage + Reply-Entwürfe alle 2h (Scribe — scannt Inbox, recherchiert Absender, gleicht mit Content-Kalender ab, entwirft Antworten; auch Brand-Deal-Verhandlungen)
  2. Bot-zu-Bot-Video-Produktion (Chief delegiert: Video-Idee → Seeker → Hemingway → Prism, komplett autonom im Hintergrund)
  3. X-Monitoring 24/7 auf Video-/Trend-Opportunities (Seeker + X-Plugin) mit Angle-Prüfung durch Mapmaker (Brainstormer)
  4. Kalender-bewusster Alltagsservice (Concierge: Restaurant-Menü vs. Ernährungsbeschränkungen, Abstimmung mit Fitness-Bot Coach Cal)
  5. Smoothie-Bestellung per DoorDash nach Physio-Terminen (Concierge — mit Überraschungs-Geschmack)
  6. Monatliche Auto-Aktualisierung der Website (Bob the Builder — Abonnentenzahlen, Views, neueste Videos)
  7. Vibe Coding — Apps/Websites bauen (Bob the Builder)
  8. Flug-/Hotel-Preis-Monitoring (Atlas)
  9. Krankenversicherungs-Suche (Nightingale) + Deal-Jagd (Hound, Personal Shopper)

Bot-Roster (Lipskys Team im Video): Chief (Chief of Staff/Delegator), Scribe (E-Mail/Kalender/Brand-Deals), Seeker (Research/X-Monitoring), Mapmaker (Brainstorming), Hemingway (Skript), Prism (Design/Thumbnails), Concierge (Alltag/Kalender), Coach Cal (Fitness), Bob the Builder (Website/Vibe Coding), Atlas (Travel), Hound (Shopping/Deals), Nightingale (Krankenversicherung).

⚠️ Ehrliche Kante:

  • Gesponsertes Video (SpaceX/xAI, wörtlich belegt: Intro + Outro) → Werbe-Kontext; durchweg positiv, keine Ausfallbeispiele
  • Keine Kritik zu Datenschutz/Sicherheit beim Gmail-/DoorDash-Zugriff; keine Kosten-Differenzierung über die $20 hinaus (was das Tier funktional limitiert, bleibt offen)
  • ASR-Artefakte im Transcript („Grockbot“ statt Grok Bot, „scriptor“ statt Scriptwriter, „cursor“ statt Cursor) — Eigennamen mit Vorsicht
  • Einordnung: konsistent mit Miles' Preisdruck-These (18.08.) — Zugänglichkeit steigt deutlich, aber $20 ≠ gratis; Bottleneck entschärft, nicht beseitigt

Grok Bot Galaxy (Livestream, 15.17.09.2026)

Event: Dreitägige SpaceXAI-Veranstaltung (15.17.09.2026), Livestream auf X (https://x.com/i/broadcasts/1AxRnZbVpjaxl; Titel laut Seite „Day 1: Grok Bot Galaxy Livestream", LIVE, 78.9K Views beim Abruf) plus In-Person in San Francisco (The Howard, 661 Howard Street). Offizieller Hub: https://x.ai/galaxy; Livestream-Tickets kostenlos über Luma (https://luma.com/3ifrgttw), keine Grok-Bot-Subscription nötig. Geteilt von Kai (@PWeber) im OME-Topic „GrokBot" (15.09.2026, 15:55 UTC), Begleit-Briefing von Herman (@HermanButlerBot) um 15:56 UTC.

Format: Drei SpaceXAI-Mitarbeiter — Matt Palmer (@mattyp), Lauren Tan (@poteto), Roshan Sadanani (@roshan_s) — bauen über 72 Stunden von Null eine Firma auf und setzen Grok Bots dabei als Angestellte ein (kein vorgewählter Name, kein vorgewähltes Produkt). Dazu Live-Demos und Rollen-Sessions:

  • Di 15.09.: Grok Bot 101 → Engineering (Lingxi Li) → Product Managers (Kevin Niparko) → Founders (Shub Gaur)
  • Mi 16.09.: Sales Engineering · Sales · SDRs · Customer Support
  • Do 17.09.: Marketing Ops · Post-Sales · Marketing, dann Wrap + Final Showcase (ab 16:30 PT)

Tagesfenster laut Websuche ca. 08:3018:00 PT (Herman-Briefing nennt Start 08:55 PT und Fenster 08:4518:00 PT — Angaben weichen ab und sind nicht primär belegt).

Ergebnis (Tag 3): Das Trio hat das 72-Stunden-Fenster mit einer aufgesetzten Firma beendet — laut Sekundärbericht (techiexpert.com, 18.09.2026) „Ship by Thursday“ (shipbythurs.day, leere GitHub-Org), Produktrichtung Betriebsplattform für temporäre Food-Pop-ups (Köche ↔ ungenutzte Venue-Flächen ↔ Event-Manager), Stack aus Notion/Slack/Cursor/Vercel, Tag-1-Meta-Agent „Dr. Eggbot“ (ein Bot, der Bots baut) für automatisierten Chief of Staff + Landing-Page-Code, Tag-2-Nachtarbeit der Bots (Venue-Recherche, lokale Genehmigungsregeln, Partner-Einladungslisten). Lieferstand: Landing Page + Waitlist + Ops-Stack + Produktrichtung — kein Nachweis von Umsatz oder zahlenden Kunden. ⚠️ Eine Dritt-Aufzeichnung des Day-3-Streams (Kanal Kadela Tsai, kein offizieller Kanal) wird in der Websuche dahingehend zusammengefasst, dass am Ende ein Spielestudio „Thursday Arena“ (thursdayarena.com) mit spielbarem Spiel gelauncht wurde und die Pop-up-Richtung nur Zwischenstufe war — ungeprüft, der Widerspruch bleibt offen.

Musk-Verstärkung (16.09.2026): Elon Musk (@elonmusk, 241,7 Mio. Follower) quotete am 16.09. um 18:52 UTC den Day-2-Broadcast von @bot mit „Watch a company being built live with @Grok @Bot!“ (https://x.com/elonmusk/status/2100296847344783441; Stand 18.09.: 6,23 Mio. Views, 15,8K Likes, 2,2K Retweets). Kein eigener Inhalt — reine Verteilung über den reichweitenstärksten Account der Plattform. Im Thread antwortet @Grok laut Bot-Briefing: „Watching a full company get built live in 72 hours with Grok Bot handling the real work is the best demo of agentic AI yet.“ (⚠️ Hersteller-Selbstbewertung, nicht unabhängig belegt.) Geteilt wurde der Post von Rüdiger (@Stelariz_75) im OME-Topic „GrokBot“ (18.09.2026, 15:12 UTC).

Einordnung: Bisher sichtbarster Belastungstest der These „Agent = Teammitglied, nicht Tool“ — unter Live-Bedingungen mit echter Deadline statt im Demo-Video. Das propagierte Muster (Delegator + Spezialisten, Bot-zu-Bot-Handoffs, Cloud-Computer) deckt sich mit dem, was Codez' Tutorial und Lipskys Use Cases beschreiben; hier wird es vor Publikum durchgespielt statt behauptet. Für die Verbreitung bemerkenswert: Die Reichweite kommt nicht aus dem Produkt-Event, sondern aus einem Musk-Quote-Post.

⚠️ Ehrliche Kante: Anbieter-eigene Marketing-Veranstaltung (SpaceXAI/xAI). Agenda, Sprecher, Format und Ergebnis stammen aus Websuche (Provider Grok) und Sekundärberichten, nicht aus eigener Stream-Auswertung; kein Transcript erfasst (Stand 18.09.2026). Der Ergebnisbericht ist widersprüchlich (Ship by Thursday vs. Thursday Arena). Die Substanz liegt in den Demos, nicht in den Claims — und VentureBeat hält fest, dass SpaceXAI keine Benchmarks für agentische Aufgaben veröffentlicht hat.

Zugang, Preise & Free Trial (Cursor-Doku, Stand 2026-09-19)

Zugang (offiziell): Grok Bot ist in jedem bezahlten individuellen Cursor-Plan und in Cursor Teams enthalten — Pro, Pro+, Ultra (Wochenquote steigt Pro → Pro+ → Ultra). Zusätzlich kann Nutzung über ein verknüpftes Einzel-Abo SuperGrok, SuperGrok Plus, SuperGrok Heavy oder X Premium+ gewährt werden. Nicht enthalten: SuperGrok Lite; SuperGrok Team/Enterprise lassen sich nicht verknüpfen. Self-Serve-Teams: jedes Mitglied hat Zugang, kein Premium-Seat oder Admin-Request nötig.

Kernregel (kostenrelevant): Cursor-Plan und SuperGrok-/X-Premium+-Link stapeln sich nicht — sie addieren keine Nutzung. Die Verknüpfung ist ein Nutzungs-Grant, kein Cursor-Plan, und nach dem Anlegen permanent (kein Entkoppeln, keine Übertragung auf ein anderes Cursor-Konto — vorher mit dem richtigen Konto anmelden). Nach einem SuperGrok-Upgrade zieht die Quote erst binnen 24 h nach.

Preise (cursor.com/pricing, abgerufen 19.09.2026): Hobby gratis · Individual $20/Monat (Pro/Pro+/Ultra-Tabs, enthält Grok Bot) · Teams $40/User/Monat (Standard/Premium) · Enterprise individuell. VentureBeat nannte zum Launch (11.08.) für Cursor Premium Teams $120/Seat; die aktuelle Preisseite zeigt $40/User als Teams-Basis.

Free Trial (offiziell): Nutzungs-Guthaben plus 7-Tage-Fenster — kein unbegrenzter Zugang. Verbrauch wird über Agentenschritte und Tokens gemessen, nicht über die Zahl der Nachrichten; große Jobs können das Guthaben in einem Lauf aufbrauchen, nachgefüllt wird nicht. Der Trial wird nie ein bezahlter Plan („the Grok Bot trial never becomes a paid plan"). „Cancel Trial" (nur auf Free-Plan-Accounts) beendet ihn sofort und entfernt Restguthaben; auf bezahlten Plänen endet er von selbst. iOS-Sonderfall: Ein App-Store-Intro-Angebot ist nicht der Guthaben-Trial — Apple betreibt es, und es wird ohne rechtzeitige Kündigung (Apple-ID → Abos) ein bezahltes Apple-Abo; Cursor kann das nicht kündigen oder erstatten. Android hat kein In-App-Trial.

On-demand: Läuft die Wochenquote aus, kann Nutzung als On-demand weiterlaufen — nur wenn aktiviert —, begrenzt durch das On-demand-Monatslimit (Web: Dashboard → Spending → Monthly Limit). Das Limit ist kein harter Stopp mitten im Lauf; bei Cursor Teams ist On-demand standardmäßig an, bei Mobile-Abos wird das Limit im Web gesetzt. Ist On-demand aus, stoppt Grok Bot mit der Wochenquote.

⚠️ Ehrliche Kante: Alle Angaben hier sind Anbieter-Doku (Cursor/SpaceXAI) — sie beschreiben die Mechanik, nicht die Zuverlässigkeit der Bots. Die kursierende Erzählung „nur $20" (Lipsky, 27.08.) ist damit präzisiert: $20/Monat ist der Cursor-Pro-Einstieg, den Grok Bot enthält — kein separates $20-Abo; Ultra bleibt die $200-Stufe. Eine im OME geteilte Community-Anleitung (ohne Autorenangabe) deckt sich mit der Doku; ihre Aussage „frischer Account startet automatisch den Test" ist dort nicht wörtlich belegt.

Grok 4.7 im Grok-Bot-Harness (21.22.09.2026)

Mit Grok 4.7 veröffentlicht SpaceXAI erstmals ein Modell, dessen Release-Text die native Kenntnis des Grok-Bot-Harnesses ausdrücklich als Trainingsziel nennt. Größerer Basismodell-Kern, längerer RL-Lauf auf schwierigen mehrstündigen Aufgaben, stärkere Selbstprüfung und besseres Langkontext-Management zielen damit nicht nur auf Chatqualität, sondern auf lang laufende Agentenarbeit.

Was offiziell belegt ist: Modell-ID grok-4.7, 500k API-Kontext, vier Reasoning-Efforts, Verfügbarkeit in Cursor/Grok Build/API und unveränderter Basispreis gegenüber Grok 4.6. Cursor dokumentiert 256k Standard- und 500k Long-Context-Fenster. Herstellerwerte: CursorBench 46,3 %, DeepSWE 71,0 %, Terminal-Bench 38,0 %; sie sind nicht unabhängig reproduziert.

Alex Finn: Rollen- und Issue-Workflow

Alex Finns Video „Grok 4.7 inside Grok Bot is INCREDIBLE“ (22.09., 14:06; geteilt von Pit Weber) bietet eine praktische Organisationsschicht. ⚠️ Kein Transcript war abrufbar. Die folgenden Details stammen aus YouTubes AI-Zusammenfassung und aus Hermans ausdrücklich zugeschriebener Videoauswertung, nicht aus einem Wortlaut-Transcript:

  • je Lebens-/Arbeitsbereich Project Manager + Developer + Designer
  • darüber ein PM-only-„Exec Team“
  • Ideen werden in Linear-/Notion-Issues zerlegt
  • Cursor Cloud Agents übernehmen Code-Arbeit
  • laut Finn ist Grok 4.7 nicht das Standardmodell der Cursor Cloud Agents; Arbeit über Cursor-Credits könne Grok-Bot-Kontingent schonen

Das ergänzt das bereits dokumentierte Chief-of-Staff-/Spezialistenmuster um eine Issue- und Ausführungstrennung: Grok Bot organisiert und zerlegt; Cursor Cloud Agents führen Code-Aufgaben aus. Ob die konkrete Default-Modell- und Credit-Aussage stimmt, ist in den verfügbaren offiziellen Quellen nicht belegt.

Grenze der Rezeptionsclaims: „besser als Opus 5 zum halben Preis“, tagelange Autonomie und ähnliche Superlative sind weder durch ein Transcript noch durch unabhängige Tests abgesichert. Der tragfähige Befund ist enger: SpaceXAI trainiert Modell und eigenen Harness gemeinsam; Finn zeigt dazu ein rollenbasiertes Betriebsmodell.

Quellen

  • X-Post XFreeze (@XFreeze), 2026-08-11: https://x.com/XFreeze/status/2087228292965478759
  • X-Post Miles Deutscher (@milesdeutscher), 2026-08-18: https://x.com/milesdeutscher/status/2089724781449052255
  • X-Post Codez (@0xCodez), 2026-08-18: https://x.com/0xCodez/status/2089676836619878567
  • X-Post Ben Lang (@benln), 2026-08-18: https://x.com/benln/status/2089699901567340808
  • X-Post Sarvesh Shrivastava (@bloggersarvesh), 2026-08-18: https://x.com/bloggersarvesh/status/2089738807478566937
  • X-Post AI Edge (@aiedge_), 2026-08-18: https://x.com/aiedge_/status/2089454218923163770
  • X-Post Prajwal Tomar (@PrajwalTomar_), 2026-08-18: https://x.com/PrajwalTomar_/status/2089328413035446593
  • X-Post Brandon (@brandon_ai), 2026-08-20: https://x.com/brandon_ai/status/2090146457659854976
  • YouTube Paul J Lipsky (@PaulJLipsky), 2026-08-27: https://www.youtube.com/watch?v=UyMJBUCyDIs — $20 + 9 Use Cases (per Transcript verifiziert)
  • Telegram Herman (@HermanButlerBot), 2026-08-27: OME Topic GrokBot #12882 — Video-Zusammenfassung (Second-hand, bestätigt $20 + Setup-Details) + #12931/#12933 — Transcript-Anhang (lokaler yt-dlp-Lauf auf Kais Mac)
  • X-Broadcast „Grok Bot Galaxy", 15.09.2026: https://x.com/i/broadcasts/1AxRnZbVpjaxl — SpaceXAI-3-Tage-Livestream (geteilt von Kai, OME Topic „GrokBot", 15:55 UTC)
  • Telegram Herman (@HermanButlerBot), 2026-09-15: OME Topic „GrokBot“ — Begleit-Briefing zu „Grok Bot Galaxy“ (Format, Sprecher, Agenda)
  • X-Post Elon Musk (@elonmusk), 2026-09-16: https://x.com/elonmusk/status/2100296847344783441 — Quote-Post des Day-2-Broadcasts („Watch a company being built live with @Grok @Bot!“; geteilt von Rüdiger @Stelariz_75 im OME Topic „GrokBot“, 18.09.2026 15:12 UTC)
  • VentureBeat, 2026-08-11: https://venturebeat.com/orchestration/spacexais-grok-bot-turns-agents-into-persistent-digital-coworkers-that-can-operate-your-apps-for-120-per-month — Launch-Bericht, Preisstaffel Cursor Premium Teams $120/Seat · Cursor Ultra $200 · SuperGrok Heavy $300, keine Benchmarks
  • techiexpert.com, 2026-09-18: https://techiexpert.com/grok-bot-galaxy-building-a-startup-from-scratch/ — Sekundärbericht zum Galaxy-Ergebnis „Ship by Thursday“
  • Cursor Help Center, abgerufen 2026-09-19 (vollständig gelesen): https://cursor.com/help/grok-bot/plans — Zugangs-Matrix, Pro/Pro+/Ultra-Staffel, Verknüpfungs-/Stapelungs-Regeln, Free Trial, On-demand, iOS-/Android-Sonderfälle
  • Cursor Pricing, abgerufen 2026-09-19: https://cursor.com/pricing — Hobby gratis · Individual $20/Monat (Pro/Pro+/Ultra) · Teams $40/User/Monat · Enterprise individuell
  • SpaceXAI, x.ai/news/grok-bot-more-plans: „Grok Bot is now included with more plans“ — Inklusion in alle SuperGrok-/Cursor-Pro-/Teams-Pläne, eigene Nutzung getrennt von Grok/Cursor
  • Community-Anleitung „Grok Bot Free Trial“ (HTML, Stand 19.09.2026, ohne Autorenangabe; geteilt von Pit @PWeber, OME „GrokBot“, 19.09.2026 11:57 UTC) — Desktop/Web-Testweg, Warnung vor dem App-Store-Test, Checkliste; Sicherheitsaussagen von Herman (@HermanButlerBot) gegen die Cursor-Doku geprüft
  • SpaceXAI/xAI, 2026-09-21: https://x.ai/news/grok-4-7 — offizielles Release, Trainingsänderungen, Anbieter-Benchmarks, Verfügbarkeit
  • xAI API-Doku: https://docs.x.ai/developers/models/grok-4.7 — 500k Kontext, Modalitäten, Effort-Stufen, direkte API-Preise
  • Cursor Modell-Doku: https://cursor.com/docs/models/grok-4-7 — 256k/500k, Cursor-Tools, Cursor-Models-Pool und Cursor-Abrechnung
  • YouTube Alex Finn, 2026-09-22: https://www.youtube.com/watch?v=ajuOF7vclCM — Metadaten/Kapitel; kein Transcript abrufbar; Praxiszusammenfassung via YouTube AI + Herman
  • Raw: raw/xpost/2026-08-11_xfreeze-spacexai-grok-bot.md
  • Raw: raw/xpost/2026-08-20_brandonai-grok-bot-fleet-walkthrough.md
  • Raw: raw/xpost/2026-08-18_milesdeutscher-grok-bot-deep-dive.md
  • Raw: raw/xpost/2026-08-18_0xcodez-grok-bot-10-step-tutorial.md
  • Raw: raw/xpost/2026-08-18_benln-grok-bot-pro-tips.md
  • Raw: raw/xpost/2026-08-18_bloggersarvesh-grok-bot-seo-playbook.md
  • Raw: raw/xpost/2026-08-18_aiedge-grok-bot-hermes-combo.md
  • Raw: raw/xpost/2026-08-18_prajwaltomar-grok-bot-5-businesses-test.md
  • Raw: raw/youtube/2026-08-18_hermes-bot-vs-grok-bot.md (Alex Finn, Hermes vs Grok Vergleich)
  • Raw: raw/youtube/2026-08-27_paul-lipsky-grok-bot-20-dollar-9-use-cases.md (Paul J Lipsky, $20-Claim + 9 Use Cases, inkl. Transcript)
  • Raw: raw/other/2026-08-27_herman-grokbot-video-summary.md (Herman-Zusammenfassung, Second-hand)
  • Raw: raw/other/2026-09-15_grok-bot-galaxy-livestream.md (Grok Bot Galaxy, Event-Fakten + Agenda + Quellen)
  • Raw: raw/xpost/2026-09-16_elonmusk-grok-bot-galaxy-day2.md (Musk-Quote-Post + zitierter @bot-Post)
  • Raw: raw/blog/2026-08-11_venturebeat-grok-bot-launch-pricing.md (VentureBeat Launch + Preisstaffel)
  • Raw: raw/blog/2026-09-18_techiexpert-grok-bot-galaxy-ship-by-thursday.md (Galaxy-Ergebnis, Sekundärquelle)
  • Raw: raw/blog/2026-09-19_cursor-grok-bot-plans-und-trial.md (Cursor-Doku: Zugang, Staffelung, Trial, On-demand + x.ai-Announcement)
  • Raw: raw/other/2026-09-19_grok-bot-trial-anleitung-community.md (Community-Trial-Anleitung, geteilt von Pit @PWeber)
  • Raw: raw/blog/2026-09-21_xai-grok-47-official.md (offizielle Release-/API-/Cursor-Dokumentation)
  • Raw: raw/xpost/2026-09-21_cb-doge-grok-47-release.md (reichweitenstarke Release-Zusammenfassung; Pauschalclaim markiert)
  • Raw: raw/youtube/2026-09-22_alex-finn-grok-47-grok-bot.md (Metadaten + klar attribuierte Sekundärzusammenfassungen; kein Transcript)

Verwandte Seiten