> - YouTube-Video "Hermes DESKTOP ist der WAHNSINN!!" von [Jonas Keil](https://www.youtube.com/@JonasKeil) (AI Trainer), 22.06.2026 → [Raw-Datei](../../raw/youtube/2026-06-22_jonas-keil-hermes-desktop.md)
> - YouTube-Video "The new Hermes Agent update has me speechless...." von [Alex Finn](https://www.youtube.com/@AlexFinnOfficial), 24.06.2026 → [Raw-Datei](../../raw/youtube/2026-06-24_alex-finn-hermes-agent-v0170-reach.md)
> - YouTube-Video "Hermes Full Course: Build Your 24/7 AI Chief of Staff in 45 Minutes" von Peter Yang, 24.06.2026 → [Raw-Datei](../../raw/youtube/2026-06-24_peter-yang-hermes-full-course.md)
> **Background:** [Ewan Mak, Medium Juni 2026](https://medium.com/@tentenco/hermes-agent-desktop-app-everything-you-need-to-know-about-nous-researchs-self-improving-ai-agent-3cb59bd31e5f)
## Was ist Hermes Desktop?
[Hermes Agent](https://hermes-agent.nousresearch.com) von [Nous Research](https://nousresearch.com/) hat am **2. Juni 2026** seine offizielle Desktop-App veröffentlicht (Public Preview, v0.15.2). Sie ist eine native Applikation für **macOS, Windows und Linux**, gebaut auf **Electron + React** mit **Python-Backend**.
Die Desktop-App ist **kein separates Produkt** — sie nutzt denselben Agent-Core wie CLI und Gateway: same config, same API keys, same sessions, same skills, same memory. Was im Terminal eingerichtet wurde, erscheint in der Desktop-App und umgekehrt.
> **Hector-Einordnung:** *"Telegram tot, CLI tot, das ist die Zukunft"* — so beschrieb ein verlinktes Video den Paradigmenwechsel. Die Desktop-App rückt Hermes in Reichweite der nicht-terminal-affinen Nutzergruppe und positioniert es als ersten ernsthaften GUI-Konkurrenten zu Claude Code's VSCode-Integration.
## 🚀 Hermes v0.17.0 — "The Reach Release" (19. Juni 2026)
Am **19. Juni 2026** veröffentlichte Nous Research das Major-Update **v0.17.0** unter dem Codenamen **"The Reach Release"**. Der Fokus liegt auf der Ausweitung der Kanäle (Reach), in denen Hermes agieren kann, tieferer Werkzeugintegration und verbesserter Steuerung.
- **Kein Mac-Relay erforderlich:** Bisherige Lösungen wie BlueBubbles benötigten einen permanent laufenden Mac im Schrank.
- **Photon Spectrum:** Nutzt einen verwalteten Line-Pool von Photon. Die Anmeldung erfolgt direkt über `hermes photon login` via Device-Code.
- **Einfachheit:** Gratis Einstieg, keine eigene Hosting-Infrastruktur oder iMessage-Brücke notwendig. Hermes kann direkt in den blauen iMessage-Bubbles chatten und agieren.
- **Parallele Tasks:** Über `delegate_task(background=true)` startet Hermes asynchrone Subagents, die im Hintergrund arbeiten.
- **Bypass Blocking:** Der Haupt-Agent (oder der Nutzer) kann parallel weiterarbeiten, anstatt auf die Fertigstellung eines langen Research-Dives oder Multi-Step-Builds zu warten.
- **Watch-Windows:** Die Desktop-App hat spezielle Live-Panes erhalten, in denen die Aktivität des Hintergrund-Subagents gestreamt wird. Das Ergebnis fließt nach Fertigstellung nahtlos als neuer Turn zurück in die Haupt-Konversation.
#### 3. Image-to-Image Editing in `image_generate`
- **Bildbearbeitung:** Das `image_generate`-Tool kann nun bestehende Bilder modifizieren statt sie nur neu zu generieren.
- **Prompts:** Anweisungen wie *"make this logo blue"* oder *"remove the background"* werden an die Edit-Endpunkte der unterstützten Bild-Provider (wie DALL-E 3 oder Gemini) geroutet.
- **Interaktiver Dialog:** Hermes erfragt alle notwendigen Parameter über native Formulare im Dashboard, Slash-Commands oder im normalen Chat.
#### 5. Cursor Composer via Grok-Subscription
- **High-Speed Coding:** `grok-composer-2.5-fast` (das Modell hinter Cursors Composer) ist nun direkt im xAI OAuth Model-Picker verfügbar.
- **Vorteil:** Nutzer mit einem bestehenden xAI Grok-Abonnement können das Modell mit vollem 200k-Kontextfenster im Hermes-Agent-Loop nutzen, ohne einen separaten API-Key zu benötigen.
#### 6. Atomares Memory-Upgrade
- **Batch-Edits:** Das `memory`-Tool unterstützt nun ein `operations`-Array für atomare Batch-Operationen (gleichzeitiges Hinzufügen, Ersetzen und Löschen).
- **Vorteil:** Verhindert das Scheitern von Speicher-Updates bei Budget-Limits. Ein Eintrag kann gelöscht und ein neuer hinzugefügt werden im exakt selben Call, ohne das Token-Limit zu sprengen.
#### 7. Weitere Kanal- & API-Upgrades
- **Raft Agent Network:** Bundled Raft-Adapter bindet Hermes an das Raft-Netzwerk ([raft.build](https://raft.build/)) an. Datensparsamkeit durch "Privacy-by-Contract" (Payloads tragen nur Event-IDs und Timestamps, keine Nachrichten-Bodys).
- **Offizielle WhatsApp Cloud API:** Neben der inoffiziellen Baileys-Brücke spricht Hermes nun nativ mit Meta's offizieller WhatsApp Business Cloud API (kein QR-Code scannen, stabiler Betrieb).
- **Telegram Rich Text (Bot API 10.1):** Automatische Formatierung der Antworten als Rich Messages (bessere Headers, Tabellen-Ersatz, Spoilers).
#### 8. Curation Cost Optimization
- Der Skill-Curator bereinigt inaktive Skills deterministisch und kostenlos. LLM-basierte Konsolidierungs-Passes (Zusammenfassung von Skills) sind nun standardmäßig deaktiviert und müssen explizit via `curator.consolidate: true` aktiviert werden, was Tokens und Kosten spart.
## 🧬 Mixture of Agents (MoA) — Multi-Model Fusion (28. Juni 2026)
Am **28. Juni 2026** wurde eine neue Hermes-Funktion bekannt: **Mixture of Agents (MoA)**. Diese erlaubt es, beliebig viele AI-Modelle zu einem einzigen **virtuellen Modell** zu verschmelzen, das im Model-Picker als reguläres Modell ausgewählt werden kann.
> **Quelle:** X-Post von [@VaibhavSisinty](https://x.com/vaibhavsisinty/status/2070741416649850898), geteilt von Pit Weber im OME-Topic "Hermès" Agents (Topic 3770) am 28.06.2026 → [Raw-Datei](../../raw/xpost/2026-06-28-hermes-moa-vaibhavsisinty.md)
### Funktionsweise
| Komponente | Rolle |
|-----------|------|
| **Reference Model(s)** | Generieren parallele Draft-Responses pro Task |
| **Aggregator Model** | Synthetisiert finales Output aus Reference-Outputs + eigenem Reasoning; handles Tool Calls |
| **Virtuelles Modell** | Erscheint als einzelnes auswählbares Modell im Model-Picker |
- Beide (oder alle) Modelle laufen **parallel** pro Task
- Der Aggregator produziert das finale Output und manages Tool Calls
- Alle Hermes-Features (Memory, Tool Use, Skills, Long Sessions, Cross-Channel Messaging) funktionieren **unberührt**
### Performance
| Benchmark | MoA vs. Solo |
|-----------|-------------|
| vs. Opus 4.8 solo | **+8%** auf hard agentic tasks |
| vs. GPT-5.5 solo | **+11%** auf hard agentic tasks |
- **Any number of models:** @Teknium klärte, dass nicht nur zwei Modelle unterstützt werden — beliebig viele, inklusive **Multiplikation desselben Modells** (Self-Fusion-Pattern)
- **Same-model multiples:** Z.B. 3× GLM-5.2 als Reference + 1× Opus 4.8 als Aggregator
### Kritik & Limitationen
- **Erhöhte Token-Kosten:** Mehrere Modelle laufen parallel → höhere API-Kosten pro Task
- **@lambdua** bezeichnete es als **"toy stage"** — noch nicht produktionsreif für kostensensitive Workflows
### Einordnung
MoA ist eng verwandt mit dem [OpenRouter Fusion / DRACO-Benchmark-Pattern](../concepts/llm/llm-model-fusion-ensembles.md), hat aber entscheidende Unterschiede:
| **Modell-Anzahl** | 2+ | N (inkl. Self-Fusion) |
| **Tool Calls** | Extern | Aggregator handles nativ |
| **Kosten** | Pay-per-model | Pay-per-model (höher bei N Modellen) |
Die Integration in den Agent-Core (mit Tool-Call-Support und Memory-Zugriff für alle beteiligten Modelle) ist der wesentliche Unterschied zu reinen API-Fusion-Ansätzen. MoA macht Ensemble-Fusion zu einer **First-Class Citizen** im Agent-Workflow.
### Leitmotiv: "Don't chase the model, build the system"
Die zentrale These des Videos ist die direkte Bestätigung der [Model Fusion & Ensembles](../concepts/llm/llm-model-fusion-ensembles.md) Konzeptseite:
- Ein **Panel** aus mehreren (auch günstigeren/local) Modellen schlägt einzelne Frontier-Modelle
- Neue Modelle (GPT 5.6, Fable 5, etc.) werden einfach ins Panel integriert — kein Warten auf den nächsten Frontier-Release
- **Systemgedanke:** Ein Team von "Genies" ist besser als ein einzelnes "Genie"
- Die Value Migration von Modellen zu **Orchestrierung** ([siehe auch](../concepts/llm/ai-value-migration-orchestration.md)) wird hier produktisiert
### Business-Kontext
- **AI Profit Boardroom / AI Profit Pod Community** — 3800+ Mitglieder, 191 Seiten Testimonials
- Zielgruppe: Personen die mit Agent-Systemen Geld verdienen wollen, auch ohne tiefes technisches Know-how
- Hermes positioniert sich nicht als Chat-Tool sondern als **Business-OS** — Jarvis (Browser-Control) + Studio (Outreach) sind direkte Revenue-Workflow-Integrationen
### Einordnung
MoA 2.0 + Agent OS markieren den Übergang von MoA als experimentellem Feature zu einem produktiven Business-Betriebssystem. Die GoldyBench-Validierung (42 Builds) widerlegt die "toy stage"-Kritik von @lambdua quantitativ. Das Agent OS mit Jarvis (Browser-Control) und Studio (Outreach) erweitert Hermes über Chat/Agent-Workflows hinaus in direkte Business-Automation — ein Schritt in Richtung eines vollständigen AI Business Operating Systems.
Die Desktop-App kann sich mit einem **remote Hermes-Backend** verbinden — einer `hermes dashboard`-Instanz auf VPS, Home-Server oder Mac Mini hinter Tailscale. Die App fungiert dann als grafischer Remote-Client. Auth-Gate, `/api/ws` chat socket und WebSocket close-code triage sind in der [Web-Dashboard-Doku](https://hermes-agent.nousresearch.com/docs/user-guide/features/web-dashboard) beschrieben.
Die Existenz des Migrationstools ist eine explizite Positionierung: Nous Research sieht OpenClaw-Nutzer als Migrationszielgruppe. Das YouTube-Video "you need to use Hermes RIGHT NOW!! (goodbye OpenClaw!!)" auf Jonas Keils Kanal unterstreicht diese Narrative.
- **Windows-Installer** nicht code-signed → SmartScreen-Warnung
- **Linux** noch via Terminal-Installation (`curl` script mit `--include-desktop` flag)
- **Self-evolving Skills** = Black Box — Skill-Files sind Markdown (lesbar), aber die Decision-Logic für Skill-Retention/Modifikation hat keine Explainability-Schnittstelle
- **Nous Portal Free-Tier** nur für Evaluation; tägliche Nutzung braucht Plus oder eigene Keys
Sponsored Content (Hostinger), aber mit legitimen Technik-Inhalt. Zeigt den kompletten Weg vom leeren VPS bis zum lauffähigen Hermes-Agent mit OpenAI-Provider:
1.**Hostinger-VPS** auswählen und Hermes über das Dashboard installieren
2.**OpenAI API-Key** als Default-Provider eintragen
4.**OpenClaw-Vergleich** — warum "everyone is talking about" Hermes
Der Vergleich mit OpenClaw in einem Sponsored-Video unterstreicht die strategische Positionierung: Hermes wird als die einfacher deploybare Alternative positioniert, besonders für Nutzer ohne Linux/CLI-Erfahrung. Die Hostinger-Partnerschaft reduziert die Einstiegshürde weiter — kein SSH, kein Terminal, Hosting wird zum Klick-Produkt.
## Alex Finn: 100+ Hours Lessons Learned (09. Juli 2026)
> **Quelle:** X-Post + Video von [Alex Finn](https://x.com/AlexFinn/status/2075055593635844306) (CEO Henry Intelligent Machines), 09.07.2026 → [Raw-Datei](../../raw/xpost/2026-07-10_alex-finn-hermes-agent-100-hours.md)
> **Follow-up (10.07.):** Alex switched main Hermes agent to GPT-5.6 for the first time
Nach 100+ Stunden mit Hermes Agent teilt Alex Finn 9 praktische Lektionen. Er nennt Hermes "the most powerful AI agent on Earth right now."
| **GPT-5.6 (codex/gpt-5.6-sol)** | Jetzt competitive/besser, Alex switched am 10.07. | Bruchteil von Opus (ChatGPT-Subscription) |
| **GLM** | Budget-Option für High-Volume/Low-Criticality | Minimal |
**Pro-Tipp:** Separate Agent-Profile pro Modell/API anlegen zum einfachen Testen und Vergleichen.
### Security & Connectivity
- **Tailscale** als Top-Empfehlung für Zero-Trust-Konnektivität über Geräte hinweg
- Security-Bedenken zu separaten Accounts: "largely overblown"
- **2+ Agents als Failover**
- Separate Agent-Accounts sind ein Fehler — eigene Accounts mit dem Agent nutzen
### Workflow-Innovationen
- **Reverse Prompting:** 5-Minuten-Morgeninterview — der Agent interviewt DICH zu den Tagesprioritäten
- **Multi-Device via Tailscale:** Agent als "AI Employee" der zwischen lokalen Maschinen wechselt
- **Strukturierte Vaults:** Ein Index-File pro Ordner beschleunigt Agent-Navigation drastisch
- **Classroom-Ordner:** /learn Workflows isolieren mit "textbook"-File für wiederverwendbare Pfade/Links
### Einordnung
Alex Finns Modell-Empfehlung (Opus → GPT-5.6 Migration) bestätigt den Trend: Frontier-Modelle werden commoditized, die System-Architektur (Hermes als Agent-OS) ist der bleibende Wert. Das Reverse-Prompting-Pattern ist eine interessante Umkehrung des üblichen Prompt-Workflows und könnte für Hectors Morning-Briefing adaptiert werden.
## 🌐 Hermes Browser Extension — @jonkomet (10. Juli 2026)
> **Quelle:** X-Post von [@DataChaz](https://x.com/DataChaz/status/2075505727326818684), 10.07.2026 → [Raw-Datei](../../raw/xpost/2026-07-10_charly-wargnier-hermes-browser-extension.md)
Eine inoffizielle, **Open-Source Browser-Extension** für Hermes Agent, gebaut von [@jonkomet](https://github.com/abundantbeing/hermes-browser-extension). Bereits 8 Updates in der ersten Woche.
### Features
| Feature | Beschreibung |
|---------|-------------|
| **Session-Management** | Volle Hermes-Session-Steuerung aus dem Browser |
| **Vision/Screenshots** | Screenshots direkt aus dem Browser an den Agenten senden |
| **Model-Switching** | Nahtloser Wechsel zwischen Opus, Grok, GPT und lokalen Modellen |
| **Gateway-Verbindung** | Direkte Verbindung zu lokalem oder remote Hermes Gateway |
### Paradigmenwechsel
> "Hermes doesn't leave your browser 🔥"
Die Extension positioniert Hermes als **Workflow-Begleiter statt separatem Ziel**. Der Agent lebt direkt im Browser — kein Tab-Wechsel, kein separates Fenster. Das ist ein fundamentaler UX-Shift:
- **Vorher:** Hermes Desktop als separate App → Browser-Tab → Kontextwechsel
- **Nachher:** Hermes als Side-Panel/Overlay im Browser → kein Kontextwechsel
### Einordnung
Die Extension ist ein Community-Projekt (nicht von Nous Research), aber die Geschwindigkeit der Iteration (8 Updates/Woche) und das direkte Feedback zeigen, dass die Community Hermes zunehmend als **Plattform** behandelt, nicht nur als Tool. Browser-Extension als UI-Schicht ist vergleichbar mit OpenClaw's Telegram-Interface — aber nativ im Browser statt in einer separaten Messaging-App.
- **Konkurrenz-Analyse:** Hermes v0.17.0 ("Reach") weitet seine Präsenz drastisch aus. Vor allem die iMessage-Integration über Photon nimmt viel Reibung aus dem iMessage-Setup.
- **Asynchrones Arbeiten:** Mit Hintergrund-Subagents und dazugehörigen Watch-Windows in der Desktop-App hat Hermes einen extrem flüssigen Multitasking-Workflow etabliert.
- **Plattform-Verbreiterung:** Neben der WhatsApp Cloud API und dem Raft Agent Network ist auch die verbesserte Telegram Bot API 10.1 Rich Text Unterstützung ein direkter Angriff auf OpenClaws Messaging-Stärke.
- **Kosten-Sensibilität:** Die Abschaltung der LLM-Curator-Konsolidierung standardmäßig zeigt, dass auch Nous Research die Tokenkosten im Dauerbetrieb optimieren muss.