Compare commits

..

2 commits

Author SHA1 Message Date
Hector
84e7b944cb ingest(xpost): teksedge unsloth dynamic-3.0 qwen3.8-27b 2026-08-20 21:54:39 +02:00
Hector
3b5751453c Ingest: IBuzovskyi Hermes Bot Mode — 5 übersehene Features (X-Post 2026-08-20)
- raw/xpost/2026-08-20_ibuzovskyi-hermes-bot-mode-5-features.md (neu)
- wiki/concepts/agents/hermes-bot-mode.md (neu): 5 Features (Skill Hub, Duplicate, Groups, Per-Skill-Toggle, Bot-to-Bot via Agent Inbox) + Setup-Flow + Einordnung
- wiki/index.md: 113. Update, neuer Concepts/Agents-Eintrag
- wiki/log.md: Ingest-Eintrag
2026-08-20 15:52:01 +02:00
6 changed files with 174 additions and 2 deletions

View file

@ -0,0 +1,54 @@
---
type: xpost
source_url: https://x.com/IBuzovskyi/status/2090154478133444907
retrieved: 2026-08-20
author: "@IBuzovskyi"
is_thread: false
quote_count: 0
tags: [hermes, bot-mode, multi-agent, skills, agent-inbox, bot-groups, customization]
---
# Ihor Buzovskyi (@IBuzovskyi / YanXbt): Hermes Agent "Bot Mode" — 5 übersehene Features
**Quelle:** https://x.com/IBuzovskyi/status/2090154478133444907
**Geteilt von:** Kai (@PWeber) in OME-Gruppe, Topic "Hermès" Agents (2026-08-20)
## Inhalt
Detailierter Guide zu den **"Bot Mode"-Features** im Hermes Agent. 5 Funktionen, die die meisten Nutzer beim initialen Setup übersehen — alle über Rechtsklick-Menüs zugänglich. Ziel: effizientere, spezialisierte und kollaborative AI-Agents ("Bots") bauen, ohne jedes Mal von Null zu starten.
### Die 5 Features
1. **Capabilities in Advanced Create**
- Beim Erstellen eines neuen Bots "Advanced" öffnen → Zugriff auf den **Skill Hub** (88.000+ Skills)
- Skills pro Bot togglen (z.B. Web-Search für Researcher, Terminal für DevOps)
- Hält Token-Verbrauch niedrig, da nur relevante Skills geladen werden
2. **Duplicate (Rechtsklick auf jeden Bot)**
- Klont einen funktionierenden Bot sofort (Config, SOUL.md, Skills, Memory)
- Schnelle Adaption (z.B. Researcher → "Competitor Analyst" durch Prompt-Edit)
3. **Manage Groups (Rechtsklick auf jeden Bot)**
- Organisiert Bots in projekt-spezifische Gruppen (z.B. "product launch team" oder "infrastructure")
- Sidebar als Projekt-Navigator
4. **Per-Skill und Per-Toolset Toggle (Edit Profile)**
- Feingranulare Kontrolle: einzelne Skills/Toolsets pro Bot an-/abschalten
- Beispiel: Researcher bekommt Browser-Tools, aber nicht Terminal
5. **Bot-to-Bot Messaging (via Agent Inbox)**
- Einfaches Protokoll in jedem Bot-SOUL.md, damit sie autonom kommunizieren
- Bots prüfen die "Agent Inbox" bei jedem Run-Start, lesen/beantworten Nachrichten, bearbeiten dann die User-Anfrage
- Ermöglicht Multi-Agent-Workflows (z.B. Researcher → Writer) ohne manuelles Copy-Paste
### Empfohlener Setup-Flow
1. Starte mit Advanced Mode beim ersten Bot
2. Dupliziere und tweake für ähnliche Rollen
3. Gruppiere nach Projekt
4. Füge die Agent-Inbox-Anweisung hinzu
5. Lasse Bots automatisch koordinieren
## Key Takeaways
1. Hermes "Bot Mode" macht Multi-Agent-Setups zugänglich: Skill Hub (88k+ Skills), Duplicate, Groups, Per-Skill-Toggle, Bot-to-Bot Messaging.
2. Bot-to-Bot Messaging via Agent Inbox (SOUL.md-Protokoll, Inbox-Check am Run-Start) ermöglicht autonome Multi-Agent-Koordination ohne manuelles Copy-Paste.
3. Das Pattern entspricht Hectors OpenClaw-Subagent-/Task-Orchestrierung und Multi-Agent-Gruppenarbeit.

View file

@ -0,0 +1,36 @@
---
type: xpost
source_url: https://x.com/TeksEdge/status/2090228570253861075
retrieved: 2026-08-20
author: "@TeksEdge (David Hendrickson)"
is_thread: false
quote_count: 0
---
# Unsloth Dynamic 3.0 — Neue GGUF-Quantisierung für Qwen3.8-27B
**Autor:** @TeksEdge (David Hendrickson)
**URL:** https://x.com/TeksEdge/status/2090228570253861075
**Retrieved:** 2026-08-20 (OME-Gruppe, Topic 27 "Tips & Tricks", gepostet von Kai/@PWeber)
## Inhalt
Follow-up-Warnung zu Unsloth AIs neu veröffentlichten **"Dynamic 3.0"-Quantisierungs-Versionen** des Qwen3.8-27B-Modells:
- **Neue GGUF-Dateien:** Unsloth hat aktualisierte GGUF-Dateien für Qwen3.8-27B veröffentlicht, die die neue **Dynamic V3-Quantisierung** nutzen.
- **Brandneue Modelldateien:** Es handelt sich um *neue* Modell-Dateien (nicht um einen Toggle/Setting in LM Studio oder llama.cpp).
- **Re-Download nötig:** Wer bereits eine ältere Unsloth-Qwen3.8-GGUF geladen hat, sollte die neuen **"UD-..."**-Versionen re-downloaden, um von den Verbesserungen zu profitieren.
- **Deutlich kleiner bei mehr Leistung:** Die neuen Quants sind deutlich kleiner und erhalten dabei mehr der ursprünglichen Modell-Leistung:
- UD-IQ1_S → ~6,2 GB
- UD-IQ1_M → ~6,7 GB
- UD-IQ2_S → ~8,4 GB
- UD-Q3_K_XL → ~13,1 GB
- Höherpräzise Varianten bis ~22 GB
- **Kompatibilität:** Funktioniert mit den üblichen Tools (llama.cpp, LM Studio, RTX/CUDA, AMD, CPU, Apple Metal).
- **Abgrenzung zu MTP/speculative decoding:** Dynamic 3.0 ist **nicht** dasselbe wie Qwen3.8s MTP (Speculative Decoding) — es geht spezifisch um bessere Qualität-zu-Größe bei Quantisierung.
**Kernaussage:** „If you grabbed the old Unsloth Qwen3.8 GGUF, go grab the new Dynamic 3.0 ones instead." Ein 27B-Modell passt jetzt in den ~68-GB-Bereich auf Consumer-Hardware — das ist signifikant.
## Einordnung
Passt zum laufenden Qwen3.8-27B-Faden (Speculative Decoding/DFlash 2, lokale Inferenz, Barbell-Routing): Quantisierungs-Optimierung ist ein weiterer Baustein für „27B auf Consumer-Hardware" — komplementär zur Decode-Beschleunigung (MTP/DFlash). Unsloth ist der Anbieter hinter dSpark (DeepSeek V4 lokal 2x).

View file

@ -0,0 +1,51 @@
---
created: 2026-08-20
updated: 2026-08-20
sources: [xpost/2026-08-20_ibuzovskyi-hermes-bot-mode-5-features.md]
tags: [hermes, bot-mode, multi-agent, skills, agent-inbox, bot-groups, customization, concepts]
---
# Hermes "Bot Mode" — 5 übersehene Features für Multi-Agent-Setups
> **Quelle:** X-Post von [@IBuzovskyi](https://x.com/IBuzovskyi/status/2090154478133444907) (YanXbt), geteilt von Kai (@PWeber) im OME-Topic "Hermès" Agents (Topic 3770) am 20.08.2026 → [Raw-Datei](../../../raw/xpost/2026-08-20_ibuzovskyi-hermes-bot-mode-5-features.md)
Hermes Agents "Bot Mode" macht den Aufbau spezialisierter, kollaborativer AI-Agents ("Bots") zugänglich — ohne jedes Mal von Null zu starten. Die meisten Nutzer übersehen 5 Funktionen beim initialen Setup, die alle über **Rechtsklick-Menüs** erreichbar sind.
## Die 5 Features
| # | Feature | Zugang | Zweck |
|---|---------|--------|-------|
| 1 | **Capabilities in Advanced Create** | "Advanced" beim Bot-Erstellen | **Skill Hub** (88.000+ Skills) pro Bot togglen (Web-Search für Researcher, Terminal für DevOps); hält Token-Verbrauch niedrig |
| 2 | **Duplicate** | Rechtsklick auf jeden Bot | Klont Bot sofort (Config, SOUL.md, Skills, Memory); schnelle Adaption (Researcher → "Competitor Analyst") |
| 3 | **Manage Groups** | Rechtsklick auf jeden Bot | Bots in projekt-spezifische Gruppen (z.B. "product launch team", "infrastructure"); Sidebar als Projekt-Navigator |
| 4 | **Per-Skill / Per-Toolset Toggle** | Edit Profile | Feingranulare Kontrolle pro Bot (Researcher bekommt Browser, nicht Terminal) |
| 5 | **Bot-to-Bot Messaging** | Agent Inbox | Einfaches Protokoll in SOUL.md, damit Bots autonom kommunizieren |
## Bot-to-Bot Messaging (Agent Inbox)
Der bemerkenswerteste Mechanismus: **Bots kommunizieren autonom** über eine gemeinsame "Agent Inbox".
- Ein einfaches Protokoll wird in jedes Bot-SOUL.md geschrieben
- Bei **jedem Run-Start** prüft der Bot die Inbox, liest/beantwortet Nachrichten
- Erst danach bearbeitet er die eigentliche User-Anfrage
- Ermöglicht **Multi-Agent-Workflows** (z.B. Researcher → Writer) ohne manuelles Copy-Paste
## Empfohlener Setup-Flow
1. **Advanced Mode** beim ersten Bot
2. **Duplizieren und tweaken** für ähnliche Rollen
3. **Gruppieren** nach Projekt
4. **Agent-Inbox-Anweisung** hinzufügen
5. Bots **automatisch koordinieren** lassen
## Einordnung
Das Bot-Mode-Pattern ist eng verwandt mit Hectors OpenClaw-Orchestrierung (Subagents, Tasks, Multi-Agent-Gruppenarbeit). Das Agent-Inbox-Prinzip (dezentrales Message-Passing zwischen Agenten über eine geteilte Queue) ist ein leichtgewichtiges Gegenstück zu zentralisierter Orchestrierung. Verwandt: der HermesWatcher-Post zu [Persistent Goals & Quality Gates](../tools/hermes-desktop.md) — beide zusammen ergeben ein vollständiges Bild für verlässliche, spezialisierte Multi-Agent-Betrieb.
## Verwandte Wiki-Seiten
- [[../../tools/hermes-desktop.md]] — Hermes Desktop (GUI, Persistent Goals, Quality Gates)
- [[../agents/hermes-vs-grok-bot.md]] — Hermes Bot vs Grok Bot
- [[../agents/compound-knowledge.md]] — Compound-Knowledge-Pattern
- [[../agents/subconscious-agent.md]] — Subconscious Agent (Self-Improvement)
- [[../../tools/openclaw.md]] — OpenClaw (Subagent-/Task-Orchestrierung)

View file

@ -1,7 +1,7 @@
--- ---
created: 2026-08-14 created: 2026-08-14
updated: 2026-08-19 updated: 2026-08-19
sources: [other/2026-08-14_qwen3.8-27b-huggingface-release.md, youtube/2026-08-18_qwen-38-27b-ollama-julian-goldie.md, xpost/2026-08-19_junsong-dflash2-speculative-decoding.md, xpost/2026-08-19_gregpr07-qwen38-uncensored.md] sources: [other/2026-08-14_qwen3.8-27b-huggingface-release.md, youtube/2026-08-18_qwen-38-27b-ollama-julian-goldie.md, xpost/2026-08-19_junsong-dflash2-speculative-decoding.md, xpost/2026-08-19_gregpr07-qwen38-uncensored.md, xpost/2026-08-20_teksedge-unsloth-dynamic-3.0-qwen38.md]
tags: [concept, qwen, qwen3.8, alibaba, 27b, open-weights, chinese-ai, moe, intelligence-density, huggingface, ollama, mtp, local-llm, speculative-decoding, dflash, uncensored, agent-safety] tags: [concept, qwen, qwen3.8, alibaba, 27b, open-weights, chinese-ai, moe, intelligence-density, huggingface, ollama, mtp, local-llm, speculative-decoding, dflash, uncensored, agent-safety]
--- ---
@ -62,6 +62,16 @@ Quelle: Gregor Zunic-Tweet `raw/xpost/2026-08-19_gregpr07-qwen38-uncensored.md`,
- **Gegenposition (Σ, @s1gmoid, zitierte Antwort):** „If searching the internet to pinpoint a specific file is scary, the world is about to get terrifying." — Verhältnismäßigkeits-/Pro-Leben-Gegen-Narrativ: Ein Agent, der gezielt im Web sucht, ist normales Verhalten, keine Bedrohung. - **Gegenposition (Σ, @s1gmoid, zitierte Antwort):** „If searching the internet to pinpoint a specific file is scary, the world is about to get terrifying." — Verhältnismäßigkeits-/Pro-Leben-Gegen-Narrativ: Ein Agent, der gezielt im Web sucht, ist normales Verhalten, keine Bedrohung.
- **Einordnung:** Diese Debatte berührt Agent-Safety-Fragen ([[../anthropic-red-teaming-frontier-safety.md|Frontier-Safety]]) und das [[../directives/pro-leben-directive.md|Pro-Leben-Prinzip]]: Offene, selbstbestimmte Agenten (Freiheit in Selbstverantwortung) vs. pauschales Gatekeeping-Narrativ. Keine Bewertung — nur die zwei Positionen dokumentiert. - **Einordnung:** Diese Debatte berührt Agent-Safety-Fragen ([[../anthropic-red-teaming-frontier-safety.md|Frontier-Safety]]) und das [[../directives/pro-leben-directive.md|Pro-Leben-Prinzip]]: Offene, selbstbestimmte Agenten (Freiheit in Selbstverantwortung) vs. pauschales Gatekeeping-Narrativ. Keine Bewertung — nur die zwei Positionen dokumentiert.
## Unsloth Dynamic 3.0 Quantisierung (Update 2026-08-20)
Quelle: TeksEdge-Tweet `raw/xpost/2026-08-20_teksedge-unsloth-dynamic-3.0-qwen38.md` (geteilt von Kai im OME-Topic „Tips & Tricks").
- **Unsloth veröffentlicht neue „Dynamic 3.0"-GGUF-Dateien für Qwen3.8-27B** (brandneue Modell-Dateien, kein Toggle in LM Studio/llama.cpp). Wer ältere Unsloth-GGUFs hat, sollte auf die neuen **„UD-"**-Versionen wechseln.
- **Deutlich kleiner bei mehr Leistung:** UD-IQ1_S ~6,2 GB, UD-IQ1_M ~6,7 GB, UD-IQ2_S ~8,4 GB, UD-Q3_K_XL ~13,1 GB, höherpräzise bis ~22 GB. Ein 27B-Modell passt damit in den ~68-GB-Bereich auf Consumer-Hardware.
- **Kompatibel mit** llama.cpp, LM Studio, RTX/CUDA, AMD, CPU, Apple Metal.
- **Wichtige Abgrenzung:** Dynamic 3.0 ≠ MTP/[[speculative-decoding.md|Speculative Decoding]] — es geht um bessere Qualität-zu-Größe bei Quantisierung, nicht um Decode-Beschleunigung. Komplementär zu DFlash 2/MTP ([[#DFlash 2 / Speculative Decoding (Update 2026-08-19)]]).
- **Einordnung:** Dritter Baustein für „27B auf Consumer-Hardware" (kompakte Architektur → MTP/DFlash-Decode-Speedup → kleinere Quants). Anbieter Unsloth = auch hinter [[../../tools/unsloth-dspark.md|dSpark]] (DeepSeek V4 lokal 2x).
## Offene Punkte ## Offene Punkte
- ⚠️ Detaillierte Benchmarks und Lizenz im Release-Zustand weiter prüfen; die Ollama-Seite bestätigt Architektur + Quantisierung, aber Referenz-Benchmarks (agentic, coding) sind noch nicht im Wiki verankert. - ⚠️ Detaillierte Benchmarks und Lizenz im Release-Zustand weiter prüfen; die Ollama-Seite bestätigt Architektur + Quantisierung, aber Referenz-Benchmarks (agentic, coding) sind noch nicht im Wiki verankert.

View file

@ -91,7 +91,7 @@
| [GLM 5.2 (Z.ai) — Chinese Frontier Coding Model](concepts/llm/glm-5.2-zai-coding-model.md) | 10x günstiger als Claude, 1M Kontext, MIT-Lizenz, Z.ai Coding Plan, **nativ in OpenClaw v2026.6.8**. Update 22.06.: Arnie-Review mit 4 Tests, Self-Hosting-Pfade (LM Studio, Unsloth, DwarfStar), Kosten-Analyse. **Update 29.06.:** Semgrep IDOR-Benchmark ≈ Opus 4.8 bei Schwachstellen-Suche, Reward Hacking im RL-Training, DSGVO-konforme Security-Nutzung, Geopolitik. **Update 01.07.:** #1 Open-Weights auf Artificial Analysis Intelligence Index v4.1 (Score 51, 4th worldwide), SWE-bench Pro 62.1 beats GPT-5.5, Industry praise from Rauch/Levie/Howard. **Update 02.07.:** atomic.chat One-Shot Benchmark — B+ at $0.08, 39× cheaper than Fable 5, 6th independent validation | youtube/2026-06-15_ichbinfabian-glm-5.2-coding-modell.md + other/2026-06-16_openclaw-releases-v2026.6.8.md + youtube/2026-06-22_ai-mit-arnie-glm-5-2-review.md + blog/2026-06-29_heise-glm52-hacking-cybersecurity.md + blog/2026-07-01_perplexity-glm52-tops-open-weights-intelligence-index.md + xpost/2026-07-02_atomicchat-coding-benchmark-fable5-gpt55-opus48-glm52.md | | [GLM 5.2 (Z.ai) — Chinese Frontier Coding Model](concepts/llm/glm-5.2-zai-coding-model.md) | 10x günstiger als Claude, 1M Kontext, MIT-Lizenz, Z.ai Coding Plan, **nativ in OpenClaw v2026.6.8**. Update 22.06.: Arnie-Review mit 4 Tests, Self-Hosting-Pfade (LM Studio, Unsloth, DwarfStar), Kosten-Analyse. **Update 29.06.:** Semgrep IDOR-Benchmark ≈ Opus 4.8 bei Schwachstellen-Suche, Reward Hacking im RL-Training, DSGVO-konforme Security-Nutzung, Geopolitik. **Update 01.07.:** #1 Open-Weights auf Artificial Analysis Intelligence Index v4.1 (Score 51, 4th worldwide), SWE-bench Pro 62.1 beats GPT-5.5, Industry praise from Rauch/Levie/Howard. **Update 02.07.:** atomic.chat One-Shot Benchmark — B+ at $0.08, 39× cheaper than Fable 5, 6th independent validation | youtube/2026-06-15_ichbinfabian-glm-5.2-coding-modell.md + other/2026-06-16_openclaw-releases-v2026.6.8.md + youtube/2026-06-22_ai-mit-arnie-glm-5-2-review.md + blog/2026-06-29_heise-glm52-hacking-cybersecurity.md + blog/2026-07-01_perplexity-glm52-tops-open-weights-intelligence-index.md + xpost/2026-07-02_atomicchat-coding-benchmark-fable5-gpt55-opus48-glm52.md |
| [GLM 5.3 (Z.ai) — Neue Generation der GLM-Serie](concepts/llm/glm-5.3-z-ai.md) | AICodeKing Early Access + Bench #1 (2026-08-14). Neue Generation der GLM-Familie (5.0→5.1→5.2→5.3, GLM 5.5 angekündigt). Viert schnellste Frontier-Kadenz der Branche. Relevanz für Model-Routing, da GLM-5.2 Hectors Primary-Modell | youtube/2026-08-14_glm-5.3-aicodeking.md | | [GLM 5.3 (Z.ai) — Neue Generation der GLM-Serie](concepts/llm/glm-5.3-z-ai.md) | AICodeKing Early Access + Bench #1 (2026-08-14). Neue Generation der GLM-Familie (5.0→5.1→5.2→5.3, GLM 5.5 angekündigt). Viert schnellste Frontier-Kadenz der Branche. Relevanz für Model-Routing, da GLM-5.2 Hectors Primary-Modell | youtube/2026-08-14_glm-5.3-aicodeking.md |
| [GLM-5.5 (Z.ai) — Trillion-Parameter Announcement](concepts/llm/glm-5.5-z-ai.md) | Successor to GLM 5.2. **>1T parameters**, 1M context, open weights, August 2026 launch. Agent/coding focus. Fourth Chinese AI announcement in four days (20.07.2026). Part of [[concepts/chinese-ai-wave-july-2026.md]]. Comparison table vs GLM 5.2 | xpost/2026-07-20-healthranger-four-chinese-models.md | | [GLM-5.5 (Z.ai) — Trillion-Parameter Announcement](concepts/llm/glm-5.5-z-ai.md) | Successor to GLM 5.2. **>1T parameters**, 1M context, open weights, August 2026 launch. Agent/coding focus. Fourth Chinese AI announcement in four days (20.07.2026). Part of [[concepts/chinese-ai-wave-july-2026.md]]. Comparison table vs GLM 5.2 | xpost/2026-07-20-healthranger-four-chinese-models.md |
| [Qwen3.8-27B (Alibaba) — Compact Frontier, "Intelligence Density"](concepts/llm/qwen3.8-27b-alibaba.md) | HuggingFace-Release (Countdown bis 14.08.2026, 4.928 wartend). Kompaktes 27B-Modell der Qwen3.8-Generation mit "unmatched intelligence density". Kontrast zum 2.4T-MoE von Qwen 3.8. Lokal-relevant (27B läuft auf Consumer-HW). Release am selben Tag wie GLM-5.3-Review — chinesischer Release-Zyklus. **Update 18.08.:** jetzt auf Ollama lauffähig (`ollama run qwen3.8:27b`), dichte 27,8B-Architektur, Hybrid-Attention, 262k-Kontext (bis 1M via YaRN), multimodal, MTP-markierte Ollama-Tags für Inferenz-Speedup. **Update 19.08.:** DFlash 2 (Z Lab → Inco AI) erreicht 70 tok/s auf M5 Max MacBook Pro — bis 4,6× schneller als autoregressives Decoding via Speculative Decoding (Jun Song: „biggest breakthrough in local AI this year", nächste Innovation in Prefill/Gewichtskompression). Uncensored-Debatte: gregpr07 („no gates") vs. s1gmoid-Gegenposition (Verhältnismäßigkeit) | other/2026-08-14_qwen3.8-27b-huggingface-release.md + youtube/2026-08-18_qwen-38-27b-ollama-julian-goldie.md + xpost/2026-08-19_junsong-dflash2-speculative-decoding.md + xpost/2026-08-19_gregpr07-qwen38-uncensored.md | | [Qwen3.8-27B (Alibaba) — Compact Frontier, "Intelligence Density"](concepts/llm/qwen3.8-27b-alibaba.md) | HuggingFace-Release (Countdown bis 14.08.2026, 4.928 wartend). Kompaktes 27B-Modell der Qwen3.8-Generation mit "unmatched intelligence density". Kontrast zum 2.4T-MoE von Qwen 3.8. Lokal-relevant (27B läuft auf Consumer-HW). Release am selben Tag wie GLM-5.3-Review — chinesischer Release-Zyklus. **Update 18.08.:** jetzt auf Ollama lauffähig (`ollama run qwen3.8:27b`), dichte 27,8B-Architektur, Hybrid-Attention, 262k-Kontext (bis 1M via YaRN), multimodal, MTP-markierte Ollama-Tags für Inferenz-Speedup. **Update 19.08.:** DFlash 2 (Z Lab → Inco AI) erreicht 70 tok/s auf M5 Max MacBook Pro — bis 4,6× schneller als autoregressives Decoding via Speculative Decoding (Jun Song: „biggest breakthrough in local AI this year", nächste Innovation in Prefill/Gewichtskompression). Uncensored-Debatte: gregpr07 („no gates") vs. s1gmoid-Gegenposition (Verhältnismäßigkeit). **Update 20.08.:** Unsloth Dynamic 3.0-GGUFs für Qwen3.8-27B — neue UD-…-Dateien deutlich kleiner (UD-IQ1_S 6,2 GB bis Q6_K 22 GB), Qualität-zu-Größe verbessert, ≠ MTP/Speculative-Decoding | other/2026-08-14_qwen3.8-27b-huggingface-release.md + youtube/2026-08-18_qwen-38-27b-ollama-julian-goldie.md + xpost/2026-08-19_junsong-dflash2-speculative-decoding.md + xpost/2026-08-19_gregpr07-qwen38-uncensored.md + xpost/2026-08-20_teksedge-unsloth-dynamic-3.0-qwen38.md |
| [DeepSeek V4-Pro GA + Harness v0.1 (Open Source)](concepts/llm/deepseek-v4-pro-ga-harness-open-source.md) | DeepSeek launcht 13.08.2026 Open Source: V4-Pro GA (App/Web/API, Reasoning-Effort low/high/max, OpenAI-Responses-API + Codex, Peak/Off-Peak-Pricing) + DeepSeek Harness v0.1 (MIT, Open-Source-Agent-Harness, Rivale zu Claude Code). Dritter Baustein der chinesischen Welle in 24h | other/2026-08-14_deepseek-v4-pro-ga-harness-open-source.md + youtube/2026-08-13_deepseek-v4-pro-0813-aicodeking.md | | [DeepSeek V4-Pro GA + Harness v0.1 (Open Source)](concepts/llm/deepseek-v4-pro-ga-harness-open-source.md) | DeepSeek launcht 13.08.2026 Open Source: V4-Pro GA (App/Web/API, Reasoning-Effort low/high/max, OpenAI-Responses-API + Codex, Peak/Off-Peak-Pricing) + DeepSeek Harness v0.1 (MIT, Open-Source-Agent-Harness, Rivale zu Claude Code). Dritter Baustein der chinesischen Welle in 24h | other/2026-08-14_deepseek-v4-pro-ga-harness-open-source.md + youtube/2026-08-13_deepseek-v4-pro-0813-aicodeking.md |
| [Chinesische Modelle räumen global die Usage-Charts ab](concepts/llm/chinese-models-top-usage-charts.md) | OpenRouter: Top-5 der wöchentlichen Token-Nutzung (28.07.03.08.2026) alle chinesisch, 56,8 Bio. Tokens, 15 Wochen in Folge führend, DeepSeek-V4-Flash Platz 1. Kimi-K3-Schock (2,8T, größtes Open-Weight-Modell, GPU-Kapazität nach 48h erschöpft, PHLX-Semi-Index 20%). Vierter Baustein der chinesischen Welle in 24h — jetzt auf Marktanteils-Ebene | other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md | | [Chinesische Modelle räumen global die Usage-Charts ab](concepts/llm/chinese-models-top-usage-charts.md) | OpenRouter: Top-5 der wöchentlichen Token-Nutzung (28.07.03.08.2026) alle chinesisch, 56,8 Bio. Tokens, 15 Wochen in Folge führend, DeepSeek-V4-Flash Platz 1. Kimi-K3-Schock (2,8T, größtes Open-Weight-Modell, GPU-Kapazität nach 48h erschöpft, PHLX-Semi-Index 20%). Vierter Baustein der chinesischen Welle in 24h — jetzt auf Marktanteils-Ebene | other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md |
| [Gemini 3.6 Flash vs 3.7 Flash — Googles Workhorse-Serie](concepts/llm/gemini-3.6-flash-vs-3.7-flash.md) | Zwei Flash-Iterationen in 3 Wochen: 3.6 Flash (21.07., $1.50/$7.50) und 3.7 Flash (13.08., Intro $0.75/$3.75 bis 31.12., Default-Modell von Antigravity). 1M Kontext/64K Output, konfigurierbares Thinking. Westliche Antwort auf chinesische Kadenz, Preis-Halbierung als Waffe | other/2026-08-14_gemini-3.6-flash-vs-3.7-flash.md | | [Gemini 3.6 Flash vs 3.7 Flash — Googles Workhorse-Serie](concepts/llm/gemini-3.6-flash-vs-3.7-flash.md) | Zwei Flash-Iterationen in 3 Wochen: 3.6 Flash (21.07., $1.50/$7.50) und 3.7 Flash (13.08., Intro $0.75/$3.75 bis 31.12., Default-Modell von Antigravity). 1M Kontext/64K Output, konfigurierbares Thinking. Westliche Antwort auf chinesische Kadenz, Preis-Halbierung als Waffe | other/2026-08-14_gemini-3.6-flash-vs-3.7-flash.md |
@ -172,6 +172,7 @@
| [Graph-Based Agent Architecture (LangGraph)](concepts/agents/graph-based-agents.md) | Agenten als gerichteter Graph (Nodes=Aktionen, Edges=Übergänge). LangGraph: Persistence, HITL, Tracing, Cycles. Komplexer aber robuster als Loops. Konsens: "Denk in Loops, implementier als LangGraph" | xpost/2026-07-18_steipete-loops-vs-graphs.md + docs.langchain.com | | [Graph-Based Agent Architecture (LangGraph)](concepts/agents/graph-based-agents.md) | Agenten als gerichteter Graph (Nodes=Aktionen, Edges=Übergänge). LangGraph: Persistence, HITL, Tracing, Cycles. Komplexer aber robuster als Loops. Konsens: "Denk in Loops, implementier als LangGraph" | xpost/2026-07-18_steipete-loops-vs-graphs.md + docs.langchain.com |
| [Architecture Triade: Steinberger, Kopadze, LangGraph, Codex](concepts/agents/architecture-triade.md) | **↑ 26.07.: +Codex Graph Compiler** — Vier-Säulen-Modell (Loop-Engineering, Shape-Vokabular, Implementation, Graph→Code-Automatisierung). Diamond-Pattern + Codex als Automatisierungsebene | xpost/2026-07-26_ruediger-agent-architecture-triade.md + xpost/2026-07-18_steipete-loops-vs-graphs.md + xpost/2026-07-24_steipete-graph-engineer-codex.md | | [Architecture Triade: Steinberger, Kopadze, LangGraph, Codex](concepts/agents/architecture-triade.md) | **↑ 26.07.: +Codex Graph Compiler** — Vier-Säulen-Modell (Loop-Engineering, Shape-Vokabular, Implementation, Graph→Code-Automatisierung). Diamond-Pattern + Codex als Automatisierungsebene | xpost/2026-07-26_ruediger-agent-architecture-triade.md + xpost/2026-07-18_steipete-loops-vs-graphs.md + xpost/2026-07-24_steipete-graph-engineer-codex.md |
| [Compound Knowledge — Wissens-Akkumulation statt Paste-in-Chat](concepts/agents/compound-knowledge.md) | Hermes `/learn`-Pattern: Dokument einmal lesen → Brain-File bauen (Index, Kapitel-Map, Glossar, Cheat Sheet) → gezielt nachschlagen statt raten. „Versteht es FOREVER" ist Hype (Index = Nachschlagen, kein Verstehen), aber Compound Knowledge ist real (10 Skills/Monat = anderer Agent). Architektur-Parallele zu OpenClaw: Skills = prozedurales Gedächtnis, Memory = durable Fakten, gezieltes Laden statt Paste-in-Chat | xpost/2026-08-15_julian-goldie-hermes-learn.md | | [Compound Knowledge — Wissens-Akkumulation statt Paste-in-Chat](concepts/agents/compound-knowledge.md) | Hermes `/learn`-Pattern: Dokument einmal lesen → Brain-File bauen (Index, Kapitel-Map, Glossar, Cheat Sheet) → gezielt nachschlagen statt raten. „Versteht es FOREVER" ist Hype (Index = Nachschlagen, kein Verstehen), aber Compound Knowledge ist real (10 Skills/Monat = anderer Agent). Architektur-Parallele zu OpenClaw: Skills = prozedurales Gedächtnis, Memory = durable Fakten, gezieltes Laden statt Paste-in-Chat | xpost/2026-08-15_julian-goldie-hermes-learn.md |
| [Hermes Bot Mode](concepts/agents/hermes-bot-mode.md) | Hermes Agent "Bot Mode" — 5 übersehene Features für Multi-Agent-Setups (IBuzovskyi, 20.08.2026): Skill Hub (88k+ Skills) in Advanced Create, Duplicate, Manage Groups, Per-Skill/Toolset Toggle, Bot-to-Bot Messaging via Agent Inbox (SOUL.md-Protokoll, Inbox-Check am Run-Start). Empfohlener Setup-Flow: Advanced → Duplicate → Group → Agent-Inbox → auto-koordinieren. Ermöglicht Multi-Agent-Workflows ohne manuelles Copy-Paste. | xpost/2026-08-20_ibuzovskyi-hermes-bot-mode-5-features.md |
| [Hermes Bot vs Grok Bot](concepts/agents/hermes-vs-grok-bot.md) | Alex Finn-Vergleich der beiden agentischen Systeme (Hermes/Nous vs Grok/xAI). Kern-Dichotomie: Souveränität (Hermes, selbst-gehostet, MIT, $5-10/mo) vs. Bequemlichkeit (Grok, Cloud-Computer, $200/mo, Plug-and-Play). Closed-Source-Lock-in vs. Open Source. Was nachbaubar ist (persistente Agenten, Login-Handoff, Bot-Teams, Workflow-Lernen). ⚠️ Kein Transcript verfügbar — Einordnung anhand dokumentierter Fakten | youtube/2026-08-18_hermes-bot-vs-grok-bot.md | | [Hermes Bot vs Grok Bot](concepts/agents/hermes-vs-grok-bot.md) | Alex Finn-Vergleich der beiden agentischen Systeme (Hermes/Nous vs Grok/xAI). Kern-Dichotomie: Souveränität (Hermes, selbst-gehostet, MIT, $5-10/mo) vs. Bequemlichkeit (Grok, Cloud-Computer, $200/mo, Plug-and-Play). Closed-Source-Lock-in vs. Open Source. Was nachbaubar ist (persistente Agenten, Login-Handoff, Bot-Teams, Workflow-Lernen). ⚠️ Kein Transcript verfügbar — Einordnung anhand dokumentierter Fakten | youtube/2026-08-18_hermes-bot-vs-grok-bot.md |
### Policy ### Policy

View file

@ -2155,3 +2155,23 @@ Bestehende `post-transformer-llm-architectures.md` bleibt als Vier-Säulen-Über
- wiki (UPDATED): `wiki/concepts/agents/harness-loop-graph-engineering.md` — Video-Quelle als deutschsprachige, unabhängige Bestätigung der Drei-Ebenen-Trennung (Harness=environment, Loop=feedback, Graph=flow) ergänzt, mit Metadata-Caveat. - wiki (UPDATED): `wiki/concepts/agents/harness-loop-graph-engineering.md` — Video-Quelle als deutschsprachige, unabhängige Bestätigung der Drei-Ebenen-Trennung (Harness=environment, Loop=feedback, Graph=flow) ergänzt, mit Metadata-Caveat.
- index.md: 116. Update, Harness/Loop/Graph-Eintrag um Video-Quelle erweitert, Raw-Katalog (+1). - index.md: 116. Update, Harness/Loop/Graph-Eintrag um Video-Quelle erweitert, Raw-Katalog (+1).
- log: this entry - log: this entry
## 2026-08-20 — IBuzovskyi: Hermes Agent "Bot Mode" — 5 übersehene Features (X-Post)
**Type:** ingest | **Scope:** raw/xpost (1 new), wiki/concepts/agents (1 new), wiki/index, wiki/log
**Source:** X-Post von @IBuzovskyi (YanXbt) — https://x.com/IBuzovskyi/status/2090154478133444907, geteilt von Kai (@PWeber) im OME-Topic "Hermès" Agents (Topic 3770) am 20.08.2026.
- raw (NEW): `raw/xpost/2026-08-20_ibuzovskyi-hermes-bot-mode-5-features.md` — neutrale Zusammenfassung: 5 Bot-Mode-Features (Skill Hub in Advanced Create, Duplicate, Manage Groups, Per-Skill/Toolset Toggle, Bot-to-Bot Messaging via Agent Inbox) + empfohlener Setup-Flow.
- wiki (NEW): `wiki/concepts/agents/hermes-bot-mode.md` — neue Konzeptseite: 5-Features-Tabelle, Bot-to-Bot-Messaging-Mechanik (Agent Inbox, SOUL.md-Protokoll, Inbox-Check am Run-Start), Setup-Flow, Einordnung (dezentrales Message-Passing vs. zentralisierte Orchestrierung; verwandt mit HermesWatcher-Persistent-Goals und OpenClaw-Subagenten).
- index.md: 113. Update, neue Concepts/Agents-Seite (Hermes Bot Mode), Raw-Katalog (+1).
- log: this entry
## 2026-08-20 — Unsloth Dynamic 3.0 Quantisierung für Qwen3.8-27B (TeksEdge)
**Type:** ingest | **Scope:** raw/xpost (1 new), wiki/concepts/llm (1 updated), wiki/index, wiki/log
**Source:** Gepostet von Kai (@PWeber) in OME-Gruppe, Topic "Tips & Tricks" (Topic 27), 2026-08-20 15:32 UTC. URL: https://x.com/TeksEdge/status/2090228570253861075
- raw (NEW): `raw/xpost/2026-08-20_teksedge-unsloth-dynamic-3.0-qwen38.md` — neutrale Rohdaten. Inhalt via x_search verifiziert.
- wiki (UPDATED): `wiki/concepts/llm/qwen3.8-27b-alibaba.md` — Abschnitt "Unsloth Dynamic 3.0 Quantisierung (Update 2026-08-20)": neue UD-…-GGUFs (UD-IQ1_S 6,2 GB bis Q6_K 22 GB), Quality-at-Size-Verbesserung, Abgrenzung ≠ MTP/Speculative-Decoding; Frontmatter-sources ergänzt.
- wiki/index.md: Qwen3.8-27B-Eintrag um Dynamic-3.0-Update erweitert, Raw-Katalog (+1).
- log: this entry