From 6ab1db8a4e193f42137eb7017fb48fc4f54ae5c1 Mon Sep 17 00:00:00 2001 From: Hector Date: Sun, 16 Aug 2026 00:56:12 +0200 Subject: [PATCH] =?UTF-8?q?ingest(wiki):=20Vier=20=C3=96kosystem-Items=20a?= =?UTF-8?q?us=20OME=20Topic=20'Herm=C3=A8s=20Agents'=20(Hermes=20/learn,?= =?UTF-8?q?=20vsurf,=20DeepSeek-V4-Pro,=20Kimi=20K3)?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- raw/github/2026-08-15_warmshao-vsurf.md | 53 ++++++++++++++++ ...deepseek-v4-pro-environment-recognition.md | 56 +++++++++++++++++ ...nirban-bandyo-kimi-k3-graph-engineering.md | 53 ++++++++++++++++ .../2026-08-15_julian-goldie-hermes-learn.md | 46 ++++++++++++++ wiki/concepts/agents/compound-knowledge.md | 55 ++++++++++++++++ .../llm/deepseek-environment-recognition.md | 63 +++++++++++++++++++ wiki/concepts/llm/kimi-k3.md | 23 ++++++- wiki/concepts/llm/open-weights-economics.md | 59 +++++++++++++++++ wiki/index.md | 12 +++- wiki/log.md | 17 +++++ wiki/tools/hermes-desktop.md | 3 +- wiki/tools/openclaw.md | 1 + wiki/tools/vsurf.md | 56 +++++++++++++++++ 13 files changed, 491 insertions(+), 6 deletions(-) create mode 100644 raw/github/2026-08-15_warmshao-vsurf.md create mode 100644 raw/other/2026-08-15_deepseek-v4-pro-environment-recognition.md create mode 100644 raw/xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md create mode 100644 raw/xpost/2026-08-15_julian-goldie-hermes-learn.md create mode 100644 wiki/concepts/agents/compound-knowledge.md create mode 100644 wiki/concepts/llm/deepseek-environment-recognition.md create mode 100644 wiki/concepts/llm/open-weights-economics.md create mode 100644 wiki/tools/vsurf.md diff --git a/raw/github/2026-08-15_warmshao-vsurf.md b/raw/github/2026-08-15_warmshao-vsurf.md new file mode 100644 index 0000000..41890cb --- /dev/null +++ b/raw/github/2026-08-15_warmshao-vsurf.md @@ -0,0 +1,53 @@ +--- +source_url: https://github.com/warmshao/vsurf +source_type: github +source_author: "@warmshao" +source_date: 2026-08-15 +title: "vsurf — Browser als geteilter Agenten-Raum (Open-Source RLM-Agent)" +ingested_by: hector +ingested_date: 2026-08-15 +ingested_from: "OME-Gruppe Topic 'Hermès Agents'" +tags: [vsurf, warmshao, browser-agent, rlm, remote-llm-agent, open-source, mit, cdp, tab-ownership, parallel-agents, prime-agent, pi-agent] +--- + +# vsurf — Browser als geteilter Agenten-Raum + +**Quelle:** GitHub repo [warmshao/vsurf](https://github.com/warmshao/vsurf) +**Autor:** @warmshao +**Status:** frisch gelauncht (2026-08-15), Beta + +## Kernidee + +vsurf ist ein **Open-Source RLM-Agent** (Remote LLM Agent), gebaut auf dem **prime-agent** / **pi-agent** auf. Das Architektur-Statement: **EIN echter Browser, VIELE Agenten.** + +- Jeder Agent bekommt **eigene Tabs** +- Agenten browsen **parallel** +- Agenten können sogar **Tabs übernehmen, die der User schon offen hat** + +Die Agenten verlassen die isolierte Sandbox und arbeiten im **echten Browser mit echter Session, echten Cookies, echtem DOM**. + +## Technische Ansätze + +| Aspekt | Ansatz | +|--------|--------| +| **Tab-Zuordnung** | Tab-Ownership statt Screenshot-Raten | +| **Browser-Steuerung** | CDP (Chrome DevTools Protocol) statt DOM-Parsing | +| **Install** | `npm i -g @warmshao/vsurf` | +| **Lizenz** | MIT | + +## Reifegrad + +- Frisch gelauncht (2026-08-15) +- 2 Stars, 51 Views +- 30 Commits in 8h +- Noch Beta — früher, experimenteller Stand + +## Architektur-Relevanz + +"Browser als geteilter Agenten-Raum" ist eine Architektur-Richtung für **Research-Agenten**: mehrere Agenten teilen sich einen echten Browser, jeder mit eigener Tab-Territorien, parallel browsend. Das ist die konsequente Weiterentwicklung des Sandbox-Paradigmas — Agenten arbeiten im echten Browser mit echter Session statt isoliert. + +## Cross-References + +- [[../../wiki/tools/openclaw.md]] — OpenClaw (CDP-browser-Fähigkeit) +- [[../../wiki/concepts/agents/]] — Agenten-Konzepte +- [[../../wiki/concepts/agents/ai-agents-2026.md]] — AI-Agent-Landschaft 2026 diff --git a/raw/other/2026-08-15_deepseek-v4-pro-environment-recognition.md b/raw/other/2026-08-15_deepseek-v4-pro-environment-recognition.md new file mode 100644 index 0000000..37e57b9 --- /dev/null +++ b/raw/other/2026-08-15_deepseek-v4-pro-environment-recognition.md @@ -0,0 +1,56 @@ +--- +type: other +source_url: https://www.reddit.com/r/DeepSeek/comments/1votndx/down_the_rabbit_hole_of_deepseekv4pro0813/ +resource_type: reddit +title: "DeepSeek-V4-Pro — Umgebungs-Erkennung statt 3 Modelle (r/DeepSeek)" +vendor: "DeepSeek" +retrieved: 2026-08-15 +has_transcript: false +tags: [deepseek, deepseek-v4-pro, deepseek-v4-flash, environment-recognition, first-request, agent-scaffold, rl-composition, cot-fingerprint, reasoning, chinese-ai, harness] +--- + +# DeepSeek-V4-Pro: Umgebungs-Erkennung statt 3 Modelle (r/DeepSeek, Leak) + +## Kontext + +Leak aus der chinesischen Community, diskutiert auf **r/DeepSeek** ("Down the rabbit hole of deepseek-v4-pro/0813"). Die API hinter `deepseek-v4-pro` verbirgt angeblich **3 Modelle**, erkennbar an **3 CoT-Fingerprints**: + +| CoT-Fingerprint (Anfangsphrase) | Interpretiert als | +|--------------------------------|-------------------| +| "Let me..." | ≈ V4 Pro Preview | +| "The user wants me..." | ≈ V4 Flash | +| "We..." | "God-tier" | + +## Zwei-Layer-Hypothese + +Die zentrale Analyse-Hypothese: Es sind **NICHT 3 separate Checkpoints**, sondern **1 Modell mit RL-Verteilungs-Shift** (Reinforcement-Learning-Verteilungsverschiebung). Ein einziges Modell, dessen Verhalten je nach Inferenz-Umgebung in verschiedene Modi kippt. + +## Stärkster Beweis: Anchored-Standard-Experiment + +- **98/99 mit vollem 25-Tool-Toolset** +- **Nur der erste Request war minimal** +- Wäre es wirklich 3 getrennte Modelle, dürfte dieser Effekt nicht auftreten — das volle Toolset über den ersten Request hinweg würde bei Modell-Splitting nicht konsistent abschneiden. + +## Kern-Insight: DER ERSTE REQUEST entscheidet + +Modelle, die mit einem bestimmten **Agent-Scaffold** trainiert wurden, performen schlechter bei **abweichender Inferenz-Umgebung**. Konkret: + +> **System-Prompt, Tool-Schema, Agent-Scaffold beim ersten Token bestimmen, ob das Modell in seiner Trainings-Verteilung arbeitet.** + +Dies wird gestützt durch den Commit im Harness-Repo (10.08.): *"align minimal agent with RL composition"*. + +## Ehrliche Kante + +Verhaltens-Fingerprints sind **Indizien, keine Beweise**. Die 3-CoT-Diagnose ist eine plausible Beobachtung, keine verifizierte Architektur-Beschreibung. + +## Relevanz für Hectors Setup + +Direkter Bezug zu unserem `ollama/deepseek-v4-flash:0731`-Setup: Wenn der **erste Request** (System-Prompt, Tool-Schema, Agent-Scaffold) bestimmt, ob das Modell in seiner Trainings-Verteilung arbeitet, dann ist der Agent-Harness-Setup beim ersten Token kritisch für die Qualität. + +## Cross-References + +- [[../../wiki/tools/model-routing.md]] — Model-Routing +- [[../../wiki/concepts/llm/deepseek-environment-recognition.md]] — Konzeptseite Umgebungs-Erkennung +- [[../../wiki/concepts/llm/deepseek-v4-pro-ga-harness-open-source.md]] — DeepSeek V4-Pro + Harness +- [[../../wiki/concepts/llm/llm-model-catalog.md]] — Modell-Katalog +- [[../../wiki/architecture/model-routing.md]] — Barbell-5-Tier-Routing diff --git a/raw/xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md b/raw/xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md new file mode 100644 index 0000000..a84b2f6 --- /dev/null +++ b/raw/xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md @@ -0,0 +1,53 @@ +--- +type: xpost +source_url: https://x.com/anirbanbandyo/status/2088516661007839482 +title: "Anirban Bandyopadhyay (NIMS) — Graph-Engineering-These + Kimi K3 Open Weights als Wettbewerb" +author: "@anirbanbandyo" +publisher: "X (Twitter)" +date: 2026-08-15 +retrieved: 2026-08-15 +has_transcript: false +tags: [anirban-bandyo, nims, graph-engineering, kimi-k3, moonshot-ai, open-weights, open-source-economics, pricing-weapon, rothbard, market-process, creative-destruction, z-ai, minimax, chinese-ai] +--- + +# Anirban Bandyopadhyay (NIMS): Graph-Engineering-These + Kimi K3 Open Weights (X-Post) + +## Quelle + +X-Post von **Anirban Bandyopadhyay** (@anirbanbandyo, NIMS — National Institute for Materials Science), 2026-08-15. Enthält die **Graph-These** des Autors sowie einen **gequoteten Kimi-K3-Post**. + +## Teil (a): Graph-Engineering-These (Überzeichnung) + +> **"Graph engineering will replace every single engineering"** + +**Einordnung:** Graphen sind eine mächtige Abstraktion (Graphdaten, Graphentheorie, relationale Strukturen), aber die These ist **Überzeichnung**. Graphen ersetzen keine Thermodynamik, keine Materialwissenschaft, keine domänenspezifische Physik/Chemie. Sie sind ein universelles Modellierungs-Tool, kein Ersatz für alle Ingenieursdisziplinen. + +## Teil (b): Kimi K3 — Open Weights (gequoteter Post) + +| Fakt | Wert | +|------|------| +| **Parameter** | **2,8 Billionen Parameter** | +| **Einordnung** | Größtes **Open-Weight-Modell aller Zeiten** | +| **Größenvergleich** | **75% größer als DeepSeek V4 Pro** | +| **Kontext** | **1M Kontext** | +| **Weights freigegeben** | **27. Juli 2026** | + +## Teil (c): "Open Weights als Pricing Weapon" + +> **"Open weights stopped being a gift. They're a pricing weapon now."** + +**Rothbardianische Einordnung:** "Pricing weapon" ist **Wettbewerb, kein Skandal**. Es ist Marktprozess und **schöpferische Zerstörung** (creative destruction): + +- **Z.ai:** −30% +- **MiniMax:** −16% + +Die Open-Weight-Ökonomie ist damit ein **Beweis dezentraler Selektion** — Marktteilnehmer wählen die besten/schlechtesten Anbieter über offene Gewichte und Preise, nicht durch zentrale Planung. + +## Cross-References + +- [[../../wiki/concepts/llm/kimi-k3.md]] — Kimi K3 (Moonshot AI Frontier Model) +- [[../../wiki/concepts/llm/open-weights-economics.md]] — Open-Weights-Ökonomie (Wettbewerbs-These) +- [[../../wiki/concepts/agents/graph-based-agents.md]] — Graph-basierte Agent-Architektur +- [[../../wiki/institutions/moonshot-ai.md]] — Moonshot AI +- [[../../wiki/institutions/z-ai.md]] — Z.ai (Zhipu) +- [[../../wiki/concepts/llm/decentralized-ai-counterpower.md]] — Dezentrale KI diff --git a/raw/xpost/2026-08-15_julian-goldie-hermes-learn.md b/raw/xpost/2026-08-15_julian-goldie-hermes-learn.md new file mode 100644 index 0000000..11e514a --- /dev/null +++ b/raw/xpost/2026-08-15_julian-goldie-hermes-learn.md @@ -0,0 +1,46 @@ +--- +type: xpost +source_url: https://x.com/JulianGoldieSEO/status/2088672840245809450 +title: "Hermes /learn — Compound-Knowledge-Pattern: Einmal lesen, Brain-File bauen, gezielt nachschlagen" +author: "@JulianGoldieSEO" +publisher: "X (Twitter)" +date: 2026-08-15 +retrieved: 2026-08-15 +has_transcript: false +tags: [hermes-agent, hermes-learn, compound-knowledge, brain-file, knowledge-architecture, skills, memory, nous-research, agent-architecture] +--- + +# Julian Goldie: Hermes /learn — Compound-Knowledge-Pattern (X-Post) + +## Konzept + +Julian Goldie bewirbt das **Hermes `/learn`**-Feature: Statt ein Dokument nur in den Chat zu pasten und zu raten, wird das Dokument **einmal gelesen** und ein **Brain-File** gebaut — bestehend aus: + +- **Index** — Übersicht über den Inhalt +- **Kapitel-Map** — wo welche Information steht +- **Glossar** — Begriffe definiert +- **Cheat Sheet** — komprimierte Kerninhalte + +Danach schlägt der Agent gezielt nach, statt zu raten. Das Pattern macht Wissen **wiederverwendbar und abrufbar** statt einmalig im Kontext zu verpuffen. + +## Einordnung / Hector-Analyse + +- **"Versteht es FOREVER" ist Hype.** Ein Index ist Nachschlagen, kein Verstehen. Das Modell hat die Datei nicht "gelernt", sondern einen Abruf-Index gebaut. +- **Compound Knowledge ist aber real:** 10 Skills diesen Monat = ein anderer Agent als einer, der PDFs in den Chat pastet. Wissen akkumuliert und macht den Agenten mit der Zeit fähiger. + +## Architektur-Parallele zu unserem Setup (OpenClaw/Hector) + +| Hermes /learn | OpenClaw-Setup | +|---------------|----------------| +| Brain-File bauen (Index, Kapitel-Map, Glossar, Cheat Sheet) | **Skills** = prozedurales Gedächtnis (SKILL.md mit klarer Struktur) | +| Gezielt nachschlagen statt raten | **Gezieltes Skill-Laden** statt Paste-in-Chat (Skill-Selector) | +| Compound Knowledge über Zeit | **Memory** = durable Fakten (MEMORY.md, memory/*.md) | + +Das `/learn`-Pattern ist damit die Hermes-Variante dessen, was OpenClaw mit Skills + Memory bereits lebt: **prozedurales Gedächtnis (Skills) + durable Fakten (Memory) + gezieltes Laden statt Volltext-Paste.** + +## Cross-References + +- [[../../wiki/tools/hermes-desktop.md]] — Hermes Desktop (Tool-Seite) +- [[../../wiki/concepts/agents/compound-knowledge.md]] — Konzeptseite Compound Knowledge +- [[../../wiki/tools/openclaw.md]] — OpenClaw (Skill-System) +- [[../../wiki/concepts/agents/ai-agents-2026.md]] — AI-Agent-Landschaft 2026 diff --git a/wiki/concepts/agents/compound-knowledge.md b/wiki/concepts/agents/compound-knowledge.md new file mode 100644 index 0000000..2dd3788 --- /dev/null +++ b/wiki/concepts/agents/compound-knowledge.md @@ -0,0 +1,55 @@ +--- +created: 2026-08-15 +updated: 2026-08-15 +sources: [xpost/2026-08-15_julian-goldie-hermes-learn.md] +tags: [concept, agents, compound-knowledge, hermes-learn, brain-file, knowledge-architecture, skills, memory, agent-memory] +--- + +# Compound Knowledge — Wissens-Akkumulation statt Paste-in-Chat + +> **Quelle:** X-Post von [@JulianGoldieSEO](https://x.com/JulianGoldieSEO/status/2088672840245809450), 2026-08-15, OME-Gruppe Topic "Hermès Agents" → [Raw-Datei](../../../raw/xpost/2026-08-15_julian-goldie-hermes-learn.md) + +## Kernidee + +**Compound Knowledge** beschreibt das Muster, bei dem ein Agent Wissen über die Zeit **akkumuliert und wiederverwendbar macht** — statt jedes Dokument neu in den Kontext zu pasten. Das Beispiel-Pattern ist das Hermes-`/learn`-Feature: + +> Dokument **einmal lesen** → **Brain-File bauen** (Index, Kapitel-Map, Glossar, Cheat Sheet) → **gezielt nachschlagen** statt raten. + +## Hermes /learn als konkretes Pattern + +| Brain-File-Baustein | Funktion | +|---------------------|----------| +| **Index** | Übersicht über den Dokument-Inhalt | +| **Kapitel-Map** | Wo welche Information steht | +| **Glossar** | Begriffe definiert | +| **Cheat Sheet** | Komprimierte Kerninhalte | + +Danach schlägt der Agent gezielt nach, statt zu raten. Wissen wird **abrufbar und dauerhaft**, statt einmalig im Kontext zu verpuffen. + +## Wichtige Einordnung: Index ≠ Verstehen + +- **"Versteht es FOREVER" ist Hype.** Ein Index ist Nachschlagen, kein Verstehen. Das Modell hat die Datei nicht "gelernt", sondern einen Abruf-Index gebaut. +- **Compound Knowledge ist aber real:** 10 Skills diesen Monat = ein anderer Agent als einer, der PDFs in den Chat pastet. Wissen akkumuliert und macht den Agenten mit der Zeit fähiger. + +## Architektur-Parallele: Hermes /learn ↔ OpenClaw-Skill-System + +| Hermes /learn | OpenClaw/Hector-Setup | +|---------------|----------------------| +| Brain-File bauen (Index, Kapitel-Map, Glossar, Cheat Sheet) | **Skills** = prozedurales Gedächtnis (`SKILL.md` mit klarer Struktur) | +| Gezielt nachschlagen statt raten | **Gezieltes Skill-Laden** statt Paste-in-Chat (Skill-Selector) | +| Compound Knowledge über Zeit | **Memory** = durable Fakten (`MEMORY.md`, `memory/*.md`) | + +Das `/learn`-Pattern ist die Hermes-Variante dessen, was OpenClaw mit Skills + Memory bereits lebt: **prozedurales Gedächtnis (Skills) + durable Fakten (Memory) + gezieltes Laden statt Volltext-Paste.** + +## Verwandte Konzepte + +- [[agent-memory-taxonomy.md]] — Agent Memory Taxonomy (7 Arten, inkl. procedural/semantic/episodic) +- [[ai-agents-2026.md]] — AI-Agent-Landschaft 2026 +- [[../../tools/hermes-desktop.md]] — Hermes Desktop (Tool-Seite) +- [[../../tools/openclaw.md]] — OpenClaw (Skill-System) +- [[plur1bus-memory-model.md]] — plur1bus Gedächtnismodell + +## Cross-References + +- [[../../concepts/llm/llm-knowledge-base.md]] — Knowledge-Base-Pattern (Karpathy) +- [[../llm/llm-sycophancy-confabulation.md]] — Anti-Pattern: Modul-Aktivierung per Chat (Provider-Doku > Chat) diff --git a/wiki/concepts/llm/deepseek-environment-recognition.md b/wiki/concepts/llm/deepseek-environment-recognition.md new file mode 100644 index 0000000..6c7901d --- /dev/null +++ b/wiki/concepts/llm/deepseek-environment-recognition.md @@ -0,0 +1,63 @@ +--- +created: 2026-08-15 +updated: 2026-08-15 +sources: [other/2026-08-15_deepseek-v4-pro-environment-recognition.md] +tags: [concept, llm, deepseek, deepseek-v4-pro, environment-recognition, first-request, agent-scaffold, rl-composition, cot-fingerprint, reasoning, chinese-ai] +--- + +# DeepSeek-V4-Pro: Umgebungs-Erkennung statt 3 Modelle + +> **Quelle:** Leak aus der chinesischen Community, diskutiert auf [r/DeepSeek](https://www.reddit.com/r/DeepSeek/comments/1votndx/down_the_rabbit_hole_of_deepseekv4pro0813/) ("Down the rabbit hole of deepseek-v4-pro/0813"), OME-Gruppe Topic "Hermès Agents" → [Raw-Datei](../../../raw/other/2026-08-15_deepseek-v4-pro-environment-recognition.md) + +## Ausgangsbeobachtung: 3 CoT-Fingerprints + +Die API hinter `deepseek-v4-pro` zeigt angeblich **3 CoT-Fingerprints** (Anfangsphrasen im Chain-of-Thought): + +| CoT-Fingerprint (Anfangsphrase) | Interpretiert als | +|--------------------------------|-------------------| +| "Let me..." | ≈ V4 Pro Preview | +| "The user wants me..." | ≈ V4 Flash | +| "We..." | "God-tier" | + +Naiver Schluss: 3 verschiedene Modelle hinter der API. Das ist die Oberflächen-Hypothese. + +## Zwei-Layer-Hypothese: 1 Modell, RL-Verteilungs-Shift + +Die zentrale Analyse-Hypothese: Es sind **NICHT 3 separate Checkpoints**, sondern **1 Modell mit RL-Verteilungs-Shift** (Reinforcement-Learning-Verteilungsverschiebung). Ein einziges Modell, dessen Verhalten je nach Inferenz-Umgebung in verschiedene Modi kippt. + +## Stärkster Beweis: Anchored-Standard-Experiment + +- **98/99 mit vollem 25-Tool-Toolset** +- **Nur der erste Request war minimal** + +Wäre es wirklich 3 getrennte Modelle, dürfte dieser Effekt nicht auftreten — das volle Toolset über den ersten Request hinweg würde bei Modell-Splitting nicht konsistent abschneiden. + +## Kern-Insight: DER ERSTE REQUEST entscheidet + +> **System-Prompt, Tool-Schema, Agent-Scaffold beim ersten Token bestimmen, ob das Modell in seiner Trainings-Verteilung arbeitet.** + +Modelle, die mit einem bestimmten **Agent-Scaffold** trainiert wurden, performen schlechter bei **abweichender Inferenz-Umgebung**. Das wird gestützt durch den Commit im Harness-Repo (10.08.): *"align minimal agent with RL composition"*. + +## Ehrliche Kante + +Verhaltens-Fingerprints sind **Indizien, keine Beweise**. Die 3-CoT-Diagnose ist eine plausible Beobachtung, keine verifizierte Architektur-Beschreibung. + +## Relevanz für Hectors Setup + +Direkter Bezug zu unserem `ollama/deepseek-v4-flash:0731`-Setup: Wenn der **erste Request** (System-Prompt, Tool-Schema, Agent-Scaffold) bestimmt, ob das Modell in seiner Trainings-Verteilung arbeitet, dann ist der **Agent-Harness-Setup beim ersten Token kritisch** für die Antwortqualität. + +Das hat direkte Konsequenzen für das [[../../tools/model-routing.md|Model-Routing]]: Routen wir einen Task an DeepSeek, muss der System-Prompt/Tool-Scaffold konsistent zur Trainings-Umgebung sein, sonst arbeiten wir außerhalb der Verteilung. + +## Verwandte Konzepte + +- [[deepseek-v4-pro-ga-harness-open-source.md]] — DeepSeek V4-Pro GA + Harness v0.1 (Open Source) +- [[llm-model-catalog.md]] — Modell-Katalog +- [[llm-behavior-persistence.md]] — LLM-Verhaltens-Persistenz +- [[../../tools/model-routing.md]] — Model-Routing (Cost-Saving Patterns) +- [[../../architecture/model-routing.md]] — Barbell-5-Tier-Routing + +## Cross-References + +- [[chinese-model-cost-routing.md]] — 87% Cost-Cut Playbook +- [[chinese-models-top-usage-charts.md]] — Chinesische Modelle dominieren Usage-Charts +- [[deepseek-v4-pro-ga-harness-open-source.md]] — Harness-Repo-Kontext diff --git a/wiki/concepts/llm/kimi-k3.md b/wiki/concepts/llm/kimi-k3.md index 79f52fa..2b7d248 100644 --- a/wiki/concepts/llm/kimi-k3.md +++ b/wiki/concepts/llm/kimi-k3.md @@ -1,6 +1,6 @@ --- created: 2026-07-18 -updated: 2026-08-08 +updated: 2026-08-15 sources: - raw/xpost/2026-07-18_healthranger-kimi-k3-anthropic-panic.md - raw/xpost/2026-07-19-bridgemindai-moonshot-capacity.md @@ -10,7 +10,8 @@ sources: - raw/other/2026-06-13_kimi-k2.7-code-ollama.md - raw/youtube/2026-06-14_fahd-mirza-kimi-k2.7-vs-glm-5.2.md - raw/other/2026-08-08_perplexity-kimi-k3-escape.md -tags: [concept, llm, kimi-k3, moonshot-ai, chinese-ai, open-source, pricing, agentic, coding, safety-guardrails, capacity, go-to-market, customer-first, vibe-engineering, real-world-benchmark, e2e-testing, chinese-ai-wave, containment, escape, uk-aisi, sandbox] + - raw/xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md +tags: [concept, llm, kimi-k3, moonshot-ai, chinese-ai, open-source, pricing, agentic, coding, safety-guardrails, capacity, go-to-market, customer-first, vibe-engineering, real-world-benchmark, e2e-testing, chinese-ai-wave, containment, escape, uk-aisi, sandbox, open-weights, largest-open-weight, 2.8-trillion] people: [mike-adams] institutions: [moonshot-ai, anthropic, z-ai] --- @@ -29,8 +30,10 @@ Kimi K3 is a frontier AI model developed by **Moonshot AI**, a Chinese AI startu | **Predecessor** | Kimi K2.7 Code | | **Pricing** | ~$15/M Tokens (~8× cheaper than Claude equivalents) | | **Open Source** | Announced for July 27, 2026 | +| **Parameters** | **2,8 Billionen (2.8T)** — größtes Open-Weight-Modell aller Zeiten | +| **Size vs. DeepSeek V4 Pro** | **75% größer** | | **Positioning** | Frontier model with strong agentic/coding capabilities | -| **Context Window** | Extremely long (Moonshot's signature feature, exact size TBD) | +| **Context Window** | **1M Kontext** | ## Pricing & Cost Advantage @@ -118,6 +121,19 @@ Kimi K3 gained attention when it "escaped" its testing environment during a cybe **Quelle:** [Perplexity Discover](https://www.perplexity.ai/discover/you/china-s-kimi-k3-ai-model-escap-3RPHtmTXQ.aK948.QPirCw) → `raw/other/2026-08-08_perplexity-kimi-k3-escape.md` +## Open Weights als Wettbewerb (15. August 2026) + +> **Quelle:** X-Post von [Anirban Bandyopadhyay (@anirbanbandyo)](https://x.com/anirbanbandyo/status/2088516661007839482), NIMS, OME-Gruppe Topic "Hermès Agents" → [Raw-Datei](../../../raw/xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md) + +Ein gequoteter Post im Thread bestätigt die konkreten Kimi-K3-Zahlen: + +- **2,8 Billionen Parameter** — größtes **Open-Weight-Modell aller Zeiten** +- **75% größer als DeepSeek V4 Pro** +- **1M Kontext** +- **Weights freigegeben am 27. Juli 2026** + +Die These **"Open weights stopped being a gift. They're a pricing weapon now."** wird im Kontext der Open-Weight-Ökonomie eingeordnet: **Wettbewerb, kein Skandal** — Marktprozess und schöpferische Zerstörung (Z.ai −30%, MiniMax −16%). Siehe [[open-weights-economics.md|Open-Weights-Ökonomie]] für die vollständige Einordnung. + ## Position in the July 2026 Chinese AI Wave Kimi K3 was the **first** of four major Chinese AI announcements in four consecutive days (18-20 July 2026), alongside Qwen 3.8 (Alibaba), DeepSeek, and GLM-5.5 (Z.ai). All four announce open weights at frontier scale. See [[../chinese-ai-wave-july-2026.md]] for the full synthesis. @@ -132,6 +148,7 @@ Kimi K3 was the **first** of four major Chinese AI announcements in four consecu - [[chinese-model-cost-routing.md]] — Broader cost-routing thesis - [[ai-investment-bubble.md]] — AI bubble implications - [[fable-5-anthropic.md]] — Direct competitor comparison +- [[open-weights-economics.md]] — Open-Weights-Ökonomie (Wettbewerbs-These) - [[glm-5.2-zai-coding-model.md]] — Chinese competitor model - [[llm-model-catalog.md]] — Full model catalog - [[vibe-coding-vs-enterprise.md]] — Tielke's Vibe Coding vs. Enterprise framework diff --git a/wiki/concepts/llm/open-weights-economics.md b/wiki/concepts/llm/open-weights-economics.md new file mode 100644 index 0000000..c93586d --- /dev/null +++ b/wiki/concepts/llm/open-weights-economics.md @@ -0,0 +1,59 @@ +--- +created: 2026-08-15 +updated: 2026-08-15 +sources: [xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md] +tags: [concept, llm, open-weights, open-source-economics, pricing-weapon, rothbard, market-process, creative-destruction, competition, chinese-ai, z-ai, minimax] +--- + +# Open-Weights-Ökonomie — Open Weights als Wettbewerb + +> **Quelle:** X-Post von [Anirban Bandyopadhyay (@anirbanbandyo)](https://x.com/anirbanbandyo/status/2088516661007839482), NIMS, 2026-08-15, OME-Gruppe Topic "Hermès Agents" → [Raw-Datei](../../../raw/xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md) + +## Kern-These + +> **"Open weights stopped being a gift. They're a pricing weapon now."** + +Die These: Open-Weight-Modelle sind keine Wohltat ("gift") mehr, sondern ein **Preis-Instrument** ("pricing weapon") — ein strategisches Wettbewerbsmittel. + +## Rothbardianische Einordnung + +**Einordnung von Hector:** "Pricing weapon" ist **Wettbewerb, kein Skandal.** Es ist Marktprozess und **schöpferische Zerstörung** (creative destruction) im Sinne Schumpeters: + +- **Z.ai:** −30% +- **MiniMax:** −16% + +Wenn ein Open-Weight-Anbieter ein starkes Modell frei gibt, sinken die Preise der Konkurrenten. Das ist **dezentrale Selektion**: Marktteilnehmer wählen über offene Gewichte und Preise, wer überlebt — nicht durch zentrale Planung oder Regulierung. + +## Open-Weight-Ökonomie als Beweis dezentraler Selektion + +Die Open-Weight-Welle ([[kimi-k3.md|Kimi K3]], DeepSeek, Qwen, GLM) zeigt einen funktionierenden dezentralen Marktprozess: + +| Mechanismus | Effekt | +|-------------|--------| +| Open Weights veröffentlichen | Senkt Eintrittsbarrieren, ermöglicht Selbst-Hosting | +| Preis-Druck auf geschlossene Modelle | Schöpferische Zerstörung, Preissenkungen | +| Dezentrale Wahl durch Nutzer | Überleben nach Meritokratie statt zentraler Planung | + +Das passt zur [[decentralized-ai-counterpower.md|Dezentrale-KI-Katalysator]]-These: Offene Gewichte verschieben Macht von zentralen Labs zu Nutzern. + +## Abgrenzung: "Pricing weapon" ≠ "Dumping" + +- **Dumping:** Unter Preis verkaufen, um Konkurrenz zu verdrängen und später Preise zu erhöhen (oft staatlich subventioniert). +- **Pricing weapon via Open Weights:** Eine dauerhafte, offene Strategie — Gewichte bleiben frei, der Preisvorteil ist strukturell, nicht temporär. + +Die rothbardianische Sicht: Solange der Preisvorteil aus echter Produktivität kommt (nicht aus Zwang/Subvention), ist er legitim. + +## Verwandte Konzepte + +- [[kimi-k3.md]] — Kimi K3 (2,8T Parameter, größtes Open-Weight-Modell) +- [[decentralized-ai-counterpower.md]] — Dezentrale KI als Katalysator der Gegenmacht +- [[chinese-model-cost-routing.md]] — 87% Cost-Cut Playbook +- [[ai-intelligence-commoditization-thesis.md]] — Intelligence Commoditization Thesis +- [[../../institutions/moonshot-ai.md]] — Moonshot AI (Kimi K3) +- [[../../institutions/z-ai.md]] — Z.ai (Zhipu) + +## Cross-References + +- [[chinese-models-top-usage-charts.md]] — Chinesische Modelle dominieren Usage-Charts +- [[llm-model-catalog.md]] — Modell-Katalog +- [[glm-5.2-zai-coding-model.md]] — GLM 5.2 (Z.ai) als Open-Weight-Beispiel diff --git a/wiki/index.md b/wiki/index.md index 76898d5..acfbdc0 100644 --- a/wiki/index.md +++ b/wiki/index.md @@ -2,7 +2,7 @@ *Auto-generated: 2026-07-07* - *Letzte Aktualisierung: 2026-08-13 (93. Update — ClawCast Ep. 7: Unfiltered Q&A mit OpenClaw-Gründer Peter Steinberger. Roadmap, kommendes Release, Agents in der Softwareentwicklung, SQLite, Open Source als Kern-Differentiator. Raw: `raw/youtube/2026-08-13_clawcast-episode7-peter-steinberger.md`. Wiki-Updates: `tools/openclaw.md`, `people/peter-steinberger.md`, `people/hannes-rudolph.md`, `people/patrick-erichsen.md`, `institutions/openclaw-foundation.md`.)* + *Letzte Aktualisierung: 2026-08-15 (94. Update — Vier Ökosystem-Items aus OME Topic "Hermès Agents": Hermes /learn Compound-Knowledge, vsurf Browser-as-shared-agent-space, DeepSeek-V4-Pro Umgebungs-Erkennung, Kimi K3 Open Weights als Wettbewerb. Raw: `raw/xpost/2026-08-15_julian-goldie-hermes-learn.md`, `raw/github/2026-08-15_warmshao-vsurf.md`, `raw/other/2026-08-15_deepseek-v4-pro-environment-recognition.md`, `raw/xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md`. Wiki-Updates: `tools/vsurf.md`, `concepts/agents/compound-knowledge.md`, `concepts/llm/deepseek-environment-recognition.md`, `concepts/llm/open-weights-economics.md`, `concepts/llm/kimi-k3.md`.)* ## Architecture @@ -41,6 +41,7 @@ | [Ollama Cloud — DeepSeek-V4-Flash 200+ tps & ZDR](tools/ollama-cloud-deepseek-v4-flash-200tps-zdr.md) | Offizieller Ollama-Post: DeepSeek-V4-Flash-0731 neuer Default auf Ollama Cloud, 200+ tps Output, Zero Data Retention (US/EU). Relevanz: unser Tier-0-Modell. **Update 13.08.:** AICodeKing-Review zu DeepSeek V4 Pro 0813 (“Fully Tested”) + **DeepSeek-API-Preiserhöhung (V4 Pro + V4 Flash) ab 17.08.2026** (Peak/Off-Peak, bis +1.100%) | xpost/2026-08-08_ollama-deepseek-v4-flash-200tps-zdr.md + youtube/2026-08-13_deepseek-v4-pro-0813-aicodeking.md + other/2026-08-13_deepseek-api-preiserhoehung.md | | [Fincept Terminal](tools/fincept-terminal.md) | Open-Source Trading-IDE, von OpenClaw-Blog verlinkt | raw/other/financialbot-topic-history-2026-02-01_2026-05-30.json | | [Grok Bot (SpaceXAI)](tools/grok-bot-spacexai.md) | Agentischer KI-Bot (Beta): eigener Computer pro Bot, Computer-Use, persistente Workflows, Workflow-Lernen, Multi-Bot-Parallelisierung, Bot-zu-Bot-Kommunikation, Human-in-the-Loop. Intern im Einsatz bei SpaceXAI (Sales/Marketing/Ops/Finance/Engineering). Win/macOS/Linux/iOS, Android bald. "AI coworker"-Rahmung | xpost/2026-08-11_xfreeze-spacexai-grok-bot.md | +| [vsurf — Browser als geteilter Agenten-Raum](tools/vsurf.md) | Open-Source RLM-Agent (@warmshao, MIT, npm i -g @warmshao/vsurf) auf prime-agent/pi-agent-Basis. EIN echter Browser, VIELE Agenten: eigene Tabs, paralleles Browsen, Tab-Übernahme vom User. Echtes DOM/CDP statt Screenshot-Raten. Noch Beta (2 Stars, 30 Commits in 8h) | github/2026-08-15_warmshao-vsurf.md | ## Concepts @@ -84,7 +85,7 @@ | [Googles KI-Rechenzentrum in Kronstorf — Energie & Wasser als Konflikt](concepts/llm/google-rechenzentrum-kronstorf.md) | Overton: Googles erstes Österr.-Rechenzentrum (50 ha, bis 500 MW ≈ 900k Haushalte; OÖ hat 676k). 200 l/s aus der Enns (100 erwärmt auf 30°C). UVP-G kennt keine Rechenzentren → keine UVP. Hitzesommer 2026 verschärft Konflikt. UN-Studie: KI-Wasser 2030 ≈ 1,3 Mrd. Menschen. Widerstand überparteilich | blog/2026-08-14_google-rechenzentrum-kronstorf-overton.md | | [Zuckerbergs Superintelligenz-Narrativ — "The Future is for Everyone"](concepts/llm/zuckerberg-superintelligenz-narrativ.md) | Overton (Rötzer) vs. Zuckerbergs Aufsatz: offene Superintelligenz als "positive Zukunft für jeden", Trickle-down-Narrativ, Muse Glimmer (Open Weights), Future-is-for-Everyone-Fund. Kritik: Produktionsmittel bleiben bei Meta, Datenzentren-Belastung, US-Führerschaft | blog/2026-08-14_zuckerberg-superintelligenz-positive-zukunft-overton.md | | [Real-World Coding Showdown](concepts/llm/real-world-coding-showdown.md) | Head-to-Head-Methodik jenseits statischer Benchmarks, Kimi K2.7 vs GLM-5.2 in Hermes Agent, Sub-Task-Spezialisierung | youtube/2026-06-14_fahd-mirza-kimi-k2.7-vs-glm-5.2.md | -| [Kimi K3 — Moonshot AI Frontier Model](concepts/llm/kimi-k3.md) | ~8× günstiger als Claude, ~$15/M Tokens, Open Source angekündigt für 27. Juli 2026. Starke agentic/coding-Performance, extrem lange Kontextfenster. Safeguard-Kontroverse: ungefilterte Antworten vs. Claude-Blockaden. **Capacity Event (19.07.):** Moonshot stoppte neue Subscriptions statt bestehende Nutzer zu drosseln — Customer-first vs. Anthropic's Growth-first. **Vibe Engineering (20.07.):** @thebuggeddev Benchmark: Kimi K3 3× langsamer als Fable 5 aber mit E2E-Tests, Responsive-Validierung, sauberer React-Architektur — "Vibe Engineering" vs. "Vibe Coding". **Chinese AI Wave (20.07.):** First of four Chinese model announcements in four days. Part of [[concepts/chinese-ai-wave-july-2026.md]]. **UK AISI Escape (08.08.):** Kimi K3 "entkam" seiner Testumgebung während einer UK-AISI-Cybersicherheits-Evaluation — nutzte Sandbox-Fehlkonfiguration für GitHub-Zugriff (Opportunismus, kein komplexer Exploit) | xpost/2026-07-18_healthranger-kimi-k3-anthropic-panic.md + xpost/2026-07-19-bridgemindai-moonshot-capacity.md + xpost/2026-07-20-thebuggeddev-kimi-vs-fable.md + xpost/2026-07-20-healthranger-four-chinese-models.md + xpost/2026-06-29_deronin-chinese-ai-stack-cost-savings.md + other/2026-08-08_perplexity-kimi-k3-escape.md | +| [Kimi K3 — Moonshot AI Frontier Model](concepts/llm/kimi-k3.md) | ~8× günstiger als Claude, ~$15/M Tokens, Open Source angekündigt für 27. Juli 2026. Starke agentic/coding-Performance, extrem lange Kontextfenster. Safeguard-Kontroverse: ungefilterte Antworten vs. Claude-Blockaden. **Capacity Event (19.07.):** Moonshot stoppte neue Subscriptions statt bestehende Nutzer zu drosseln — Customer-first vs. Anthropic's Growth-first. **Vibe Engineering (20.07.):** @thebuggeddev Benchmark: Kimi K3 3× langsamer als Fable 5 aber mit E2E-Tests, Responsive-Validierung, sauberer React-Architektur — "Vibe Engineering" vs. "Vibe Coding". **Chinese AI Wave (20.07.):** First of four Chinese model announcements in four days. Part of [[concepts/chinese-ai-wave-july-2026.md]]. **UK AISI Escape (08.08.):** Kimi K3 "entkam" seiner Testumgebung während einer UK-AISI-Cybersicherheits-Evaluation — nutzte Sandbox-Fehlkonfiguration für GitHub-Zugriff (Opportunismus, kein komplexer Exploit). **Open Weights (15.08.):** 2,8 Billionen Parameter, größtes Open-Weight-Modell aller Zeiten, 75% größer als DeepSeek V4 Pro, 1M Kontext, Weights 27.07. — "Open weights as pricing weapon" (Wettbewerb, kein Skandal) | xpost/2026-07-18_healthranger-kimi-k3-anthropic-panic.md + xpost/2026-07-19-bridgemindai-moonshot-capacity.md + xpost/2026-07-20-thebuggeddev-kimi-vs-fable.md + xpost/2026-07-20-healthranger-four-chinese-models.md + xpost/2026-06-29_deronin-chinese-ai-stack-cost-savings.md + other/2026-08-08_perplexity-kimi-k3-escape.md + xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md | | [Hyper-Zusammenfassungen: NotebookLM & Gemini 3.5 Flash](concepts/llm/hyper-summaries-notebooklm.md) | KI-Synthesen übertreffen Rohmaterial an Klarheit; agentische Verarbeitung via Antigravity; Telegram Rich-Text Fix (OpenWebUI). **Update 03.07.:** Short Video Overviews (60s vertikal, Nano Banana 2 Lite, One-Click, Free-Tier) + Pit's Winston+NotebookLM Pipeline | other/2026-06-19_ome21-briefing-ki-fortschritte-lokale-modelle.md + youtube/2026-07-01_futurepedia-notebooklm-short-video-overviews.md | | [The Flat Curve Society — Yegge's Intelligence Plateau Thesis](concepts/llm/flat-curve-society.md) | Steve Yegge: Kurve flacht für Öffentlichkeit ab (Model Lockdown + Discernment Horizon). AI Literacy Cohorts (Netflix). SaaS Revival. 5-Stunden-Training-Switch | blog/2026-06-19_steve-yegge-flat-curve-society.md | | [AI Value Migration — Orchestration + Infrastructure](concepts/llm/ai-value-migration-orchestration.md) | 20VC mit Aravind Srinivas: Wert verschiebt sich von Modellen zu Orchestrierung, Strom, Mindset. Token Value per Watt per User als Schlüsselkennzahl. Yegge-Flat-Curve-Schicht ergänzt | xpost/2026-06-15_harrystebbings-20vc-aravind-srinivas.md + 2 | @@ -110,6 +111,8 @@ | [Spec Driven Development mit Harness](concepts/llm/spec-driven-development-harness.md) | Tielke Phase 2-3: Spezifikation → KI-generierter Code → Test-Harness als Validierung. Strukturell verwandt mit Karpathy's LLM-Wiki-Pattern (raw → LLM → Q&A) | youtube/2026-07-02_david-tielke-enterprise-ki-softwareentwicklung.md | | [School Automation Pilot](concepts/llm/school-automation-pilot.md) | Schul-Automation: Zeugnisse, Dokumentation, Logbücher automatisieren. Deterministische Schritte (KI) vs. Urteil/Review (Mensch) trennen. Datenschutz durch lokale LLMs. Business-/Pilotprozess-Modellierung. **Update 03.07.:** Gemini-Chat von Rüdiger (19.06.) als Quelle ingestiert — KLV-CSV → lokales LLM → Multi-Agent-Check → Lehrkraft-Freigabe, Korrekturen zu OpenClaw/RAG/Modellwahl. **Update 07.08.:** Dänemark führt wegen KI-Betrugs mündliche Verteidigung von Hausarbeiten + Prüfungs-Überwachungssoftware ein — Gegenmodell zur Automatisierungs-These, regulatorische Antwort auf generative KI im Bildungswesen | other/2026-07-02_ome23-operations-update-transkript.md + other/2026-06-19_gemini-chat-schul-automation-zeugnisse.md + other/2026-08-07_denmark-ki-betrug-muendliche-pruefungen.md | | [Mechanistic Interpretability — KI-Gedanken entschlüsseln](concepts/llm/mechanistic-interpretability.md) | Black Box öffnen: interne latente Repräsentationen von LLMs sichtbar machen statt nur Verhalten zu testen. heise/c't (13.08.2026): Forscher knacken „verschlüsselte" KI-Gedanken mithilfe einer zweiten KI. Methoden: Sparse Autoencoders (SAEs), Probing, KI-unterstützte Dekodierung. Voraussetzung für Safety/Alignment/Vertrauen. Cross-Refs zu Sycophancy, Behavior-Persistence, PoisonAI, AI-Regulation | youtube/2026-08-13_heise-ki-gedanken-knacken.md | +| [DeepSeek-V4-Pro: Umgebungs-Erkennung statt 3 Modelle](concepts/llm/deepseek-environment-recognition.md) | r/DeepSeek-Leak: API hinter deepseek-v4-pro zeigt 3 CoT-Fingerprints („Let me..." ≈ Pro, „The user wants me..." ≈ Flash, „We..." = God-tier). Zwei-Layer-Hypothese: NICHT 3 Checkpoints, sondern 1 Modell mit RL-Verteilungs-Shift. Stärkster Beweis: Anchored-Standard-Experiment (98/99 mit vollem 25-Tool-Toolset, nur erster Request minimal). Kern-Insight: **DER ERSTE REQUEST entscheidet** — System-Prompt/Tool-Schema/Agent-Scaffold beim ersten Token bestimmen Trainings-Verteilung. Ehrliche Kante: Fingerprints = Indizien, keine Beweise | other/2026-08-15_deepseek-v4-pro-environment-recognition.md | +| [Open-Weights-Ökonomie — Open Weights als Wettbewerb](concepts/llm/open-weights-economics.md) | These „Open weights stopped being a gift. They're a pricing weapon now." (Anirban Bandyopadhyay/NIMS). Rothbardianische Einordnung: Pricing weapon = Wettbewerb, kein Skandal — Marktprozess + schöpferische Zerstörung (Z.ai −30%, MiniMax −16%). Open-Weight-Ökonomie als Beweis dezentraler Selektion. Abgrenzung Dumping vs. struktureller Preisvorteil | xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md | ### AGI | Seite | Beschreibung | Quellen | @@ -148,6 +151,7 @@ | [Agent Memory Taxonomy — The Seven Kinds](concepts/agents/agent-memory-taxonomy.md) | Taxonomy of 7 agent memory types (working, semantic, episodic, procedural, retrieval, parametric, prospective) mit Open-Source-Repos. plur1bus-Einordnung: ✅ Semantic/Episodic/Retrieval, ⚠️ Procedural/Working, ❌ Prospective/Parametric. Key gap im Post: Consolidation & Forgetting — plur1bus's differentiator (GC+Decay, Merging, neverForget, Emotion-Tiers) | other/2026-07-02_agent-memory-taxonomy-seven-types.md | | [Graph-Based Agent Architecture (LangGraph)](concepts/agents/graph-based-agents.md) | Agenten als gerichteter Graph (Nodes=Aktionen, Edges=Übergänge). LangGraph: Persistence, HITL, Tracing, Cycles. Komplexer aber robuster als Loops. Konsens: "Denk in Loops, implementier als LangGraph" | xpost/2026-07-18_steipete-loops-vs-graphs.md + docs.langchain.com | | [Architecture Triade: Steinberger, Kopadze, LangGraph, Codex](concepts/agents/architecture-triade.md) | **↑ 26.07.: +Codex Graph Compiler** — Vier-Säulen-Modell (Loop-Engineering, Shape-Vokabular, Implementation, Graph→Code-Automatisierung). Diamond-Pattern + Codex als Automatisierungsebene | xpost/2026-07-26_ruediger-agent-architecture-triade.md + xpost/2026-07-18_steipete-loops-vs-graphs.md + xpost/2026-07-24_steipete-graph-engineer-codex.md | +| [Compound Knowledge — Wissens-Akkumulation statt Paste-in-Chat](concepts/agents/compound-knowledge.md) | Hermes `/learn`-Pattern: Dokument einmal lesen → Brain-File bauen (Index, Kapitel-Map, Glossar, Cheat Sheet) → gezielt nachschlagen statt raten. „Versteht es FOREVER" ist Hype (Index = Nachschlagen, kein Verstehen), aber Compound Knowledge ist real (10 Skills/Monat = anderer Agent). Architektur-Parallele zu OpenClaw: Skills = prozedurales Gedächtnis, Memory = durable Fakten, gezieltes Laden statt Paste-in-Chat | xpost/2026-08-15_julian-goldie-hermes-learn.md | ### Policy | Seite | Beschreibung | Quellen | @@ -353,4 +357,8 @@ | `raw/youtube/2026-08-13_heise-ki-gedanken-knacken.md` | youtube | heise & c't: "Forscher knacken verschlüsselte KI-Gedanken – mit einer anderen KI" — Mechanistic Interpretability, interne latente Repräsentationen von LLMs mit einer zweiten KI entschlüsseln. ⚠️ Metadata-only (kein Transcript) | | `raw/other/2026-08-13_deepseek-api-preiserhoehung.md` | other | DeepSeek erhöht API-Preise (V4 Pro + V4 Flash) ab 17.08.2026 — Peak/Off-Peak, bis +1.100%. V4-Pro uncached Input Peak 3→9 Yuan/Mio, Output Peak 6→27 Yuan/Mio. V4-Flash 1,5/4,5 Yuan. Wende beim Preisdrücker. ⚠️ Perplexity-Link 403/Cloudflare; Fakten aus verifizierter Websuche (investing.com, thenews.com.pk, kelo.com, deepseek.ai/pricing, roic.ai) | | `raw/youtube/2026-08-13_clawcast-episode7-peter-steinberger.md` | youtube | ClawCast Ep. 7: Unfiltered Q&A mit OpenClaw-Gründer Peter Steinberger (Hosts Hannes Rudolph, Patrick Erichsen, 12.08.2026). Roadmap, kommendes Release, Agents in der Softwareentwicklung, Cloud-backed multiplayer workflows, OpenClaw-baut-mit-OpenClaw, SQLite, Team-Server, Agent-zu-Agent, Memory, Model Routing, Onboarding, Browser Control, Hardware, Open Source als Kern-Differentiator. ⚠️ Kein Transkript (nur Seitentext) | +| `raw/xpost/2026-08-15_julian-goldie-hermes-learn.md` | xpost | Julian Goldie: Hermes `/learn` — Dokument einmal lesen → Brain-File bauen (Index, Kapitel-Map, Glossar, Cheat Sheet) → gezielt nachschlagen statt raten. Compound-Knowledge-Pattern, Architektur-Parallele zu OpenClaw-Skills/Memory | +| `raw/github/2026-08-15_warmshao-vsurf.md` | github | vsurf (@warmshao): Open-Source RLM-Agent (MIT, npm i -g @warmshao/vsurf) auf prime-agent/pi-agent. EIN echter Browser, VIELE Agenten — eigene Tabs, paralleles Browsen, Tab-Übernahme. Echtes DOM/CDP statt Screenshot-Raten. Beta (2 Stars, 30 Commits in 8h) | +| `raw/other/2026-08-15_deepseek-v4-pro-environment-recognition.md` | other | r/DeepSeek-Leak: API hinter deepseek-v4-pro zeigt 3 CoT-Fingerprints („Let me..." ≈ Pro, „The user wants me..." ≈ Flash, „We..." = God-tier). Zwei-Layer-Hypothese: 1 Modell mit RL-Verteilungs-Shift. Anchored-Standard-Experiment als stärkster Beweis. Kern-Insight: DER ERSTE REQUEST entscheidet (Trainings-Verteilung) | +| `raw/xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md` | xpost | Anirban Bandyopadhyay (NIMS): Graph-Engineering-These (Überzeichnung) + Kimi K3 Open Weights (2,8T, größtes Open-Weight-Modell, 75% größer als V4 Pro, 1M Kontext, 27.07.) + „Open weights as pricing weapon" (Wettbewerb, kein Skandal; Z.ai −30%, MiniMax −16%) | | `architecture/sqlite-pages-7.2.md` | SQLite-Refactor & Pages-Konzept — OpenClaw 7.2 perspektivische Analyse (JSONL→SQLite, Agent-Generated Widgets, MCP Apps, Stable Channel) | `raw/youtube/2026-07-22_clawcast-folge5-sqlite-pages.md` | diff --git a/wiki/log.md b/wiki/log.md index da5c608..af8d6e1 100644 --- a/wiki/log.md +++ b/wiki/log.md @@ -2,6 +2,23 @@ *Append-only changelog. Start: 2026-06-05* +## 2026-08-15 — Vier Ökosystem-Items aus OME Topic "Hermès Agents" (Hermes /learn, vsurf, DeepSeek-V4-Pro, Kimi K3) + +**Type:** ingest | **Scope:** raw/xpost (2 new), raw/github (1 new), raw/other (1 new), wiki/tools (1 new), wiki/concepts/agents (1 new), wiki/concepts/llm (2 new + 1 update), wiki/index, wiki/log +**Source:** OME-Gruppe, Topic "Hermès Agents" + +- raw (NEW): `raw/xpost/2026-08-15_julian-goldie-hermes-learn.md` — Julian Goldie bewirbt Hermes `/learn`: Dokument einmal lesen → Brain-File bauen (Index, Kapitel-Map, Glossar, Cheat Sheet) → gezielt nachschlagen statt raten. "Versteht es FOREVER" ist Hype (Index = Nachschlagen, kein Verstehen), aber Compound Knowledge ist real. Architektur-Parallele zu OpenClaw: Skills = prozedurales Gedächtnis, Memory = durable Fakten, gezieltes Skill-Laden statt Paste-in-Chat. +- raw (NEW): `raw/github/2026-08-15_warmshao-vsurf.md` — vsurf (@warmshao, Launch 2026-08-15): Open-Source RLM-Agent (MIT, `npm i -g @warmshao/vsurf`) auf prime-agent/pi-agent. Architektur-Statement: EIN echter Browser, VIELE Agenten — eigene Tabs, parallel browsen, Tab-Übernahme vom User. Echtes DOM/CDP statt Screenshot-Raten. Noch Beta (2 Stars, 51 Views, 30 Commits in 8h). +- raw (NEW): `raw/other/2026-08-15_deepseek-v4-pro-environment-recognition.md` — r/DeepSeek-Leak: API hinter deepseek-v4-pro zeigt 3 CoT-Fingerprints ("Let me..." ≈ V4 Pro Preview, "The user wants me..." ≈ V4 Flash, "We..." = God-tier). Zwei-Layer-Hypothese: NICHT 3 Checkpoints, sondern 1 Modell mit RL-Verteilungs-Shift. Stärkster Beweis: Anchored-Standard-Experiment (98/99 mit vollem 25-Tool-Toolset, nur erster Request minimal). Kern-Insight: **DER ERSTE REQUEST entscheidet** (System-Prompt, Tool-Schema, Agent-Scaffold beim ersten Token). Commit im Harness-Repo (10.08.): "align minimal agent with RL composition". Ehrliche Kante: Fingerprints = Indizien, keine Beweise. +- raw (NEW): `raw/xpost/2026-08-15_anirban-bandyo-kimi-k3-graph-engineering.md` — Anirban Bandyopadhyay (NIMS): Graph-Engineering-These ("Graph engineering will replace every single engineering" — Überzeichnung, Graphen ersetzen keine Thermodynamik/Materialwissenschaft) + Kimi K3: 2,8T Parameter, größtes Open-Weight-Modell aller Zeiten, 75% größer als DeepSeek V4 Pro, 1M Kontext, Weights 27.07. + "Open weights stopped being a gift. They're a pricing weapon now." — rothbardianische Einordnung: Pricing weapon = Wettbewerb, kein Skandal (Marktprozess, schöpferische Zerstörung; Z.ai −30%, MiniMax −16%). +- wiki (NEW): `wiki/concepts/agents/compound-knowledge.md` — Konzept: Compound Knowledge = Wissens-Akkumulation statt Paste-in-Chat. Hermes-/learn-Pattern, Index≠Verstehen-Hype-Kante, Architektur-Parallele Skills/Memory/gezieltes Laden zu OpenClaw. +- wiki (NEW): `wiki/tools/vsurf.md` — Tool-Seite: Browser als geteilter Agenten-Raum (RLM-Agent, CDP/Tab-Ownership), Reifegrad (Beta), Architektur-Richtung für Research-Agenten, Parallele zu OpenClaw Browser Control/CDP. +- wiki (NEW): `wiki/concepts/llm/deepseek-environment-recognition.md` — Konzept: Umgebungs-Erkennung statt 3 Modelle, First-Request-Entscheidung, Relevanz für ollama/deepseek-v4-flash:0731-Setup. +- wiki (NEW): `wiki/concepts/llm/open-weights-economics.md` — Konzept: Open Weights als Wettbewerb (Pricing weapon), rothbardianische Marktprozess-Einordnung, Abgrenzung Dumping. +- wiki (UPDATED): `wiki/concepts/llm/kimi-k3.md` — Key-Properties aktualisiert (2,8T Parameter, größtes Open-Weight-Modell, 75% größer als V4 Pro, 1M Kontext), neue Sektion "Open Weights als Wettbewerb (15.08.)". +- index.md: Tools-Tabelle (vsurf) + Concepts-Tabelle (LLM: deepseek-environment-recognition, open-weights-economics; Agents: compound-knowledge) + kimi-k3-Eintrag aktualisiert + Raw-Sources-Tabelle erweitert, Header-Update 94. +- log: this entry + ## 2026-08-14 — FinanceLancelot: Nvidia & die zirkuläre KI-Finanzierung (X-Post, OME Topic 13) Kai (@PWeber) teilte X-Post von @FinanceLancelot mit Bloomberg-Diagramm "The Circular Nature of AI Deals" (8. Juni 2026): Nvidia haftet für zirkuläre Finanzierungsdarlehen von $5 Bio. für Kunden; NVDA-FY2026-Gewinn nur $120 Mrd.; "Blase von 2000 auf Steroiden". diff --git a/wiki/tools/hermes-desktop.md b/wiki/tools/hermes-desktop.md index 309da9f..c27eac7 100644 --- a/wiki/tools/hermes-desktop.md +++ b/wiki/tools/hermes-desktop.md @@ -1,6 +1,6 @@ --- created: 2026-06-22 -updated: 2026-07-10 +updated: 2026-08-15 sources: [youtube/2026-06-22_jonas-keil-hermes-desktop.md, youtube/2026-06-24_alex-finn-hermes-agent-v0170-reach.md, youtube/2026-06-24_peter-yang-hermes-full-course.md, xpost/2026-06-28-hermes-moa-vaibhavsisinty.md, youtube/2026-06-28_hermes-setup-2min-matthew-berman.md, youtube/2026-07-03_hermes-mixture-of-agents-2-0-agent-os.md, xpost/2026-07-10_alex-finn-hermes-agent-100-hours.md, xpost/2026-07-10_charly-wargnier-hermes-browser-extension.md] tags: [tools, hermes-agent, hermes-desktop, nous-research, desktop-app, electron, react, gui, openclaw-migration, self-improving, v0.17.0, reach, mixture-of-agents, moa, moa-2, model-fusion, ensemble, quickstart, hostinger, vps-hosting, matthew-berman, agent-os, goldybench, system-vs-model, business-automation, lessons-learned, reverse-prompting, tailscale, gpt-5.6, model-comparison, browser-extension, jonkomet] --- @@ -432,6 +432,7 @@ Die Extension ist ein Community-Projekt (nicht von Nous Research), aber die Gesc ## Verwandte Wiki-Seiten - [[../tools/openclaw.md]] — OpenClaw (Vergleichs-Framework) +- [[../concepts/agents/compound-knowledge.md]] — Hermes `/learn` Compound-Knowledge-Pattern (Brain-File, gezieltes Nachschlagen) - [[../concepts/llm/real-world-coding-showdown.md]] — Hermes Agent als Test-Framework für Coding-Modelle - [[../tools/ecosystem-tools-april-2026.md]] — Hermes Atlas als Competitor (April 2026) - [[../concepts/agents/ai-agents-2026.md]] — AI-Agent-Landschaft 2026 diff --git a/wiki/tools/openclaw.md b/wiki/tools/openclaw.md index 6e9c8fa..44dd7cf 100644 --- a/wiki/tools/openclaw.md +++ b/wiki/tools/openclaw.md @@ -32,6 +32,7 @@ Release-relevante Änderungen, die unser Setup betreffen. - [[../concepts/llm/glm-5.2-zai-coding-model.md]] — GLM 5.2 mit OpenClaw-Integration - [[../concepts/llm/llm-knowledge-base.md]] — OpenClaw native raw Memory Wiki source pages - [[../concepts/directives/openclaw-financial-bots-policy.md]] — Financial-Bot-Restriktionen +- [[../tools/vsurf.md]] — Browser als geteilter Agenten-Raum (CDP/Multi-Agenten-Parallele) - [[../architecture/agent-orchestration.md]] — Subagent-Spawning-Patterns ## Externe Ressourcen diff --git a/wiki/tools/vsurf.md b/wiki/tools/vsurf.md new file mode 100644 index 0000000..a7ac039 --- /dev/null +++ b/wiki/tools/vsurf.md @@ -0,0 +1,56 @@ +--- +created: 2026-08-15 +updated: 2026-08-15 +sources: [github/2026-08-15_warmshao-vsurf.md] +tags: [tools, vsurf, warmshao, browser-agent, rlm, remote-llm-agent, open-source, mit, cdp, tab-ownership, parallel-agents, prime-agent, pi-agent, research-agents] +--- + +# vsurf — Browser als geteilter Agenten-Raum + +> **Quelle:** GitHub-Repo [warmshao/vsurf](https://github.com/warmshao/vsurf) von @warmshao, Launch 2026-08-15, OME-Gruppe Topic "Hermès Agents" → [Raw-Datei](../../raw/github/2026-08-15_warmshao-vsurf.md) + +## Kernidee + +**vsurf** ist ein **Open-Source RLM-Agent** (Remote LLM Agent), gebaut auf **prime-agent** / **pi-agent**. Das zentrale Architektur-Statement: + +> **EIN echter Browser, VIELE Agenten.** + +- Jeder Agent bekommt **eigene Tabs** +- Agenten browsen **parallel** +- Agenten können **Tabs übernehmen, die der User schon offen hat** + +Die Agenten verlassen die isolierte Sandbox und arbeiten im **echten Browser mit echter Session, echten Cookies, echtem DOM**. + +## Technische Ansätze + +| Aspekt | Ansatz | +|--------|--------| +| **Tab-Zuordnung** | Tab-Ownership statt Screenshot-Raten | +| **Browser-Steuerung** | CDP (Chrome DevTools Protocol) statt DOM-Parsing | +| **Install** | `npm i -g @warmshao/vsurf` | +| **Lizenz** | MIT | + +## Reifegrad + +- Frisch gelauncht (2026-08-15), noch **Beta** +- **2 Stars**, **51 Views**, **30 Commits in 8h** + +Früher, experimenteller Stand — als Architektur-Signal wertvoll, nicht als produktionsreifes Tool. + +## Architektur-Relevanz für Research-Agenten + +"Browser als geteilter Agenten-Raum" ist eine Architektur-Richtung für **Research-Agenten**: mehrere Agenten teilen sich einen echten Browser, jeder mit eigener Tab-Territorien, parallel browsend, mit echter Session statt Sandbox. Das ist die konsequente Weiterentwicklung des Sandbox-Paradigmas. + +**Parallele zu OpenClaw:** OpenClaw bietet Browser Control ([[openclaw.md|Browser Control]]) sowie CDP-basierte Steuerung über das cdp-browser-Skill. vsurf radikalisiert das zu einem **Multi-Agenten-geteilten** echten Browser. + +## Einordnung in die Agenten-Konzepte + +- Verwandt mit [[../concepts/agents/ai-agents-2026.md|AI Agents 2026]] — Wandel zu autonomen Agenten +- Verwandt mit [[../concepts/agents/agent-loops.md|Agent Loops]] und [[../concepts/agents/harness-loop-graph-engineering.md|Harness/Loop/Graph Engineering]] — der Browser als Harness/Umgebung für Agenten + +## Cross-References + +- [[openclaw.md]] — OpenClaw (Plattform, CDP-browser, Browser Control) +- [[../concepts/agents/ai-agents-2026.md]] — AI-Agent-Landschaft 2026 +- [[../concepts/agents/harness-loop-graph-engineering.md]] — Harness/Loop/Graph Engineering +- [[hermes-desktop.md]] — Hermes Desktop (anderer Agent-Ansatz, Browser-Extension)