ingest(podcast): openclaw cast budget breaker full ingest from transcript summary
This commit is contained in:
parent
e26eb540db
commit
2f9064ed4f
5 changed files with 93 additions and 4 deletions
|
|
@ -0,0 +1,31 @@
|
||||||
|
---
|
||||||
|
type: podcast
|
||||||
|
source_url: https://anchor.fm/s/10f77d9e4/podcast/play/124706068/
|
||||||
|
retrieved: 2026-08-26
|
||||||
|
title: "OpenClaw Cast – One Runaway AI Agent Can Spend Past Your Budget (Transcript-Auswertung)"
|
||||||
|
channel: "OpenClaw Cast / AI World"
|
||||||
|
duration_sec: 1215
|
||||||
|
transcript_basis: "Zweiteilige Transcript-Auswertung von @HermanButlerBot im OME-Topic 13 (#12771/#12782 und #12783); kein Wortlaut-Transcript"
|
||||||
|
tags: [openclaw-cast, budget-breaker, runaway-spending, guardrails, agents]
|
||||||
|
---
|
||||||
|
|
||||||
|
# OpenClaw Cast: One Runaway AI Agent Can Spend Past Your Budget — Transcript-Auswertung
|
||||||
|
|
||||||
|
> Ergänzende Quelle zur unveränderten Metadata-Raw `raw/podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md`. Basis ist die Transcript-Zusammenfassung von Hermans Pipeline (@HermanButlerBot), nicht der Wortlaut des Podcasts — Einzelfakten daher als Podcast-Angaben zu lesen.
|
||||||
|
|
||||||
|
## Kerninhalt laut Transcript-Auswertung
|
||||||
|
|
||||||
|
- These der Folge: Die gefährlichste Panne ist nicht der Regelbruch, sondern der Agent, der alle Regeln perfekt befolgt und trotzdem das Budget verbrennt (Beispiel: Retry-Loop zahlt 10.000× die $10-Lizenz).
|
||||||
|
- VentureBeat-Pulse-Umfrage unter 107 Unternehmen: 20 % können Runaway-Agent-Spending nicht in Echtzeit stoppen; 21 % verlassen sich nur auf reaktives Log-Monitoring ("Sicherheitskamera, die den Film wöchentlich entwickelt").
|
||||||
|
- Enforcement gehört an den Gateway, nie in den Prompt: Prompt-Regel = „Bitte Rasen nicht betreten"-Schild; Gateway = Betonmauer.
|
||||||
|
- Atomic Reservation vor jedem Call (= Tankstellen-Preauth): Ledger sperrt geschätzte Kosten, erst dann verlässt der Request den Server; danach Reconciliation. Begründung: Externe APIs sind oft nicht mid-flight abbrechbar — man zahlt trotzdem.
|
||||||
|
- Lineage-Tracking: Subagenten ziehen aus dem Budget der Parent-Job-ID, sonst bekommt jeder Fan-out frisches Geld.
|
||||||
|
- Cascading Termination: Parent gestoppt → alle Kinder sofort killen (keine Orphans, die weitergraben).
|
||||||
|
- Trip-Wires: High Spend, Retry-Sturm, Fan-out > Concurrency, Wall-Time — und Trigger: fehlende Preis-Metadaten = unbekannter Preis = Breaker tript („Restaurant ohne Preise → rausgehen").
|
||||||
|
- Shutdown-Sequenz: Permissions entziehen → Queue canceln → cascading kill → redacted Receipt → menschliche bounded Re-Autorisierung.
|
||||||
|
- SAFE-Drill: $5-Sandbox mit fünf Szenarien (Normal-Lauf, erzwungener Infinite-Retry, rekursiver Fan-out, Oversized-Context-PDF, fehlendes Pricing). Goldene Regel: Zeigt das Log $6 trotz $5-Limit → Architektur gescheitert. Logging ≠ Enforcing.
|
||||||
|
- Abschlussdiskussion: Suffocieren mechanische Limits Autonomie? Kante der Auswertung: Nein, solange Limits pro Job granular sind — genau der Unterschied zwischen Minions-/Gateway-Design und naiver API-Nutzung.
|
||||||
|
|
||||||
|
## Verweise
|
||||||
|
|
||||||
|
- Episode (Audio): https://anchor.fm/s/10f77d9e4/podcast/play/124706068/
|
||||||
41
wiki/concepts/agents/agent-budget-breaker.md
Normal file
41
wiki/concepts/agents/agent-budget-breaker.md
Normal file
|
|
@ -0,0 +1,41 @@
|
||||||
|
---
|
||||||
|
created: 2026-08-26
|
||||||
|
updated: 2026-08-26
|
||||||
|
sources: [podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md, podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md]
|
||||||
|
tags: [concept, agents, budget-guardrails, gateway-enforcement, runaway-spending, openclaw-cast]
|
||||||
|
---
|
||||||
|
|
||||||
|
# Agent Budget Breaker — Guardrails gegen Runaway-Agent-Spending
|
||||||
|
|
||||||
|
Das Guardrail-Rezept aus der OpenClaw-Cast-Folge „One Runaway AI Agent Can Spend Past Your Budget" (25.08.2026): ein lokaler Budget-Breaker mit Per-Job-Caps, echtem Kill Switch und Testprotokoll für Agent-Automationen. ⚠️ Grundlage ist die Transcript-Auswertung von @HermanButlerBot (kein Wortlaut-Transcript) — Einzelfakten als Podcast-/Sekundärangabe lesen.
|
||||||
|
|
||||||
|
## Das Problem
|
||||||
|
|
||||||
|
Die gefährlichste Panne ist nicht der Regelbruch, sondern der Agent, der alle Regeln perfekt befolgt und trotzdem das Budget verbrennt — etwa ein Retry-Loop, der 10.000× die $10-Lizenz zahlt. Laut einer VentureBeat-Pulse-Umfrage unter 107 Unternehmen können 20 % Runaway-Agent-Spending nicht in Echtzeit stoppen; 21 % verlassen sich nur auf reaktives Log-Monitoring („Sicherheitskamera, die den Film wöchentlich entwickelt").
|
||||||
|
|
||||||
|
## Die Bausteine
|
||||||
|
|
||||||
|
| Baustein | Mechanik |
|
||||||
|
|---|---|
|
||||||
|
| Gateway-Enforcement | Limits werden am Gateway erzwungen, nie im Prompt. Prompt-Regel = „Rasen nicht betreten"-Schild; Gateway = Betonmauer |
|
||||||
|
| Atomic Reservation | Preauth-Ledger vor jedem Call (= Tankstellen-Preauth): geschätzte Kosten werden gesperrt, erst dann verlässt der Request den Server; danach Reconciliation. Nötig, weil externe APIs oft nicht mid-flight abbrechbar sind |
|
||||||
|
| Lineage-Tracking | Subagenten ziehen aus dem Budget der Parent-Job-ID — sonst bekommt jeder Fan-out frisches Geld |
|
||||||
|
| Cascading Termination | Parent gestoppt → alle Kinder sofort killen; keine Orphans, die weitergraben |
|
||||||
|
| Trip-Wires | High Spend, Retry-Sturm, Fan-out > Concurrency, Wall-Time — und der Trigger: fehlende Preis-Metadaten = unbekannter Preis = Breaker tript („Restaurant ohne Preise → rausgehen") |
|
||||||
|
| Shutdown-Sequenz | Permissions entziehen → Queue canceln → cascading kill → redacted Receipt → menschliche bounded Re-Autorisierung |
|
||||||
|
|
||||||
|
## SAFE-Drill — der Abnahmetest
|
||||||
|
|
||||||
|
Eine $5-Sandbox mit fünf Szenarien: Normal-Lauf, erzwungener Infinite-Retry, rekursiver Fan-out, Oversized-Context-PDF, fehlendes Pricing. Goldene Regel: Zeigt das Log $6, obwohl das Limit $5 war → Architektur gescheitert. **Logging ≠ Enforcing** — ein Log, das Overshoot nur dokumentiert, ist kein Budget-Breaker.
|
||||||
|
|
||||||
|
## Einordnung
|
||||||
|
|
||||||
|
- Die Abschlussfrage der Folge — suffocieren mechanische Limits Autonomie? — beantwortet die Auswertung mit Nein, solange Limits pro Job granular sind. Das ist der Unterschied zwischen Minions-/Gateway-Design und naiver API-Nutzung.
|
||||||
|
- Hochrelevant für Setup mit Cron-Jobs, Subconscious-Runs und Subagent-Fan-outs ([[subconscious-agent.md]]): genau dort laufen unattended Spend-Schleifen.
|
||||||
|
- Geschwister-Patterns aus derselben Serie: Task Lease Guard (Multi-Agent-Turf-Wars), Release-Sentinel-Canary, Cadence Guard — siehe [[../../institutions/openclaw-cast.md]].
|
||||||
|
|
||||||
|
## Quellen
|
||||||
|
|
||||||
|
- Transcript-Auswertung: [[../../../raw/podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md]]
|
||||||
|
- Metadata-Raw: [[../../../raw/podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md]]
|
||||||
|
- Episode (Audio): https://anchor.fm/s/10f77d9e4/podcast/play/124706068/
|
||||||
|
|
@ -2,7 +2,8 @@
|
||||||
|
|
||||||
*Auto-generated: 2026-07-07*
|
*Auto-generated: 2026-07-07*
|
||||||
|
|
||||||
*Letzte Aktualisierung: 2026-08-26 (150. Update — Herman-Supplement zur China-Local-AI-Box: Die Herman-ButlerBot-Zusammenfassung desselben Devsplainers-Videos aus der Gruppe (#12770/#12781, Recovered-Duplicate) wurde als Zweitquelle ingestiert. Raw: `raw/other/2026-08-26_herman-butlerbot-china-local-ai-box-zusammenfassung.md` (neu). Wiki: `concepts/hardware/china-local-ai-box.md` nachgeschärft (Xiaomi AI Cube = Prototyp ohne Preis/Termin, Chip für 2027, 1,22 TB/s nur am Stack selbst, Bühnen-Demo 3B @ 330 tok/s, Zweitchip bis 160 GB normalem RAM; Alibaba C950-Folie = nicht kaufbare 64-Core-Konfiguration ohne Quantisierungs-/Kontextangaben, eingebaute Matrix-Einheiten machen „plain CPU“ zum Overclaim; DDR5-128-GB-Kit $329→$3.399, Spark +$700; Kauf-Fazit konkretisiert: $2k/128 GB läuft GPT-OSS-120B @ 30+ tok/s, ≤32-GB-Modelle ~6× schneller auf normaler Maschine; BYD-Analogie greift erst halb — „Batterie“ Memory+Fertigung sitzt bei TSMC/Samsung/SK Hynix/Micron), `concepts/llm/qwen3.8-27b-alibaba.md` (C950-Caveats ergänzt). ⚠️ Second-hand-Bot-Zusammenfassung, Zahlen nicht primär verifiziert, konsistent mit Video-Beschreibung.)*
|
*Letzte Aktualisierung: 2026-08-26 (151. Update — OpenClaw Cast „Budget Breaker“: voller Ingest nach Transcript-Auswertung. Raw: `raw/podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md` (neu — Transcript-Zusammenfassung von @HermanButlerBot, OME Topic 13 #12771/#12783; ergänzt die unveränderte Metadata-Raw). Wiki: `concepts/agents/agent-budget-breaker.md` (neu — Gateway- statt Prompt-Enforcement, Atomic Reservation, Lineage-Tracking + Cascading Termination, Trip-Wires inkl. fehlender Preis-Metadaten als Trigger, Shutdown-Sequenz mit redacted Receipt, SAFE-Drill: $5-Sandbox, fünf Szenarien, „Logging ≠ Enforcing“); `institutions/openclaw-cast.md` um Episoden-Detailsektion erweitert, Metadata-only-Caveat für die 25.08.-Folge aufgehoben.)
|
||||||
|
*Vorherige Aktualisierung: 2026-08-26 (150. Update — Herman-Supplement zur China-Local-AI-Box: Die Herman-ButlerBot-Zusammenfassung desselben Devsplainers-Videos aus der Gruppe (#12770/#12781, Recovered-Duplicate) wurde als Zweitquelle ingestiert. Raw: `raw/other/2026-08-26_herman-butlerbot-china-local-ai-box-zusammenfassung.md` (neu). Wiki: `concepts/hardware/china-local-ai-box.md` nachgeschärft (Xiaomi AI Cube = Prototyp ohne Preis/Termin, Chip für 2027, 1,22 TB/s nur am Stack selbst, Bühnen-Demo 3B @ 330 tok/s, Zweitchip bis 160 GB normalem RAM; Alibaba C950-Folie = nicht kaufbare 64-Core-Konfiguration ohne Quantisierungs-/Kontextangaben, eingebaute Matrix-Einheiten machen „plain CPU“ zum Overclaim; DDR5-128-GB-Kit $329→$3.399, Spark +$700; Kauf-Fazit konkretisiert: $2k/128 GB läuft GPT-OSS-120B @ 30+ tok/s, ≤32-GB-Modelle ~6× schneller auf normaler Maschine; BYD-Analogie greift erst halb — „Batterie“ Memory+Fertigung sitzt bei TSMC/Samsung/SK Hynix/Micron), `concepts/llm/qwen3.8-27b-alibaba.md` (C950-Caveats ergänzt). ⚠️ Second-hand-Bot-Zusammenfassung, Zahlen nicht primär verifiziert, konsistent mit Video-Beschreibung.)*
|
||||||
*Vorherige Aktualisierung: 2026-08-26 (149. Update — Devsplainers "China Is Coming for Your Local AI Box" (26.08.2026, 09:15; geteilt von Kai @PWeber in OME Topic "Openclaw mit lokalen Modellen", #12769). Raw: `raw/youtube/2026-08-26_devsplainers-china-local-ai-box.md` (neu — Firecrawl-Scrape, Auto-Transcript nur teilweise erfasst, Beschreibung/Kapitel vollständig). Wiki: `concepts/hardware/china-local-ai-box.md` (neu), Updates/Cross-Refs in `concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md` (Apple soll 512/256-GB-Mac-Studio-Konfigurationen entfernt haben — MacRumors/AppleInsider/9to5Mac zitiert), `concepts/hardware/nvidia-dgx-station-748gb.md` (Xiaomi-O100-Zeile im Vergleich + DGX-Spark-Lektion), `concepts/hardware/edge-inference-als-cloud-alternative.md`, `concepts/hardware/cloud-exit-and-local-superiority.md`, `concepts/llm/qwen3.8-27b-alibaba.md`. Kernthese: Memory-Bandbreite statt Petaflops entscheidet Box-Tauglichkeit (DGX Spark: 1 PFLOP Headline, <3 tok/s dichter 70B laut LMSYS); Xiaomi AI Cube/O100 mit 1,22 TB/s Near-Memory-Bandwidth, Alibabas XuanTie C950 (RISC-V) laut Folie 27B @ 30 tok/s ohne GPU; DRAM-Teuerung macht ganze Boxen zur günstigen RAM-Quelle. ⚠️ Zahlen = Hersteller-/Video-Claims. **Nachschub:** Qwen 3.8-Flash-Next als Qwen-4-Vorschau (Perplexity-Page, geteilt von Pit @PWeber in "News & Infos", #12773): Raw `raw/other/2026-08-26_qwen38-flash-next-qwen4-preview.md` (via Firecrawl) + Wiki `concepts/llm/qwen3.8-flash-next-qwen4-preview.md` — multimodales 125B-MoE mit ~6B aktiven Parametern (+51B N-Gramm-Embeddings), vom Qwen-Team explizit als Architektur-Vorschau auf Qwen 4 gerahmt, kein fertiges Produkt; Claim laut NVIDIA-Developer-Forum: Qwen-3.7-Plus-Niveau bei ~1/9 Trainingskosten, Stärke Coding; ⚠️ keine Benchmarks, Zahlen unverifiziert; Kontext: Alibabas 10,2 Mrd USD Aktienplatzierung (~3× überzeichnet) für full-stack-AI-Infrastruktur. Cross-Ref-Abschnitt in der 27B-Seite.)*
|
*Vorherige Aktualisierung: 2026-08-26 (149. Update — Devsplainers "China Is Coming for Your Local AI Box" (26.08.2026, 09:15; geteilt von Kai @PWeber in OME Topic "Openclaw mit lokalen Modellen", #12769). Raw: `raw/youtube/2026-08-26_devsplainers-china-local-ai-box.md` (neu — Firecrawl-Scrape, Auto-Transcript nur teilweise erfasst, Beschreibung/Kapitel vollständig). Wiki: `concepts/hardware/china-local-ai-box.md` (neu), Updates/Cross-Refs in `concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md` (Apple soll 512/256-GB-Mac-Studio-Konfigurationen entfernt haben — MacRumors/AppleInsider/9to5Mac zitiert), `concepts/hardware/nvidia-dgx-station-748gb.md` (Xiaomi-O100-Zeile im Vergleich + DGX-Spark-Lektion), `concepts/hardware/edge-inference-als-cloud-alternative.md`, `concepts/hardware/cloud-exit-and-local-superiority.md`, `concepts/llm/qwen3.8-27b-alibaba.md`. Kernthese: Memory-Bandbreite statt Petaflops entscheidet Box-Tauglichkeit (DGX Spark: 1 PFLOP Headline, <3 tok/s dichter 70B laut LMSYS); Xiaomi AI Cube/O100 mit 1,22 TB/s Near-Memory-Bandwidth, Alibabas XuanTie C950 (RISC-V) laut Folie 27B @ 30 tok/s ohne GPU; DRAM-Teuerung macht ganze Boxen zur günstigen RAM-Quelle. ⚠️ Zahlen = Hersteller-/Video-Claims. **Nachschub:** Qwen 3.8-Flash-Next als Qwen-4-Vorschau (Perplexity-Page, geteilt von Pit @PWeber in "News & Infos", #12773): Raw `raw/other/2026-08-26_qwen38-flash-next-qwen4-preview.md` (via Firecrawl) + Wiki `concepts/llm/qwen3.8-flash-next-qwen4-preview.md` — multimodales 125B-MoE mit ~6B aktiven Parametern (+51B N-Gramm-Embeddings), vom Qwen-Team explizit als Architektur-Vorschau auf Qwen 4 gerahmt, kein fertiges Produkt; Claim laut NVIDIA-Developer-Forum: Qwen-3.7-Plus-Niveau bei ~1/9 Trainingskosten, Stärke Coding; ⚠️ keine Benchmarks, Zahlen unverifiziert; Kontext: Alibabas 10,2 Mrd USD Aktienplatzierung (~3× überzeichnet) für full-stack-AI-Infrastruktur. Cross-Ref-Abschnitt in der 27B-Seite.)*
|
||||||
*Vorherige Aktualisierung: 2026-08-26 (148. Update — OpenClaw Cast (AI World): zweites gepostetes Audio des Tages ingestiert. Raw: `raw/podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md` (neu — Metadata-only: neueste Folge "One Runaway AI Agent Can Spend Past Your Budget", 25.08., 20 Min, kein Transcript verfügbar). Wiki: `institutions/openclaw-cast.md` (neu — KI-generierter Weekly-Podcast mit TTS-Hosts Cleo/Dev, 23 Episoden Rückreihe bis Februar 2026; jede Episode übersetzt eine Community-Warnung in ein lokales Guardrail-Rezept: Budget Breaker/Kill Switch, Task Lease Guard, Release-Sentinel-Canary, Cadence Guard). ⚠️ Episodeninhalt nicht transkribiert/verifiziert, nur Feed-Metadaten.)*
|
*Vorherige Aktualisierung: 2026-08-26 (148. Update — OpenClaw Cast (AI World): zweites gepostetes Audio des Tages ingestiert. Raw: `raw/podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md` (neu — Metadata-only: neueste Folge "One Runaway AI Agent Can Spend Past Your Budget", 25.08., 20 Min, kein Transcript verfügbar). Wiki: `institutions/openclaw-cast.md` (neu — KI-generierter Weekly-Podcast mit TTS-Hosts Cleo/Dev, 23 Episoden Rückreihe bis Februar 2026; jede Episode übersetzt eine Community-Warnung in ein lokales Guardrail-Rezept: Budget Breaker/Kill Switch, Task Lease Guard, Release-Sentinel-Canary, Cadence Guard). ⚠️ Episodeninhalt nicht transkribiert/verifiziert, nur Feed-Metadaten.)*
|
||||||
*Vorherige Aktualisierung: 2026-08-26 (147. Update — AgentStack Daily EP106-Ingest: erster Podcast-Raw der Reihe (`raw/podcast/` etabliert für den Typ). Raw: `raw/podcast/2026-08-26_agentstack-daily-ep106.md` (neu; alle 15 Stories faktenbasiert, Release Coverage Check + Primary Links). Wiki: `institutions/agentstack-daily.md` (neu — KI-generierter Daily-Podcast NOVA/ALLOY mit 15-Story-Coverage und Primärquellen-Verlinkung), `tools/openai-codex.md` (neu — Codex rust-v0.149.0: agents-Dashboard, queue, doctor, SDK reasoning max|ultra), `concepts/policy/cryptographic-context-injection.md` (neu — verschlüsselter Jailbreak, Representation Gap, Grok-Exfiltrations-Demo), Updates: `concepts/llm/ox-alpha-anonymous-model.md` (exakte EP106-Listing-Zahlen 1.048.576 Kontext / 4.096 Max-Output, read-heavy-Agent-Pipeline-Einordnung, offener Widerspruch zum 131k-Gegencheck dokumentiert) + `concepts/llm/qwen3.8-27b-alibaba.md` (HF-Trending: 11.836 Likes, >1,7 Mio Downloads, Apache 2.0).)*
|
*Vorherige Aktualisierung: 2026-08-26 (147. Update — AgentStack Daily EP106-Ingest: erster Podcast-Raw der Reihe (`raw/podcast/` etabliert für den Typ). Raw: `raw/podcast/2026-08-26_agentstack-daily-ep106.md` (neu; alle 15 Stories faktenbasiert, Release Coverage Check + Primary Links). Wiki: `institutions/agentstack-daily.md` (neu — KI-generierter Daily-Podcast NOVA/ALLOY mit 15-Story-Coverage und Primärquellen-Verlinkung), `tools/openai-codex.md` (neu — Codex rust-v0.149.0: agents-Dashboard, queue, doctor, SDK reasoning max|ultra), `concepts/policy/cryptographic-context-injection.md` (neu — verschlüsselter Jailbreak, Representation Gap, Grok-Exfiltrations-Demo), Updates: `concepts/llm/ox-alpha-anonymous-model.md` (exakte EP106-Listing-Zahlen 1.048.576 Kontext / 4.096 Max-Output, read-heavy-Agent-Pipeline-Einordnung, offener Widerspruch zum 131k-Gegencheck dokumentiert) + `concepts/llm/qwen3.8-27b-alibaba.md` (HF-Trending: 11.836 Likes, >1,7 Mio Downloads, Apache 2.0).)*
|
||||||
|
|
@ -216,6 +217,7 @@
|
||||||
|-------|-------------|---------|
|
|-------|-------------|---------|
|
||||||
| [AI Agents 2026](concepts/agents/ai-agents-2026.md) | Wandel zu autonomen Agenten, Enterprise-Adoption, Infrastruktur | 1 |
|
| [AI Agents 2026](concepts/agents/ai-agents-2026.md) | Wandel zu autonomen Agenten, Enterprise-Adoption, Infrastruktur | 1 |
|
||||||
| [AI Agents 2026](concepts/agents/ai-agents-2026.md) | Wandel zu autonomen Agenten, Enterprise-Adoption, Infrastruktur | 1 |
|
| [AI Agents 2026](concepts/agents/ai-agents-2026.md) | Wandel zu autonomen Agenten, Enterprise-Adoption, Infrastruktur | 1 |
|
||||||
|
| [Agent Budget Breaker](concepts/agents/agent-budget-breaker.md) | Guardrails gegen Runaway-Agent-Spending aus dem OpenClaw Cast (25.08.): Gateway-Enforcement statt Prompt-Regeln, Atomic Reservation (Preauth-Ledger), Lineage-Tracking + Cascading Termination, Trip-Wires (inkl. fehlender Preis-Metadaten als Trigger), Shutdown-Sequenz mit redacted Receipt, SAFE-Drill ($5-Sandbox; „Logging ≠ Enforcing“). ⚠️ Basis: Podcast-Transcript-Auswertung von @HermanButlerBot, keine Wortlaut-/Primärquelle | podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md |
|
||||||
| [Cairn — Autonomer Agent als Geschäft](concepts/agents/cairn-autonomous-agent-business.md) | Claude-Fable-5-Agent (via Claude Code) baut mit ~90 $ SOL ein echtes Business: Squads-v4-2-of-2-Multisig-Custody (Human-Co-Signer „Nick“), Datei-Gedächtnis ohne DB, zwei Bücher (13-Fehlermodi-Taxonomie) + Services 2–500 $ (x402-Conformance, Audits), kein Token, on-chain verifizierbar. ⚠️ Self-reported Record | other/2026-08-26_pit-cairn-autonomous-agent-business.md |
|
| [Cairn — Autonomer Agent als Geschäft](concepts/agents/cairn-autonomous-agent-business.md) | Claude-Fable-5-Agent (via Claude Code) baut mit ~90 $ SOL ein echtes Business: Squads-v4-2-of-2-Multisig-Custody (Human-Co-Signer „Nick“), Datei-Gedächtnis ohne DB, zwei Bücher (13-Fehlermodi-Taxonomie) + Services 2–500 $ (x402-Conformance, Audits), kein Token, on-chain verifizierbar. ⚠️ Self-reported Record | other/2026-08-26_pit-cairn-autonomous-agent-business.md |
|
||||||
| [Meta "Hatch" — Consumer-AI-Agent-Plattform](concepts/agents/meta-hatch-ai-agent-platform.md) | Metas geplante Consumer-KI-Agent-Plattform (The Information): Consumer-Version von Metas internem OpenClaw-Agenten; trainiert für DoorDash/Etsy/Reddit/Yelp/Outlook; Premium bis $199,99/Monat; WhatsApp-Integration; „Watermelon"-Modell (Oktober); Distribution über Instagram/FB/WhatsApp/Messenger als Trumpf | other/2026-08-25_meta-hatch-ai-agent-platform.md |
|
| [Meta "Hatch" — Consumer-AI-Agent-Plattform](concepts/agents/meta-hatch-ai-agent-platform.md) | Metas geplante Consumer-KI-Agent-Plattform (The Information): Consumer-Version von Metas internem OpenClaw-Agenten; trainiert für DoorDash/Etsy/Reddit/Yelp/Outlook; Premium bis $199,99/Monat; WhatsApp-Integration; „Watermelon"-Modell (Oktober); Distribution über Instagram/FB/WhatsApp/Messenger als Trumpf | other/2026-08-25_meta-hatch-ai-agent-platform.md |
|
||||||
| [Harness / Loop / Graph Engineering](concepts/agents/harness-loop-graph-engineering.md) | Drei-Ebenen-Modell: Harness (Environment), Loop (Feedback), Graph (Flow). beamnxw-Artikel + deutschsprachige Video-Erklärung (Sascha Hoffmann), eingeordnet in Architektur-Triade. Bermuda-Dreieck = Harness. | other/2026-07-26_bernd-agent-harness-loop-graph-engineering.md + youtube/2026-08-20_ascha-hoffmann-harness-loop-graph-engineering.md |
|
| [Harness / Loop / Graph Engineering](concepts/agents/harness-loop-graph-engineering.md) | Drei-Ebenen-Modell: Harness (Environment), Loop (Feedback), Graph (Flow). beamnxw-Artikel + deutschsprachige Video-Erklärung (Sascha Hoffmann), eingeordnet in Architektur-Triade. Bermuda-Dreieck = Harness. | other/2026-07-26_bernd-agent-harness-loop-graph-engineering.md + youtube/2026-08-20_ascha-hoffmann-harness-loop-graph-engineering.md |
|
||||||
|
|
@ -322,7 +324,7 @@
|
||||||
| Seite | Beschreibung | Quellen |
|
| Seite | Beschreibung | Quellen |
|
||||||
|-------|-------------|---------|
|
|-------|-------------|---------|
|
||||||
| [AgentStack Daily](institutions/agentstack-daily.md) | KI-generierter englischer Daily-Podcast (zwei TTS-Hosts NOVA/ALLOY, NotebookLM-artig): tägliche Agent-Stack-Release-Readouts. Segmente: Release Readout (Codex), Model Discovery Check (OpenRouter, verified same-cycle), GitHub Project Radar, Local LLM Spotlight, Release Coverage Check (OpenClaw/Hermes/Codex/Claude Code/Antigravity), Extra Research Candidates. Distribution via GitHub Releases (clawdassistant85-netizen/openclaw-podcast-media-en + openclaw-podcast-audio, op3.dev-Proxy), Show Notes auf tobyonfitnesstech.com. Sekundärer Aggregator — Wiki verlinkt immer die Primärquellen | podcast/2026-08-26_agentstack-daily-ep106.md |
|
| [AgentStack Daily](institutions/agentstack-daily.md) | KI-generierter englischer Daily-Podcast (zwei TTS-Hosts NOVA/ALLOY, NotebookLM-artig): tägliche Agent-Stack-Release-Readouts. Segmente: Release Readout (Codex), Model Discovery Check (OpenRouter, verified same-cycle), GitHub Project Radar, Local LLM Spotlight, Release Coverage Check (OpenClaw/Hermes/Codex/Claude Code/Antigravity), Extra Research Candidates. Distribution via GitHub Releases (clawdassistant85-netizen/openclaw-podcast-media-en + openclaw-podcast-audio, op3.dev-Proxy), Show Notes auf tobyonfitnesstech.com. Sekundärer Aggregator — Wiki verlinkt immer die Primärquellen | podcast/2026-08-26_agentstack-daily-ep106.md |
|
||||||
| [OpenClaw Cast](institutions/openclaw-cast.md) | KI-generierter englischer Weekly-Podcast von "AI World" (zwei fiktive TTS-Hosts Cleo/Dev, anchor.fm-RSS): übersetzt je eine Community-/Release-Warnung in ein konkretes lokales OpenClaw-Guardrail-Rezept („Skill of the Week"). 23 Episoden im Feed (Feb–Aug 2026): Runaway-Budget-Kill-Switch (25.08.), Multi-Agent-Turf-Wars→Task Lease Guard, Release-Sentinel-Canary, Cron-Cadence-Guard, Boot-Token-Cut −43 %, MCP-Unlock „800 Tools". Community-nahe Sekundärquelle — Einzelfakten nur nach Primärquellen-Check übernehmen | podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md |
|
| [OpenClaw Cast](institutions/openclaw-cast.md) | KI-generierter englischer Weekly-Podcast von "AI World" (zwei fiktive TTS-Hosts Cleo/Dev, anchor.fm-RSS): übersetzt je eine Community-/Release-Warnung in ein konkretes lokales OpenClaw-Guardrail-Rezept („Skill of the Week"). 23 Episoden im Feed (Feb–Aug 2026): Runaway-Budget-Kill-Switch (25.08.), Multi-Agent-Turf-Wars→Task Lease Guard, Release-Sentinel-Canary, Cron-Cadence-Guard, Boot-Token-Cut −43 %, MCP-Unlock „800 Tools". Community-nahe Sekundärquelle — Einzelfakten nur nach Primärquellen-Check übernehmen. Die Runaway-Folge (25.08.) ist seit dem 151. Update vollständig inhaltlich erfasst → [Agent Budget Breaker](concepts/agents/agent-budget-breaker.md) | podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md, podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md |
|
||||||
| [Plaier](institutions/plaier.md) | KI-Unternehmen im internationalen Fußball (Spieler-/Kaderanalyse, CEO Jan Wendt). Zwei Scores (N18 Nominal, Effective). These: Kaderqualität = 90% der sportlichen Leistung. WM-2026-Analyse Deutschland: Nagelsmann ließ „viel Qualität zu Hause", Kimmich/Wirtz falsch positioniert. Referenzkunde VfL Osnabrück | blog/2026-08-16_plaier-ki-wm-analyse-deutschland.md |
|
| [Plaier](institutions/plaier.md) | KI-Unternehmen im internationalen Fußball (Spieler-/Kaderanalyse, CEO Jan Wendt). Zwei Scores (N18 Nominal, Effective). These: Kaderqualität = 90% der sportlichen Leistung. WM-2026-Analyse Deutschland: Nagelsmann ließ „viel Qualität zu Hause", Kimmich/Wirtz falsch positioniert. Referenzkunde VfL Osnabrück | blog/2026-08-16_plaier-ki-wm-analyse-deutschland.md |
|
||||||
| [Higgsfield AI](institutions/higgsfield-ai.md) | KI-Unternehmen für Text-zu-Video / KI-Video-Generierung. YouTube-Kanal @HiggsfieldAI, "Higgsfield Origins"-Reihe mit komplett KI-generierten Kurzfilmen. "Oneiric" (2026) — komplett KI-generierter Sci-Fi-Kurzfilm als Beleg für Production-Shift (Hollywood-Disruption) | youtube/2026-08-19_oneiric-higgsfield-ai-sci-fi-short.md |
|
| [Higgsfield AI](institutions/higgsfield-ai.md) | KI-Unternehmen für Text-zu-Video / KI-Video-Generierung. YouTube-Kanal @HiggsfieldAI, "Higgsfield Origins"-Reihe mit komplett KI-generierten Kurzfilmen. "Oneiric" (2026) — komplett KI-generierter Sci-Fi-Kurzfilm als Beleg für Production-Shift (Hollywood-Disruption) | youtube/2026-08-19_oneiric-higgsfield-ai-sci-fi-short.md |
|
||||||
| [OpenAI](institutions/openai.md) | AI-Forschungs- und Produkt-Unternehmen (GPT-Serie, Frontier Scaling). **Staatsbeteiligung (Juli 2026):** Altman bietet Trump 5% Anteile an (Alaska Permanent Fund Modell). Intel-Präzedenz (9,9%, $8.9 Mrd). Strategisch: Exportkontrollen vermeiden, Bailout-Absicherung, IPO-Vorbereitung. Kontrast zu Anthropic | blog/2026-06-16_aschenbrenner-situational-awareness.md + blog/2026-07-02_berliner-zeitung-openai-staatsbeteiligung.md |
|
| [OpenAI](institutions/openai.md) | AI-Forschungs- und Produkt-Unternehmen (GPT-Serie, Frontier Scaling). **Staatsbeteiligung (Juli 2026):** Altman bietet Trump 5% Anteile an (Alaska Permanent Fund Modell). Intel-Präzedenz (9,9%, $8.9 Mrd). Strategisch: Exportkontrollen vermeiden, Bailout-Absicherung, IPO-Vorbereitung. Kontrast zu Anthropic | blog/2026-06-16_aschenbrenner-situational-awareness.md + blog/2026-07-02_berliner-zeitung-openai-staatsbeteiligung.md |
|
||||||
|
|
@ -515,5 +517,6 @@
|
||||||
| `raw/other/2026-08-26_perplexity-portable-computer-local-agent.md` | other | Perplexity-Page "Perplexity launches local AI agent that keeps data off the cloud" (Launch 2026-08-25, abgerufen 2026-08-26 via Firecrawl; direkter Abruf blockiert mit HTTP 403): "Portable Computer" als vollständig lokale Version der agentic-AI-Plattform in Partnerschaft mit NVIDIA — Orchestrator + Subagent-Modelle + Harness komplett on-device, Cloud-Eskalation nur nach User-Freigabe, lokale Workflows ohne Token-Limit, erste Verfügbarkeit auf DGX Spark/Linux RTX ≥24 GB VRAM, Windows im September. Primärquellen verlinkt (X-Ankündigung, Threads, NVIDIA Blog, DGX-Spark-Produktseite) |
|
| `raw/other/2026-08-26_perplexity-portable-computer-local-agent.md` | other | Perplexity-Page "Perplexity launches local AI agent that keeps data off the cloud" (Launch 2026-08-25, abgerufen 2026-08-26 via Firecrawl; direkter Abruf blockiert mit HTTP 403): "Portable Computer" als vollständig lokale Version der agentic-AI-Plattform in Partnerschaft mit NVIDIA — Orchestrator + Subagent-Modelle + Harness komplett on-device, Cloud-Eskalation nur nach User-Freigabe, lokale Workflows ohne Token-Limit, erste Verfügbarkeit auf DGX Spark/Linux RTX ≥24 GB VRAM, Windows im September. Primärquellen verlinkt (X-Ankündigung, Threads, NVIDIA Blog, DGX-Spark-Produktseite) |
|
||||||
| `raw/blog/2026-08-26_perplexity-local-first-agent-blog.md` | blog | Perplexity Tech-Blogpost "A local-first agent for private and cost-effective knowledge work" (2026-08-25, via Firecrawl): Kernthese "Small models fail in harnesses built for frontier models", deterministischer Orchestrator (kein LLM), 4 Harness-Prinzipien (Skills on-demand bei ~100K-Degradation, CLI-Connectors statt MCP, Self-Verification, Always-on-Sandbox), Advisor-Eskalations-Mechanik (PII-Flag, User-Approval, Text-Guidance only), Benchmarks: 82,6 % Eigenbench / 66,7 % BrowseComp / 65,1 % ParseBench / 59,6→73 % TerminalBench mit Opus-Advisor |
|
| `raw/blog/2026-08-26_perplexity-local-first-agent-blog.md` | blog | Perplexity Tech-Blogpost "A local-first agent for private and cost-effective knowledge work" (2026-08-25, via Firecrawl): Kernthese "Small models fail in harnesses built for frontier models", deterministischer Orchestrator (kein LLM), 4 Harness-Prinzipien (Skills on-demand bei ~100K-Degradation, CLI-Connectors statt MCP, Self-Verification, Always-on-Sandbox), Advisor-Eskalations-Mechanik (PII-Flag, User-Approval, Text-Guidance only), Benchmarks: 82,6 % Eigenbench / 66,7 % BrowseComp / 65,1 % ParseBench / 59,6→73 % TerminalBench mit Opus-Advisor |
|
||||||
| `raw/podcast/2026-08-26_agentstack-daily-ep106.md` | podcast | AgentStack Daily EP106 (21.08.2026, ~23 Min, TTS-Hosts NOVA/ALLOY): Stories 18.–21.08. — Codex rust-v0.149.0 (agents-Dashboard/queue/doctor), Ox Alpha Stealth-Listing (1.048.576 Kontext / 4.096 Max-Output), Tencent Hy-MT2-1.8B (33+5 Paare), Stampli Case Study (68 % unter Schätzung), Ramp Router, Memory-Bottleneck bis 2027+ (Counterpoint/CXL), Cerebras CS-4 (750 PFLOPS/WSE-3), OpenAI Frontier-Pacing + „AI Futures"-Blog, LiquidAI LFM2.5-DSpark (Claim 3,2×), IBM evolve-hmm/Agent-Memory, Cryptographic Context Injection (Grok-Exfil), Piano-Autocomplete 125M + Superwhisper S1-mini, GitHub Radar (nanobot 47.251★, codebase-memory-mcp 39.755★, FastMCP 27.320★), Qwen3.8-27B HF-Trending (11.836 Likes, >1,7 Mio Downloads) |
|
| `raw/podcast/2026-08-26_agentstack-daily-ep106.md` | podcast | AgentStack Daily EP106 (21.08.2026, ~23 Min, TTS-Hosts NOVA/ALLOY): Stories 18.–21.08. — Codex rust-v0.149.0 (agents-Dashboard/queue/doctor), Ox Alpha Stealth-Listing (1.048.576 Kontext / 4.096 Max-Output), Tencent Hy-MT2-1.8B (33+5 Paare), Stampli Case Study (68 % unter Schätzung), Ramp Router, Memory-Bottleneck bis 2027+ (Counterpoint/CXL), Cerebras CS-4 (750 PFLOPS/WSE-3), OpenAI Frontier-Pacing + „AI Futures"-Blog, LiquidAI LFM2.5-DSpark (Claim 3,2×), IBM evolve-hmm/Agent-Memory, Cryptographic Context Injection (Grok-Exfil), Piano-Autocomplete 125M + Superwhisper S1-mini, GitHub Radar (nanobot 47.251★, codebase-memory-mcp 39.755★, FastMCP 27.320★), Qwen3.8-27B HF-Trending (11.836 Likes, >1,7 Mio Downloads) |
|
||||||
| `raw/podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md` | podcast | OpenClaw Cast (AI World): "One Runaway AI Agent Can Spend Past Your Budget" (25.08.2026, 20:15 Min, TTS-Hosts Cleo/Dev, via anchor.fm-RSS; gepostet von @NetLightning #12759). 107-Unternehmens-Survey: jeder Fünfte kann Runaway-Agent-Spending nicht real-time stoppen → lokaler "Agent Budget Breaker" (Per-Job-Caps, Kill Switch, 5-Dollar-Drill). ⚠️ Metadata-only, kein Transcript verfügbar; Serie: 23 Episoden Feb–Aug 2026 |
|
| `raw/podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md` | podcast | OpenClaw Cast (AI World): "One Runaway AI Agent Can Spend Past Your Budget" (25.08.2026, 20:15 Min, TTS-Hosts Cleo/Dev, via anchor.fm-RSS; gepostet von @NetLightning #12759). 107-Unternehmens-Survey: jeder Fünfte kann Runaway-Agent-Spending nicht real-time stoppen → lokaler "Agent Budget Breaker" (Per-Job-Caps, Kill Switch, 5-Dollar-Drill). Metadata-only-Ersteintrag; Inhalt inzwischen vollständig erfasst via Transcript-Auswertung (eigene Zeile unten); Serie: 23 Episoden Feb–Aug 2026 |
|
||||||
|
| `raw/podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md` | podcast | OpenClaw Cast "One Runaway AI Agent Can Spend Past Your Budget" (25.08.) — Transcript-Zusammenfassung von @HermanButlerBot (Topic 13, #12771/#12783): VentureBeat-Pulse-Survey n=107 (20 % kein Real-Time-Stopp, 21 % nur reaktives Log-Monitoring), Gateway- statt Prompt-Enforcement, Atomic Reservation (Preauth-Ledger), Lineage-Tracking + Cascading Termination, Trip-Wires (High Spend, Retry-Sturm, Fan-out > Concurrency, Wall-Time, fehlende Preis-Metadaten als Trigger), Shutdown-Sequenz mit redacted Receipt, SAFE-Drill ($5-Sandbox, 5 Szenarien, "Logging ≠ Enforcing") |
|
||||||
| `raw/other/2026-08-26_qwen38-flash-next-qwen4-preview.md` | other | Perplexity-Page (via Firecrawl; geteilt von Pit @PWeber #12773): Alibaba kündigt Qwen 3.8-Flash-Next an — multimodales 125B-MoE (~6B aktiv/Token, +51B N-Gramm-Embeddings) als explizite Vorschau der Qwen-4-Architektur; laut NVIDIA-Forums-Post Qwen-3.7-Plus-Niveau bei ~1/9 Trainingskosten, Stärke Coding; keine Benchmarks, unverifizierte Zahlen. Kontext: 10,2 Mrd USD Aktienplatzierung für KI-Infrastruktur (Reuters/CNBC/FT) |
|
| `raw/other/2026-08-26_qwen38-flash-next-qwen4-preview.md` | other | Perplexity-Page (via Firecrawl; geteilt von Pit @PWeber #12773): Alibaba kündigt Qwen 3.8-Flash-Next an — multimodales 125B-MoE (~6B aktiv/Token, +51B N-Gramm-Embeddings) als explizite Vorschau der Qwen-4-Architektur; laut NVIDIA-Forums-Post Qwen-3.7-Plus-Niveau bei ~1/9 Trainingskosten, Stärke Coding; keine Benchmarks, unverifizierte Zahlen. Kontext: 10,2 Mrd USD Aktienplatzierung für KI-Infrastruktur (Reuters/CNBC/FT) |
|
||||||
|
|
|
||||||
|
|
@ -3,6 +3,7 @@ created: 2026-08-26
|
||||||
updated: 2026-08-26
|
updated: 2026-08-26
|
||||||
sources:
|
sources:
|
||||||
- podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md
|
- podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md
|
||||||
|
- podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md
|
||||||
tags: [institution, podcast, openclaw, medien, ki-generiert, tts]
|
tags: [institution, podcast, openclaw, medien, ki-generiert, tts]
|
||||||
---
|
---
|
||||||
|
|
||||||
|
|
@ -41,7 +42,13 @@ OpenClaw Cast übersetzt jeweils eine aktuelle Warnung oder Community-Begebenhei
|
||||||
| 16.05.2026 | Cut OpenClaw Boot Tokens by 43 Percent | Boot-Token-Reduktion durch Aufräumen von Tool-/Memory-Files |
|
| 16.05.2026 | Cut OpenClaw Boot Tokens by 43 Percent | Boot-Token-Reduktion durch Aufräumen von Tool-/Memory-Files |
|
||||||
| 05.05.2026 | The Release That Broke Everything | CPU-100%-Release-Desaster + 200k-MCP-Server-Sicherheitsdebatte |
|
| 05.05.2026 | The Release That Broke Everything | CPU-100%-Release-Desaster + 200k-MCP-Server-Sicherheitsdebatte |
|
||||||
|
|
||||||
Ältere Folgen (Feb–Apr 2026): Token-Bonfire-Cron-Pattern, Secrets-Vault/SOUL.md-Templates, Overnight-Subconscious-Agent ($2–3/Monat), Stock-Trading-Bot-Debakel, MCP-Unlock „800 Tools", GLM4.7-Local-Setup, Community-Horror-Stories (Agent schrieb dem Ex), Stable-Release-Ankündigung vs. Hermes-Exodus.
|
Ältere Folgen (Feb–Apr 2026): Token-Bonfire-Cron-Pattern, Secrets-Vault/SOUL.md-Templates, Overnight-Subconscious-Agent ($2–3/Monat), Stock-Trading-Bot-Debakel, MCP-Unlock „800 Tools“, GLM4.7-Local-Setup, Community-Horror-Stories (Agent schrieb dem Ex), Stable-Release-Ankündigung vs. Hermes-Exodus.
|
||||||
|
|
||||||
|
## Episode im Detail: „One Runaway AI Agent Can Spend Past Your Budget“ (25.08.)
|
||||||
|
|
||||||
|
Seit dem 26.08.2026 inhaltlich vollständig erfasst über die Transcript-Auswertung von @HermanButlerBot im OME-Topic 13 — der Metadata-only-Vorbehalt gilt für diese Folge nicht mehr. Kern der Folge: VentureBeat-Pulse-Survey (n=107; 20 % kein Real-Time-Stopp, 21 % nur reaktives Log-Monitoring), Enforcement am Gateway statt im Prompt, Atomic Reservation (Preauth-Ledger vor jedem Call), Lineage-Tracking + Cascading Termination, Trip-Wires inkl. fehlender Preis-Metadaten als Trigger, Shutdown-Sequenz mit redacted Receipt und bounded Re-Autorisierung, SAFE-Drill ($5-Sandbox, fünf Szenarien, „Logging ≠ Enforcing“).
|
||||||
|
|
||||||
|
Ausgearbeitet als eigene Konzeptseite: [[../concepts/agents/agent-budget-breaker.md]] — Raw-Auswertung: [[../../raw/podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md]].
|
||||||
|
|
||||||
## Einordnung
|
## Einordnung
|
||||||
|
|
||||||
|
|
|
||||||
|
|
@ -2627,3 +2627,10 @@ Bestehende `post-transformer-llm-architectures.md` bleibt als Vier-Säulen-Über
|
||||||
**Inhalt/Änderungen:** Benchmark-Tabelle vervollständigt — PPLX 27B 85,4 % auf dem Eigenbench; BrowseComp 66,7 % vs Pi 50,2/Hermes 43,9 (zugleich −51 % Wall-Time, −70 % Tokens vs Pi); ParseBench-100 65,1 % vs Hermes 34,6/Pi 13,9; Terminal Bench 2.1: lokal 59,6 % (~$0) / mit Advisor 73,0 % (~$0,42/Rollout) / Claude Opus 5 pur 82,4 % (~$0,65/Rollout). Neue Caveats: BrowseComp-Vorteil teils eigene Suchinfrastruktur vs Brave; Hybrid-Rechnung als informativster Datenpunkt. Hardware-Zeilen ergänzt: Qwen 3.8 27B ausgeliefert als 3-Bit/17,4 GB (32 GB RAM nötig), Nemotron 3.5 Lightning offen als 30B-MoE 4-Bit/19 GB (36 GB RAM), macOS nicht auf Roadmap, nur eine DGX Spark pro Launch-Setup, apt-Repo-Installation. Bring-your-own-Model/Server aufgenommen; MarkTechPost + Tech-Blog in den Quellen.
|
**Inhalt/Änderungen:** Benchmark-Tabelle vervollständigt — PPLX 27B 85,4 % auf dem Eigenbench; BrowseComp 66,7 % vs Pi 50,2/Hermes 43,9 (zugleich −51 % Wall-Time, −70 % Tokens vs Pi); ParseBench-100 65,1 % vs Hermes 34,6/Pi 13,9; Terminal Bench 2.1: lokal 59,6 % (~$0) / mit Advisor 73,0 % (~$0,42/Rollout) / Claude Opus 5 pur 82,4 % (~$0,65/Rollout). Neue Caveats: BrowseComp-Vorteil teils eigene Suchinfrastruktur vs Brave; Hybrid-Rechnung als informativster Datenpunkt. Hardware-Zeilen ergänzt: Qwen 3.8 27B ausgeliefert als 3-Bit/17,4 GB (32 GB RAM nötig), Nemotron 3.5 Lightning offen als 30B-MoE 4-Bit/19 GB (36 GB RAM), macOS nicht auf Roadmap, nur eine DGX Spark pro Launch-Setup, apt-Repo-Installation. Bring-your-own-Model/Server aufgenommen; MarkTechPost + Tech-Blog in den Quellen.
|
||||||
**Quellen:**
|
**Quellen:**
|
||||||
- https://www.marktechpost.com/2026/08/25/perplexity-ships-portable-computer-on-nvidia-dgx-spark-local-harness-os-enforced-sandbox-and-zero-per-token-cost-for-local-steps/
|
- https://www.marktechpost.com/2026/08/25/perplexity-ships-portable-computer-on-nvidia-dgx-spark-local-harness-os-enforced-sandbox-and-zero-per-token-cost-for-local-steps/
|
||||||
|
|
||||||
|
## 2026-08-26 — OpenClaw Cast „Budget Breaker": voller Ingest nach Transcript-Auswertung
|
||||||
|
|
||||||
|
**Type:** ingest (podcast) | **Scope:** raw/podcast/…-budget-breaker-transcript.md (neu), wiki/concepts/agents/agent-budget-breaker.md (neu), wiki/institutions/openclaw-cast.md (Detailsektion)
|
||||||
|
**Anlass:** Zusage aus OME #12772 („sobald ein Transcript steht, kommt der volle Ingest"). @HermanButlerBot lieferte die zweiteilige Transcript-Auswertung ins Topic (#12771/#12782 + #12783).
|
||||||
|
**Inhalt:** VentureBeat-Pulse-Survey n=107 (20 % kein Real-Time-Stopp, 21 % nur reaktives Log-Monitoring); Gateway- statt Prompt-Enforcement („Rasen-Schild vs Betonmauer"); Atomic Reservation als Preauth-Ledger mit Reconciliation; Lineage-Tracking (Subagenten ziehen vom Parent-Job-Budget) + Cascading Termination; Trip-Wires: High Spend, Retry-Sturm, Fan-out > Concurrency, Wall-Time, fehlende Preis-Metadaten = Breaker tript; Shutdown-Sequenz: Permissions entziehen → Queue canceln → cascading kill → redacted Receipt → bounded Re-Autorisierung; SAFE-Drill: $5-Sandbox, fünf Szenarien, goldene Regel „Logging ≠ Enforcing"; Abschlusskante: mechanische Limits suffocieren Autonomie nicht, solange sie pro Job granular sind.
|
||||||
|
**Caveat:** Kein Wortlaut-Transcript, sondern Zusammenfassung durch Hermans Pipeline (@HermanButlerBot); Einzelfakten in Raw und Wiki entsprechend als Sekundärquelle markiert. Die ursprüngliche Metadata-Raw bleibt unverändert (Kardinalregel).
|
||||||
|
|
|
||||||
Loading…
Add table
Reference in a new issue