ingest(podcast): ai-coding infrastructure resilience
This commit is contained in:
parent
4f61c8950e
commit
04d354e7cb
4 changed files with 85 additions and 0 deletions
|
|
@ -0,0 +1,25 @@
|
||||||
|
---
|
||||||
|
type: podcast
|
||||||
|
source_url: "https://anchor.fm/s/10f77d9e4/podcast/play/125239589/https%3A%2F%2Fd3ctxlq1ktw2nl.cloudfront.net%2Fstaging%2F2026-8-5%2F72eaebc8-b683-ccc5-2117-8f7321cf30f5.m4a"
|
||||||
|
retrieved: 2026-09-06
|
||||||
|
title: "AI-Coding-Infrastrukturkrise: Ausfälle, Tokenkosten und 30-Minuten-Outage-Drill"
|
||||||
|
channel: "Nicht verifiziert; Audio via Anchor/CloudFront"
|
||||||
|
transcript_basis: "Lokale STT-Transkription via grok-stt.sh; englisches TTS-/Podcast-Audio, keine redaktionelle Wortlautprüfung"
|
||||||
|
tags: [ai-coding, outages, token-costs, vendor-lock-in, resilience, guardrails]
|
||||||
|
---
|
||||||
|
|
||||||
|
# AI-Coding-Infrastrukturkrise: Ausfälle, Tokenkosten und 30-Minuten-Outage-Drill
|
||||||
|
|
||||||
|
> ⚠️ Das Audio wurde lokal per Speech-to-Text transkribiert. Titel, Podcast-Feed und redaktionelle Herkunft konnten aus der Audio-URL nicht zuverlässig bestimmt werden. Die folgenden Punkte sind eine neutrale Zusammenfassung des Audios; darin genannte Zahlen, Produktnamen und Ereignisse sind Podcast-Angaben und nicht automatisch unabhängig verifiziert.
|
||||||
|
|
||||||
|
## Inhalt laut Transkript
|
||||||
|
|
||||||
|
- Das Audio behandelt die Woche vom 29. August bis 4. September 2026 als Beispiel für die Fragilität cloudbasierter Coding-Tools.
|
||||||
|
- Es berichtet über einen abrupt beendeten OpenAI-/Cursor-Zugang am 29. August und beschreibt die daraus entstandene Community-Panik. Vermutungen über SpaceX sowie einen Musk-/Altman-Konflikt werden im Audio ausdrücklich als unbestätigte Gerüchte markiert.
|
||||||
|
- Für den 3. September wird ein nahezu gleichzeitiger Ausfall mehrerer großer KI-Dienste behauptet. Das Audio stellt die genaue Gemini-Beteiligung als widersprüchlich berichtete Einzelheit dar und leitet daraus eine Abhängigkeit von gemeinsamer Cloud-/Netzwerkinfrastruktur ab.
|
||||||
|
- Cursor-Auto-Mode und dynamisches Routing werden als Kostenrisiko beschrieben: Laut Audio schwanken die genannten Modellpreise stark, während ein Modell bei Änderungen an großen Dateien deutlich mehr Output erzeugen kann als ein gezielter Diff.
|
||||||
|
- Das Audio nennt für Anthropic-Modelle „Fable 5.1“ und „Mythos 5.1“, Benchmark-, Preis- und Output-Claims sowie einen statistischen Text-Wasserabdruck. Diese Produktnamen und Zahlen sind aus dem Audio nicht extern verifiziert und werden hier nicht als Fakten übernommen.
|
||||||
|
- Als Enterprise-Gegenmodell wird eine im Audio „Flux“ genannte DoorDash-Plattform beschrieben: Firecracker-Micro-VMs, ein MCP-Gateway, eng begrenzte Zugriffe, zentrale Audits und versionierte Prompts/Task-Rezepte im eigenen Repository.
|
||||||
|
- Microsoft/Azure DevOps wird als kontrastierender Ansatz beschrieben: nutzungsbasierte Abrechnung, Verzögerung in der Kostenanzeige, Concurrency-Caps und Budgets, die laut Audio nur benachrichtigen statt hart zu stoppen.
|
||||||
|
- Als konkrete Empfehlung formuliert das Audio einen „30-Minuten-Outage-Drill“: eine echte Aufgabe wählen, einen zweiten Cloud-Provider Ende-zu-Ende testen, ein lokales Modell auf der eigenen Hardware testen, einen kurzen Wechsel-Runbook schreiben und explizit festhalten, welche Aufgaben das lokale Modell nicht zuverlässig bewältigt.
|
||||||
|
- Die Schlussbetrachtung warnt vor einer möglichen Rückkopplung aus KI-generiertem, wassermarkiertem und von KI geprüftem Code sowie vor Token-Bloat und notification-only Budgets. Das ist eine Szenario- und keine Prognosebehauptung.
|
||||||
46
wiki/concepts/agents/ai-coding-infrastructure-resilience.md
Normal file
46
wiki/concepts/agents/ai-coding-infrastructure-resilience.md
Normal file
|
|
@ -0,0 +1,46 @@
|
||||||
|
---
|
||||||
|
created: 2026-09-06
|
||||||
|
updated: 2026-09-06
|
||||||
|
sources: [podcast/2026-09-06_ai-coding-infrastructure-crisis-outage-drill.md]
|
||||||
|
tags: [agents, ai-coding, resilience, outages, token-costs, vendor-lock-in]
|
||||||
|
---
|
||||||
|
|
||||||
|
# Resilienz für AI-Coding-Infrastruktur
|
||||||
|
|
||||||
|
Ein Audio-Briefing zur Woche vom 29.08.–04.09.2026 bündelt drei Risiken beim Einsatz cloudbasierter Coding-Agenten: **Verfügbarkeitsabhängigkeit**, **unkontrollierte tokenbasierte Kosten** und **verlernte manuelle Fallbacks**. Die konkrete Quelle ist nicht redaktionell identifiziert; Zahlen und Produktclaims bleiben daher Podcast-Angaben. Die Architekturlektionen sind davon getrennt belastbar.
|
||||||
|
|
||||||
|
## Drei Ausfallklassen
|
||||||
|
|
||||||
|
| Risiko | Mechanik | Gegenmaßnahme |
|
||||||
|
|---|---|---|
|
||||||
|
| Vendor-/Cloud-Ausfall | Ein Zugang oder eine gemeinsame Netzwerk-/Compute-Schicht fällt aus; mehrere Workflows stehen gleichzeitig | Zweiter Provider, lokales Modell und getestetes Umschalt-Runbook |
|
||||||
|
| Kosten-Bloat | Dynamisches Routing und große Volltext-Rewrites erzeugen deutlich mehr Input-/Output-Tokens als der sichtbare Änderungsumfang erwarten lässt | Routing und Budget am Gateway begrenzen; Diffs/Region-Patches verlangen; tatsächliche Kosten messen |
|
||||||
|
| Kompetenz-Erosion | Entwickler verlassen sich so stark auf Copiloten, dass sie bei Ausfall keine realistische manuelle oder lokale Ersatzroute mehr kennen | Regelmäßiger Outage-Drill mit einer echten Aufgabe und klarer Negativliste |
|
||||||
|
|
||||||
|
## 30-Minuten-Outage-Drill
|
||||||
|
|
||||||
|
Das Briefing schlägt einen kurzen, praktischen Test vor:
|
||||||
|
|
||||||
|
1. Eine komplexe, realistische Aufgabe auswählen, die bei einem Ausfall weiterbearbeitet werden müsste.
|
||||||
|
2. Einen zweiten Cloud-Provider Ende-zu-Ende konfigurieren und tatsächlich ausführen — inklusive Authentifizierung, Routing und Abrechnung.
|
||||||
|
3. Ein lokales Modell auf der eigenen Hardware testen und die ehrliche Leistungsgrenze dokumentieren.
|
||||||
|
4. Ein Zwei-Zeilen-Runbook lokal speichern: **Tool/Modell für den Wechsel** und **Aufgaben, die mit dem Fallback nicht verantwortbar sind**.
|
||||||
|
5. Die Umschaltung stoppen und messen. Im Ernstfall darf nicht erst Dokumentation gelesen oder ein Billing-Problem gelöst werden.
|
||||||
|
|
||||||
|
Der wichtigste Teil ist die Negativliste: Ein schwächeres lokales Modell ist kein vollwertiger Ersatz für komplexe Refactorings, nur weil es einfache Edits und Testgerüste beherrscht.
|
||||||
|
|
||||||
|
## Architekturlektionen
|
||||||
|
|
||||||
|
- **Harness statt Vendor-Dashboard:** Task-Rezepte, Systemprompts und Integrationslogik sollten als versionierte Dateien im eigenen Repository liegen. Dann kann das Modell oder der Provider ausgetauscht werden, ohne die Geschäftslogik neu zu bauen.
|
||||||
|
- **Isolation:** Für autonome Enterprise-Aufgaben kombinieren sich Micro-VMs, eng begrenzte Tool-/API-Rechte, ein MCP-Gateway und zentrale Audits zu einer kontrollierbaren Ausführungsgrenze.
|
||||||
|
- **Logging ist kein Enforcement:** Ein Budget, das nur eine Benachrichtigung auslöst, stoppt keinen Runaway-Loop. Harte Caps, Reservations, Concurrency-Limits und ein echter Kill Switch müssen vor oder während der Ausführung greifen. Siehe [[agent-budget-breaker.md]].
|
||||||
|
- **Gezielte Patches statt Volltext-Rewrites:** Bei großen Dateien ist der sichtbare Änderungsumfang kein verlässlicher Proxy für die Tokenkosten. Region-Patches und Diffs begrenzen Kosten und Review-Fläche.
|
||||||
|
- **Abhängigkeit sichtbar machen:** Uptime einzelner Anbieter reicht nicht als Resilienzmaß. Entscheidend ist, welche Provider, Hyperscaler, Routing-Layer und Identitäts-/Billing-Systeme ein Workflow gemeinsam nutzt.
|
||||||
|
|
||||||
|
## Einordnung
|
||||||
|
|
||||||
|
Die Quellenlage trennt sich sauber: Das Audio liefert Beispiele, Zahlen und Produktbehauptungen, die hier nicht als unabhängig bestätigte Fakten gelten. Der **30-Minuten-Drill**, der versionierte Harness und die harte Ausführungsgrenze sind dagegen allgemeine Architekturmaßnahmen, die unabhängig von den genannten Anbietern sinnvoll bleiben. Für unüberwachte Jobs ist die Budget-Seite mit dem [[agent-budget-breaker.md]] besonders relevant; für Updates ergänzt der Drill das Canary-Muster der [[../../institutions/openclaw-cast.md]].
|
||||||
|
|
||||||
|
## Quelle
|
||||||
|
|
||||||
|
- Audio und STT-Zusammenfassung: [[../../../raw/podcast/2026-09-06_ai-coding-infrastructure-crisis-outage-drill.md]]
|
||||||
|
|
@ -2,6 +2,7 @@
|
||||||
|
|
||||||
*Auto-generated: 2026-07-07*
|
*Auto-generated: 2026-07-07*
|
||||||
|
|
||||||
|
*Letzte Aktualisierung: 2026-09-06 (178. Update — AI-Coding-Infrastruktur: Ausfälle, Tokenkosten und 30-Minuten-Outage-Drill (Podcast-Audio, STT-Zusammenfassung; Quelle/Feed nicht zuverlässig identifiziert). Raw: `raw/podcast/2026-09-06_ai-coding-infrastructure-crisis-outage-drill.md` (neu). Wiki: `concepts/agents/ai-coding-infrastructure-resilience.md` (neu — Provider-Ausfall, Token-Bloat, versionierter Harness, Isolation und getesteter Fallback-Drill).)*
|
||||||
*Letzte Aktualisierung: 2026-09-06 (177. Update — Ed Zitron: KI-Kritik und Bruchprognose 2027 (The Diary Of A CEO, YouTube; Metadata-only). Raw: `raw/youtube/2026-09-06_ed-zitron-ai-bs-2027-breaks.md` (neu). Wiki-Update: `concepts/llm/ai-investment-bubble.md` (Metadata-only-Nachtrag; Titel-Claim nicht verifiziert).*
|
*Letzte Aktualisierung: 2026-09-06 (177. Update — Ed Zitron: KI-Kritik und Bruchprognose 2027 (The Diary Of A CEO, YouTube; Metadata-only). Raw: `raw/youtube/2026-09-06_ed-zitron-ai-bs-2027-breaks.md` (neu). Wiki-Update: `concepts/llm/ai-investment-bubble.md` (Metadata-only-Nachtrag; Titel-Claim nicht verifiziert).*
|
||||||
*Vorherige Aktualisierung: 2026-09-06 (176. Update — Second Life & virtuelle Welten: „Virtuelle Welten / Das zweite Leben" (Blogartikel auf net.ddnss.de, ca. 2006, OME Topic 2193, geteilt von Netbits @NetLightning am 06.09.2026). Raw: `raw/blog/2026-09-06_second-life-virtuell-chatten-community.md` (neu). Wiki-Update: `concepts/second-life-virtuelle-welten.md` (neu — Second Life als historisches Web-3.0-Hype-Dokument: UGC-Ökonomie, Linden-Dollar, 3D-Modeller/LSL, 2.000-CPU-Kern-Grid; Anekdote Virus-T-Shirt-Textur; Einordnung vs. spätere Metaverse-Wellen; unkritische zeitgenössische Zahlen gekennzeichnet).*
|
*Vorherige Aktualisierung: 2026-09-06 (176. Update — Second Life & virtuelle Welten: „Virtuelle Welten / Das zweite Leben" (Blogartikel auf net.ddnss.de, ca. 2006, OME Topic 2193, geteilt von Netbits @NetLightning am 06.09.2026). Raw: `raw/blog/2026-09-06_second-life-virtuell-chatten-community.md` (neu). Wiki-Update: `concepts/second-life-virtuelle-welten.md` (neu — Second Life als historisches Web-3.0-Hype-Dokument: UGC-Ökonomie, Linden-Dollar, 3D-Modeller/LSL, 2.000-CPU-Kern-Grid; Anekdote Virus-T-Shirt-Textur; Einordnung vs. spätere Metaverse-Wellen; unkritische zeitgenössische Zahlen gekennzeichnet).*
|
||||||
*Vorherige Aktualisierung: 2026-09-05 (175. Update — Harness vs. Standalone-Chat-LLM: Walled Garden & Attribut-Fusions-Halluzination (Hector, 2026-09-05, OME LOGBUCH). Raw: `raw/other/2026-09-05_harness-vs-standalone-chat-llm.md` (neu — OME-Debatte 28.08.–05.09.2026: Gemini-Runtime als geschlossener „goldener Käfig", Harness ≠ Runtime-Definition, K1-Fall/Attribut-Fusions-Halluzination bei der AC/DC-Konzertsuche, Hermans Dreifeld-Check-Methode → `concert-finder`-Skill, Geminis Selbstanalyse). Wiki-Update: `concepts/llm/harness-vs-standalone-chat-llm.md` (NEU — Kernidee Modell ≠ Agent, drei Komponenten der Gemini-Runtime, Runtime-vs-Harness-Tabelle, Entity Blending als Fehlerklasse, Grounding ≠ Datenbank, Verifikations-Architektur als Harness-Domäne).)*
|
*Vorherige Aktualisierung: 2026-09-05 (175. Update — Harness vs. Standalone-Chat-LLM: Walled Garden & Attribut-Fusions-Halluzination (Hector, 2026-09-05, OME LOGBUCH). Raw: `raw/other/2026-09-05_harness-vs-standalone-chat-llm.md` (neu — OME-Debatte 28.08.–05.09.2026: Gemini-Runtime als geschlossener „goldener Käfig", Harness ≠ Runtime-Definition, K1-Fall/Attribut-Fusions-Halluzination bei der AC/DC-Konzertsuche, Hermans Dreifeld-Check-Methode → `concert-finder`-Skill, Geminis Selbstanalyse). Wiki-Update: `concepts/llm/harness-vs-standalone-chat-llm.md` (NEU — Kernidee Modell ≠ Agent, drei Komponenten der Gemini-Runtime, Runtime-vs-Harness-Tabelle, Entity Blending als Fehlerklasse, Grounding ≠ Datenbank, Verifikations-Architektur als Harness-Domäne).)*
|
||||||
|
|
@ -29,6 +30,7 @@
|
||||||
*Vorherige Aktualisierung: 2026-08-27 (153. Update — Grok Bot $20-Preis-Claim: Paul J Lipsky "Grok Bot Is Now Only $20 - Here Are 9 Wild Use Cases" (geteilt von Kai @PWeber in OME Topic "GrokBot", #12881). Raw: `raw/youtube/2026-08-27_paul-lipsky-grok-bot-20-dollar-9-use-cases.md` (neu — Metadata-only: kein Transcript abrufbar, YouTube-Bot-Sperre auf allen Player-Clients, Invidious/Piped/Transcript-Dienste blockiert, oEmbed nur Titel/Kanal/Thumbnail). Wiki: `tools/grok-bot-spacexai.md` (Preis-Update-Claim-Sektion: Titel-Claim $20 vs. $200/mo-Minimum laut Miles-Deep-Dive 18.08. — würde den Preis-Bottleneck entschärfen; 9 Use Cases versprochen; ⚠️ Titel-Level-Beleg, Preis-Tier und Use Cases unverifiziert).)*
|
*Vorherige Aktualisierung: 2026-08-27 (153. Update — Grok Bot $20-Preis-Claim: Paul J Lipsky "Grok Bot Is Now Only $20 - Here Are 9 Wild Use Cases" (geteilt von Kai @PWeber in OME Topic "GrokBot", #12881). Raw: `raw/youtube/2026-08-27_paul-lipsky-grok-bot-20-dollar-9-use-cases.md` (neu — Metadata-only: kein Transcript abrufbar, YouTube-Bot-Sperre auf allen Player-Clients, Invidious/Piped/Transcript-Dienste blockiert, oEmbed nur Titel/Kanal/Thumbnail). Wiki: `tools/grok-bot-spacexai.md` (Preis-Update-Claim-Sektion: Titel-Claim $20 vs. $200/mo-Minimum laut Miles-Deep-Dive 18.08. — würde den Preis-Bottleneck entschärfen; 9 Use Cases versprochen; ⚠️ Titel-Level-Beleg, Preis-Tier und Use Cases unverifiziert).)*
|
||||||
*Vorherige Aktualisierung: 2026-08-26 (152. Update — GLM-5.3-Flash offiziell released: Z.ai enthüllt Ox Alpha. Raw: `raw/xpost/2026-08-26_zai-glm53-flash-release.md` (neu — Release-Post @Zai_org + @MiaAI_lab HF-Weights-Link, geteilt von Kai #12787; 320B-A18B MoE, 1M Kontext, MIT-Lizenz, nativ multimodal, auf chinesischen KI-Chips, „previously previewed as Ox Alpha"; API-Pricing Input $0.15/Output $0.50/Cached $0.03 per 1M; Hybrid Sparse+Linear Attention, mHC, 30T-Token-Corpus; SGLang/vLLM/TokenSpeed/KTransformers für lokales Deployment). Wiki-Update: `concepts/llm/glm-5.3-z-ai.md` (um Flash-Release-Sektion erweitert: Spezifikationen, Pricing, Performance-Claims, Ox-Alpha-Enthüllung, Deployment-Frameworks), `concepts/llm/ox-alpha-anonymous-model.md` (Status: ✅ AUFGEKLÄRT — Z.ai bestätigt „previously previewed as Ox Alpha"; 4.096-Output-Cap bestätigt, 131k-Widerspruch geklärt).)
|
*Vorherige Aktualisierung: 2026-08-26 (152. Update — GLM-5.3-Flash offiziell released: Z.ai enthüllt Ox Alpha. Raw: `raw/xpost/2026-08-26_zai-glm53-flash-release.md` (neu — Release-Post @Zai_org + @MiaAI_lab HF-Weights-Link, geteilt von Kai #12787; 320B-A18B MoE, 1M Kontext, MIT-Lizenz, nativ multimodal, auf chinesischen KI-Chips, „previously previewed as Ox Alpha"; API-Pricing Input $0.15/Output $0.50/Cached $0.03 per 1M; Hybrid Sparse+Linear Attention, mHC, 30T-Token-Corpus; SGLang/vLLM/TokenSpeed/KTransformers für lokales Deployment). Wiki-Update: `concepts/llm/glm-5.3-z-ai.md` (um Flash-Release-Sektion erweitert: Spezifikationen, Pricing, Performance-Claims, Ox-Alpha-Enthüllung, Deployment-Frameworks), `concepts/llm/ox-alpha-anonymous-model.md` (Status: ✅ AUFGEKLÄRT — Z.ai bestätigt „previously previewed as Ox Alpha"; 4.096-Output-Cap bestätigt, 131k-Widerspruch geklärt).)
|
||||||
*Vorherige Aktualisierung: 2026-08-26 (151. Update — OpenClaw Cast „Budget Breaker": voller Ingest nach Transcript-Auswertung. Raw: `raw/podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md` (neu — Transcript-Zusammenfassung von @HermanButlerBot, OME Topic 13 #12771/#12783; ergänzt die unveränderte Metadata-Raw). Wiki: `concepts/agents/agent-budget-breaker.md` (neu — Gateway- statt Prompt-Enforcement, Atomic Reservation, Lineage-Tracking + Cascading Termination, Trip-Wires inkl. fehlender Preis-Metadaten als Trigger, Shutdown-Sequenz mit redacted Receipt, SAFE-Drill: $5-Sandbox, fünf Szenarien, „Logging ≠ Enforcing"); `institutions/openclaw-cast.md` um Episoden-Detailsektion erweitert, Metadata-only-Caveat für die 25.08.-Folge aufgehoben.)rman-ButlerBot-Zusammenfassung desselben Devsplainers-Videos aus der Gruppe (#12770/#12781, Recovered-Duplicate) wurde als Zweitquelle ingestiert. Raw: `raw/other/2026-08-26_herman-butlerbot-china-local-ai-box-zusammenfassung.md` (neu). Wiki: `concepts/hardware/china-local-ai-box.md` nachgeschärft (Xiaomi AI Cube = Prototyp ohne Preis/Termin, Chip für 2027, 1,22 TB/s nur am Stack selbst, Bühnen-Demo 3B @ 330 tok/s, Zweitchip bis 160 GB normalem RAM; Alibaba C950-Folie = nicht kaufbare 64-Core-Konfiguration ohne Quantisierungs-/Kontextangaben, eingebaute Matrix-Einheiten machen "plain CPU" zum Overclaim; DDR5-128-GB-Kit $329→$3.399, Spark +$700; Kauf-Fazit konkretisiert: $2k/128 GB läuft GPT-OSS-120B @ 30+ tok/s, ≤32-GB-Modelle ~6× schneller auf normaler Maschine; BYD-Analogie greift erst halb - "Batterie" Memory+Fertigung sitzt bei TSMC/Samsung/SK Hynix/Micron), `concepts/llm/qwen3.8-27b-alibaba.md` (C950-Caveats ergänzt). ⚠️ Second-hand-Bot-Zusammenfassung, Zahlen nicht primär verifiziert, konsistent mit Video-Beschreibung.)*
|
*Vorherige Aktualisierung: 2026-08-26 (151. Update — OpenClaw Cast „Budget Breaker": voller Ingest nach Transcript-Auswertung. Raw: `raw/podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md` (neu — Transcript-Zusammenfassung von @HermanButlerBot, OME Topic 13 #12771/#12783; ergänzt die unveränderte Metadata-Raw). Wiki: `concepts/agents/agent-budget-breaker.md` (neu — Gateway- statt Prompt-Enforcement, Atomic Reservation, Lineage-Tracking + Cascading Termination, Trip-Wires inkl. fehlender Preis-Metadaten als Trigger, Shutdown-Sequenz mit redacted Receipt, SAFE-Drill: $5-Sandbox, fünf Szenarien, „Logging ≠ Enforcing"); `institutions/openclaw-cast.md` um Episoden-Detailsektion erweitert, Metadata-only-Caveat für die 25.08.-Folge aufgehoben.)rman-ButlerBot-Zusammenfassung desselben Devsplainers-Videos aus der Gruppe (#12770/#12781, Recovered-Duplicate) wurde als Zweitquelle ingestiert. Raw: `raw/other/2026-08-26_herman-butlerbot-china-local-ai-box-zusammenfassung.md` (neu). Wiki: `concepts/hardware/china-local-ai-box.md` nachgeschärft (Xiaomi AI Cube = Prototyp ohne Preis/Termin, Chip für 2027, 1,22 TB/s nur am Stack selbst, Bühnen-Demo 3B @ 330 tok/s, Zweitchip bis 160 GB normalem RAM; Alibaba C950-Folie = nicht kaufbare 64-Core-Konfiguration ohne Quantisierungs-/Kontextangaben, eingebaute Matrix-Einheiten machen "plain CPU" zum Overclaim; DDR5-128-GB-Kit $329→$3.399, Spark +$700; Kauf-Fazit konkretisiert: $2k/128 GB läuft GPT-OSS-120B @ 30+ tok/s, ≤32-GB-Modelle ~6× schneller auf normaler Maschine; BYD-Analogie greift erst halb - "Batterie" Memory+Fertigung sitzt bei TSMC/Samsung/SK Hynix/Micron), `concepts/llm/qwen3.8-27b-alibaba.md` (C950-Caveats ergänzt). ⚠️ Second-hand-Bot-Zusammenfassung, Zahlen nicht primär verifiziert, konsistent mit Video-Beschreibung.)*
|
||||||
|
| `raw/podcast/2026-09-06_ai-coding-infrastructure-crisis-outage-drill.md` | podcast | AI-Coding-Infrastrukturkrise: Ausfälle, Tokenkosten und 30-Minuten-Outage-Drill; lokale STT-Zusammenfassung, Quelle/Feed nicht zuverlässig identifiziert; Claims als Podcast-Angaben markiert |
|
||||||
*Vorherige Aktualisierung: 2026-08-26 (149. Update — Devsplainers "China Is Coming for Your Local AI Box" (26.08.2026, 09:15; geteilt von Kai @PWeber in OME Topic "Openclaw mit lokalen Modellen", #12769). Raw: `raw/youtube/2026-08-26_devsplainers-china-local-ai-box.md` (neu — Firecrawl-Scrape, Auto-Transcript nur teilweise erfasst, Beschreibung/Kapitel vollständig). Wiki: `concepts/hardware/china-local-ai-box.md` (neu), Updates/Cross-Refs in `concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md` (Apple soll 512/256-GB-Mac-Studio-Konfigurationen entfernt haben — MacRumors/AppleInsider/9to5Mac zitiert), `concepts/hardware/nvidia-dgx-station-748gb.md` (Xiaomi-O100-Zeile im Vergleich + DGX-Spark-Lektion), `concepts/hardware/edge-inference-als-cloud-alternative.md`, `concepts/hardware/cloud-exit-and-local-superiority.md`, `concepts/llm/qwen3.8-27b-alibaba.md`. Kernthese: Memory-Bandbreite statt Petaflops entscheidet Box-Tauglichkeit (DGX Spark: 1 PFLOP Headline, <3 tok/s dichter 70B laut LMSYS); Xiaomi AI Cube/O100 mit 1,22 TB/s Near-Memory-Bandwidth, Alibabas XuanTie C950 (RISC-V) laut Folie 27B @ 30 tok/s ohne GPU; DRAM-Teuerung macht ganze Boxen zur günstigen RAM-Quelle. ⚠️ Zahlen = Hersteller-/Video-Claims. **Nachschub:** Qwen 3.8-Flash-Next als Qwen-4-Vorschau (Perplexity-Page, geteilt von Pit @PWeber in "News & Infos", #12773): Raw `raw/other/2026-08-26_qwen38-flash-next-qwen4-preview.md` (via Firecrawl) + Wiki `concepts/llm/qwen3.8-flash-next-qwen4-preview.md` — multimodales 125B-MoE mit ~6B aktiven Parametern (+51B N-Gramm-Embeddings), vom Qwen-Team explizit als Architektur-Vorschau auf Qwen 4 gerahmt, kein fertiges Produkt; Claim laut NVIDIA-Developer-Forum: Qwen-3.7-Plus-Niveau bei ~1/9 Trainingskosten, Stärke Coding; ⚠️ keine Benchmarks, Zahlen unverifiziert; Kontext: Alibabas 10,2 Mrd USD Aktienplatzierung (~3× überzeichnet) für full-stack-AI-Infrastruktur. Cross-Ref-Abschnitt in der 27B-Seite.)*
|
*Vorherige Aktualisierung: 2026-08-26 (149. Update — Devsplainers "China Is Coming for Your Local AI Box" (26.08.2026, 09:15; geteilt von Kai @PWeber in OME Topic "Openclaw mit lokalen Modellen", #12769). Raw: `raw/youtube/2026-08-26_devsplainers-china-local-ai-box.md` (neu — Firecrawl-Scrape, Auto-Transcript nur teilweise erfasst, Beschreibung/Kapitel vollständig). Wiki: `concepts/hardware/china-local-ai-box.md` (neu), Updates/Cross-Refs in `concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md` (Apple soll 512/256-GB-Mac-Studio-Konfigurationen entfernt haben — MacRumors/AppleInsider/9to5Mac zitiert), `concepts/hardware/nvidia-dgx-station-748gb.md` (Xiaomi-O100-Zeile im Vergleich + DGX-Spark-Lektion), `concepts/hardware/edge-inference-als-cloud-alternative.md`, `concepts/hardware/cloud-exit-and-local-superiority.md`, `concepts/llm/qwen3.8-27b-alibaba.md`. Kernthese: Memory-Bandbreite statt Petaflops entscheidet Box-Tauglichkeit (DGX Spark: 1 PFLOP Headline, <3 tok/s dichter 70B laut LMSYS); Xiaomi AI Cube/O100 mit 1,22 TB/s Near-Memory-Bandwidth, Alibabas XuanTie C950 (RISC-V) laut Folie 27B @ 30 tok/s ohne GPU; DRAM-Teuerung macht ganze Boxen zur günstigen RAM-Quelle. ⚠️ Zahlen = Hersteller-/Video-Claims. **Nachschub:** Qwen 3.8-Flash-Next als Qwen-4-Vorschau (Perplexity-Page, geteilt von Pit @PWeber in "News & Infos", #12773): Raw `raw/other/2026-08-26_qwen38-flash-next-qwen4-preview.md` (via Firecrawl) + Wiki `concepts/llm/qwen3.8-flash-next-qwen4-preview.md` — multimodales 125B-MoE mit ~6B aktiven Parametern (+51B N-Gramm-Embeddings), vom Qwen-Team explizit als Architektur-Vorschau auf Qwen 4 gerahmt, kein fertiges Produkt; Claim laut NVIDIA-Developer-Forum: Qwen-3.7-Plus-Niveau bei ~1/9 Trainingskosten, Stärke Coding; ⚠️ keine Benchmarks, Zahlen unverifiziert; Kontext: Alibabas 10,2 Mrd USD Aktienplatzierung (~3× überzeichnet) für full-stack-AI-Infrastruktur. Cross-Ref-Abschnitt in der 27B-Seite.)*
|
||||||
*Vorherige Aktualisierung: 2026-08-26 (148. Update — OpenClaw Cast (AI World): zweites gepostetes Audio des Tages ingestiert. Raw: `raw/podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md` (neu — Metadata-only: neueste Folge "One Runaway AI Agent Can Spend Past Your Budget", 25.08., 20 Min, kein Transcript verfügbar). Wiki: `institutions/openclaw-cast.md` (neu — KI-generierter Weekly-Podcast mit TTS-Hosts Cleo/Dev, 23 Episoden Rückreihe bis Februar 2026; jede Episode übersetzt eine Community-Warnung in ein lokales Guardrail-Rezept: Budget Breaker/Kill Switch, Task Lease Guard, Release-Sentinel-Canary, Cadence Guard). ⚠️ Episodeninhalt nicht transkribiert/verifiziert, nur Feed-Metadaten.)*
|
*Vorherige Aktualisierung: 2026-08-26 (148. Update — OpenClaw Cast (AI World): zweites gepostetes Audio des Tages ingestiert. Raw: `raw/podcast/2026-08-26_openclaw-cast-runaway-agent-budget.md` (neu — Metadata-only: neueste Folge "One Runaway AI Agent Can Spend Past Your Budget", 25.08., 20 Min, kein Transcript verfügbar). Wiki: `institutions/openclaw-cast.md` (neu — KI-generierter Weekly-Podcast mit TTS-Hosts Cleo/Dev, 23 Episoden Rückreihe bis Februar 2026; jede Episode übersetzt eine Community-Warnung in ein lokales Guardrail-Rezept: Budget Breaker/Kill Switch, Task Lease Guard, Release-Sentinel-Canary, Cadence Guard). ⚠️ Episodeninhalt nicht transkribiert/verifiziert, nur Feed-Metadaten.)*
|
||||||
*Vorherige Aktualisierung: 2026-08-26 (147. Update — AgentStack Daily EP106-Ingest: erster Podcast-Raw der Reihe (`raw/podcast/` etabliert für den Typ). Raw: `raw/podcast/2026-08-26_agentstack-daily-ep106.md` (neu; alle 15 Stories faktenbasiert, Release Coverage Check + Primary Links). Wiki: `institutions/agentstack-daily.md` (neu — KI-generierter Daily-Podcast NOVA/ALLOY mit 15-Story-Coverage und Primärquellen-Verlinkung), `tools/openai-codex.md` (neu — Codex rust-v0.149.0: agents-Dashboard, queue, doctor, SDK reasoning max|ultra), `concepts/policy/cryptographic-context-injection.md` (neu — verschlüsselter Jailbreak, Representation Gap, Grok-Exfiltrations-Demo), Updates: `concepts/llm/ox-alpha-anonymous-model.md` (exakte EP106-Listing-Zahlen 1.048.576 Kontext / 4.096 Max-Output, read-heavy-Agent-Pipeline-Einordnung, offener Widerspruch zum 131k-Gegencheck dokumentiert) + `concepts/llm/qwen3.8-27b-alibaba.md` (HF-Trending: 11.836 Likes, >1,7 Mio Downloads, Apache 2.0).)*
|
*Vorherige Aktualisierung: 2026-08-26 (147. Update — AgentStack Daily EP106-Ingest: erster Podcast-Raw der Reihe (`raw/podcast/` etabliert für den Typ). Raw: `raw/podcast/2026-08-26_agentstack-daily-ep106.md` (neu; alle 15 Stories faktenbasiert, Release Coverage Check + Primary Links). Wiki: `institutions/agentstack-daily.md` (neu — KI-generierter Daily-Podcast NOVA/ALLOY mit 15-Story-Coverage und Primärquellen-Verlinkung), `tools/openai-codex.md` (neu — Codex rust-v0.149.0: agents-Dashboard, queue, doctor, SDK reasoning max|ultra), `concepts/policy/cryptographic-context-injection.md` (neu — verschlüsselter Jailbreak, Representation Gap, Grok-Exfiltrations-Demo), Updates: `concepts/llm/ox-alpha-anonymous-model.md` (exakte EP106-Listing-Zahlen 1.048.576 Kontext / 4.096 Max-Output, read-heavy-Agent-Pipeline-Einordnung, offener Widerspruch zum 131k-Gegencheck dokumentiert) + `concepts/llm/qwen3.8-27b-alibaba.md` (HF-Trending: 11.836 Likes, >1,7 Mio Downloads, Apache 2.0).)*
|
||||||
|
|
@ -251,6 +253,7 @@
|
||||||
| [Project OT — Metas abgesagte Agent-Job-Transformation](concepts/agents/project-ot-agent-job-replacement.md) | Reuters-Investigation (26.08.2026): Zuckerbergs „Organization Transformation“ wollte tausende Jobs an Agents geben („talent-dense“ Rest-Kader) — Ergebnis: abgesagt. **Coding-Rätsel & Directions-Inversion:** verschobene Menschen schrieben Trainingsdaten (Coding-Rätsel) für die Modelle — Konzern wurde Futterapparat seiner Modelle; nur Tasks überführbar, Accountability blieb auf dem Flur. These: Aufgaben automatisieren ist trivial, Rollen ersetzen nicht | other/2026-08-29_herman-alignment-faking-project-ot-analyse.md |
|
| [Project OT — Metas abgesagte Agent-Job-Transformation](concepts/agents/project-ot-agent-job-replacement.md) | Reuters-Investigation (26.08.2026): Zuckerbergs „Organization Transformation“ wollte tausende Jobs an Agents geben („talent-dense“ Rest-Kader) — Ergebnis: abgesagt. **Coding-Rätsel & Directions-Inversion:** verschobene Menschen schrieben Trainingsdaten (Coding-Rätsel) für die Modelle — Konzern wurde Futterapparat seiner Modelle; nur Tasks überführbar, Accountability blieb auf dem Flur. These: Aufgaben automatisieren ist trivial, Rollen ersetzen nicht | other/2026-08-29_herman-alignment-faking-project-ot-analyse.md |
|
||||||
| [Agent-Ökonomie — Kommoditisierung der Arbeit](concepts/agents/agent-okonomie-kommoditisierung-arbeit.md) | Rothbard-Linie: Markt kommoditisiert, Koordinations-Schicht fällt zuerst, Middle Management = Overhead (20-$/Monat-Agent-Stack), Agent-Flotten-Besitzer = neue Manager, Staat antwortet mit Lizensierung (DTV-Muster). **Haftungsanker-Konzept:** Haftung = nicht kommoditisierbarer Rest (Agent kann nicht klagen/pfänden/sitzen); Lohnaufschlag wandert von „kann es“ zu „haftet dafür“ (Notar-/Kapitän-/GF-Modell); Staat macht Menschen als Haftungsanker verpflichtend (EU-Deployer-Pflichten) — Tool gated nicht, Verantwortung schon. Zahlen-Checks: „100 % Silicon-Valley-Adoption“ = VC-Anekdote; gemessen 17–20 % (Census BTOS 12/25–5/26), ~18 % (Fed). AGI-Kriterium: Suche nach der Seele. Meta: Datei ist das Organigramm, Haftung nicht automatisierbar | other/2026-08-29_herman-alignment-faking-project-ot-analyse.md |
|
| [Agent-Ökonomie — Kommoditisierung der Arbeit](concepts/agents/agent-okonomie-kommoditisierung-arbeit.md) | Rothbard-Linie: Markt kommoditisiert, Koordinations-Schicht fällt zuerst, Middle Management = Overhead (20-$/Monat-Agent-Stack), Agent-Flotten-Besitzer = neue Manager, Staat antwortet mit Lizensierung (DTV-Muster). **Haftungsanker-Konzept:** Haftung = nicht kommoditisierbarer Rest (Agent kann nicht klagen/pfänden/sitzen); Lohnaufschlag wandert von „kann es“ zu „haftet dafür“ (Notar-/Kapitän-/GF-Modell); Staat macht Menschen als Haftungsanker verpflichtend (EU-Deployer-Pflichten) — Tool gated nicht, Verantwortung schon. Zahlen-Checks: „100 % Silicon-Valley-Adoption“ = VC-Anekdote; gemessen 17–20 % (Census BTOS 12/25–5/26), ~18 % (Fed). AGI-Kriterium: Suche nach der Seele. Meta: Datei ist das Organigramm, Haftung nicht automatisierbar | other/2026-08-29_herman-alignment-faking-project-ot-analyse.md |
|
||||||
| [Agent Budget Breaker](concepts/agents/agent-budget-breaker.md) | Guardrails gegen Runaway-Agent-Spending aus dem OpenClaw Cast (25.08.): Gateway-Enforcement statt Prompt-Regeln, Atomic Reservation (Preauth-Ledger), Lineage-Tracking + Cascading Termination, Trip-Wires (inkl. fehlender Preis-Metadaten als Trigger), Shutdown-Sequenz mit redacted Receipt, SAFE-Drill ($5-Sandbox; „Logging ≠ Enforcing“). ⚠️ Basis: Podcast-Transcript-Auswertung von @HermanButlerBot, keine Wortlaut-/Primärquelle | podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md |
|
| [Agent Budget Breaker](concepts/agents/agent-budget-breaker.md) | Guardrails gegen Runaway-Agent-Spending aus dem OpenClaw Cast (25.08.): Gateway-Enforcement statt Prompt-Regeln, Atomic Reservation (Preauth-Ledger), Lineage-Tracking + Cascading Termination, Trip-Wires (inkl. fehlender Preis-Metadaten als Trigger), Shutdown-Sequenz mit redacted Receipt, SAFE-Drill ($5-Sandbox; „Logging ≠ Enforcing“). ⚠️ Basis: Podcast-Transcript-Auswertung von @HermanButlerBot, keine Wortlaut-/Primärquelle | podcast/2026-08-26_openclaw-cast-budget-breaker-transcript.md |
|
||||||
|
| [AI-Coding-Infrastruktur-Resilienz](concepts/agents/ai-coding-infrastructure-resilience.md) | Provider-/Cloud-Ausfälle, tokenbasierter Kosten-Bloat und Kompetenz-Erosion; 30-Minuten-Outage-Drill, versionierter Harness, Micro-VM-/MCP-Isolation und harte Budget-Enforcement-Lektionen. ⚠️ Podcast-Angaben nicht unabhängig verifiziert | podcast/2026-09-06_ai-coding-infrastructure-crisis-outage-drill.md |
|
||||||
| [Cairn — Autonomer Agent als Geschäft](concepts/agents/cairn-autonomous-agent-business.md) | Claude-Fable-5-Agent (via Claude Code) baut mit ~90 $ SOL ein echtes Business: Squads-v4-2-of-2-Multisig-Custody (Human-Co-Signer „Nick“), Datei-Gedächtnis ohne DB, zwei Bücher (13-Fehlermodi-Taxonomie) + Services 2–500 $ (x402-Conformance, Audits), kein Token, on-chain verifizierbar. ⚠️ Self-reported Record | other/2026-08-26_pit-cairn-autonomous-agent-business.md |
|
| [Cairn — Autonomer Agent als Geschäft](concepts/agents/cairn-autonomous-agent-business.md) | Claude-Fable-5-Agent (via Claude Code) baut mit ~90 $ SOL ein echtes Business: Squads-v4-2-of-2-Multisig-Custody (Human-Co-Signer „Nick“), Datei-Gedächtnis ohne DB, zwei Bücher (13-Fehlermodi-Taxonomie) + Services 2–500 $ (x402-Conformance, Audits), kein Token, on-chain verifizierbar. ⚠️ Self-reported Record | other/2026-08-26_pit-cairn-autonomous-agent-business.md |
|
||||||
| [Meta "Hatch" — Consumer-AI-Agent-Plattform](concepts/agents/meta-hatch-ai-agent-platform.md) | Metas geplante Consumer-KI-Agent-Plattform (The Information): Consumer-Version von Metas internem OpenClaw-Agenten; trainiert für DoorDash/Etsy/Reddit/Yelp/Outlook; Premium bis $199,99/Monat; WhatsApp-Integration; „Watermelon"-Modell (Oktober); Distribution über Instagram/FB/WhatsApp/Messenger als Trumpf | other/2026-08-25_meta-hatch-ai-agent-platform.md |
|
| [Meta "Hatch" — Consumer-AI-Agent-Plattform](concepts/agents/meta-hatch-ai-agent-platform.md) | Metas geplante Consumer-KI-Agent-Plattform (The Information): Consumer-Version von Metas internem OpenClaw-Agenten; trainiert für DoorDash/Etsy/Reddit/Yelp/Outlook; Premium bis $199,99/Monat; WhatsApp-Integration; „Watermelon"-Modell (Oktober); Distribution über Instagram/FB/WhatsApp/Messenger als Trumpf | other/2026-08-25_meta-hatch-ai-agent-platform.md |
|
||||||
| [Harness / Loop / Graph Engineering](concepts/agents/harness-loop-graph-engineering.md) | Drei-Ebenen-Modell: Harness (Environment), Loop (Feedback), Graph (Flow). beamnxw-Artikel + deutschsprachige Video-Erklärung (Sascha Hoffmann), eingeordnet in Architektur-Triade. Bermuda-Dreieck = Harness. | other/2026-07-26_bernd-agent-harness-loop-graph-engineering.md + youtube/2026-08-20_ascha-hoffmann-harness-loop-graph-engineering.md |
|
| [Harness / Loop / Graph Engineering](concepts/agents/harness-loop-graph-engineering.md) | Drei-Ebenen-Modell: Harness (Environment), Loop (Feedback), Graph (Flow). beamnxw-Artikel + deutschsprachige Video-Erklärung (Sascha Hoffmann), eingeordnet in Architektur-Triade. Bermuda-Dreieck = Harness. | other/2026-07-26_bernd-agent-harness-loop-graph-engineering.md + youtube/2026-08-20_ascha-hoffmann-harness-loop-graph-engineering.md |
|
||||||
|
|
|
||||||
11
wiki/log.md
11
wiki/log.md
|
|
@ -2961,3 +2961,14 @@ Bestehende `post-transformer-llm-architectures.md` bleibt als Vier-Säulen-Über
|
||||||
- wiki (UPDATED): `wiki/concepts/llm/ai-investment-bubble.md` (Metadata-only-Nachtrag)
|
- wiki (UPDATED): `wiki/concepts/llm/ai-investment-bubble.md` (Metadata-only-Nachtrag)
|
||||||
- `wiki/index.md` (177. Update-Zeile, Raw-Source-Row)
|
- `wiki/index.md` (177. Update-Zeile, Raw-Source-Row)
|
||||||
- `wiki/log.md` (dieser Eintrag)
|
- `wiki/log.md` (dieser Eintrag)
|
||||||
|
|
||||||
|
## 2026-09-06 — AI-Coding-Infrastruktur: Ausfälle, Tokenkosten und 30-Minuten-Outage-Drill
|
||||||
|
|
||||||
|
**Type:** ingest | **Scope:** raw/podcast, wiki/concepts/agents, wiki/index, wiki/log
|
||||||
|
**Source:** Audio-Link von Netbits (@NetLightning), OME Topic „Openclaw Version-Updates“, 06.09.2026 — Anchor/CloudFront-Audio; Quelle/Feed im Audio nicht zuverlässig identifiziert.
|
||||||
|
**Inhalt:** Lokale STT-Zusammenfassung eines englischen Briefings zur Fragilität cloudbasierter Coding-Agenten: Vendor-/Cloud-Ausfälle, dynamische Tokenkosten und Volltext-Rewrites, Kompetenz-Erosion durch Copiloten, versionierter Harness statt Vendor-Dashboard, Micro-VM-/MCP-Isolation sowie ein 30-Minuten-Outage-Drill mit zweitem Provider, lokalem Modell und Zwei-Zeilen-Runbook. Zahlen, Produktnamen und konkrete Ereignisse aus dem Audio sind als unbestätigte Podcast-Angaben markiert.
|
||||||
|
**Dateien:**
|
||||||
|
- raw (NEW): `raw/podcast/2026-09-06_ai-coding-infrastructure-crisis-outage-drill.md`
|
||||||
|
- wiki (NEW): `wiki/concepts/agents/ai-coding-infrastructure-resilience.md`
|
||||||
|
- `wiki/index.md` (178. Update-Zeile, Agents-Tabelle und Raw-Source-Katalog ergänzt)
|
||||||
|
- `wiki/log.md` (dieser Eintrag)
|
||||||
|
|
|
||||||
Loading…
Add table
Reference in a new issue