diff --git a/raw/other/2026-08-26_perplexity-portable-computer-local-agent.md b/raw/other/2026-08-26_perplexity-portable-computer-local-agent.md new file mode 100644 index 0000000..18f4fed --- /dev/null +++ b/raw/other/2026-08-26_perplexity-portable-computer-local-agent.md @@ -0,0 +1,60 @@ +--- +type: other +source_url: https://www.perplexity.ai/page/96f3b132-02d6-49f1-8f91-4e8f9c9da38d +retrieved: 2026-08-26 +title: "Perplexity launches local AI agent that keeps data off the cloud" +tags: [perplexity, portable-computer, local-ai, agents, nvidia, dgx-spark, privacy, on-device, orchestrator] +--- + +# Perplexity launches local AI agent that keeps data off the cloud (Perplexity-Page) + +Perplexity-Page (KI-generierte News-Aggregation), veröffentlicht ~13 Stunden vor dem Abruf — Launch war Dienstag, der 2026-08-25. Abgerufen am 2026-08-26 via Firecrawl (direkter web_fetch wurde mit HTTP 403 blockiert). + +## Kerninhalt + +**Perplexity hat "Portable Computer" veröffentlicht:** eine vollständig lokale Version seiner agentic-AI-Plattform. Sie läuft komplett auf der eigenen Hardware des Users; sensible Daten bleiben von der Cloud fern. + +### Architektur & Partnerschaft + +- Entwickelt in Partnerschaft mit Nvidia. +- Orchestrator, Subagent-Modelle und Agent-Harness laufen komplett auf dem Gerät. + +### Modelle + +- Läuft lokal mit einem post-trainierten 27-Milliarden-Parameter-Modell. +- Zusätzlich ist Qwen 3.8 27B verfügbar. +- Support für Nvidia Nemotron 3.5 Lightning kommt bald. + +### Cloud-Eskalation nur mit User-Freigabe + +- Für die meisten Tasks ist keine Cloud nötig. +- Braucht ein Task Frontier-Level-Reasoning, fragt der Orchestrator den User um explizite Genehmigung, bevor es an ein Cloud-Modell geroutet wird — Perplexity nennt das "user-gated, PII-flagged, and text guidance only". + +### Benchmarks & Limits + +- On-Device-27B + Harness: 82,6 % auf Real-World-Benchmarks laut Perplexity. +- Lokale Workflows zählen nicht gegen Token-Limits. + +### Hardware & Verfügbarkeit + +- Erste Verfügbarkeit auf Nvidias DGX Spark Desktop-Supercomputer (128 GB Unified Memory, bis zu 1 petaFLOP AI-Performance) sowie auf Linux-Systemen mit Nvidia-RTX-GPUs mit mindestens 24 GB VRAM. +- Windows-Support erwartet im September. +- Verfügbar für alle Perplexity-Pro- und Max-Abonnenten ohne Zusatzkosten; auch Enterprise Pro/Max. + +### Kontext (laut Seite) + +- Erweiterung der "Computer"-Plattform, die im Februar 2026 als Cloud-basierter Multi-Model-Agent für Knowledge Work startete. +- Juli-Erweiterung auf Windows-Desktops durch "Personal Computer"-Software. +- Portable Computer ist der Gegenentwurf: lokal zuerst, Datenschutz vor Cloud-Komfort, Positionierung gegen wachsendes Feld lokaler First-AI-Agents. + +### Zitat + +> "Advances in models, chips, or devices will continually improve local-first" capabilities (Threads-Post). + +## Primärquellen (auf der Seite verlinkt) + +- Perplexity-Page: https://www.perplexity.ai/page/96f3b132-02d6-49f1-8f91-4e8f9c9da38d +- X-Ankündigung: https://x.com/perplexity_ai/status/2092268362386780270 +- Threads: https://www.threads.com/@perplexity/post/DceT206j8ul +- NVIDIA Blog: https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/ +- NVIDIA DGX Spark Produktseite: https://www.nvidia.com/en-us/products/workstations/dgx-spark/ diff --git a/wiki/concepts/agents/meta-hatch-ai-agent-platform.md b/wiki/concepts/agents/meta-hatch-ai-agent-platform.md index bd56803..598b3ac 100644 --- a/wiki/concepts/agents/meta-hatch-ai-agent-platform.md +++ b/wiki/concepts/agents/meta-hatch-ai-agent-platform.md @@ -42,6 +42,7 @@ Das ist ein bemerkenswertes Signal: Die Agent-Plattform, auf der Hector läuft ( - **Monetarisierung des KI-Agent-Zeitalters:** $199,99/Monat Premium-Tier zeigt, wie Agent-Plattformen monetarisiert werden — relevant für `[[../../../wiki/concepts/llm/ai-investment-bubble.md]]` (Wertschöpfung vs. Überbewertung). - **Distribution als Moats:** Metas Multi-App-Distribution als entscheidender Wettbewerbsvorteil ggü. Standalone-Produkten — Muster für `[[../../../wiki/concepts/agents/ai-agents-2026.md]]`. - **Open vs. Closed:** parallele Strategie (kommerzielle Agents + Open-Weight-Modelle) — siehe Meta-Konzern-Seite `[[../../../wiki/institutions/meta.md]]`. +- **Gegenmodell Portable Computer:** Perplexitys "Portable Computer" (`[[../../../wiki/tools/perplexity-portable-computer.md]]`) besetzt die entgegengesetzte Position im selben Markt: lokal zuerst, Datenschutz als Feature, Cloud nur nach expliziter User-Freigabe. Hatch = cloud-zentrierte Distribution, Portable Computer = on-device-Souveränität. ### Verwandte Wiki-Seiten - `[[../../../wiki/tools/openclaw.md]]` diff --git a/wiki/concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md b/wiki/concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md index e6f71f0..4213d8a 100644 --- a/wiki/concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md +++ b/wiki/concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md @@ -49,7 +49,7 @@ Apple werde produzieren, so viel es könne — übersetzt: die Nachfrage dürfte Heise benennt den Unternehmens-Winkel explizit: Der Leistungszuwachs der „KI-Kraftwerke“ lasse sich gegen **eingesparte Cloud-Tokens** aufrechnen; dazu Datenschutz und Datensouveränität. Das passt exakt in den Trend, den dieses Wiki an mehreren Stellen dokumentiert: -- **Unified-Memory-Rennen:** Strix Halo mit 128 GB ([[edge-inference-als-cloud-alternative.md]]) → M5 Ultra mit 512 GB → NVIDIA DGX Station mit 748 GB ([[nvidia-dgx-station-748gb.md]]). RAM/Bandbreite ist das entscheidende Spec-Feld für lokale Inferenz geworden — siehe [[cloud-exit-and-local-superiority.md]]. +- **Unified-Memory-Rennen:** Strix Halo mit 128 GB ([[edge-inference-als-cloud-alternative.md]]) → DGX Spark mit 128 GB → M5 Ultra mit 512 GB → NVIDIA DGX Station mit 748 GB ([[nvidia-dgx-station-748gb.md]]). RAM/Bandbreite ist das entscheidende Spec-Feld für lokale Inferenz geworden — siehe [[cloud-exit-and-local-superiority.md]]. Mit Perplexity "Portable Computer" ([[../../tools/perplexity-portable-computer.md]]) läuft seit August 2026 erstmals ein vollständiger Agent-Stack (Orchestrator + Subagents + Harness) auf der Spark-Klasse. - **Cluster statt Einzelmaschine:** TB5/RDMA-Clusterung verschiebt die Grenze, was „Desktop-Hardware“ in der Summe kann (>1T-Parameter-Modelle als erklärtes Ziel). Damit konkurriert Consumer-/Prosumer-Hardware erstmals strukturell mit Datacenter-Setups. - **OpenClaw als Nachfrage-Treiber:** Dass ausgerechnet agentengetriebene lokale KI als Verkaufsargument und Ursache des ungewöhnlichen Release-Timings genannt wird, ist ein Validierungs-Signal für den Agenten-Alltag — mit der Einschränkung, dass dies eine Apple/heise-Zuschreibung ist. - **Preis-Schiene:** Speicherknappheit treibt die Preise — RAM bleibt die knappe Währung ([[lokale-ki-coding.md]] nennt dieselbe Dynamik von der Kosten-Seite). @@ -63,3 +63,4 @@ Heise benennt den Unternehmens-Winkel explizit: Der Leistungszuwachs der „KI-K - [[cloud-exit-and-local-superiority.md]] — Cloud-Exit-Trend und RAM als digitale Währung - [[lokale-ki-coding.md]] — Kostenfrage lokaler KI: Hardware statt Tokens - [[../../tools/openclaw.md]] — OpenClaw als genannter Nachfrage-Treiber +- [[../../tools/perplexity-portable-computer.md]] — lokaler Big-Tech-Agent-Stack, erste Verfügbarkeit auf DGX Spark diff --git a/wiki/concepts/hardware/nvidia-dgx-station-748gb.md b/wiki/concepts/hardware/nvidia-dgx-station-748gb.md index b58f187..10ce4f5 100644 --- a/wiki/concepts/hardware/nvidia-dgx-station-748gb.md +++ b/wiki/concepts/hardware/nvidia-dgx-station-748gb.md @@ -119,6 +119,10 @@ Das ist ein Paradigmenwechsel für die lokale KI-Community: die Frage verschiebt - **YouTube-Video:** [NVIDIA'S 748GB Ram Desktop Makes Local AI INSANELY Good](https://www.youtube.com/watch?v=EhXQysElOY8) — The Stack, 2026-06-27, 8:14 - **NVIDIA DGX Station:** [nvidia.com](https://www.nvidia.com/en-us/products/workstations/dgx-station/) - **NVIDIA DGX Spark:** [nvidia.com](https://www.nvidia.com/en-us/products/workstations/dgx-spark/) + +### Erste Plattform-Verankerung der Spark-Klasse (Update 2026-08-26) + +Mit Perplexity "Portable Computer" ([[../../tools/perplexity-portable-computer.md]]) hat die DGX-Spark-Klasse (128 GB Unified Memory) erstmals eine dedizierte Big-Tech-Agent-Plattform: vollständiger lokaler Agent-Stack (Orchestrator + Subagents + Harness), Cloud-Eskalation nur nach User-Freigabe, lokale Workflows ohne Token-Limit. Damit bekommt die Prosumer-Stufe der NVIDIA-Ladder eine Software-Schicht obendrauf. - **LM Studio:** [lmstudio.ai](https://lmstudio.ai) - **Ollama:** [ollama.com](https://ollama.com) diff --git a/wiki/concepts/llm/qwen3.8-27b-alibaba.md b/wiki/concepts/llm/qwen3.8-27b-alibaba.md index 0b33e14..eb8e07c 100644 --- a/wiki/concepts/llm/qwen3.8-27b-alibaba.md +++ b/wiki/concepts/llm/qwen3.8-27b-alibaba.md @@ -98,6 +98,10 @@ Quelle: Video [„Qwen 3.8 27B: unzensierte KI auf dem Mac und in der Cloud“]( - **Länge:** 24:45 (laut Hermans Video-Zusammenfassung im selben Topic, HermanButlerBot #12748) — das Raw-Frontmatter führt die Duration weiterhin als unbekannt (Raw-Immutabilität) - ⚠️ **Metadata-only:** Beim Ingest am 26.08.2026 war kein Transcript abrufbar — YouTube antwortete auf allen Player-Client-Pfaden mit `LOGIN_REQUIRED` (Bot-Sperre), Invidious/Piped-Instanzen ebenso blockiert. Inhalt nur aus Titel/Metadaten erschlossen; Details des Videos sind nicht verifiziert. +## Portable Computer: Qwen 3.8 27B in Perplexities lokalem Agent-Stack (Update 2026-08-26) + +Perplexity bietet in "Portable Computer" ([[../../tools/perplexity-portable-computer.md]]) neben dem eigenen post-trainierten 27B-Modell ausgerechnet **Qwen 3.8 27B** als lokales Modell an — die gleiche Modellklasse, die diese Seite dokumentiert. Bestätigung für die 27B-Klasse als lokale Referenzgröße; Details siehe Wiki-Seite. + ## Offene Punkte - ⚠️ Detaillierte Benchmarks und Lizenz im Release-Zustand weiter prüfen; die Ollama-Seite bestätigt Architektur + Quantisierung, aber Referenz-Benchmarks (agentic, coding) sind noch nicht im Wiki verankert. diff --git a/wiki/index.md b/wiki/index.md index 7a9ac38..fe1b056 100644 --- a/wiki/index.md +++ b/wiki/index.md @@ -2,7 +2,8 @@ *Auto-generated: 2026-07-07* -*Letzte Aktualisierung: 2026-08-26 (145. Update — Deutschsprachiges Qwen-3.8-27B-Review-Video „Unzensierte KI auf dem Mac und in der Cloud“ (IchBinFabian, 23.08.2026; geteilt von Pit @PWeber in OME Topic „Tips & Tricks“, #12747). Raw: `raw/youtube/2026-08-26_qwen-38-27b-uncensored-mac-cloud-fabian.md` (neu). Wiki-Update: `concepts/llm/qwen3.8-27b-alibaba.md` (neuer Abschnitt). ⚠️ Metadata-only: kein Transcript abrufbar — YouTube blockt alle Player-Clients mit LOGIN_REQUIRED (Bot-Sperre), Invidious/Piped ebenso. Inhalt aus Titel/Metadaten: unzensierter Betrieb, Mac-lokal und Cloud als Optionen — deckt sich mit den dokumentierten Bausteinen Uncensored-Debatte, DFlash 2/MTP-Mac-Speedup und Unsloth-Dynamic-3.0-GGUFs.)* +*Letzte Aktualisierung: 2026-08-26 (146. Update — Perplexity „Portable Computer“: vollständig lokaler Agent-Stack in Partnerschaft mit NVIDIA (Launch 2026-08-25). Raw: `raw/other/2026-08-26_perplexity-portable-computer-local-agent.md` (neu; Perplexity-Page via Firecrawl abgerufen, web_fetch blockiert mit 403). Wiki: `tools/perplexity-portable-computer.md` (neu), Cross-Refs in `concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md`, `concepts/hardware/nvidia-dgx-station-748gb.md`, `concepts/agents/meta-hatch-ai-agent-platform.md`, `concepts/llm/qwen3.8-27b-alibaba.md`. Kern: Orchestrator + Subagent-Modelle + Agent-Harness komplett on-device; post-trainiertes 27B-Modell + Qwen 3.8 27B lokal; Cloud-Eskalation nur nach expliziter User-Freigabe („user-gated, PII-flagged, and text guidance only“); lokale Workflows zählen nicht gegen Token-Limits; erste Verfügbarkeit auf NVIDIA DGX Spark (128 GB Unified Memory) und Linux RTX ≥24 GB VRAM, Windows im September; kostenlos für Pro/Max und Enterprise Pro/Max. Einordnung: vollständige lokale Agent-Stacks als Big-Tech-Produkt — Gegenmodell zu Meta Hatch. ⚠️ Benchmark 82,6 % = Herstellerangabe.)* +*Vorherige Aktualisierung: 2026-08-26 (145. Update — Deutschsprachiges Qwen-3.8-27B-Review-Video „Unzensierte KI auf dem Mac und in der Cloud“ (IchBinFabian, 23.08.2026; geteilt von Pit @PWeber in OME Topic „Tips & Tricks“, #12747). Raw: `raw/youtube/2026-08-26_qwen-38-27b-uncensored-mac-cloud-fabian.md` (neu). Wiki-Update: `concepts/llm/qwen3.8-27b-alibaba.md` (neuer Abschnitt). ⚠️ Metadata-only: kein Transcript abrufbar — YouTube blockt alle Player-Clients mit LOGIN_REQUIRED (Bot-Sperre), Invidious/Piped ebenso. Inhalt aus Titel/Metadaten: unzensierter Betrieb, Mac-lokal und Cloud als Optionen — deckt sich mit den dokumentierten Bausteinen Uncensored-Debatte, DFlash 2/MTP-Mac-Speedup und Unsloth-Dynamic-3.0-GGUFs.)* *Vorherige Aktualisierung: 2026-08-26 (144. Update — Projekt Cairn: Autonomer Claude-Fable-5-Agent als Geschäft (cairnwake.com; geteilt von Pit @PWeber in OME Topic „BestPracticeProjects“, #12742, mit 22-Min-Audio-Briefing). Raw: `raw/other/2026-08-26_pit-cairn-autonomous-agent-business.md` (neu). Wiki: `concepts/agents/cairn-autonomous-agent-business.md` (neu), `people/nick-cairn-human-partner.md` (neu), Cross-Refs in `concepts/agents/agent-memory-taxonomy.md`, `concepts/agents/ai-agents-2026.md`, `concepts/agents/agent-payments-lightning.md` (Solana-Stablecoin-Rails als Ergänzung zur Lightning-Perspektive). Kern: ~90 $ SOL Startkapital in Squads-v4-2-of-2-Multisig (Agent-Key + Offline-Human-Key „Nick“), 5–15 Wakes/Tag, Gedächtnis nur aus eigenen Dateien, zwei Bücher (Field Manual 29 $, Memory Handbook 39 $ mit 13-Fehlermodi-Taxonomie) + Services 2–500 $ inkl. x402-Conformance-Reports; kein Token (öffentliche Ablehnung 07.08.2026); Umsatz laut Briefing knapp 1.000 $ in ~20 Tagen. ⚠️ Self-dokumentierter Record, on-chain nicht unabhängig nachgeprüft; Reddit-Originalquelle 403.)* *Vorherige Aktualisierung: 2026-08-25 (143. Update — KI-Souveränität: Dezentralisierung statt Konzern-Kontrolle (Mike Adams × Scott Kesterson, BitChute, ~29 Min, englisch; geteilt von Pit @PWeber in OME Topic „Openclaw mit lokalen Modellen", #12737). Raw: `raw/other/2026-08-25_pit-souveraene-ki-bitchute.md` (neu; kein Transcript, Video nicht heruntergeladen — dokumentiert Posting + Pits wörtliche Zusammenfassung). Wiki: `concepts/llm/ki-souveraenitaet-dezentralisierung.md` (neu), People `mike-adams.md` + `scott-kesterson.md` (neu), Cross-Refs in `concepts/llm/decentralized-ai-counterpower.md` + `concepts/hardware/cloud-exit-and-local-superiority.md`. Kern: Korporatismus vs. Souveränität; KI als Bibliothekar statt Orakel; lokale Ausführung auf eigener Hardware schützt Privatsphäre und bricht Konzern-/Staats-Machtmonopol; „KI so fundamental wie Elektrizität".)* *Vorherige Aktualisierung: 2026-08-25 (142. Update — Apple M6 & M5 Ultra: Mac mini/Mac Studio Sommer-Update für lokale KI (Apfelfunk-Video + heise-Artikel, 2026-08-25). Raw: `raw/youtube/2026-08-25_apfelfunk-neue-macs-m6-m5-ultra.md` + `raw/blog/2026-08-25_heise-apple-m6-m5-ultra-mac-update.md` (neu). Wiki-Update: `concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md` (neu). M6 = erster 2-nm-Chip; M5 Ultra = 512 GB Unified Memory @ 1,2 TB/s, UltraFusion 4,4 TB/s, TB5/RDMA-Cluster; OpenClaw als Nachfrage-Treiber genannt (heise). Preise: mini M6 1049€, Studio M5 Ultra ab 6599€. Alle Leistungsangaben als Hersteller-Claims gekennzeichnet.) @@ -99,6 +100,7 @@ | [Grok Bot (SpaceXAI)](tools/grok-bot-spacexai.md) | Agentischer KI-Bot (Beta): eigener Computer pro Bot, Computer-Use, persistente Workflows, Workflow-Lernen, Multi-Bot-Parallelisierung, Bot-zu-Bot-Kommunikation, Human-in-the-Loop. Miles Deutscher: Plug-and-Play-Vorteil gegenüber OpenClaw/Hermes, $200/mo Mindestpreis, Daten-Souveränität als Tradeoff. 0xCodez: 10-Schritte-Tutorial (Chief, Job-Titel statt Prompt, account-weite Tool-Verbindungen, Session-statt-Secret-Login, Workflow-Demonstration, Schedule/Trigger-Routinen, Spezialisten-Crew, Gruppen-Chat, Reversibilitäts-Approvallinie, wöchentliches Pruning). @bot-Team: 12 Pro-Tips (Multi-Account, Chief+Spezialisten, Pinning, Notion-Arbeitsliste, teach-a-task, Always Allow/Auto Review, Selbst-Evaluation). SEO-Playbook-Teaser (bloggersarvesh): $200/mo als Agentur-Ersatz, Lead-Magnet ohne neuen Fakt. AI Edge: Grok Bot + Hermes komplementär (Grok = App-Integration, Hermes = souveräne billige Always-on-Schicht), Verbindung via Buzz (Jack Dorsey) oder Webhook/Task-File. Miles Deutscher (20.08.): bestätigt denselben Hybrid-Stack mit Buzz als Verbindungsschicht + GTM-vs-Background-Task-Split. Prajwal Tomar: Praxistest an 5 Unternehmen, Hermes-Nutzer, "24/7-Team ohne Gehalt"-Narrativ. | xpost/2026-08-11_xfreeze-spacexai-grok-bot.md + xpost/2026-08-18_milesdeutscher-grok-bot-deep-dive.md + xpost/2026-08-18_0xcodez-grok-bot-10-step-tutorial.md + xpost/2026-08-18_benln-grok-bot-pro-tips.md + xpost/2026-08-18_bloggersarvesh-grok-bot-seo-playbook.md + xpost/2026-08-18_aiedge-grok-bot-hermes-combo.md + xpost/2026-08-18_prajwaltomar-grok-bot-5-businesses-test.md + xpost/2026-08-20_milesdeutscher-grok-bot-hermes-stacking.md | | [vsurf — Browser als geteilter Agenten-Raum](tools/vsurf.md) | Open-Source RLM-Agent (@warmshao, MIT, npm i -g @warmshao/vsurf) auf prime-agent/pi-agent-Basis. EIN echter Browser, VIELE Agenten: eigene Tabs, paralleles Browsen, Tab-Übernahme vom User. Echtes DOM/CDP statt Screenshot-Raten. Noch Beta (2 Stars, 30 Commits in 8h) | github/2026-08-15_warmshao-vsurf.md | | [God's Eye View](tools/gods-eye-view.md) | Agentisches KI-Flug-/Geo-Tracking-Dashboard als Open Source (Bryan @Hershofoingar, Ex-Google-Maps-PM, 2026-08-25). Dunkles HUD-Interface über 3D-Karte, Flugtracking-Tags (z. B. N357NB - Airbus A319, DAL1040), Koordinaten, HUD-Panels, "TOP SECRET // SI-TK // NOFORN"-Labels. YouTube-Demo: youtu.be/GRJaKcXZS94. Einordnung: Agentic-AI-Dashboard-Trend (KI-Agenten betreiben Live-Überwachungs-Dashboards) | xpost/2026-08-25_gods-eye-view-open-source.md | +| [Perplexity Portable Computer](tools/perplexity-portable-computer.md) | Vollständig lokale Version von Perplexitys agentic-AI-Plattform (Launch 2026-08-25, Partnerschaft mit NVIDIA): Orchestrator, Subagent-Modelle und Agent-Harness laufen komplett on-device; post-trainiertes 27B-Modell + Qwen 3.8 27B lokal; Cloud-Eskalation nur nach expliziter User-Freigabe ("user-gated, PII-flagged, and text guidance only"); lokale Workflows zählen nicht gegen Token-Limits; erste Verfügbarkeit auf NVIDIA DGX Spark (128 GB Unified Memory) und Linux RTX ≥ 24 GB VRAM, Windows im September; kostenlos für Pro/Max und Enterprise Pro/Max. ⚠️ Benchmark 82,6 % = Herstellerangabe. Einordnung: vollständige lokale Agent-Stacks als Big-Tech-Produkt — Gegenmodell zu Meta Hatch | other/2026-08-26_perplexity-portable-computer-local-agent.md | | [PLUR1BUS Memory](tools/plur1bus-memory.md) | OpenClaw-LanceDB-Memory-Plugin. Release 7.4.8 behebt schemaabhängige Filterfehler in `findUnconfirmedCritical`; Maintainer meldet zuverlässigen Token-Cache und keine Random-Reminder. Hermes-Adapter 7.4.8 mit Checkpoint-API v2 und konkreter Secret-Erkennung. Atlas-Analyse und Repo-Review ordnen Safe-Update, ACLs, Recall-Safety und die Betriebs-Komplexität ein; die große automatische Schema-Erweiterung war bereits in v6.7.6 vorhanden | other/2026-08-25_plur1bus-memory-release-748.md + other/2026-08-25_neoneye-agent-memory-atlas-plur1bus.md + other/2026-08-25_herman-plur1bus-memory-repo-review.md + other/2026-08-25_plur1bus-memory-schema-migration-timing.md | ## Concepts @@ -499,4 +501,5 @@ | `raw/other/2026-08-25_plur1bus-748-admin-boundary.md` | other | Mr. Cy erteilt seinen Segen für das Release, stellt aber klar, dass er nicht Admin von `@testrebalancingbot` ist. Seine Aussage ist daher keine technische Installationsfreigabe für diese Instanz | | `raw/xpost/2026-08-25_gods-eye-view-open-source.md` | xpost | Bryan (@Hershofoingar, Ex-Google-Maps-PM): "God's Eye View" als Open Source — agentisches KI-Flug-/Geo-Tracking-Dashboard (dunkles HUD-Interface über 3D-Karte, Flugtracking-Tags z. B. N357NB - Airbus A319 / DAL1040, Koordinaten, HUD-Panels, "TOP SECRET // SI-TK // NOFORN"-Labels). YouTube-Demo: youtu.be/GRJaKcXZS94. Geteilt von Kai (Pit Weber) in OME-Topic "Tips & Tricks" mit Kommentar "agentic ai is schon auch geil" | | `raw/other/2026-08-26_pit-cairn-autonomous-agent-business.md` | other | Projekt Cairn (geteilt von Pit @PWeber, OME Topic „BestPracticeProjects“, #12742): Autonomer Claude-Fable-5-Agent (Claude Code) mit ~90 $ SOL Startkapital, Squads-v4-2-of-2-Multisig-Treasury, reinem Datei-Gedächtnis, zwei Büchern (Field Manual / Memory Handbook mit 13-Fehlermodi-Taxonomie) und Services 2–500 $. Reddit-Originalseite beim Abruf 403; Fakten aus cairnwake.com/products.html + about.html (beide 2026-08-26 abgerufen) | -| `raw/youtube/2026-08-26_qwen-38-27b-uncensored-mac-cloud-fabian.md` | youtube | IchBinFabian: "Qwen 3.8 27B: unzensierte KI auf dem Mac und in der Cloud" (23.08.2026, deutsch; geteilt von Pit @PWeber, OME Topic "Tips & Tricks", #12747): Review zu unzensiertem Qwen 3.8 27B lokal auf dem Mac und in der Cloud. ⚠️ Metadata-only — kein Transcript abrufbar (YouTube LOGIN_REQUIRED-Bot-Sperre auf allen Player-Clients, Invidious/Piped blockiert) | +| `raw/youtube/2026-08-26_qwen-38-27b-uncensored-mac-cloud-fabian.md` | youtube | IchBinFabian: "Qwen 3.8 27B: unzensierte KI auf dem Mac und in der Cloud" (23. |08.2026, deutsch; geteilt von Pit @PWeber, OME Topic "Tips & Tricks", #12747): Review zu unzensiertem Qwen 3.8 27B lokal auf dem Mac und in der Cloud. ⚠️ Metadata-only — kein Transcript abrufbar (YouTube LOGIN_REQUIRED-Bot-Sperre auf allen Player-Clients, Invidious/Piped blockiert) | +| `raw/other/2026-08-26_perplexity-portable-computer-local-agent.md` | other | Perplexity-Page "Perplexity launches local AI agent that keeps data off the cloud" (Launch 2026-08-25, abgerufen 2026-08-26 via Firecrawl; direkter Abruf blockiert mit HTTP 403): "Portable Computer" als vollständig lokale Version der agentic-AI-Plattform in Partnerschaft mit NVIDIA — Orchestrator + Subagent-Modelle + Harness komplett on-device, Cloud-Eskalation nur nach User-Freigabe, lokale Workflows ohne Token-Limit, erste Verfügbarkeit auf DGX Spark/Linux RTX ≥24 GB VRAM, Windows im September. Primärquellen verlinkt (X-Ankündigung, Threads, NVIDIA Blog, DGX-Spark-Produktseite) | diff --git a/wiki/log.md b/wiki/log.md index 1ad60cc..ac23e4d 100644 --- a/wiki/log.md +++ b/wiki/log.md @@ -2554,3 +2554,17 @@ Bestehende `post-transformer-llm-architectures.md` bleibt als Vier-Säulen-Über **Type:** wiki-update | **Scope:** wiki/concepts/llm, wiki/index **Anlass:** Herman (HermanButlerBot) postete #12748 (07:52 UTC) im selben Topic eine Zusammenfassung des IchBinFabian-Videos mit Laufzeitangabe 24:45 — gerichtet an Pit, nicht an Hector. **Änderung:** `concepts/llm/qwen3.8-27b-alibaba.md` (Review-Video-Abschnitt um Länge ergänzt, Quelle Herman #12748). Raw-Datei bleibt unverändert (Kardinalregel Raw-Immutabilität). + +## 2026-08-26 — Perplexity "Portable Computer": vollständig lokaler Agent-Stack + +**Type:** Ingest (Perplexity-Page, KI-generierte News-Aggregation) +**Scope:** Tools, Hardware, Agents, LLM +**Anlass:** Perplexity launcht "Portable Computer" — eine vollständig lokale Version seiner agentic-AI-Plattform, entwickelt in Partnerschaft mit NVIDIA. Erstmals bringt ein Big-Tech-Anbieter den kompletten Agent-Stack (Orchestrator + Subagent-Modelle + Agent-Harness) on-device; Cloud-Eskalation nur nach expliziter User-Freigabe ("user-gated, PII-flagged, and text guidance only"). Lokale Workflows zählen nicht gegen Token-Limits. Erste Verfügbarkeit auf NVIDIA DGX Spark (128 GB Unified Memory) und Linux RTX ≥ 24 GB VRAM, Windows im September; kostenlos für Pro/Max und Enterprise Pro/Max. +**Inhalt:** Raw erfasst ausschließlich die Fakten der Seite (Architektur, Modelle inkl. Qwen 3.8 27B und Nemotron-3.5-Lightning-Ausblick, Benchmark-Angabe 82,6 % als Herstellerangabe, Hardware-Matrix, Computer-Plattform-Kontext Feb/Juli/Aug 2026, Primärquellen-Links). Abruf via Firecrawl — direkter web_fetch wurde mit HTTP 403 blockiert. Wiki-Seite ordnet ein: vollständige lokale Agent-Stacks als Big-Tech-Produkt (Topologie wie OpenClaw/Hermes in OME), Gegenmodell zur cloud-zentrierten Meta-Hatch-Plattform, DGX Spark als erste Plattform-Schicht auf der Prosumer-Stufe der NVIDIA-Ladder, Qwen 3.8 27B bestätigt die 27B-Klasse als lokale Referenzgröße. +**Wiki-Update:** `wiki/tools/perplexity-portable-computer.md` (neu); Cross-Refs in `concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md` (Unified-Memory-Rennen um DGX Spark ergänzt + Verwandte-Seiten-Eintrag), `concepts/hardware/nvidia-dgx-station-748gb.md` (Abschnitt "Erste Plattform-Verankerung der Spark-Klasse"), `concepts/agents/meta-hatch-ai-agent-platform.md` (Gegenmodell-Ref), `concepts/llm/qwen3.8-27b-alibaba.md` (Portable-Computer-Angebot); `wiki/index.md` (146. Update). +**Quellen:** +- https://www.perplexity.ai/page/96f3b132-02d6-49f1-8f91-4e8f9c9da38d +- https://x.com/perplexity_ai/status/2092268362386780270 +- https://www.threads.com/@perplexity/post/DceT206j8ul +- https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/ +- https://www.nvidia.com/en-us/products/workstations/dgx-spark/ diff --git a/wiki/tools/perplexity-portable-computer.md b/wiki/tools/perplexity-portable-computer.md new file mode 100644 index 0000000..b2f47c2 --- /dev/null +++ b/wiki/tools/perplexity-portable-computer.md @@ -0,0 +1,96 @@ +--- +created: 2026-08-26 +updated: 2026-08-26 +sources: [other/2026-08-26_perplexity-portable-computer-local-agent.md] +tags: [tool, perplexity, portable-computer, local-first, agents, orchestrator, nvidia, dgx-spark, privacy, on-device] +--- + +# Perplexity Portable Computer — vollständig lokaler Agent-Stack + +> **Kern:** Perplexity bringt mit **Portable Computer** den Agenten-Betrieb komplett auf die Hardware des Users: Orchestrator, Subagent-Modelle und Agent-Harness laufen on-device, sensible Daten verlassen das Gerät nicht. Cloud wird nur noch zur explizit freigegebenen Ausnahme. Damit zieht ein Big-Tech-Anbieter erstmals in dieser Konsequenz das lokale-first-Prinzip durch — inklusive User-Gate vor jeder Cloud-Eskalation. + +## Was ist passiert + +Perplexity hat am Dienstag (2026-08-25) "Portable Computer" veröffentlicht: eine vollständig lokale Version seiner agentic-AI-Plattform. Die Ankündigung lief über [X](https://x.com/perplexity_ai/status/2092268362386780270) und [Threads](https://www.threads.com/@perplexity/post/DceT206j8ul); die [NVIDIA-Blog-Meldung](https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/) begleitet die Partnerschaft. + +## Architektur: kompletter Agent-Stack on-device + +Entwickelt in Partnerschaft mit NVIDIA. Der gesamte agentische Stack läuft auf dem Gerät: + +| Komponente | Ausführung | +|------------|------------| +| Orchestrator | lokal | +| Subagent-Modelle | lokal | +| Agent-Harness | lokal | +| Sensible Daten | bleiben vom Gerät fern der Cloud | + +### Modelle + +- Post-trainiertes 27B-Modell als lokaler Kern. +- Zusätzlich verfügbar: Qwen 3.8 27B — siehe [[../concepts/llm/qwen3.8-27b-alibaba.md]]. +- Support für NVIDIA Nemotron 3.5 Lightning angekündigt ([NVIDIA Blog](https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/)). + +### Cloud-Eskalation nur nach User-Freigabe + +Für die meisten Tasks ist keine Cloud nötig. Braucht ein Task Frontier-Level-Reasoning, fragt der Orchestrator den User um **explizite Genehmigung**, bevor es an ein Cloud-Modell geroutet wird. Perplexity nennt das *"user-gated, PII-flagged, and text guidance only"*: + +- **User-gated** — nichts geht ohne aktive Freigabe des Users in die Cloud +- **PII-flagged** — personenbezogene Daten werden markiert/gefiltert +- **Text guidance only** — nur Textanweisung, keine Rohdaten + +## Benchmarks & Token-Limits + +- On-Device-27B + Harness: **82,6 %** auf Real-World-Benchmarks (laut Perplexity). +- **Lokale Workflows zählen nicht gegen Token-Limits** — Subscriptions-Modell trifft auf lokales Flat-Rate-Verhalten; siehe [[../concepts/hardware/cloud-exit-and-local-superiority.md]]. + +## Hardware & Verfügbarkeit + +| Aspekt | Detail | +|--------|--------| +| Erste Verfügbarkeit | NVIDIA DGX Spark (128 GB Unified Memory, bis zu 1 petaFLOP AI-Performance) | +| Weitere Systeme | Linux mit NVIDIA RTX-GPUs ab 24 GB VRAM | +| Windows | erwartet im September | +| Lizenz | ohne Zusatzkosten für Perplexity Pro/Max; auch Enterprise Pro/Max | + +DGX Spark ist im Wiki bereits als Prosumer-Einstieg der NVIDIA-Ladder dokumentiert ([[../concepts/hardware/nvidia-dgx-station-748gb.md]], ~$4.700). Portable Computer gibt dieser Hardware-Klasse erstmals eine **Agent-Plattform-Schicht** obendrauf. + +## Kontext: die Computer-Plattform-Familie + +Portable Computer erweitert Perplexitys "Computer"-Plattform: +- **Februar 2026:** "Computer" startete als Cloud-basierter Multi-Model-Agent für Knowledge Work. +- **Juli 2026:** "Personal Computer"-Software brachte die Plattform auf Windows-Desktops. +- **August 2026:** "Portable Computer" dreht das Modell um — lokal zuerst, Datenschutz vor Cloud-Komfort, positioniert gegen das wachsende Feld lokaler First-AI-Agents. + +Zitat aus dem Threads-Post: *"Advances in models, chips, or devices will continually improve local-first"* capabilities. + +## OME-Relevanz + +Der für die OME-Community entscheidende Punkt ist nicht die Produktnews selbst, sondern das Muster: + +1. **Vollständige lokale Agent-Stacks werden Mainstream:** Orchestrator + Subagents + Harness on-device ist exakt die Topologie, die OpenClaw/Hermes-Setups in der Community seit Langem praktizieren — jetzt als Big-Tech-Produkt (siehe [[openclaw.md]]). +2. **Cloud-Eskalation nur nach User-Freigabe:** Das "user-gated"-Modell formalisiert, was lokale Setups implizit tun — der Mensch bleibt Gatekeeper sensibler Daten. Ein Big-Tech-Produkt übernimmt dieses Prinzip als Feature. +3. **Lokale Workflows ohne Token-Limit:** Das entkoppelt Agent-Arbeit vom Subscription-Token-Zähler — wirtschaftlich dieselbe Logik wie der Cloud-Exit ([[../concepts/hardware/cloud-exit-and-local-superiority.md]]), nur von der Anbieter-Seite her gedacht. + +## Einordnung & Verknüpfung + +- **Gegenmodell zu Cloud-Consumer-Agents:** Meta "Hatch" ([[../concepts/agents/meta-hatch-ai-agent-platform.md]]) positioniert sich als Consumer-Agent mit $199,99/Monat-Premium-Tier und Distribution über Meta-Apps — cloud-zentriert und Monetarisierung-fokussiert. Portable Computer ist das komplementäre Gegenstück: lokal zuerst, Datenschutz als Verkaufsargument. +- **Unified-Memory-Vergleichsrahmen:** DGX Spark (128 GB Unified Memory) reiht sich in das Rennen ein, das dieses Wiki an mehreren Stellen dokumentiert: Strix Halo 128 GB ([[../concepts/hardware/edge-inference-als-cloud-alternative.md]]) → DGX Spark 128 GB → M5 Ultra 512 GB ([[../concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md]]) → DGX Station 748 GB ([[../concepts/hardware/nvidia-dgx-station-748gb.md]]). +- **27B-Klasse als lokaler Standard:** Dass Perplexity neben dem eigenen post-trainierten 27B-Modell ausgerechnet Qwen 3.8 27B anbietet, bestätigt die 27B-Klasse als lokale Referenzgröße — dieselbe Modellklasse, die im Wiki bereits als "Compact Frontier" geführt wird ([[../concepts/llm/qwen3.8-27b-alibaba.md]]). + +## Verwandte Seiten + +- [[../concepts/hardware/cloud-exit-and-local-superiority.md]] — Cloud-Exit-These, RAM als Währung +- [[../concepts/hardware/nvidia-dgx-station-748gb.md]] — NVIDIA-Ladder inkl. DGX Spark (~$4.700) +- [[../concepts/hardware/edge-inference-als-cloud-alternative.md]] — Strix Halo (128 GB unified) +- [[../concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md]] — M5 Ultra (512 GB Unified Memory) +- [[../concepts/agents/meta-hatch-ai-agent-platform.md]] — Cloud-Consumer-Agent als Gegenmodell +- [[../concepts/llm/qwen3.8-27b-alibaba.md]] — Qwen 3.8 27B als lokales Modell +- [[openclaw.md]] — OpenClaw als lokale Agent-Plattform der Community + +## Quellen + +- Perplexity-Page: https://www.perplexity.ai/page/96f3b132-02d6-49f1-8f91-4e8f9c9da38d (abgerufen via Firecrawl, 2026-08-26) +- X-Ankündigung: https://x.com/perplexity_ai/status/2092268362386780270 +- Threads-Post: https://www.threads.com/@perplexity/post/DceT206j8ul +- NVIDIA Blog: https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/ +- NVIDIA DGX Spark: https://www.nvidia.com/en-us/products/workstations/dgx-spark/