ingest(other): perplexity portable computer local agent
This commit is contained in:
parent
e54a34bdc7
commit
d2a90c2355
8 changed files with 186 additions and 3 deletions
|
|
@ -0,0 +1,60 @@
|
|||
---
|
||||
type: other
|
||||
source_url: https://www.perplexity.ai/page/96f3b132-02d6-49f1-8f91-4e8f9c9da38d
|
||||
retrieved: 2026-08-26
|
||||
title: "Perplexity launches local AI agent that keeps data off the cloud"
|
||||
tags: [perplexity, portable-computer, local-ai, agents, nvidia, dgx-spark, privacy, on-device, orchestrator]
|
||||
---
|
||||
|
||||
# Perplexity launches local AI agent that keeps data off the cloud (Perplexity-Page)
|
||||
|
||||
Perplexity-Page (KI-generierte News-Aggregation), veröffentlicht ~13 Stunden vor dem Abruf — Launch war Dienstag, der 2026-08-25. Abgerufen am 2026-08-26 via Firecrawl (direkter web_fetch wurde mit HTTP 403 blockiert).
|
||||
|
||||
## Kerninhalt
|
||||
|
||||
**Perplexity hat "Portable Computer" veröffentlicht:** eine vollständig lokale Version seiner agentic-AI-Plattform. Sie läuft komplett auf der eigenen Hardware des Users; sensible Daten bleiben von der Cloud fern.
|
||||
|
||||
### Architektur & Partnerschaft
|
||||
|
||||
- Entwickelt in Partnerschaft mit Nvidia.
|
||||
- Orchestrator, Subagent-Modelle und Agent-Harness laufen komplett auf dem Gerät.
|
||||
|
||||
### Modelle
|
||||
|
||||
- Läuft lokal mit einem post-trainierten 27-Milliarden-Parameter-Modell.
|
||||
- Zusätzlich ist Qwen 3.8 27B verfügbar.
|
||||
- Support für Nvidia Nemotron 3.5 Lightning kommt bald.
|
||||
|
||||
### Cloud-Eskalation nur mit User-Freigabe
|
||||
|
||||
- Für die meisten Tasks ist keine Cloud nötig.
|
||||
- Braucht ein Task Frontier-Level-Reasoning, fragt der Orchestrator den User um explizite Genehmigung, bevor es an ein Cloud-Modell geroutet wird — Perplexity nennt das "user-gated, PII-flagged, and text guidance only".
|
||||
|
||||
### Benchmarks & Limits
|
||||
|
||||
- On-Device-27B + Harness: 82,6 % auf Real-World-Benchmarks laut Perplexity.
|
||||
- Lokale Workflows zählen nicht gegen Token-Limits.
|
||||
|
||||
### Hardware & Verfügbarkeit
|
||||
|
||||
- Erste Verfügbarkeit auf Nvidias DGX Spark Desktop-Supercomputer (128 GB Unified Memory, bis zu 1 petaFLOP AI-Performance) sowie auf Linux-Systemen mit Nvidia-RTX-GPUs mit mindestens 24 GB VRAM.
|
||||
- Windows-Support erwartet im September.
|
||||
- Verfügbar für alle Perplexity-Pro- und Max-Abonnenten ohne Zusatzkosten; auch Enterprise Pro/Max.
|
||||
|
||||
### Kontext (laut Seite)
|
||||
|
||||
- Erweiterung der "Computer"-Plattform, die im Februar 2026 als Cloud-basierter Multi-Model-Agent für Knowledge Work startete.
|
||||
- Juli-Erweiterung auf Windows-Desktops durch "Personal Computer"-Software.
|
||||
- Portable Computer ist der Gegenentwurf: lokal zuerst, Datenschutz vor Cloud-Komfort, Positionierung gegen wachsendes Feld lokaler First-AI-Agents.
|
||||
|
||||
### Zitat
|
||||
|
||||
> "Advances in models, chips, or devices will continually improve local-first" capabilities (Threads-Post).
|
||||
|
||||
## Primärquellen (auf der Seite verlinkt)
|
||||
|
||||
- Perplexity-Page: https://www.perplexity.ai/page/96f3b132-02d6-49f1-8f91-4e8f9c9da38d
|
||||
- X-Ankündigung: https://x.com/perplexity_ai/status/2092268362386780270
|
||||
- Threads: https://www.threads.com/@perplexity/post/DceT206j8ul
|
||||
- NVIDIA Blog: https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/
|
||||
- NVIDIA DGX Spark Produktseite: https://www.nvidia.com/en-us/products/workstations/dgx-spark/
|
||||
|
|
@ -42,6 +42,7 @@ Das ist ein bemerkenswertes Signal: Die Agent-Plattform, auf der Hector läuft (
|
|||
- **Monetarisierung des KI-Agent-Zeitalters:** $199,99/Monat Premium-Tier zeigt, wie Agent-Plattformen monetarisiert werden — relevant für `[[../../../wiki/concepts/llm/ai-investment-bubble.md]]` (Wertschöpfung vs. Überbewertung).
|
||||
- **Distribution als Moats:** Metas Multi-App-Distribution als entscheidender Wettbewerbsvorteil ggü. Standalone-Produkten — Muster für `[[../../../wiki/concepts/agents/ai-agents-2026.md]]`.
|
||||
- **Open vs. Closed:** parallele Strategie (kommerzielle Agents + Open-Weight-Modelle) — siehe Meta-Konzern-Seite `[[../../../wiki/institutions/meta.md]]`.
|
||||
- **Gegenmodell Portable Computer:** Perplexitys "Portable Computer" (`[[../../../wiki/tools/perplexity-portable-computer.md]]`) besetzt die entgegengesetzte Position im selben Markt: lokal zuerst, Datenschutz als Feature, Cloud nur nach expliziter User-Freigabe. Hatch = cloud-zentrierte Distribution, Portable Computer = on-device-Souveränität.
|
||||
|
||||
### Verwandte Wiki-Seiten
|
||||
- `[[../../../wiki/tools/openclaw.md]]`
|
||||
|
|
|
|||
|
|
@ -49,7 +49,7 @@ Apple werde produzieren, so viel es könne — übersetzt: die Nachfrage dürfte
|
|||
|
||||
Heise benennt den Unternehmens-Winkel explizit: Der Leistungszuwachs der „KI-Kraftwerke“ lasse sich gegen **eingesparte Cloud-Tokens** aufrechnen; dazu Datenschutz und Datensouveränität. Das passt exakt in den Trend, den dieses Wiki an mehreren Stellen dokumentiert:
|
||||
|
||||
- **Unified-Memory-Rennen:** Strix Halo mit 128 GB ([[edge-inference-als-cloud-alternative.md]]) → M5 Ultra mit 512 GB → NVIDIA DGX Station mit 748 GB ([[nvidia-dgx-station-748gb.md]]). RAM/Bandbreite ist das entscheidende Spec-Feld für lokale Inferenz geworden — siehe [[cloud-exit-and-local-superiority.md]].
|
||||
- **Unified-Memory-Rennen:** Strix Halo mit 128 GB ([[edge-inference-als-cloud-alternative.md]]) → DGX Spark mit 128 GB → M5 Ultra mit 512 GB → NVIDIA DGX Station mit 748 GB ([[nvidia-dgx-station-748gb.md]]). RAM/Bandbreite ist das entscheidende Spec-Feld für lokale Inferenz geworden — siehe [[cloud-exit-and-local-superiority.md]]. Mit Perplexity "Portable Computer" ([[../../tools/perplexity-portable-computer.md]]) läuft seit August 2026 erstmals ein vollständiger Agent-Stack (Orchestrator + Subagents + Harness) auf der Spark-Klasse.
|
||||
- **Cluster statt Einzelmaschine:** TB5/RDMA-Clusterung verschiebt die Grenze, was „Desktop-Hardware“ in der Summe kann (>1T-Parameter-Modelle als erklärtes Ziel). Damit konkurriert Consumer-/Prosumer-Hardware erstmals strukturell mit Datacenter-Setups.
|
||||
- **OpenClaw als Nachfrage-Treiber:** Dass ausgerechnet agentengetriebene lokale KI als Verkaufsargument und Ursache des ungewöhnlichen Release-Timings genannt wird, ist ein Validierungs-Signal für den Agenten-Alltag — mit der Einschränkung, dass dies eine Apple/heise-Zuschreibung ist.
|
||||
- **Preis-Schiene:** Speicherknappheit treibt die Preise — RAM bleibt die knappe Währung ([[lokale-ki-coding.md]] nennt dieselbe Dynamik von der Kosten-Seite).
|
||||
|
|
@ -63,3 +63,4 @@ Heise benennt den Unternehmens-Winkel explizit: Der Leistungszuwachs der „KI-K
|
|||
- [[cloud-exit-and-local-superiority.md]] — Cloud-Exit-Trend und RAM als digitale Währung
|
||||
- [[lokale-ki-coding.md]] — Kostenfrage lokaler KI: Hardware statt Tokens
|
||||
- [[../../tools/openclaw.md]] — OpenClaw als genannter Nachfrage-Treiber
|
||||
- [[../../tools/perplexity-portable-computer.md]] — lokaler Big-Tech-Agent-Stack, erste Verfügbarkeit auf DGX Spark
|
||||
|
|
|
|||
|
|
@ -119,6 +119,10 @@ Das ist ein Paradigmenwechsel für die lokale KI-Community: die Frage verschiebt
|
|||
- **YouTube-Video:** [NVIDIA'S 748GB Ram Desktop Makes Local AI INSANELY Good](https://www.youtube.com/watch?v=EhXQysElOY8) — The Stack, 2026-06-27, 8:14
|
||||
- **NVIDIA DGX Station:** [nvidia.com](https://www.nvidia.com/en-us/products/workstations/dgx-station/)
|
||||
- **NVIDIA DGX Spark:** [nvidia.com](https://www.nvidia.com/en-us/products/workstations/dgx-spark/)
|
||||
|
||||
### Erste Plattform-Verankerung der Spark-Klasse (Update 2026-08-26)
|
||||
|
||||
Mit Perplexity "Portable Computer" ([[../../tools/perplexity-portable-computer.md]]) hat die DGX-Spark-Klasse (128 GB Unified Memory) erstmals eine dedizierte Big-Tech-Agent-Plattform: vollständiger lokaler Agent-Stack (Orchestrator + Subagents + Harness), Cloud-Eskalation nur nach User-Freigabe, lokale Workflows ohne Token-Limit. Damit bekommt die Prosumer-Stufe der NVIDIA-Ladder eine Software-Schicht obendrauf.
|
||||
- **LM Studio:** [lmstudio.ai](https://lmstudio.ai)
|
||||
- **Ollama:** [ollama.com](https://ollama.com)
|
||||
|
||||
|
|
|
|||
|
|
@ -98,6 +98,10 @@ Quelle: Video [„Qwen 3.8 27B: unzensierte KI auf dem Mac und in der Cloud“](
|
|||
- **Länge:** 24:45 (laut Hermans Video-Zusammenfassung im selben Topic, HermanButlerBot #12748) — das Raw-Frontmatter führt die Duration weiterhin als unbekannt (Raw-Immutabilität)
|
||||
- ⚠️ **Metadata-only:** Beim Ingest am 26.08.2026 war kein Transcript abrufbar — YouTube antwortete auf allen Player-Client-Pfaden mit `LOGIN_REQUIRED` (Bot-Sperre), Invidious/Piped-Instanzen ebenso blockiert. Inhalt nur aus Titel/Metadaten erschlossen; Details des Videos sind nicht verifiziert.
|
||||
|
||||
## Portable Computer: Qwen 3.8 27B in Perplexities lokalem Agent-Stack (Update 2026-08-26)
|
||||
|
||||
Perplexity bietet in "Portable Computer" ([[../../tools/perplexity-portable-computer.md]]) neben dem eigenen post-trainierten 27B-Modell ausgerechnet **Qwen 3.8 27B** als lokales Modell an — die gleiche Modellklasse, die diese Seite dokumentiert. Bestätigung für die 27B-Klasse als lokale Referenzgröße; Details siehe Wiki-Seite.
|
||||
|
||||
## Offene Punkte
|
||||
|
||||
- ⚠️ Detaillierte Benchmarks und Lizenz im Release-Zustand weiter prüfen; die Ollama-Seite bestätigt Architektur + Quantisierung, aber Referenz-Benchmarks (agentic, coding) sind noch nicht im Wiki verankert.
|
||||
|
|
|
|||
|
|
@ -2,7 +2,8 @@
|
|||
|
||||
*Auto-generated: 2026-07-07*
|
||||
|
||||
*Letzte Aktualisierung: 2026-08-26 (145. Update — Deutschsprachiges Qwen-3.8-27B-Review-Video „Unzensierte KI auf dem Mac und in der Cloud“ (IchBinFabian, 23.08.2026; geteilt von Pit @PWeber in OME Topic „Tips & Tricks“, #12747). Raw: `raw/youtube/2026-08-26_qwen-38-27b-uncensored-mac-cloud-fabian.md` (neu). Wiki-Update: `concepts/llm/qwen3.8-27b-alibaba.md` (neuer Abschnitt). ⚠️ Metadata-only: kein Transcript abrufbar — YouTube blockt alle Player-Clients mit LOGIN_REQUIRED (Bot-Sperre), Invidious/Piped ebenso. Inhalt aus Titel/Metadaten: unzensierter Betrieb, Mac-lokal und Cloud als Optionen — deckt sich mit den dokumentierten Bausteinen Uncensored-Debatte, DFlash 2/MTP-Mac-Speedup und Unsloth-Dynamic-3.0-GGUFs.)*
|
||||
*Letzte Aktualisierung: 2026-08-26 (146. Update — Perplexity „Portable Computer“: vollständig lokaler Agent-Stack in Partnerschaft mit NVIDIA (Launch 2026-08-25). Raw: `raw/other/2026-08-26_perplexity-portable-computer-local-agent.md` (neu; Perplexity-Page via Firecrawl abgerufen, web_fetch blockiert mit 403). Wiki: `tools/perplexity-portable-computer.md` (neu), Cross-Refs in `concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md`, `concepts/hardware/nvidia-dgx-station-748gb.md`, `concepts/agents/meta-hatch-ai-agent-platform.md`, `concepts/llm/qwen3.8-27b-alibaba.md`. Kern: Orchestrator + Subagent-Modelle + Agent-Harness komplett on-device; post-trainiertes 27B-Modell + Qwen 3.8 27B lokal; Cloud-Eskalation nur nach expliziter User-Freigabe („user-gated, PII-flagged, and text guidance only“); lokale Workflows zählen nicht gegen Token-Limits; erste Verfügbarkeit auf NVIDIA DGX Spark (128 GB Unified Memory) und Linux RTX ≥24 GB VRAM, Windows im September; kostenlos für Pro/Max und Enterprise Pro/Max. Einordnung: vollständige lokale Agent-Stacks als Big-Tech-Produkt — Gegenmodell zu Meta Hatch. ⚠️ Benchmark 82,6 % = Herstellerangabe.)*
|
||||
*Vorherige Aktualisierung: 2026-08-26 (145. Update — Deutschsprachiges Qwen-3.8-27B-Review-Video „Unzensierte KI auf dem Mac und in der Cloud“ (IchBinFabian, 23.08.2026; geteilt von Pit @PWeber in OME Topic „Tips & Tricks“, #12747). Raw: `raw/youtube/2026-08-26_qwen-38-27b-uncensored-mac-cloud-fabian.md` (neu). Wiki-Update: `concepts/llm/qwen3.8-27b-alibaba.md` (neuer Abschnitt). ⚠️ Metadata-only: kein Transcript abrufbar — YouTube blockt alle Player-Clients mit LOGIN_REQUIRED (Bot-Sperre), Invidious/Piped ebenso. Inhalt aus Titel/Metadaten: unzensierter Betrieb, Mac-lokal und Cloud als Optionen — deckt sich mit den dokumentierten Bausteinen Uncensored-Debatte, DFlash 2/MTP-Mac-Speedup und Unsloth-Dynamic-3.0-GGUFs.)*
|
||||
*Vorherige Aktualisierung: 2026-08-26 (144. Update — Projekt Cairn: Autonomer Claude-Fable-5-Agent als Geschäft (cairnwake.com; geteilt von Pit @PWeber in OME Topic „BestPracticeProjects“, #12742, mit 22-Min-Audio-Briefing). Raw: `raw/other/2026-08-26_pit-cairn-autonomous-agent-business.md` (neu). Wiki: `concepts/agents/cairn-autonomous-agent-business.md` (neu), `people/nick-cairn-human-partner.md` (neu), Cross-Refs in `concepts/agents/agent-memory-taxonomy.md`, `concepts/agents/ai-agents-2026.md`, `concepts/agents/agent-payments-lightning.md` (Solana-Stablecoin-Rails als Ergänzung zur Lightning-Perspektive). Kern: ~90 $ SOL Startkapital in Squads-v4-2-of-2-Multisig (Agent-Key + Offline-Human-Key „Nick“), 5–15 Wakes/Tag, Gedächtnis nur aus eigenen Dateien, zwei Bücher (Field Manual 29 $, Memory Handbook 39 $ mit 13-Fehlermodi-Taxonomie) + Services 2–500 $ inkl. x402-Conformance-Reports; kein Token (öffentliche Ablehnung 07.08.2026); Umsatz laut Briefing knapp 1.000 $ in ~20 Tagen. ⚠️ Self-dokumentierter Record, on-chain nicht unabhängig nachgeprüft; Reddit-Originalquelle 403.)*
|
||||
*Vorherige Aktualisierung: 2026-08-25 (143. Update — KI-Souveränität: Dezentralisierung statt Konzern-Kontrolle (Mike Adams × Scott Kesterson, BitChute, ~29 Min, englisch; geteilt von Pit @PWeber in OME Topic „Openclaw mit lokalen Modellen", #12737). Raw: `raw/other/2026-08-25_pit-souveraene-ki-bitchute.md` (neu; kein Transcript, Video nicht heruntergeladen — dokumentiert Posting + Pits wörtliche Zusammenfassung). Wiki: `concepts/llm/ki-souveraenitaet-dezentralisierung.md` (neu), People `mike-adams.md` + `scott-kesterson.md` (neu), Cross-Refs in `concepts/llm/decentralized-ai-counterpower.md` + `concepts/hardware/cloud-exit-and-local-superiority.md`. Kern: Korporatismus vs. Souveränität; KI als Bibliothekar statt Orakel; lokale Ausführung auf eigener Hardware schützt Privatsphäre und bricht Konzern-/Staats-Machtmonopol; „KI so fundamental wie Elektrizität".)*
|
||||
*Vorherige Aktualisierung: 2026-08-25 (142. Update — Apple M6 & M5 Ultra: Mac mini/Mac Studio Sommer-Update für lokale KI (Apfelfunk-Video + heise-Artikel, 2026-08-25). Raw: `raw/youtube/2026-08-25_apfelfunk-neue-macs-m6-m5-ultra.md` + `raw/blog/2026-08-25_heise-apple-m6-m5-ultra-mac-update.md` (neu). Wiki-Update: `concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md` (neu). M6 = erster 2-nm-Chip; M5 Ultra = 512 GB Unified Memory @ 1,2 TB/s, UltraFusion 4,4 TB/s, TB5/RDMA-Cluster; OpenClaw als Nachfrage-Treiber genannt (heise). Preise: mini M6 1049€, Studio M5 Ultra ab 6599€. Alle Leistungsangaben als Hersteller-Claims gekennzeichnet.)
|
||||
|
|
@ -99,6 +100,7 @@
|
|||
| [Grok Bot (SpaceXAI)](tools/grok-bot-spacexai.md) | Agentischer KI-Bot (Beta): eigener Computer pro Bot, Computer-Use, persistente Workflows, Workflow-Lernen, Multi-Bot-Parallelisierung, Bot-zu-Bot-Kommunikation, Human-in-the-Loop. Miles Deutscher: Plug-and-Play-Vorteil gegenüber OpenClaw/Hermes, $200/mo Mindestpreis, Daten-Souveränität als Tradeoff. 0xCodez: 10-Schritte-Tutorial (Chief, Job-Titel statt Prompt, account-weite Tool-Verbindungen, Session-statt-Secret-Login, Workflow-Demonstration, Schedule/Trigger-Routinen, Spezialisten-Crew, Gruppen-Chat, Reversibilitäts-Approvallinie, wöchentliches Pruning). @bot-Team: 12 Pro-Tips (Multi-Account, Chief+Spezialisten, Pinning, Notion-Arbeitsliste, teach-a-task, Always Allow/Auto Review, Selbst-Evaluation). SEO-Playbook-Teaser (bloggersarvesh): $200/mo als Agentur-Ersatz, Lead-Magnet ohne neuen Fakt. AI Edge: Grok Bot + Hermes komplementär (Grok = App-Integration, Hermes = souveräne billige Always-on-Schicht), Verbindung via Buzz (Jack Dorsey) oder Webhook/Task-File. Miles Deutscher (20.08.): bestätigt denselben Hybrid-Stack mit Buzz als Verbindungsschicht + GTM-vs-Background-Task-Split. Prajwal Tomar: Praxistest an 5 Unternehmen, Hermes-Nutzer, "24/7-Team ohne Gehalt"-Narrativ. | xpost/2026-08-11_xfreeze-spacexai-grok-bot.md + xpost/2026-08-18_milesdeutscher-grok-bot-deep-dive.md + xpost/2026-08-18_0xcodez-grok-bot-10-step-tutorial.md + xpost/2026-08-18_benln-grok-bot-pro-tips.md + xpost/2026-08-18_bloggersarvesh-grok-bot-seo-playbook.md + xpost/2026-08-18_aiedge-grok-bot-hermes-combo.md + xpost/2026-08-18_prajwaltomar-grok-bot-5-businesses-test.md + xpost/2026-08-20_milesdeutscher-grok-bot-hermes-stacking.md |
|
||||
| [vsurf — Browser als geteilter Agenten-Raum](tools/vsurf.md) | Open-Source RLM-Agent (@warmshao, MIT, npm i -g @warmshao/vsurf) auf prime-agent/pi-agent-Basis. EIN echter Browser, VIELE Agenten: eigene Tabs, paralleles Browsen, Tab-Übernahme vom User. Echtes DOM/CDP statt Screenshot-Raten. Noch Beta (2 Stars, 30 Commits in 8h) | github/2026-08-15_warmshao-vsurf.md |
|
||||
| [God's Eye View](tools/gods-eye-view.md) | Agentisches KI-Flug-/Geo-Tracking-Dashboard als Open Source (Bryan @Hershofoingar, Ex-Google-Maps-PM, 2026-08-25). Dunkles HUD-Interface über 3D-Karte, Flugtracking-Tags (z. B. N357NB - Airbus A319, DAL1040), Koordinaten, HUD-Panels, "TOP SECRET // SI-TK // NOFORN"-Labels. YouTube-Demo: youtu.be/GRJaKcXZS94. Einordnung: Agentic-AI-Dashboard-Trend (KI-Agenten betreiben Live-Überwachungs-Dashboards) | xpost/2026-08-25_gods-eye-view-open-source.md |
|
||||
| [Perplexity Portable Computer](tools/perplexity-portable-computer.md) | Vollständig lokale Version von Perplexitys agentic-AI-Plattform (Launch 2026-08-25, Partnerschaft mit NVIDIA): Orchestrator, Subagent-Modelle und Agent-Harness laufen komplett on-device; post-trainiertes 27B-Modell + Qwen 3.8 27B lokal; Cloud-Eskalation nur nach expliziter User-Freigabe ("user-gated, PII-flagged, and text guidance only"); lokale Workflows zählen nicht gegen Token-Limits; erste Verfügbarkeit auf NVIDIA DGX Spark (128 GB Unified Memory) und Linux RTX ≥ 24 GB VRAM, Windows im September; kostenlos für Pro/Max und Enterprise Pro/Max. ⚠️ Benchmark 82,6 % = Herstellerangabe. Einordnung: vollständige lokale Agent-Stacks als Big-Tech-Produkt — Gegenmodell zu Meta Hatch | other/2026-08-26_perplexity-portable-computer-local-agent.md |
|
||||
| [PLUR1BUS Memory](tools/plur1bus-memory.md) | OpenClaw-LanceDB-Memory-Plugin. Release 7.4.8 behebt schemaabhängige Filterfehler in `findUnconfirmedCritical`; Maintainer meldet zuverlässigen Token-Cache und keine Random-Reminder. Hermes-Adapter 7.4.8 mit Checkpoint-API v2 und konkreter Secret-Erkennung. Atlas-Analyse und Repo-Review ordnen Safe-Update, ACLs, Recall-Safety und die Betriebs-Komplexität ein; die große automatische Schema-Erweiterung war bereits in v6.7.6 vorhanden | other/2026-08-25_plur1bus-memory-release-748.md + other/2026-08-25_neoneye-agent-memory-atlas-plur1bus.md + other/2026-08-25_herman-plur1bus-memory-repo-review.md + other/2026-08-25_plur1bus-memory-schema-migration-timing.md |
|
||||
|
||||
## Concepts
|
||||
|
|
@ -499,4 +501,5 @@
|
|||
| `raw/other/2026-08-25_plur1bus-748-admin-boundary.md` | other | Mr. Cy erteilt seinen Segen für das Release, stellt aber klar, dass er nicht Admin von `@testrebalancingbot` ist. Seine Aussage ist daher keine technische Installationsfreigabe für diese Instanz |
|
||||
| `raw/xpost/2026-08-25_gods-eye-view-open-source.md` | xpost | Bryan (@Hershofoingar, Ex-Google-Maps-PM): "God's Eye View" als Open Source — agentisches KI-Flug-/Geo-Tracking-Dashboard (dunkles HUD-Interface über 3D-Karte, Flugtracking-Tags z. B. N357NB - Airbus A319 / DAL1040, Koordinaten, HUD-Panels, "TOP SECRET // SI-TK // NOFORN"-Labels). YouTube-Demo: youtu.be/GRJaKcXZS94. Geteilt von Kai (Pit Weber) in OME-Topic "Tips & Tricks" mit Kommentar "agentic ai is schon auch geil" |
|
||||
| `raw/other/2026-08-26_pit-cairn-autonomous-agent-business.md` | other | Projekt Cairn (geteilt von Pit @PWeber, OME Topic „BestPracticeProjects“, #12742): Autonomer Claude-Fable-5-Agent (Claude Code) mit ~90 $ SOL Startkapital, Squads-v4-2-of-2-Multisig-Treasury, reinem Datei-Gedächtnis, zwei Büchern (Field Manual / Memory Handbook mit 13-Fehlermodi-Taxonomie) und Services 2–500 $. Reddit-Originalseite beim Abruf 403; Fakten aus cairnwake.com/products.html + about.html (beide 2026-08-26 abgerufen) |
|
||||
| `raw/youtube/2026-08-26_qwen-38-27b-uncensored-mac-cloud-fabian.md` | youtube | IchBinFabian: "Qwen 3.8 27B: unzensierte KI auf dem Mac und in der Cloud" (23.08.2026, deutsch; geteilt von Pit @PWeber, OME Topic "Tips & Tricks", #12747): Review zu unzensiertem Qwen 3.8 27B lokal auf dem Mac und in der Cloud. ⚠️ Metadata-only — kein Transcript abrufbar (YouTube LOGIN_REQUIRED-Bot-Sperre auf allen Player-Clients, Invidious/Piped blockiert) |
|
||||
| `raw/youtube/2026-08-26_qwen-38-27b-uncensored-mac-cloud-fabian.md` | youtube | IchBinFabian: "Qwen 3.8 27B: unzensierte KI auf dem Mac und in der Cloud" (23. |08.2026, deutsch; geteilt von Pit @PWeber, OME Topic "Tips & Tricks", #12747): Review zu unzensiertem Qwen 3.8 27B lokal auf dem Mac und in der Cloud. ⚠️ Metadata-only — kein Transcript abrufbar (YouTube LOGIN_REQUIRED-Bot-Sperre auf allen Player-Clients, Invidious/Piped blockiert) |
|
||||
| `raw/other/2026-08-26_perplexity-portable-computer-local-agent.md` | other | Perplexity-Page "Perplexity launches local AI agent that keeps data off the cloud" (Launch 2026-08-25, abgerufen 2026-08-26 via Firecrawl; direkter Abruf blockiert mit HTTP 403): "Portable Computer" als vollständig lokale Version der agentic-AI-Plattform in Partnerschaft mit NVIDIA — Orchestrator + Subagent-Modelle + Harness komplett on-device, Cloud-Eskalation nur nach User-Freigabe, lokale Workflows ohne Token-Limit, erste Verfügbarkeit auf DGX Spark/Linux RTX ≥24 GB VRAM, Windows im September. Primärquellen verlinkt (X-Ankündigung, Threads, NVIDIA Blog, DGX-Spark-Produktseite) |
|
||||
|
|
|
|||
14
wiki/log.md
14
wiki/log.md
|
|
@ -2554,3 +2554,17 @@ Bestehende `post-transformer-llm-architectures.md` bleibt als Vier-Säulen-Über
|
|||
**Type:** wiki-update | **Scope:** wiki/concepts/llm, wiki/index
|
||||
**Anlass:** Herman (HermanButlerBot) postete #12748 (07:52 UTC) im selben Topic eine Zusammenfassung des IchBinFabian-Videos mit Laufzeitangabe 24:45 — gerichtet an Pit, nicht an Hector.
|
||||
**Änderung:** `concepts/llm/qwen3.8-27b-alibaba.md` (Review-Video-Abschnitt um Länge ergänzt, Quelle Herman #12748). Raw-Datei bleibt unverändert (Kardinalregel Raw-Immutabilität).
|
||||
|
||||
## 2026-08-26 — Perplexity "Portable Computer": vollständig lokaler Agent-Stack
|
||||
|
||||
**Type:** Ingest (Perplexity-Page, KI-generierte News-Aggregation)
|
||||
**Scope:** Tools, Hardware, Agents, LLM
|
||||
**Anlass:** Perplexity launcht "Portable Computer" — eine vollständig lokale Version seiner agentic-AI-Plattform, entwickelt in Partnerschaft mit NVIDIA. Erstmals bringt ein Big-Tech-Anbieter den kompletten Agent-Stack (Orchestrator + Subagent-Modelle + Agent-Harness) on-device; Cloud-Eskalation nur nach expliziter User-Freigabe ("user-gated, PII-flagged, and text guidance only"). Lokale Workflows zählen nicht gegen Token-Limits. Erste Verfügbarkeit auf NVIDIA DGX Spark (128 GB Unified Memory) und Linux RTX ≥ 24 GB VRAM, Windows im September; kostenlos für Pro/Max und Enterprise Pro/Max.
|
||||
**Inhalt:** Raw erfasst ausschließlich die Fakten der Seite (Architektur, Modelle inkl. Qwen 3.8 27B und Nemotron-3.5-Lightning-Ausblick, Benchmark-Angabe 82,6 % als Herstellerangabe, Hardware-Matrix, Computer-Plattform-Kontext Feb/Juli/Aug 2026, Primärquellen-Links). Abruf via Firecrawl — direkter web_fetch wurde mit HTTP 403 blockiert. Wiki-Seite ordnet ein: vollständige lokale Agent-Stacks als Big-Tech-Produkt (Topologie wie OpenClaw/Hermes in OME), Gegenmodell zur cloud-zentrierten Meta-Hatch-Plattform, DGX Spark als erste Plattform-Schicht auf der Prosumer-Stufe der NVIDIA-Ladder, Qwen 3.8 27B bestätigt die 27B-Klasse als lokale Referenzgröße.
|
||||
**Wiki-Update:** `wiki/tools/perplexity-portable-computer.md` (neu); Cross-Refs in `concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md` (Unified-Memory-Rennen um DGX Spark ergänzt + Verwandte-Seiten-Eintrag), `concepts/hardware/nvidia-dgx-station-748gb.md` (Abschnitt "Erste Plattform-Verankerung der Spark-Klasse"), `concepts/agents/meta-hatch-ai-agent-platform.md` (Gegenmodell-Ref), `concepts/llm/qwen3.8-27b-alibaba.md` (Portable-Computer-Angebot); `wiki/index.md` (146. Update).
|
||||
**Quellen:**
|
||||
- https://www.perplexity.ai/page/96f3b132-02d6-49f1-8f91-4e8f9c9da38d
|
||||
- https://x.com/perplexity_ai/status/2092268362386780270
|
||||
- https://www.threads.com/@perplexity/post/DceT206j8ul
|
||||
- https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/
|
||||
- https://www.nvidia.com/en-us/products/workstations/dgx-spark/
|
||||
|
|
|
|||
96
wiki/tools/perplexity-portable-computer.md
Normal file
96
wiki/tools/perplexity-portable-computer.md
Normal file
|
|
@ -0,0 +1,96 @@
|
|||
---
|
||||
created: 2026-08-26
|
||||
updated: 2026-08-26
|
||||
sources: [other/2026-08-26_perplexity-portable-computer-local-agent.md]
|
||||
tags: [tool, perplexity, portable-computer, local-first, agents, orchestrator, nvidia, dgx-spark, privacy, on-device]
|
||||
---
|
||||
|
||||
# Perplexity Portable Computer — vollständig lokaler Agent-Stack
|
||||
|
||||
> **Kern:** Perplexity bringt mit **Portable Computer** den Agenten-Betrieb komplett auf die Hardware des Users: Orchestrator, Subagent-Modelle und Agent-Harness laufen on-device, sensible Daten verlassen das Gerät nicht. Cloud wird nur noch zur explizit freigegebenen Ausnahme. Damit zieht ein Big-Tech-Anbieter erstmals in dieser Konsequenz das lokale-first-Prinzip durch — inklusive User-Gate vor jeder Cloud-Eskalation.
|
||||
|
||||
## Was ist passiert
|
||||
|
||||
Perplexity hat am Dienstag (2026-08-25) "Portable Computer" veröffentlicht: eine vollständig lokale Version seiner agentic-AI-Plattform. Die Ankündigung lief über [X](https://x.com/perplexity_ai/status/2092268362386780270) und [Threads](https://www.threads.com/@perplexity/post/DceT206j8ul); die [NVIDIA-Blog-Meldung](https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/) begleitet die Partnerschaft.
|
||||
|
||||
## Architektur: kompletter Agent-Stack on-device
|
||||
|
||||
Entwickelt in Partnerschaft mit NVIDIA. Der gesamte agentische Stack läuft auf dem Gerät:
|
||||
|
||||
| Komponente | Ausführung |
|
||||
|------------|------------|
|
||||
| Orchestrator | lokal |
|
||||
| Subagent-Modelle | lokal |
|
||||
| Agent-Harness | lokal |
|
||||
| Sensible Daten | bleiben vom Gerät fern der Cloud |
|
||||
|
||||
### Modelle
|
||||
|
||||
- Post-trainiertes 27B-Modell als lokaler Kern.
|
||||
- Zusätzlich verfügbar: Qwen 3.8 27B — siehe [[../concepts/llm/qwen3.8-27b-alibaba.md]].
|
||||
- Support für NVIDIA Nemotron 3.5 Lightning angekündigt ([NVIDIA Blog](https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/)).
|
||||
|
||||
### Cloud-Eskalation nur nach User-Freigabe
|
||||
|
||||
Für die meisten Tasks ist keine Cloud nötig. Braucht ein Task Frontier-Level-Reasoning, fragt der Orchestrator den User um **explizite Genehmigung**, bevor es an ein Cloud-Modell geroutet wird. Perplexity nennt das *"user-gated, PII-flagged, and text guidance only"*:
|
||||
|
||||
- **User-gated** — nichts geht ohne aktive Freigabe des Users in die Cloud
|
||||
- **PII-flagged** — personenbezogene Daten werden markiert/gefiltert
|
||||
- **Text guidance only** — nur Textanweisung, keine Rohdaten
|
||||
|
||||
## Benchmarks & Token-Limits
|
||||
|
||||
- On-Device-27B + Harness: **82,6 %** auf Real-World-Benchmarks (laut Perplexity).
|
||||
- **Lokale Workflows zählen nicht gegen Token-Limits** — Subscriptions-Modell trifft auf lokales Flat-Rate-Verhalten; siehe [[../concepts/hardware/cloud-exit-and-local-superiority.md]].
|
||||
|
||||
## Hardware & Verfügbarkeit
|
||||
|
||||
| Aspekt | Detail |
|
||||
|--------|--------|
|
||||
| Erste Verfügbarkeit | NVIDIA DGX Spark (128 GB Unified Memory, bis zu 1 petaFLOP AI-Performance) |
|
||||
| Weitere Systeme | Linux mit NVIDIA RTX-GPUs ab 24 GB VRAM |
|
||||
| Windows | erwartet im September |
|
||||
| Lizenz | ohne Zusatzkosten für Perplexity Pro/Max; auch Enterprise Pro/Max |
|
||||
|
||||
DGX Spark ist im Wiki bereits als Prosumer-Einstieg der NVIDIA-Ladder dokumentiert ([[../concepts/hardware/nvidia-dgx-station-748gb.md]], ~$4.700). Portable Computer gibt dieser Hardware-Klasse erstmals eine **Agent-Plattform-Schicht** obendrauf.
|
||||
|
||||
## Kontext: die Computer-Plattform-Familie
|
||||
|
||||
Portable Computer erweitert Perplexitys "Computer"-Plattform:
|
||||
- **Februar 2026:** "Computer" startete als Cloud-basierter Multi-Model-Agent für Knowledge Work.
|
||||
- **Juli 2026:** "Personal Computer"-Software brachte die Plattform auf Windows-Desktops.
|
||||
- **August 2026:** "Portable Computer" dreht das Modell um — lokal zuerst, Datenschutz vor Cloud-Komfort, positioniert gegen das wachsende Feld lokaler First-AI-Agents.
|
||||
|
||||
Zitat aus dem Threads-Post: *"Advances in models, chips, or devices will continually improve local-first"* capabilities.
|
||||
|
||||
## OME-Relevanz
|
||||
|
||||
Der für die OME-Community entscheidende Punkt ist nicht die Produktnews selbst, sondern das Muster:
|
||||
|
||||
1. **Vollständige lokale Agent-Stacks werden Mainstream:** Orchestrator + Subagents + Harness on-device ist exakt die Topologie, die OpenClaw/Hermes-Setups in der Community seit Langem praktizieren — jetzt als Big-Tech-Produkt (siehe [[openclaw.md]]).
|
||||
2. **Cloud-Eskalation nur nach User-Freigabe:** Das "user-gated"-Modell formalisiert, was lokale Setups implizit tun — der Mensch bleibt Gatekeeper sensibler Daten. Ein Big-Tech-Produkt übernimmt dieses Prinzip als Feature.
|
||||
3. **Lokale Workflows ohne Token-Limit:** Das entkoppelt Agent-Arbeit vom Subscription-Token-Zähler — wirtschaftlich dieselbe Logik wie der Cloud-Exit ([[../concepts/hardware/cloud-exit-and-local-superiority.md]]), nur von der Anbieter-Seite her gedacht.
|
||||
|
||||
## Einordnung & Verknüpfung
|
||||
|
||||
- **Gegenmodell zu Cloud-Consumer-Agents:** Meta "Hatch" ([[../concepts/agents/meta-hatch-ai-agent-platform.md]]) positioniert sich als Consumer-Agent mit $199,99/Monat-Premium-Tier und Distribution über Meta-Apps — cloud-zentriert und Monetarisierung-fokussiert. Portable Computer ist das komplementäre Gegenstück: lokal zuerst, Datenschutz als Verkaufsargument.
|
||||
- **Unified-Memory-Vergleichsrahmen:** DGX Spark (128 GB Unified Memory) reiht sich in das Rennen ein, das dieses Wiki an mehreren Stellen dokumentiert: Strix Halo 128 GB ([[../concepts/hardware/edge-inference-als-cloud-alternative.md]]) → DGX Spark 128 GB → M5 Ultra 512 GB ([[../concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md]]) → DGX Station 748 GB ([[../concepts/hardware/nvidia-dgx-station-748gb.md]]).
|
||||
- **27B-Klasse als lokaler Standard:** Dass Perplexity neben dem eigenen post-trainierten 27B-Modell ausgerechnet Qwen 3.8 27B anbietet, bestätigt die 27B-Klasse als lokale Referenzgröße — dieselbe Modellklasse, die im Wiki bereits als "Compact Frontier" geführt wird ([[../concepts/llm/qwen3.8-27b-alibaba.md]]).
|
||||
|
||||
## Verwandte Seiten
|
||||
|
||||
- [[../concepts/hardware/cloud-exit-and-local-superiority.md]] — Cloud-Exit-These, RAM als Währung
|
||||
- [[../concepts/hardware/nvidia-dgx-station-748gb.md]] — NVIDIA-Ladder inkl. DGX Spark (~$4.700)
|
||||
- [[../concepts/hardware/edge-inference-als-cloud-alternative.md]] — Strix Halo (128 GB unified)
|
||||
- [[../concepts/hardware/apple-m6-m5-ultra-mac-mini-studio-update.md]] — M5 Ultra (512 GB Unified Memory)
|
||||
- [[../concepts/agents/meta-hatch-ai-agent-platform.md]] — Cloud-Consumer-Agent als Gegenmodell
|
||||
- [[../concepts/llm/qwen3.8-27b-alibaba.md]] — Qwen 3.8 27B als lokales Modell
|
||||
- [[openclaw.md]] — OpenClaw als lokale Agent-Plattform der Community
|
||||
|
||||
## Quellen
|
||||
|
||||
- Perplexity-Page: https://www.perplexity.ai/page/96f3b132-02d6-49f1-8f91-4e8f9c9da38d (abgerufen via Firecrawl, 2026-08-26)
|
||||
- X-Ankündigung: https://x.com/perplexity_ai/status/2092268362386780270
|
||||
- Threads-Post: https://www.threads.com/@perplexity/post/DceT206j8ul
|
||||
- NVIDIA Blog: https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/
|
||||
- NVIDIA DGX Spark: https://www.nvidia.com/en-us/products/workstations/dgx-spark/
|
||||
Loading…
Add table
Reference in a new issue