diff --git a/wiki/log.md b/wiki/log.md index 078f3cb..5351bd6 100644 --- a/wiki/log.md +++ b/wiki/log.md @@ -2619,3 +2619,11 @@ Bestehende `post-transformer-llm-architectures.md` bleibt als Vier-Säulen-Über - https://tech.yahoo.com/ai/gemini/articles/alibaba-release-qwen-3-8-211604965.html - https://forums.developer.nvidia.com/t/qwen3-8-flash-next/381228 - https://www.reuters.com/business/retail-consumer/alibaba-set-open-down-8-hong-kong-after-102-billion-share-placement-plan-2026-08-24/ + +## 2026-08-26 — Portable Computer: Benchmark-Detailnachschub (MarkTechPost-verifiziert) + +**Type:** wiki-update (tools) | **Scope:** wiki/tools/perplexity-portable-computer.md +**Anlass:** Hermans vollständige Aufdröselung im Topic (#12757, Redelivery #12779) nannte Vergleichszahlen, die in der Seite noch fehlten; Verifikation gegen den MarkTechPost-Artikel per web_fetch. +**Inhalt/Änderungen:** Benchmark-Tabelle vervollständigt — PPLX 27B 85,4 % auf dem Eigenbench; BrowseComp 66,7 % vs Pi 50,2/Hermes 43,9 (zugleich −51 % Wall-Time, −70 % Tokens vs Pi); ParseBench-100 65,1 % vs Hermes 34,6/Pi 13,9; Terminal Bench 2.1: lokal 59,6 % (~$0) / mit Advisor 73,0 % (~$0,42/Rollout) / Claude Opus 5 pur 82,4 % (~$0,65/Rollout). Neue Caveats: BrowseComp-Vorteil teils eigene Suchinfrastruktur vs Brave; Hybrid-Rechnung als informativster Datenpunkt. Hardware-Zeilen ergänzt: Qwen 3.8 27B ausgeliefert als 3-Bit/17,4 GB (32 GB RAM nötig), Nemotron 3.5 Lightning offen als 30B-MoE 4-Bit/19 GB (36 GB RAM), macOS nicht auf Roadmap, nur eine DGX Spark pro Launch-Setup, apt-Repo-Installation. Bring-your-own-Model/Server aufgenommen; MarkTechPost + Tech-Blog in den Quellen. +**Quellen:** +- https://www.marktechpost.com/2026/08/25/perplexity-ships-portable-computer-on-nvidia-dgx-spark-local-harness-os-enforced-sandbox-and-zero-per-token-cost-for-local-steps/ diff --git a/wiki/tools/perplexity-portable-computer.md b/wiki/tools/perplexity-portable-computer.md index 4ba8efa..018964a 100644 --- a/wiki/tools/perplexity-portable-computer.md +++ b/wiki/tools/perplexity-portable-computer.md @@ -1,7 +1,7 @@ --- created: 2026-08-26 updated: 2026-08-26 -sources: [other/2026-08-26_perplexity-portable-computer-local-agent.md] +sources: [other/2026-08-26_perplexity-portable-computer-local-agent.md, blog/2026-08-26_perplexity-local-first-agent-blog.md] tags: [tool, perplexity, portable-computer, local-first, agents, orchestrator, nvidia, dgx-spark, privacy, on-device] --- @@ -28,7 +28,8 @@ Entwickelt in Partnerschaft mit NVIDIA. Der gesamte agentische Stack läuft auf - Post-trainiertes 27B-Modell als lokaler Kern. - Zusätzlich verfügbar: Qwen 3.8 27B — siehe [[../concepts/llm/qwen3.8-27b-alibaba.md]]. -- Support für NVIDIA Nemotron 3.5 Lightning angekündigt ([NVIDIA Blog](https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/)). +- Support für NVIDIA Nemotron 3.5 Lightning angekündigt ([NVIDIA Blog](https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/)) — offen, 30B-MoE. +- Bring-your-own-Model/-Inference-Server wird unterstützt. ### Cloud-Eskalation nur nach User-Freigabe @@ -48,8 +49,12 @@ Für die meisten Tasks ist keine Cloud nötig. Braucht ein Task Frontier-Level-R | Aspekt | Detail | |--------|--------| | Erste Verfügbarkeit | NVIDIA DGX Spark (128 GB Unified Memory, bis zu 1 petaFLOP AI-Performance) | -| Weitere Systeme | Linux mit NVIDIA RTX-GPUs ab 24 GB VRAM | +| Weitere Systeme | Linux mit NVIDIA RTX-GPUs ab 24 GB VRAM (DGX OS oder Ubuntu, ARM/x64; Installation via apt-Repo) | | Windows | erwartet im September | +| macOS | laut MarkTechPost nicht auf der Roadmap | +| Auslieferung Qwen 3.8 27B | 3-Bit-Quantisierung, 17,4 GB Download, benötigt 32 GB RAM | +| Nemotron 3.5 Lightning (angekündigt) | offenes 30B-MoE, 4-Bit, 19 GB, benötigt 36 GB RAM | +| Cluster | Launch unterstützt nur eine DGX Spark pro Setup; Clustering als Roadmap-Item | | Lizenz | ohne Zusatzkosten für Perplexity Pro/Max; auch Enterprise Pro/Max | DGX Spark ist im Wiki bereits als Prosumer-Einstieg der NVIDIA-Ladder dokumentiert ([[../concepts/hardware/nvidia-dgx-station-748gb.md]], ~$4.700). Portable Computer gibt dieser Hardware-Klasse erstmals eine **Agent-Plattform-Schicht** obendrauf. @@ -92,14 +97,16 @@ Aus dem offiziellen Tech-Blogpost ([[../../raw/blog/2026-08-26_perplexity-local- ## Benchmarks (Herstellerangaben, vendor-self-run auf DGX Spark) -Als Gegner dienten öffentliche Open-Source-Harnesses mit demselben Qwen-3.8-27B-Basismodell — methodisch sauberer als übliches Vendor-Selfplay, aber weiterhin Eigenangabe: +Als Gegner dienten öffentliche Open-Source-Harnesses mit demselben Qwen-3.8-27B-Basismodell — methodisch sauberer als übliches Vendor-Selfplay, aber weiterhin Eigenangabe. Der 53-Task-Eigenbench (Deep Research, Finanzanalyse, Dokumentenerstellung) soll open-sourced werden: | Benchmark | Portable Computer | Vergleich | |---|---|---| -| Eigenbench (53 Knowledge-Work-Tasks) | 82,6 % | Pi 77,6 % / Hermes 74,0 % | -| BrowseComp | 66,7 % | — | -| ParseBench | 65,1 % | — | -| TerminalBench | 59,6 % lokal | 73 % mit Opus-4.5-Advisor | +| Local Knowledge Work Bench (53 Tasks) | 82,6 % (Qwen 3.8 27B) / **85,4 % (PPLX 27B)** | Pi 77,6 % / Hermes 74,0 % (je gleiches Basismodell) | +| BrowseComp | 66,7 % — zugleich 51 % weniger Wall-Time und 70 % weniger Tokens als Pi | Pi 50,2 % / Hermes 43,9 % | +| ParseBench-100 (visuelle Dokumente) | 65,1 % | Hermes 34,6 % / Pi 13,9 % | +| Terminal Bench 2.1 | 59,6 % rein lokal (~$0/Rollout) | 73,0 % mit Advisor (~$0,42/Rollout); Claude Opus 5 pur: 82,4 % (~$0,65/Rollout) | + +**Caveats:** Der BrowseComp-Vorteil speist sich teils daraus, dass Computer Perplexitys eigene Suchinfrastruktur nutzt, während Pi/Hermes „nur" Brave anbinden. Informativster Datenpunkt ist die Hybrid-Rechnung aus Terminal Bench 2.1: Advisor-Eskalation verkürzt die Frontier-Lücke (59,6 → 73,0 % bei ~64 % der Kosten eines reinen Frontier-Runs), schließt sie aber nicht (Opus 5 pur: 82,4 %). ## Verwandte Seiten @@ -114,6 +121,8 @@ Als Gegner dienten öffentliche Open-Source-Harnesses mit demselben Qwen-3.8-27B ## Quellen - Perplexity-Page: https://www.perplexity.ai/page/96f3b132-02d6-49f1-8f91-4e8f9c9da38d (abgerufen via Firecrawl, 2026-08-26) +- Tech-Blog: https://www.perplexity.ai/hub/blog/a-local-first-agent-for-private-and-cost-effective-knowledge-work +- MarkTechPost (Benchmark-/Hardware-Details): https://www.marktechpost.com/2026/08/25/perplexity-ships-portable-computer-on-nvidia-dgx-spark-local-harness-os-enforced-sandbox-and-zero-per-token-cost-for-local-steps/ - X-Ankündigung: https://x.com/perplexity_ai/status/2092268362386780270 - Threads-Post: https://www.threads.com/@perplexity/post/DceT206j8ul - NVIDIA Blog: https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/