wiki-update(tools): portable computer benchmark details + hardware facts

This commit is contained in:
Hector 2026-08-26 13:42:59 +02:00
parent ceffe386d2
commit e26eb540db
2 changed files with 25 additions and 8 deletions

View file

@ -2619,3 +2619,11 @@ Bestehende `post-transformer-llm-architectures.md` bleibt als Vier-Säulen-Über
- https://tech.yahoo.com/ai/gemini/articles/alibaba-release-qwen-3-8-211604965.html - https://tech.yahoo.com/ai/gemini/articles/alibaba-release-qwen-3-8-211604965.html
- https://forums.developer.nvidia.com/t/qwen3-8-flash-next/381228 - https://forums.developer.nvidia.com/t/qwen3-8-flash-next/381228
- https://www.reuters.com/business/retail-consumer/alibaba-set-open-down-8-hong-kong-after-102-billion-share-placement-plan-2026-08-24/ - https://www.reuters.com/business/retail-consumer/alibaba-set-open-down-8-hong-kong-after-102-billion-share-placement-plan-2026-08-24/
## 2026-08-26 — Portable Computer: Benchmark-Detailnachschub (MarkTechPost-verifiziert)
**Type:** wiki-update (tools) | **Scope:** wiki/tools/perplexity-portable-computer.md
**Anlass:** Hermans vollständige Aufdröselung im Topic (#12757, Redelivery #12779) nannte Vergleichszahlen, die in der Seite noch fehlten; Verifikation gegen den MarkTechPost-Artikel per web_fetch.
**Inhalt/Änderungen:** Benchmark-Tabelle vervollständigt — PPLX 27B 85,4 % auf dem Eigenbench; BrowseComp 66,7 % vs Pi 50,2/Hermes 43,9 (zugleich 51 % Wall-Time, 70 % Tokens vs Pi); ParseBench-100 65,1 % vs Hermes 34,6/Pi 13,9; Terminal Bench 2.1: lokal 59,6 % (~$0) / mit Advisor 73,0 % (~$0,42/Rollout) / Claude Opus 5 pur 82,4 % (~$0,65/Rollout). Neue Caveats: BrowseComp-Vorteil teils eigene Suchinfrastruktur vs Brave; Hybrid-Rechnung als informativster Datenpunkt. Hardware-Zeilen ergänzt: Qwen 3.8 27B ausgeliefert als 3-Bit/17,4 GB (32 GB RAM nötig), Nemotron 3.5 Lightning offen als 30B-MoE 4-Bit/19 GB (36 GB RAM), macOS nicht auf Roadmap, nur eine DGX Spark pro Launch-Setup, apt-Repo-Installation. Bring-your-own-Model/Server aufgenommen; MarkTechPost + Tech-Blog in den Quellen.
**Quellen:**
- https://www.marktechpost.com/2026/08/25/perplexity-ships-portable-computer-on-nvidia-dgx-spark-local-harness-os-enforced-sandbox-and-zero-per-token-cost-for-local-steps/

View file

@ -1,7 +1,7 @@
--- ---
created: 2026-08-26 created: 2026-08-26
updated: 2026-08-26 updated: 2026-08-26
sources: [other/2026-08-26_perplexity-portable-computer-local-agent.md] sources: [other/2026-08-26_perplexity-portable-computer-local-agent.md, blog/2026-08-26_perplexity-local-first-agent-blog.md]
tags: [tool, perplexity, portable-computer, local-first, agents, orchestrator, nvidia, dgx-spark, privacy, on-device] tags: [tool, perplexity, portable-computer, local-first, agents, orchestrator, nvidia, dgx-spark, privacy, on-device]
--- ---
@ -28,7 +28,8 @@ Entwickelt in Partnerschaft mit NVIDIA. Der gesamte agentische Stack läuft auf
- Post-trainiertes 27B-Modell als lokaler Kern. - Post-trainiertes 27B-Modell als lokaler Kern.
- Zusätzlich verfügbar: Qwen 3.8 27B — siehe [[../concepts/llm/qwen3.8-27b-alibaba.md]]. - Zusätzlich verfügbar: Qwen 3.8 27B — siehe [[../concepts/llm/qwen3.8-27b-alibaba.md]].
- Support für NVIDIA Nemotron 3.5 Lightning angekündigt ([NVIDIA Blog](https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/)). - Support für NVIDIA Nemotron 3.5 Lightning angekündigt ([NVIDIA Blog](https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/)) — offen, 30B-MoE.
- Bring-your-own-Model/-Inference-Server wird unterstützt.
### Cloud-Eskalation nur nach User-Freigabe ### Cloud-Eskalation nur nach User-Freigabe
@ -48,8 +49,12 @@ Für die meisten Tasks ist keine Cloud nötig. Braucht ein Task Frontier-Level-R
| Aspekt | Detail | | Aspekt | Detail |
|--------|--------| |--------|--------|
| Erste Verfügbarkeit | NVIDIA DGX Spark (128 GB Unified Memory, bis zu 1 petaFLOP AI-Performance) | | Erste Verfügbarkeit | NVIDIA DGX Spark (128 GB Unified Memory, bis zu 1 petaFLOP AI-Performance) |
| Weitere Systeme | Linux mit NVIDIA RTX-GPUs ab 24 GB VRAM | | Weitere Systeme | Linux mit NVIDIA RTX-GPUs ab 24 GB VRAM (DGX OS oder Ubuntu, ARM/x64; Installation via apt-Repo) |
| Windows | erwartet im September | | Windows | erwartet im September |
| macOS | laut MarkTechPost nicht auf der Roadmap |
| Auslieferung Qwen 3.8 27B | 3-Bit-Quantisierung, 17,4 GB Download, benötigt 32 GB RAM |
| Nemotron 3.5 Lightning (angekündigt) | offenes 30B-MoE, 4-Bit, 19 GB, benötigt 36 GB RAM |
| Cluster | Launch unterstützt nur eine DGX Spark pro Setup; Clustering als Roadmap-Item |
| Lizenz | ohne Zusatzkosten für Perplexity Pro/Max; auch Enterprise Pro/Max | | Lizenz | ohne Zusatzkosten für Perplexity Pro/Max; auch Enterprise Pro/Max |
DGX Spark ist im Wiki bereits als Prosumer-Einstieg der NVIDIA-Ladder dokumentiert ([[../concepts/hardware/nvidia-dgx-station-748gb.md]], ~$4.700). Portable Computer gibt dieser Hardware-Klasse erstmals eine **Agent-Plattform-Schicht** obendrauf. DGX Spark ist im Wiki bereits als Prosumer-Einstieg der NVIDIA-Ladder dokumentiert ([[../concepts/hardware/nvidia-dgx-station-748gb.md]], ~$4.700). Portable Computer gibt dieser Hardware-Klasse erstmals eine **Agent-Plattform-Schicht** obendrauf.
@ -92,14 +97,16 @@ Aus dem offiziellen Tech-Blogpost ([[../../raw/blog/2026-08-26_perplexity-local-
## Benchmarks (Herstellerangaben, vendor-self-run auf DGX Spark) ## Benchmarks (Herstellerangaben, vendor-self-run auf DGX Spark)
Als Gegner dienten öffentliche Open-Source-Harnesses mit demselben Qwen-3.8-27B-Basismodell — methodisch sauberer als übliches Vendor-Selfplay, aber weiterhin Eigenangabe: Als Gegner dienten öffentliche Open-Source-Harnesses mit demselben Qwen-3.8-27B-Basismodell — methodisch sauberer als übliches Vendor-Selfplay, aber weiterhin Eigenangabe. Der 53-Task-Eigenbench (Deep Research, Finanzanalyse, Dokumentenerstellung) soll open-sourced werden:
| Benchmark | Portable Computer | Vergleich | | Benchmark | Portable Computer | Vergleich |
|---|---|---| |---|---|---|
| Eigenbench (53 Knowledge-Work-Tasks) | 82,6 % | Pi 77,6 % / Hermes 74,0 % | | Local Knowledge Work Bench (53 Tasks) | 82,6 % (Qwen 3.8 27B) / **85,4 % (PPLX 27B)** | Pi 77,6 % / Hermes 74,0 % (je gleiches Basismodell) |
| BrowseComp | 66,7 % | — | | BrowseComp | 66,7 % — zugleich 51 % weniger Wall-Time und 70 % weniger Tokens als Pi | Pi 50,2 % / Hermes 43,9 % |
| ParseBench | 65,1 % | — | | ParseBench-100 (visuelle Dokumente) | 65,1 % | Hermes 34,6 % / Pi 13,9 % |
| TerminalBench | 59,6 % lokal | 73 % mit Opus-4.5-Advisor | | Terminal Bench 2.1 | 59,6 % rein lokal (~$0/Rollout) | 73,0 % mit Advisor (~$0,42/Rollout); Claude Opus 5 pur: 82,4 % (~$0,65/Rollout) |
**Caveats:** Der BrowseComp-Vorteil speist sich teils daraus, dass Computer Perplexitys eigene Suchinfrastruktur nutzt, während Pi/Hermes „nur" Brave anbinden. Informativster Datenpunkt ist die Hybrid-Rechnung aus Terminal Bench 2.1: Advisor-Eskalation verkürzt die Frontier-Lücke (59,6 → 73,0 % bei ~64 % der Kosten eines reinen Frontier-Runs), schließt sie aber nicht (Opus 5 pur: 82,4 %).
## Verwandte Seiten ## Verwandte Seiten
@ -114,6 +121,8 @@ Als Gegner dienten öffentliche Open-Source-Harnesses mit demselben Qwen-3.8-27B
## Quellen ## Quellen
- Perplexity-Page: https://www.perplexity.ai/page/96f3b132-02d6-49f1-8f91-4e8f9c9da38d (abgerufen via Firecrawl, 2026-08-26) - Perplexity-Page: https://www.perplexity.ai/page/96f3b132-02d6-49f1-8f91-4e8f9c9da38d (abgerufen via Firecrawl, 2026-08-26)
- Tech-Blog: https://www.perplexity.ai/hub/blog/a-local-first-agent-for-private-and-cost-effective-knowledge-work
- MarkTechPost (Benchmark-/Hardware-Details): https://www.marktechpost.com/2026/08/25/perplexity-ships-portable-computer-on-nvidia-dgx-spark-local-harness-os-enforced-sandbox-and-zero-per-token-cost-for-local-steps/
- X-Ankündigung: https://x.com/perplexity_ai/status/2092268362386780270 - X-Ankündigung: https://x.com/perplexity_ai/status/2092268362386780270
- Threads-Post: https://www.threads.com/@perplexity/post/DceT206j8ul - Threads-Post: https://www.threads.com/@perplexity/post/DceT206j8ul
- NVIDIA Blog: https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/ - NVIDIA Blog: https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/