knowledge-base/raw/youtube/2026-08-18_qwen-38-27b-ollama-julian-goldie.md
Hector f0d95da1cf ingest(youtube): qwen-3.8-27b-ollama-julian-goldie
- raw/youtube/2026-08-18_qwen-38-27b-ollama-julian-goldie.md (neu)
- wiki/concepts/llm/qwen3.8-27b-alibaba.md (Update: Ollama-Verfügbarkeit + MTP)
- wiki/people/julian-goldie-seo.md (neu)
- wiki/index.md (97. Update)
- wiki/log.md (Eintrag)
2026-08-18 18:37:52 +02:00

2.6 KiB
Raw Blame History

type source_url retrieved channel channel_url title has_transcript shared_by shared_in tags
youtube https://www.youtube.com/watch?v=5wJePx3FG0o 2026-08-18 Julian Goldie SEO https://www.youtube.com/@JulianGoldieSEO Qwen 3.8 27B is NOW on Ollama… This is CRAZY! false @PWeber (Kai) OME-Gruppe, Topic 'Tips & Tricks'
qwen
qwen3.8
27b
ollama
local-llm
mtp
alibaba

Qwen 3.8 27B is NOW on Ollama… This is CRAZY! — Video-Rohdaten

Video-Metadaten

Inhalt (neutrale Zusammenfassung)

Das Video behandelt die Verfügbarkeit von Qwen 3.8 27B auf Ollama für lokale Bereitstellung. Thematisch gehört es in den laufenden Diskurs um das kompakte 27B-Modell der Qwen3.8-Generation.

Zusammenhängende technische Fakten (aus dem Diskussions-Kontext des Topic + ergänzenden Quellen):

  • Qwen 3.8 27B ist ein dichtes 27,8-Milliarden-Parameter-Modell von Alibaba, jetzt über Ollama lauffähig.
  • Start via ollama run qwen3.8:27b; Standard-Build ist eine 18-GB-Q4_K_M-Quantisierung, geeignet für ≥24 GB VRAM, CPU-Offload bei weniger VRAM.
  • Hybrid-Attention-Architektur (linear + full attention) für lange Kontexte und schnelle Inferenz.
  • Natives Kontextfenster: 262.144 Token, erweiterbar auf ~1 Million Token über YaRN-Scaling.
  • Optimiert für Coding, professionelles Arbeiten, Recherche und lang-horizontige agentische Aufgaben; native Bild- und Video-Understanding-Unterstützung.
  • MTP (Multi-Token Prediction): Modell sagt mehrere künftige Token gleichzeitig voraus, die dann verifiziert werden — bei Treffern werden mehrere Token in einem Schritt akzeptiert → deutliche Inferenz-Beschleunigung ohne Qualitätsverlust. Bei Qwen 3.6 27B demonstrierte MTP einen ~1.71× Durchsatz-Speedup.
  • Ollama-Tags: Das Modell erscheint mit mehreren Tags in Ollama, darunter MTP-markierte Varianten (Spezifikations-Kopf --spec-type draft-mtp).