Gerücht: Qwen3.8-27B lässt weiter auf sich warten
Kurz gesagt: Alibaba hatte für die Woche ab dem 10. August 2026 offene Gewichte für das kompakte KI-Modell Qwen3.8-27B versprochen - bislang ist nichts erschienen, nur die deutlich größere Variante Qwen3.8-Max (2,4 Billionen Parameter) wurde laut mehreren Trackern am 13. August freigegeben. Auf Reddit vertreibt sich die LocalLLaMA-Community die Wartezeit mit Spekulationen über drei von Qwen angeteaserte Verbesserungsfelder - Bildverständnis, Agenten-Fähigkeiten und den Denkmodus -, konkrete Spezifikationen oder Benchmarks zur 27B-Version gibt es bislang nicht.
Symbolbild: KI-generiert
Wer auf ein handliches, lokal betreibbares KI-Modell von Alibaba wartet, braucht weiter Geduld: Qwen3.8-27B, die kompakte Variante mit rund 27 Milliarden Parametern, sollte laut Ankündigung eigentlich in der Woche ab dem 10. August 2026 mit offenen Gewichten erscheinen - passiert ist bislang nichts. Im Reddit-Forum r/LocalLLaMA vertreiben sich Nutzer die Wartezeit inzwischen mit einer Wunschliste an Funktionen, garniert mit einem Insider-Scherz: Ein Nutzer wünscht sich für den Denkmodus einen Regler mit den Stufen "high", "xhigh" und augenzwinkernd "monk" - reine Fantasie, keine offizielle Ankündigung.
Das grosse Modell ist da, das kleine fehlt
Konkreter wird es beim großen Schwestermodell: Qwen3.8-Max, mit 2,4 Billionen Gesamt- und rund 95 Milliarden aktiven Parametern das Flaggschiff der Reihe, wurde laut dem Tracking-Portal OrcaRouter am 13. August tatsächlich mit offenen Gewichten veröffentlicht - ein Gerücht dazu hatte SmartHome Kompass bereits einen Tag zuvor eingeordnet. Für die kleinere 27B-Version, die auf einzelnen Consumer-Grafikkarten laufen soll, gibt es laut OrcaRouter dagegen weiterhin keinen neuen Termin.
Was zur 27B-Version bekannt ist - und was nicht
Bestätigt sind bislang nur grobe Eckdaten: rund 27 Milliarden Parameter und, basierend auf Community-Schätzungen zum Vorgänger, ein Speicherbedarf von etwa 16 Gigabyte VRAM in stark komprimierter Quantisierung auf einer RTX 4090. Ob das Modell dicht oder als Mixture-of-Experts aufgebaut ist, welche Kontextlänge und Lizenz es bekommt und wie es in Benchmarks gegenüber Konkurrenten wie Llama oder DeepSeek abschneidet, ist nach Angaben von OrcaRouter bislang komplett offen - unabhängige Benchmark-Zahlen existieren für diese Modellgröße noch nicht.
Drei angeteaserte Verbesserungen
Laut dem Reddit-Beitrag hat Qwen auf einer eigenen Ankündigungsseite drei Verbesserungsfelder benannt: bessere Bildverarbeitung (VLM), erweiterte Agenten-Fähigkeiten und einen überarbeiteten Denkmodus. Beim Vorgängermodell Qwen3.6-27B waren genau diese drei Bereiche bereits zentrale Merkmale - natives Bild- und Videoverständnis in einem einzigen Checkpoint, verbesserte Agenten-Programmierung für Frontend-Aufgaben sowie ein Modus, der Denkverlauf über mehrere Gespräche hinweg speichert. Naheliegend ist daher, dass Qwen3.8-27B genau diese drei Fähigkeiten weiterentwickelt - offiziell bestätigt ist das für die neue Version aber nicht.
Einordnung
Für Hobby-Entwickler und Firmen, die KI-Modelle aus Datenschutz- oder Kostengründen lokal statt in der Cloud betreiben wollen, wäre ein leistungsfähiges 27B-Modell mit offener Lizenz interessant - es liefe auf einer einzelnen Consumer-Grafikkarte. Bis Alibaba tatsächlich liefert, bleibt aber alles Spekulation: Weder Release-Termin noch technische Details oder Leistungswerte sind derzeit belegt.
Quelle: Reddit r/LocalLLaMA, ergänzt um Angaben von OrcaRouter.