Qwen 3.8 Max vorgestellt - Angriff auf Anthropic & Co
Kurz gesagt: Qwen3.8-Max ist Alibabas neues Flaggschiff-Sprachmodell mit 2,4 Billionen Parametern, 1-Million-Token-Kontextfenster und eigenen Benchmark-Werten, die es nah an Claude Opus 4.8 und GPT-5.6 heranrücken lassen. Wichtig für die Einordnung: Alle bisherigen Zahlen stammen von Alibaba selbst, unabhängige Plattformen wie LMArena haben das Modell zum Start noch nicht bewertet. Die Gewichte sollen zeitnah offen veröffentlicht werden, die API ist bereits nutzbar.
Bild: KI-generiert
Wer ein KI-Modell einsetzen will, kennt das Problem: Der Hersteller verspricht Spitzenwerte, doch ob das im eigenen Anwendungsfall stimmt, zeigt sich erst, wenn unabhängige Tester nachmessen. Genau in dieser Lücke steht gerade Alibabas neuestes Modell.
Was Alibaba am 3. August vorgestellt hat
Nach einer ersten Vorschau am 19. Juli hat Alibaba sein KI-Modell Qwen3.8-Max am 3. August 2026 offiziell vorgestellt, wie unter anderem MarkTechPost und Bloomberg berichten. Das Modell arbeitet mit 2,4 Billionen Parametern in einer Mixture-of-Experts-Architektur, von denen pro Anfrage rund 95 Milliarden aktiv genutzt werden. Das Kontextfenster fasst mit aktiviertem Denkmodus bis zu rund 991.000 Token - genug, um sehr lange Dokumente, Videos oder ganze Codebasen am Stück zu verarbeiten. Das Modell ist zudem multimodal: Es soll aus Screenshots funktionierende Software rekonstruieren, 2D-Grundrisse in 3D-Visualisierungen umwandeln und für längere, eigenständige Coding- und Recherche-Aufgaben eingesetzt werden können.
Die Zahlen im Vergleich - und ihre Grenze
Alibaba selbst veröffentlichte Benchmark-Werte, die das Modell nah an die Konkurrenz heranrücken: Bei SWE-bench Pro, einem Test für eigenständiges Programmieren, erreicht Qwen3.8-Max 67,7 Punkte - damit liegt es vor GPT-5.6 Sol (64,6), aber hinter Claude Opus 4.8 (69,2) und deutlich hinter Anthropics Fable 5 (80,0). Bei Terminal-Bench 2.1 kommt Qwen3.8-Max auf 86,6 Punkte, GPT-5.6 Sol führt mit 88,8, Claude Opus 4.8 liegt mit 84,6 knapp dahinter. Bei Bildaufgaben (OSWorld-Verified) soll es laut Hersteller nur einer Fable-5-Variante unterlegen sein. Entscheidend für die Einordnung: Diese Werte stammen ausschließlich von Alibaba selbst. Unabhängige Plattformen wie LMArena oder Artificial Analysis hatten das Modell zum Redaktionsschluss noch nicht bewertet - belastbare Fremdvergleiche stehen also noch aus.
Preis, Verfügbarkeit und was das für Nutzer bedeutet
Die API ist bereits freigeschaltet: 2 US-Dollar pro Million Eingabe-Token, 6 US-Dollar pro Million Ausgabe-Token, 0,25 US-Dollar für zwischengespeicherte Eingaben. Alibaba kündigte zudem an, die Modellgewichte für Qwen3.8-Max sowie eine kleinere 27-Milliarden-Parameter-Variante offen zum Download bereitzustellen - Letztere richtet sich an Firmen, die das Modell auf eigener Hardware betreiben wollen. Für Leser, die KI-Werkzeuge im Alltag oder Beruf nutzen, heißt das konkret: Wer heute schon mit Claude, GPT oder Gemini arbeitet, bekommt mit Qwen3.8-Max eine ernstzunehmende, günstigere Alternative für Programmier- und Rechercheaufgaben - ob sie im eigenen Einsatzfall wirklich mithält, lässt sich erst nach den ersten unabhängigen Tests seriös beurteilen, nicht schon anhand der Herstellerangaben allein.
Quellen: MarkTechPost, Bloomberg, Yotta Labs.