Microsoft: Neues Code-Modell schwächer als Deepseek
Kurz gesagt: Microsoft hat mit MAI-Code-1.1-Flash ein neues, für GitHub Copilot optimiertes Code-Modell veröffentlicht. Es ist 25 Prozent token-effizienter und kostet nur ein Viertel des Vorgängers MAI-Code-1-Flash. Beim SWE-bench-Verified-Test erreicht es 72,6 Prozent - mehr als der Vorgänger, aber deutlich weniger als Deepseeks V4-Flash mit 82,7 Prozent, das zugleich günstiger ist als Microsofts Modell.
Microsoft hat ein neues Code-Modell für GitHub Copilot veröffentlicht: MAI-Code-1.1-Flash soll laut Unternehmensangaben 25 Prozent token-effizienter arbeiten als sein Vorgänger und kostet dadurch nur noch ein Viertel von dessen Preis. Für Entwickler, die Copilot in Visual Studio Code nutzen, ist das Modell direkt im Modell-Picker verfügbar.
Guenstiger als der Vorgaenger, teurer als die Konkurrenz
Der Preisvorteil gegenueber der eigenen Vorgaengerversion aendert nichts daran, dass MAI-Code-1.1-Flash im Marktvergleich schlecht dasteht: Laut Zahlen von The Decoder kostet das Modell 0,20 US-Dollar je Million Input-Token und 1,20 US-Dollar je Million Output-Token. Deepseeks V4-Flash verlangt mit 0,14 respektive 0,28 US-Dollar deutlich weniger - bei gleichzeitig besserer Leistung. Auf dem Software-Engineering-Benchmark SWE-bench Verified erreicht Microsofts Modell 72,6 Prozent (Vorgaenger: 71,6 Prozent), Deepseek kommt auf 82,7 Prozent. Nach eigenen Recherchen bei Microsofts offizieller Modellankuendigung und Herstellerangaben aus einem unabhaengigen Marktvergleich zeigt sich zudem: Schon der Vorgaenger MAI-Code-1-Flash wurde von Microsoft selbst mit 71,6 Prozent auf SWE-bench Verified beziffert - gegen Anthropics Claude Haiku 4.5, das dort nur 66,6 Prozent erreicht. Gegen die chinesische Konkurrenz faellt der Vorsprung also weg, gegen die US-Konkurrenz bleibt er bestehen. Belastbare, unabhaengig erhobene Zahlen speziell zur 1.1-Version lagen zum Redaktionsschluss noch nicht vor - die Vergleichswerte stammen aus Herstellerangaben beider Seiten.
Zwischen Marketing und Realitaet
Brisant ist die Einordnung von The Decoder: Microsoft praesentiert sich oeffentlich gern als Verfechter offener KI-Modelle, MAI-Code-1.1-Flash ist jedoch ein rein proprietaeres System ohne offen zugaengliche Gewichte. Der Artikel wirft dem Unternehmen vor, schwaechere Benchmark-Ergebnisse in der Modellkarte zu verstecken - ein Hinweis darauf, dass es Microsoft weniger um technische Fuehrung als um Margenoptimierung im eigenen Copilot-Oekosystem geht.
Was das fuer Entwickler in Deutschland bedeutet
Wer GitHub Copilot beruflich einsetzt, bekommt mit MAI-Code-1.1-Flash eine guenstigere Microsoft-eigene Option, die aber nur dann sinnvoll ist, wenn man ohnehin an das Copilot-Oekosystem gebunden bleiben will. Fuer reine Kosten-Leistungs-Abwaegung bei Code-Aufgaben liefern aktuelle Zahlen ein klares Bild: Wer die guenstigste und zugleich staerkste Option sucht, landet nach diesen Werten eher bei Deepseeks V4-Flash als bei Microsofts neuem Modell.
Quelle: The Decoder, ergaenzt um Microsofts offizielle Modellankuendigung.