Coding-Duell đ„ Gemini 4 âCarbonâ soll mit Opus 5.5 mithalten
Kurz gesagt: Laut Business Insider testen Google-Mitarbeiter intern eine Gemini-4-Version namens Carbon, die sich beim Coding âwie Opus 5.5 anfĂŒhltâ. Das ist der Eindruck eines einzelnen Mitarbeiters, ohne Benchmark und ohne Veröffentlichungstermin. FĂŒr Ihre Wahl des Coding-Assistenten Ă€ndert das heute nichts.
Symbolbild: KI-generiert
Wer tĂ€glich mit einem KI-Assistenten programmiert, fragt sich, ob der nĂ€chste Modellwechsel Zeit spart oder nur neue Umstellungen kostet. Genau darum geht es bei einer Meldung vom 9. Oktober 2026: Laut Business Insider (ĂŒber Techmeme) testen Google-Mitarbeiter intern eine neue Gemini-4-Version namens âCarbonâ. Ein Mitarbeiter sagt, sie fĂŒhle sich im Coding an wie Anthropics Opus 5.5. Das Original haben wir nicht direkt einsehen können, die Angaben stammen aus SekundĂ€rberichten.
Was belegt ist, und was nicht
Google hat Gemini 4 Argon am 30. September 2026 angekĂŒndigt, zunĂ€chst fĂŒr ausgewĂ€hlte Cybersecurity-Partner, danach fĂŒr zahlende API-Kunden und Ultra-Abonnenten. Laut TestingCatalog laufen die Carbon-Tests ĂŒber âJetskiâ, den internen Namen von Antigravity. Unklar bleibt, ob Carbon spĂ€ter ein Argon-Update oder ein eigenes Release wird. FĂŒr Carbon selbst gibt es keine veröffentlichten Benchmarks. Der Vergleich mit Opus 5.5 beruht allein auf dem BauchgefĂŒhl einer einzelnen Person, die laut Bericht selbst weitere Tests fĂŒr nötig hĂ€lt.
Was wir ĂŒber Argon wissen
FĂŒr Argon liegen Zahlen vor, allerdings ĂŒberwiegend vom Hersteller. Im DeepSWE-Test v1.1 nennt Google 77,9 Prozent, Opus 5.5 kommt dort auf 74,2 Prozent. Google nutzte dabei einen eigenen Testaufbau, die Konkurrenzwerte stammen aus anderen Quellen, der Vergleich ist daher nicht sauber kontrolliert. Im FrontierSWE v2 liegt Argon mit 55,0 Prozent hinter Opus 5.5 mit 62,3 Prozent, im Terminal-Bench 4.0 mit 57,4 gegen 66,4 Prozent ebenfalls. Im Artificial Analysis Intelligence Index liegt Opus 5.5 mit rund 58 Punkten vor Argon mit rund 53. UnabhĂ€ngige Nachmessungen zu Google-Zahlen gab es zum Start laut DataCamp noch nicht.
Unsere Einordnung
Das Bild ist gemischt: Argon gewinnt viele Tests, beim Programmieren aber nicht durchgehend. Dass bei Google schon ein besserer Build kursiert, ist ein GerĂŒcht, kein Produkt. Wer heute mit Opus 5.5 zufrieden arbeitet, hat keinen Grund zu warten. Ein Wechsel lohnt erst, wenn Carbon oder Argon in Ihrem eigenen Projekt messbar besser abschneiden. Weitere Berichte zu KI-Modellen finden Sie in unserer KI-Rubrik.