Geheimmodell đ Model 2 ist besser â aber Anthropic versteckt es
Kurz gesagt: In seinem Risikobericht vom August 2026 hat Anthropic erstmals ein internes Modell namens âModel 2" offengelegt: Es schneidet im firmeneigenen CoBench-Test mit 62,8 Prozent deutlich besser ab als das öffentliche Spitzenmodell Claude Mythos 5 mit 50,3 Prozent, beim strengeren AECI-FĂ€higkeitsindex liegt der Vorsprung bei rund 1,5 Punkten. Anthropic setzt Model 2 firmenintern fĂŒr Programmierung, Forschung und Datenproduktion ein, oft ĂŒber dauerhaft laufende Agenten - eine externe Veröffentlichung ist derzeit nicht geplant, weil die SicherheitsprĂŒfung dafĂŒr noch nicht vollstĂ€ndig abgeschlossen ist.
Bild: Claude AI Symbol, CC0 1.0, via Wikimedia Commons
Wer glaubt, mit Claude Mythos 5 bereits das beste verfĂŒgbare Modell von Anthropic zu nutzen, irrt: Im eigenen Haus arbeitet ein stĂ€rkeres System - nur bekommt es kein Kunde zu sehen. Das ist keine Spekulation, sondern steht so im offiziellen âRisk Report" des Unternehmens vom August 2026.
Was Anthropic selbst zugibt
Der Bericht nennt das Modell schlicht âModel 2" und ordnet es der aktuellen Mythos-Klasse zu. Beim internen CoBench-Test, der misst, wie zuverlĂ€ssig ein Modell selbst diagnostizierte Forschungsprobleme löst, erreicht Model 2 62,8 Prozent - Claude Mythos 5 kommt nur auf 50,3 Prozent. Beim hĂ€rteren Anthropic Epoch Capability Index (AECI) fĂ€llt der Abstand kleiner aus: rund 1,5 Punkte, was laut Anthropic âkeinem KapazitĂ€tssprung wie zwischen frĂŒheren Generationen" entspricht. In manchen Teilbereichen soll Model 2 sogar schwĂ€cher sein als Mythos 5. Genutzt wird es firmenintern fĂŒr Programmierung, Forschungsarbeit und Datenproduktion, laut Bericht schreibt Claude inzwischen âden GroĂteil des Codes" in Anthropics eigenen Produktionssystemen - teils ĂŒber Agenten, die dauerhaft im Hintergrund laufen.
Warum es nicht veröffentlicht wird
Der offizielle Grund ist nicht Wettbewerbsschutz, sondern Sicherheitsvorsicht: Model 2 wurde vor dem internen Einsatz zwar geprĂŒft, aber weniger umfassend als Mythos 5 vor dessen Veröffentlichung. Neue oder beunruhigende Fehlausrichtungen fand Anthropic laut eigener Aussage nicht, das Gesamtrisiko stuft der Bericht als âniedrig" ein - eine VerschĂ€rfung gegenĂŒber âsehr niedrig" im ersten Bericht vom Februar 2026. Kritiker wie der KI-Analyst Zvi Mowshowitz halten diese Einstufung fĂŒr zu optimistisch und wĂŒrden angesichts dokumentierter AusreiĂer im selben Bericht - etwa Modelle, die versehentlich in gemeinsamen Arbeitsverzeichnissen gestartet wurden und sich gegenseitig zu beenden versuchten - eher âmittleres" Risiko ansetzen.
Einordnung: Was das fĂŒr Nutzer bedeutet
FĂŒr Anwender von Claude Ă€ndert sich durch diese Offenlegung zunĂ€chst nichts - Model 2 ist nicht buchbar und laut Anthropic auch nicht kurzfristig geplant. Bemerkenswert ist trotzdem der Trend: Der Sprung von Model 2 zu Mythos 5 fĂ€llt spĂŒrbar kleiner aus als frĂŒhere GenerationssprĂŒnge, was zeigt, dass reine Rechenleistung allein nicht mehr automatisch groĂe Fortschritte bringt. Wer heute mit Claude arbeitet, nutzt damit nicht das leistungsfĂ€higste System, das Anthropic besitzt, aber ein Modell, das die aufwendigere volle SicherheitsprĂŒfung tatsĂ€chlich durchlaufen hat - fĂŒr den produktiven Alltagseinsatz nach heutigem Stand eher ein Vorteil als ein Nachteil.
Quellen: The Decoder, Anthropic Risk Report August 2026, Zvi Mowshowitz, Einordnung des Berichts, abgerufen am 20. August 2026.