đŸ€– KI-News

Geheimmodell 🔐 Model 2 ist besser – aber Anthropic versteckt es

Kurz gesagt: In seinem Risikobericht vom August 2026 hat Anthropic erstmals ein internes Modell namens „Model 2" offengelegt: Es schneidet im firmeneigenen CoBench-Test mit 62,8 Prozent deutlich besser ab als das öffentliche Spitzenmodell Claude Mythos 5 mit 50,3 Prozent, beim strengeren AECI-FĂ€higkeitsindex liegt der Vorsprung bei rund 1,5 Punkten. Anthropic setzt Model 2 firmenintern fĂŒr Programmierung, Forschung und Datenproduktion ein, oft ĂŒber dauerhaft laufende Agenten - eine externe Veröffentlichung ist derzeit nicht geplant, weil die SicherheitsprĂŒfung dafĂŒr noch nicht vollstĂ€ndig abgeschlossen ist.

Geheimmodell 🔐 Model 2 ist besser – aber Anthropic versteckt es

Bild: Claude AI Symbol, CC0 1.0, via Wikimedia Commons

Wer glaubt, mit Claude Mythos 5 bereits das beste verfĂŒgbare Modell von Anthropic zu nutzen, irrt: Im eigenen Haus arbeitet ein stĂ€rkeres System - nur bekommt es kein Kunde zu sehen. Das ist keine Spekulation, sondern steht so im offiziellen „Risk Report" des Unternehmens vom August 2026.

Was Anthropic selbst zugibt

Der Bericht nennt das Modell schlicht „Model 2" und ordnet es der aktuellen Mythos-Klasse zu. Beim internen CoBench-Test, der misst, wie zuverlĂ€ssig ein Modell selbst diagnostizierte Forschungsprobleme löst, erreicht Model 2 62,8 Prozent - Claude Mythos 5 kommt nur auf 50,3 Prozent. Beim hĂ€rteren Anthropic Epoch Capability Index (AECI) fĂ€llt der Abstand kleiner aus: rund 1,5 Punkte, was laut Anthropic „keinem KapazitĂ€tssprung wie zwischen frĂŒheren Generationen" entspricht. In manchen Teilbereichen soll Model 2 sogar schwĂ€cher sein als Mythos 5. Genutzt wird es firmenintern fĂŒr Programmierung, Forschungsarbeit und Datenproduktion, laut Bericht schreibt Claude inzwischen „den Großteil des Codes" in Anthropics eigenen Produktionssystemen - teils ĂŒber Agenten, die dauerhaft im Hintergrund laufen.

Warum es nicht veröffentlicht wird

Der offizielle Grund ist nicht Wettbewerbsschutz, sondern Sicherheitsvorsicht: Model 2 wurde vor dem internen Einsatz zwar geprĂŒft, aber weniger umfassend als Mythos 5 vor dessen Veröffentlichung. Neue oder beunruhigende Fehlausrichtungen fand Anthropic laut eigener Aussage nicht, das Gesamtrisiko stuft der Bericht als „niedrig" ein - eine VerschĂ€rfung gegenĂŒber „sehr niedrig" im ersten Bericht vom Februar 2026. Kritiker wie der KI-Analyst Zvi Mowshowitz halten diese Einstufung fĂŒr zu optimistisch und wĂŒrden angesichts dokumentierter Ausreißer im selben Bericht - etwa Modelle, die versehentlich in gemeinsamen Arbeitsverzeichnissen gestartet wurden und sich gegenseitig zu beenden versuchten - eher „mittleres" Risiko ansetzen.

Einordnung: Was das fĂŒr Nutzer bedeutet

FĂŒr Anwender von Claude Ă€ndert sich durch diese Offenlegung zunĂ€chst nichts - Model 2 ist nicht buchbar und laut Anthropic auch nicht kurzfristig geplant. Bemerkenswert ist trotzdem der Trend: Der Sprung von Model 2 zu Mythos 5 fĂ€llt spĂŒrbar kleiner aus als frĂŒhere GenerationssprĂŒnge, was zeigt, dass reine Rechenleistung allein nicht mehr automatisch große Fortschritte bringt. Wer heute mit Claude arbeitet, nutzt damit nicht das leistungsfĂ€higste System, das Anthropic besitzt, aber ein Modell, das die aufwendigere volle SicherheitsprĂŒfung tatsĂ€chlich durchlaufen hat - fĂŒr den produktiven Alltagseinsatz nach heutigem Stand eher ein Vorteil als ein Nachteil.

Quellen: The Decoder, Anthropic Risk Report August 2026, Zvi Mowshowitz, Einordnung des Berichts, abgerufen am 20. August 2026.

Quelle & Einordnung: Anlass dieser Meldung: The Decoder. Text und Bewertung sind unsere eigene, unabhĂ€ngige Einordnung – wir geben keine fremden Inhalte im Wortlaut wieder.
Was das im Alltag bedeutet
đŸ€– Transparenz: Recherche und Text dieser Meldung entstehen mit KI-Werkzeugen. Themenauswahl, Einordnung und Veröffentlichung verantwortet die Redaktion – verantwortlich im Sinne des § 18 Abs. 2 MStV ist Jörg Schock.

SmartHome Kompass bei Google folgen · alle Nachrichten

← Alle KI-News