Einleitung
Anthropic hat in seinem Risikobericht vom August 2026 ein unveröffentlichtes internes KI-Modell namens Model 2 stillschweigend offengelegt.
Bei diesem Modell handelt es sich nicht um eine öffentliche Claude-Version, und Anthropic hat es auch nicht als Produkt veröffentlicht. Es erscheint in dem Bericht, weil das Unternehmen bei der Bewertung von Risiken fortgeschrittener KI auch intern eingesetzte Grenz- und Grenznähe-Systeme einbezieht.
Nach Angaben von Anthropic ist Model 2 in seiner Gesamtfähigkeit geringfügig stärker als Claude Mythos 5.
Die Verbesserung ist real, aber das Unternehmen vermeidet es bewusst, sie als bedeutenden Generationssprung zu beschreiben.
Anthropics eigene Zusammenfassung weist darauf hin, dass Model 2 bei vielen Aufgaben im Zusammenhang mit interner Nutzung deutlich besser abschneidet als Mythos 5, aber noch weit von dem Fähigkeitssprung entfernt ist, den das Unternehmen beim Upgrade von Claude Opus 4.6 auf Claude Mythos Preview beobachtet hat.
Das macht Model 2 aus einer anderen Perspektive interessant.
Weniger als den Beginn einer völlig neuen Generation markiert es eher eine kontinuierliche Verfeinerung der Grenzmodell-Fähigkeiten von Anthropic.
Der Bericht enthält auch einen konkreten Datenpunkt: In der internen CoBench-Evaluierung von Anthropic erzielt Model 2 62,8 % und liegt damit vor Claude Mythos 5 mit 50,3 % und Claude Mythos Preview mit 54,8 %.

Derselbe Bericht erwähnt auch ein weiteres internes System namens Model 1, was außerhalb Spekulationen auslöste, ob Anthropic eine Reihe interner Modelle entwickelt, denen später öffentliche Claude-Produktnamen zugewiesen werden.
Der offizielle Bericht stützt diese Interpretation nur teilweise.
Anthropic bestätigt, dass Model 1 und Model 2 interne Modelle sind, gibt jedoch nicht an, dass Model 2 der offizielle Nachfolger von Model 1 ist oder dass eines der beiden eine zukünftige Claude-Version sein wird.
Model 2 ist insgesamt geringfügig stärker als Claude Mythos 5
Der von AIBase gemeldete Kernpunkt ist zutreffend: Anthropic gibt an, dass Model 2 insgesamt stärker ist als Claude Mythos 5.
Der Risikobericht vom August beschreibt Model 2 wie folgt:
- In bestimmten Bereichen ist die Leistung besser als bei Mythos 5.
- In anderen Bereichen ist die Leistung schwächer als bei Mythos 5.
- In der Gesamtfähigkeit ist es geringfügig stärker.
Anthropic gibt außerdem an, dass die grobe qualitative Einschätzung lautet, dass Model 2 bei vielen Aufgaben im Zusammenhang mit interner Nutzung deutliche Verbesserungen bietet.
Diese Formulierung ist wichtig.
Model 2 sollte nicht als in jeder Benchmark oder in jedem risikobezogenen Bereich durchgängig besser als Mythos 5 beschrieben werden.
Der Bericht selbst zeigt, dass die Vergleichsergebnisse je nach Aufgabe variieren.
Beispielsweise gibt Anthropic bei bestimmten chemischen und biologischen Risikobewertungen an, dass Model 2 begrenzte Ergebnisse erzielt, die mit Claude Mythos 5 vergleichbar oder schwächer sind.
Bei einer anderen Bewertung zu verdecktem Verhalten ist Model 2 geringfügig stärker als Mythos 5, bleibt aber deutlich hinter Mythos Preview zurück.
Die fairste Zusammenfassung lautet daher:
Model 2
= insgesamt geringfügig stärker
≠ in jeder Evaluierung besser
Die Verbesserung ist kein bedeutender Generationssprung
Der Originalartikel betont, dass diese Verbesserung relativ begrenzt ist.
Anthropic gibt an, dass im Vergleich zu …,
derselbe Fall.
Das Unternehmen stellt Model 2 ausdrücklich dem früheren Sprung gegenüber, nämlich dem Upgrade von Claude Opus 4.6 auf Claude Mythos Preview.
Dieses Upgrade stellte eine größere Leistungssteigerung dar.
Model 2 nicht.
Anthropic gibt an, dass dieses neuere interne Modell bei vielen internen Aufgaben deutliche Verbesserungen aufweist, aber keine disruptive Veränderung gleichen Ausmaßes darstellt.
Dies spiegelt sich auch in einer anderen internen Fähigkeitskennzahl wider.
Anthropic pflegt eine interne Version des Epoch-Fähigkeitsindex namens AECI, der die Leistung in mehreren internen Benchmark-Tests zusammenfasst.
Basierend auf begrenzten Daten liegt die Punktzahl von Model 2 bei etwa:
1,5 AECI-Punkte
über Claude Mythos 5.
Anthropic weist ausdrücklich darauf hin, dass diese Schätzung eine große Fehlertoleranz aufweist.
Außerdem gibt das Unternehmen an, dass dieser Anstieg geringer ist als die Verbesserung von Mythos Preview zu Mythos 5.
Dies stützt die wesentliche Einordnung des Artikels: Model 2 scheint eine inkrementelle Verbesserung des Grenzmodells zu sein, nicht eine deutlich neue Fähigkeitsstufe.
CoBench bietet den klarsten öffentlichen Vergleich
Die konkretesten Belege im Bericht stammen aus CoBench.
Anthropic beschreibt CoBench als eine interne Evaluierung, die testen soll, ob ein Modell reale Forschungs- und Entwicklungsprobleme des Unternehmens lösen kann, anstatt allgemeine Benchmarks als Ersatzmetrik zu verwenden.
Die Evaluierung versetzt das Modell an einen bestimmten Zeitpunkt in der Geschichte der Anthropic-Infrastruktur.
Das Modell erhält eine Ressourcen-Snapshot, einschließlich:
- Code.
- Logs.
- Interne Dokumentation.
- Historische interne Nachrichten.
Anschließend muss es die Grundursachen technischer Probleme diagnostizieren, die Anthropic-Ingenieure zuvor gelöst haben.
Die im August-Bericht beschriebene aktuelle Version umfasst:
449 Probleme
Hauptsächlich aus Problemen, die zwischen Februar und April 2026 gelöst wurden.
Diese Probleme stammen aus Abteilungen der technischen Organisation von Anthropic, die in folgenden Bereichen tätig sind:
- Training von Modellen.
- Betrieb der Modellinfrastruktur.
- Debugging technischer Systeme.
- Research Engineering.
Dies macht CoBench besonders relevant für den Fokus von Anthropic auf KI-automatisierte KI-Forschung.
Model 2 erzielt 62,8 % in CoBench
Die im Bericht gezeigten Vergleichswerte:
| Modell | CoBench-Punktzahl |
|---|---|
| Claude Sonnet 4.6 | 12,0 % |
| Claude Opus 4.6 | 15,6 % |
| Claude Opus 4.7 | 27,4 % |
| Claude Mythos 5 | 50,3 % |
| Claude Mythos Preview | 54,8 % |
| Model 2 | 62,8 % |
Model 2 liegt damit an der Spitze der in der Grafik dargestellten Modelle.
Der Vorsprung gegenüber Mythos 5 beträgt:
62,8 %
- 50,3 % = 12,5 Prozentpunkte
Das ist bei dieser speziellen internen Benchmark eine erhebliche Differenz.
Sie liegt jedoch noch weit unter der Punktzahl, die Anthropic für einen vollständigen Ersatz des technischen Personals für erforderlich hält.
Anthropic schätzt, dass eine vollständige Ersetzung von Forschern etwa 85 % erfordert
Anthropic gibt an, dass ein System, das Anthropic-Forschungswissenschaftler und -ingenieure tatsächlich vollständig ersetzen könnte, laut manueller Prüfung von Aufgaben und Bewertungsprozessen in CoBench mindestens etwa folgende Punktzahl erreichen müsste:
85 %
Die 62,8 % von Model 2 liegen also noch deutlich darunter.
Anthropic weist außerdem darauf hin, dass die Benchmark die Äquivalenz zum Menschen nicht perfekt misst.
Der Datensatz ist
bewusst auf schwierige Probleme ausgerichtet.
Die meisten Aufgaben wurden ausgewählt, weil Mythos Preview bei drei Versuchen mindestens einmal scheiterte.
Anthropic gibt an, dass der Datensatz ohne dieses Filtern etwa doppelt so groß wäre.
Es gibt weitere Einschränkungen:
- Einige historische menschliche Schlussfolgerungen könnten unvollkommen sein.
- Einige Antworten könnten mehrdeutig sein.
- Automatische Bewertungen können fehlerhaft sein.
Das Modell erhält nicht wirklich alle Berechtigungen oder die Infrastrukturunterstützung, die ein echter Anthropic-Ingenieur möglicherweise hat.
Daher ist CoBench am besten als ein nützliches internes Signal zu betrachten und nicht als allgemeiner Maßstab dafür, ob KI-Modelle Forscher ersetzen können.
Mythos 5 mehr Tokens zu geben, schließt die Lücke nicht vollständig
Anthropic hat außerdem getestet, ob die CoBench-Ergebnisse lediglich ein unzureichendes Inferenzbudget widerspiegeln.
Das Diagramm verwendet ein Token-Budget von etwa:
300.000 Tokens
für die bewerteten Einstellungen.
Als Anthropic das Budget für Mythos 5 erhöhte auf:
900.000 Tokens
verbesserte sich dessen Ergebnis nur um etwa:
3 Prozentpunkte
Dies deutet darauf hin, dass zumindest ein Teil des Vorteils von Modell 2 nicht allein dadurch erklärt werden kann, dass Mythos 5 mehr Tokens erhält.
Anthropic ist weiterhin der Ansicht, dass bessere Scaffolding- und Evaluierungsrahmen die Ergebnisse verbessern können. Die Benchmark misst also nicht ausschließlich die Modellgewichte selbst.
Agentenarchitektur ist wichtig.
Modell 2 wird bei Anthropic bereits intensiv intern genutzt
Modell 2 wurde noch nicht veröffentlicht, ist aber kein ungenutzter Lab-Checkpoint.
Anthropic gibt an, dass Modell 2 und Claude Mythos 5 zu den leistungsfähigsten und am häufigsten genutzten internen Modellen gehören.
Sie werden intensiv eingesetzt für:
- Programmierung.
- Datengenerierung.
- Andere Agenten-Workflows.
- Forschung.
- Entwicklung.
Anthropic gibt außerdem an, dass beide Modelle über persistente Agenten-Bereitstellungen genutzt werden und nicht nur über interaktive Chat-Sitzungen.
Dies ist wichtig, da sich der Risikobericht des Unternehmens teilweise darauf konzentriert, dass KI-Systeme zunehmend Teile der eigenen Forschungs- und Entwicklungsarbeit von Anthropic automatisieren könnten.
Erstelle in Minuten eine Showcase-Website und gewinne Leads
Beschreibe deine Idee einmal, und We0 AI erstellt eine Showcase-Website, Seiten und ein CMS und hilft nach dem Launch bei Kunden und Traffic.
Eine komplette Projektgeneration zur kostenlosen Registrierung
Am besten geeignet, um einen vollständigen Generierungsablauf auszuprobieren und schnell einen ersten Projektentwurf zu sehen.
Dem Bericht zufolge schreibt Claude inzwischen die überwiegende Mehrheit des Codes, der in die Produktionscodebasis von Anthropic eingebracht wird.
Anthropic zieht jedoch nicht den Schluss, dass seine Modelle derzeit in der Lage sind, seine Forscher vollständig zu ersetzen.
Das Unternehmen ist der Ansicht, dass KI die interne Arbeit erheblich beschleunigt, aber seine Bewertung vom August lag weiterhin unterhalb der Schwelle der Politik für verantwortungsvolle Skalierung für eine stark beschleunigte KI-gesteuerte Forschung und Entwicklung.
Modell 2 hat die vollständige Pre-Deployment-Evaluierungssuite von Anthropic noch nicht durchlaufen
Der Bericht enthält einen weiteren wichtigen Vorbehalt.
Modell 2 hat den internen Bereitstellungsprüfungsprozess von Anthropic bestanden, hat aber noch nicht die vollständige Evaluierungssuite durchlaufen, die das Unternehmen normalerweise vor einer externen Bereitstellung durchführt.
Daher gibt Anthropic an, dass sein Verständnis von Modell 2 mit einer etwas geringeren Sicherheit verbunden ist als bei vollständig evaluierten veröffentlichten Modellen.
Dies ist bei der Interpretation von Benchmark-Vergleichen wichtig.
Ein einzelnes CoBench-Ergebnis kann darauf hindeuten, dass Modell 2 bei internen Forschungs- und Entwicklungsaufgaben stark abschneidet.
Es etabliert jedoch kein vollständiges Leistungsprofil, das Folgendes abdeckt:
- Allgemeines Denken.
- Programmierung.
- Cybersicherheit.
- Biologie.
- Sicherheit.
- Ausrichtung (Alignment).
- Langfristige Autonomie.
- Verbrauchernutzung.
- Unternehmensumgebungen.
Arbeitsaufwand.
Anthropics derzeitige Schlussfolgerung ist bewusst weit gefasst: Modell 2 scheint insgesamt etwas besser abzuschneiden als Mythos 5.
Anthropic hat derzeit keine Pläne, Modell 2 extern zu veröffentlichen
In dem kurzen Artikel von AIBase ist das wichtigste praktische Detail leicht zu übersehen.
Anthropic stellt klar:
Wir haben derzeit keine Pläne,
das Modell extern zu veröffentlichen.
Daher sollte Modell 2 nicht als kommendes Claude-Produkt mit implizitem Veröffentlichungsdatum betrachtet werden.
Es gibt derzeit keine offiziellen Angaben zu:
- Veröffentlichungsdatum.
- Öffentlichem Modellnamen.
- Claude-API-Modell-ID.
- Preisen.
- Kontextfensterspezifikationen.
- Plänen für Verbraucherverfügbarkeit.
- Plänen für Unternehmensbereitstellung.
Jede Behauptung, Modell 2 werde „Claude Mythos 6“, „Claude Opus 6“ oder ein anderes benanntes Produkt, ist reine Spekulation.
Anthropic legt das Modell offen, weil das interne Modell für die Risikobewertung des Unternehmens relevant ist.
Dies unterscheidet sich von einer Produktveröffentlichung.
Claude Mythos 5 ist tatsächlich kein allgemein verfügbares öffentliches Modell
Der ursprüngliche Titel von AIBase besagte, Claude Mythos 5 sei Anthropics stärkstes öffentlich verfügbares Modell.
Dies muss leicht korrigiert werden.
Claude Mythos 5 ist nicht allgemein verfügbar.
Anthropic bietet das Modell derzeit nur einer begrenzten Gruppe zugelassener Kunden über Project Glasswing und damit verbundene Trusted-Access-Programme an.
Die allgemein verfügbare Entsprechung ist Claude Fable 5.
Anthropic gibt an, dass Fable 5 und Mythos 5 auf denselben zugrunde liegenden Modellen basieren.
Der Unterschied besteht darin, dass Fable 5 in sensiblen Bereichen wie Cybersicherheit und Biologie stärkere Sicherheitsvorkehrungen enthält, während Mythos 5 für geprüfte Benutzer bereitgestellt wird, die bei autorisierten Arbeiten weniger Einschränkungen benötigen.
Die aktuelle Produktbeziehung ist:
Claude Mythos 5
= Eingeschränkter Trusted Access
Claude Fable 5
= Gleiches zugrunde liegendes Modell
+ Stärkere Sicherheitsvorkehrungen
+ Breite Verfügbarkeit
Für den durchschnittlichen Leser ist es daher genauer zu sagen: Mythos 5 ist Anthropics stärkstes eingeschränkt zugängliches Frontier-Modell, während Fable 5 das leistungsfähigste breit veröffentlichte Modell ist.
Modell 1 ist real, aber die Produktgeschichte „Modell 1 → Modell 2“ ist reine Spekulation
Der Bericht erwähnt auch Modell 1.
Dies lädt natürlich zu Spekulationen ein:
Modell 1
→ Modell 2
→ Zukünftige Claude-Versionen?
Aber Anthropic macht eine solche Aussage nicht.
Tatsächlich beschreibt es Modell 1 recht zurückhaltend.
Das Unternehmen sagt, dass Modell 1 in seinen Fähigkeiten in etwa vergleichbar ist mit:
- Claude Mythos Preview.
- Claude Mythos 5.
Es erhielt eine relativ begrenzte interne Bereitstellung.
Anthropic gibt an, dass die überwiegende Mehrheit der internen Benutzer Mythos 5 bevorzugte und die Nutzung von Modell 1 zum Stichtag des Berichts, dem
15. Juli, bereits gering war und weiter abnahm.
Das Unternehmen erklärt außerdem:
Es erwartet, dass Modell 1 in Zukunft
nicht extern bereitgestellt
oder breit intern genutzt wird
Modell 1 scheint daher eher ein interner Entwicklungszweig oder Checkpoint zu sein als ein klar definierter Vorgänger, der auf eine öffentliche Veröffentlichung wartet.
Modell 2 unterscheidet sich in einem wichtigen Aspekt von Modell 1
Anthropic geht mit Modell 2 deutlich vorsichtiger um.
Modell 1 wird nur kurz behandelt und im weiteren Verlauf der Risikoanalyse weitgehend ausgeklammert, da Anthropic
der Ansicht ist, dass Mythos 5 eine angemessene Obergrenze für sein Risiko darstellt.
Im Gegensatz dazu wird Modell 2 im größten Teil des Berichts verwendet, weil es:
- Insgesamt leistungsfähiger ist.
- Intern häufiger genutzt wird.
- Für die Frontier-Risikoanalyse von Anthropic relevant ist.
Der Bericht besagt, dass die interne Nutzung von Modell 2 der von Mythos 5 ähnelt.
Dies beweist keine unmittelbar bevorstehende öffentliche Veröffentlichung.
Es deutet jedoch darauf hin, dass Modell 2 eine wichtige operative Position innerhalb von Anthropic einnimmt.
Der Risikobericht ist der Grund, warum die Öffentlichkeit von dem Modell erfährt
Modell 2 wurde nicht über einen herkömmlichen Veröffentlichungsblogbeitrag eingeführt.
Es taucht auf, weil die Politik für verantwortungsvolle Skalierung von Anthropic das Unternehmen dazu verpflichtet, Risikoanalysen für Systeme durchzuführen, die intern tatsächlich entwickelt und bereitgestellt werden.
Der Risikobericht vom August 2026 deckt die Aktivitäten von Anthropic bis zum 15. Juli 2026 ab.
Wenn interne Modelle für die folgenden Fragen relevant sind, listet Anthropic sie auf:
- Fehlausrichtungsprobleme in Hochrisikoumgebungen.
- Automatisierte KI-Forschung und -Entwicklung.
- Biologische und chemische Risiken.
- Modellsicherheit.
- Interne Überwachung.
Aus diesem Grund enthält der Bericht Abschnitte über Modell 2
... bekommt mehr Informationen als ein gewöhnliches, unveröffentlichtes Modell.
Diese Offenlegung ist in erster Linie ein Produkt der Sicherheitsgovernance, nicht eines Produktleaks.
Was der Bericht uns sagt – und was nicht
| Aussage | Status |
|---|---|
| Anthropic hat ein internes Modell namens Modell 2 | Bestätigt |
| Modell 2 wurde nicht veröffentlicht | Bestätigt |
| Modell 2 ist insgesamt etwas stärker als Mythos 5 | Von Anthropic bestätigt |
| Modell 2 ist in jedem Bereich besser als Mythos 5 | Nein |
| Modell 2 erreicht 62,8 % im gezeigten CoBench-Vergleich | Im Bericht bestätigt |
| Mythos 5 erreicht 50,3 % im selben Vergleich | Im Bericht bestätigt |
| Anthropic schätzt, dass eine vollständige Substitution der technischen Belegschaft bei CoBench etwa 85 % erreichen würde | Bestätigt |
| Modell 2 wird intern stark genutzt | Bestätigt |
| Modell 2 hat das vollständige reguläre externe Veröffentlichungsbewertungspaket durchlaufen | Nein |
| Anthropic plant derzeit einen öffentlichen Start von Modell 2 | Nein |
| Modell 2 hat einen offiziellen Claude-Produktnamen | Nein |
| Modell 1 ist ein reales internes Modell | Bestätigt |
| Modell 1 ist nachweislich der direkte Vorgänger von Modell 2 | Noch nicht bestätigt |
| Modell 1 soll öffentlich veröffentlicht werden | Nein |
| Claude Mythos 5 ist für alle Nutzer freigegeben | Nein |
| Claude Fable 5 ist die breit verfügbare Version, die Mythos 5 entspricht | Bestätigt |
Häufige Fragen
Was ist das Anthropic-Modell 2?
Modell 2 ist ein unveröffentlichtes internes Frontier-Modell, das im Anthropic-Risikobericht vom August 2026 offengelegt wurde. Anthropic gibt an, dass es insgesamt etwas stärker ist als Claude Mythos 5 und intern im Unternehmen breit für Codierung, Datengenerierung, Forschung, Engineering und andere Agentenarbeit eingesetzt wird.
Ist Modell 2 besser als Claude Mythos 5?
Insgesamt sagt Anthropic ja – aber nur geringfügig. Das Unternehmen erklärt außerdem, dass Modell 2 in manchen Bereichen stärker und in anderen schwächer ist und daher nicht als durchgängig überlegen beschrieben werden sollte.
Wie hoch ist der CoBench-Score von Modell 2?
Der im Bericht gezeigte Vergleich zeigt, dass Modell 2 62,8 % erreicht und damit vor dem Mythos-Preview mit 54,8 % und Mythos 5 mit 50,3 % liegt. Anthropic schätzt, dass ein vollständig fähiges Modell
für die Substitution technischer Mitarbeiter in aktuellen Bewertungen mindestens etwa 85 % erreichen müsste.
Was bewertet CoBench?
CoBench ist eine interne Bewertung von Anthropic, die auf historischen Forschungs- und Engineering-Problemen basiert, die technische Mitarbeiter in der Vergangenheit gelöst haben. Das Modell erhält historische Momentaufnahmen, einschließlich Code, Logs, interner Nachrichten und Dokumente, und muss die zugrunde liegenden technischen Probleme diagnostizieren.
Wird Anthropic Modell 2 veröffentlichen?
Anthropic gibt an, derzeit keine Pläne für eine öffentliche Veröffentlichung von Modell 2 zu haben. Das Unternehmen hat weder Produktnamen, Veröffentlichungstermin, API-Kennung, Preisgestaltung noch Pläne für öffentlichen Zugang bekannt gegeben.
Ist Modell 2 das nächste Claude-Mythos-Modell?
Anthropic hat dies nicht gesagt. Modell 2 ist eine interne Kennung, die im Risikobericht verwendet wird; eine Zuordnung zu einem zukünftigen Claude-Produktnamen ist reine Spekulation.
Was ist das Anthropic-Modell 1?
Modell 1 ist ein weiteres internes Modell, das im selben Bericht offengelegt wurde. Anthropic gibt an, dass es grob mit Mythos Preview und Mythos 5 vergleichbar ist, mit einer relativ geringen und sinkenden internen Nutzung, und dass keine externe Bereitstellung geplant ist.
Ist Claude Mythos 5 öffentlich verfügbar?
Nicht allgemein verfügbar. Mythos 5 wird über eingeschränkte vertrauenswürdige Zugangsprogramme wie Project Glasswing bereitgestellt, während Claude Fable 5 dasselbe Basismodell nutzt, jedoch mit stärkeren Sicherheitsvorkehrungen und breit verfügbar ist.
Verwandte Tools
- Claude: Allgemeiner KI-Assistent von Anthropic für Verbraucher und Fachleute.
- Claude API: Entwicklerplattform von Anthropic für allgemein verfügbare Claude-Modelle.
- Anthropic Console: Offizieller Arbeitsbereich zum Testen von Claude-API-Modellen und zur Verwaltung von Entwicklerzugriffen.
- Project Glasswing: Vertrauenswürdiges Zugangsprogramm von Anthropic für fortgeschrittene Mythos-Klassen-Fähigkeiten im Bereich Cybersicherheit.
- Anthropic Transparency Hub: Zentrale Ressource für Modellsicherheitsbewertungen, Systemkarten und Risikoinformationen.
Verwandte Links
- Anthropic-Risikobericht August 2026: Primärquelle, die Modell 1, Modell 2, CoBench, interne Nutzung und aktuelle Veröffentlichungspläne offenlegt.
- Claude Fable 5 und Claude Mythos 5: Offizielle Ankündigung von Anthropic, die die Beziehung zwischen den beiden Modellen erklärt.
- Claude-Modellübersicht: Offizielle Verfügbarkeits- und API-Informationen zu den veröffentlichten Claude-Modellen.
- Claude Mythos: Offizielle Informationen zu Verfügbarkeit, Sicherheitsvorkehrungen, Preisen und Project Glasswing von Mythos 5.
- Anthropic Responsible Scaling Policy: Der Governance-Rahmen hinter dem regelmäßigen Risikoberichtsprozess von Anthropic.
- Anthropic Transparency Hub: Offizielle Sicherheits- und Leistungsinformationen zu aktuellen Claude-Modellen.
Zusammenfassung
Der Anthropic-Risikobericht vom August 2026 hat ein internes Modell namens Modell 2 offengelegt, das bereits
derzeit intensiv für Forschung, Engineering, Codierung, Datengenerierung und persistente Agenten-Workflows eingesetzt wird.
Das Modell ist in der internen CoBench-Bewertung von Anthropic stärker als Claude Mythos 5, mit Werten von 62,8 % gegenüber 50,3 %. Anthropic gibt zudem an, dass Modell 2 insgesamt etwas stärker zu sein scheint, obwohl es in einigen Bereichen schwächer ist als Mythos 5 und die Verbesserung weit geringer ausfällt als frühere große Leistungssprünge.
Der Bericht erwähnt auch Modell 1, aber die Beweislage reicht nicht aus, um Modell 1 und Modell 2 als bestätigte öffentliche Produktreihenfolge zu betrachten. Die interne Nutzung von Modell 1 sinkt, während Anthropic ausdrücklich erklärt, dass es derzeit keine Pläne für eine öffentliche Veröffentlichung von Modell 2 gibt.
Die klarste Schlussfolgerung ist, dass das interne Frontier-Niveau von Anthropic Mythos 5 leicht übertroffen hat – aber Modell 2 ist ein internes Forschungssystem, kein veröffentlichtes Produkt der nächsten Claude-Generation.



