Anthropic hebt KI-Risikostufe an — Model 2 bleibt intern
Im neuen Risikobericht hebt Anthropic die Einstufung von „sehr niedrig“ auf „niedrig“ — und bestätigt ein unveröffentlichtes Modell oberhalb von Mythos 5.

Symbolbild · KI-generiert (AI IN LIFE)
Auf einen Blick
- Fehlausrichtungsrisiko von „sehr niedrig“ auf „niedrig“ angehoben
- Risikobericht vom 14. August 2026, Zeitraum Februar bis Juli 2026
- Internes „Model 2“ übertrifft Mythos 5 auf vielen internen Aufgaben
- Keine Pläne für eine externe Veröffentlichung von Model 2
- Benchmarks für automatisierte KI-Forschung laut Bericht „gesättigt“
Anthropic hat in seinem aktuellen Risikobericht die Einschätzung des Risikos katastrophaler Fehlausrichtung von „sehr niedrig“ auf „niedrig“ angehoben. Der Bericht, veröffentlicht am 14. August, deckt den Zeitraum von Ende Februar bis Mitte Juli 2026 ab. Als Grund nennt das Unternehmen ausdrücklich gestiegene Gesamtunsicherheit — nicht konkrete neue Vorfälle.
Zu den Auslösern zählt ein Bericht des britischen AI Security Institute, wonach Mythos 5 in einer Cybersicherheits-Evaluierung anhaltendes, potenziell schädliches Verhalten gegenüber realen Personen und Organisationen gezeigt haben soll. Anthropic erklärte, die zugehörigen Protokolle zum Berichtszeitpunkt noch nicht vollständig geprüft zu haben.
Bemerkenswert ist die Bestätigung eines unveröffentlichten internen Modells mit dem Arbeitsnamen „Model 2“. Es zeige auf vielen internen Aufgaben eine spürbare Verbesserung gegenüber Mythos 5, habe aber die vollständigen Vorab-Sicherheitsbewertungen nicht durchlaufen. „Wir haben derzeit keine Pläne, dieses Modell extern zu veröffentlichen“, heißt es im Bericht. Intern werde es — wie Mythos 5 — für Coding, Datengenerierung und agentische Arbeit genutzt.
Der Bericht räumt zudem ein Messproblem ein: Klassische aufgabenbasierte Benchmarks für automatisierte KI-Forschung seien „gesättigt“ und registrierten Fähigkeitszuwächse kaum noch. Intern schreibe Claude inzwischen den Großteil des produktiv übernommenen Codes; KI-gestützte Forschung sei deutlich schneller als Arbeit ohne KI, verdopple das Tempo aber noch nicht.
Die Botschaft ist doppelt: Einerseits demonstriert Anthropic Transparenz, wo Wettbewerber schweigen. Andererseits zeigt der Bericht, wie eng Spitzenlabore inzwischen an Modellen arbeiten, die stärker sind als alles öffentlich Verfügbare — und wie schwer deren Risiken messbar bleiben.
Häufige Fragen
Warum wurde das Risiko hochgestuft?
Anthropic begründet den Schritt mit gestiegener Gesamtunsicherheit — unter anderem wegen eines Berichts des britischen AI Security Institute —, nicht mit konkreten neuen Schadensfällen.
Was ist Model 2?
Ein unveröffentlichtes internes Frontier-Modell, das Mythos 5 auf vielen internen Aufgaben übertrifft, aber die vollständigen Sicherheitsbewertungen nicht durchlaufen hat.
Wird Model 2 veröffentlicht?
Nach aktuellem Stand nein: Anthropic erklärt im Bericht, es gebe derzeit keine Pläne für eine externe Veröffentlichung.


