Anthropic: 5 Mio. Dollar fuer unabhaengige Wellbeing-Tests
Ein neues Grant-Programm finanziert Open-Source-Evaluationen, die messen sollen, wie KI-Modelle das Wohlbefinden ihrer Nutzer beeinflussen.

Symbolbild · KI-generiert (AI IN LIFE)
Auf einen Blick
- 5 Mio. $ Fördervolumen für unabhängige Wellbeing-Evaluationen
- Gefördert werden Open-Source-Evals, nutzbar für alle Entwickler
- Leistungen: direkte Finanzierung, Modellzugang, technischer Support
- Fokus: Mehrschritt-Gespräche, Companionship, psychische Krisen
- Anforderungen u. a.: klinische Experten einbinden, Grader gegen Fachleute validieren
Anthropic hat am 25.08.2026 ein Förderprogramm über 5 Millionen Dollar gestartet, das unabhängige Forschung zur Wirkung von KI auf das Wohlbefinden von Nutzerinnen und Nutzern finanziert. Geförderte Teams erhalten direkte Mittel, Modellzugang und technischen Support — und veröffentlichen ihre Evaluationen als Open Source, sodass jeder Entwickler sie einsetzen kann.
Warum dieser Schritt? KI-Systeme sind längst nicht mehr nur Arbeitswerkzeuge, sondern auch Gesprächspartner — bis hin zur emotionalen Stütze in Krisensituationen. „Als Branche arbeiten wir noch an klaren Standards dafür, wie sich Modelle in diesen Gesprächen verhalten sollten“, schreibt Anthropic — etwa wenn Nutzer Gesellschaft beim Modell suchen oder eine psychische Krise mit KI-Hilfe bewältigen wollen.
Das Messproblem ist real: Bei den meisten Modellverhalten lässt sich eine einzelne Antwort als richtig oder falsch bewerten. Wohlbefinden erfordert dagegen Kontext über lange, mehrstufige Gespräche hinweg — Risiken zeigen sich oft erst im Verlauf. Anthropics Beispiel: Diät-Tipps können angemessen sein, bei einer Vorgeschichte mit Essstörungen aber aktiv schaden.
Anthropic veröffentlicht zum Programm Leitlinien seines Safeguards-Teams: Gefördert werden Evaluationen, die klar definieren, was sie messen, klinische Fachleute in Design und Validierung einbinden, sowohl Übervorsicht als auch Schäden testen, reale Mehrschritt-Gespräche abbilden und ihre automatischen Bewerter gegen echte Experten validieren.
Die Grantees arbeiten nach Anthropic-Angaben vollständig unabhängig. Das Programm reiht sich in eine Serie von Initiativen ein, mit denen das Unternehmen Bewertungsmaßstäbe für Modellverhalten externalisiert — nach Wirtschafts- und Sicherheitsforschung nun ausdrücklich für die psychische Dimension der KI-Nutzung.
Häufige Fragen
Was genau fördert das Programm?
Unabhängige, quelloffene Evaluationen und Benchmarks, die messen, wie sich KI-Gespräche auf das Wohlbefinden von Nutzern auswirken — inklusive Modellzugang und technischem Support.
Warum sind Wellbeing-Evals so schwierig?
Risiken zeigen sich oft erst über lange Gespräche: Eine für sich genommen harmlose Antwort kann im Kontext — etwa bei Essstörungen oder Suizidgedanken — schädlich sein.
Wer kann sich bewerben?
Anthropic richtet sich ausdrücklich an Kliniker, Psychologen, Methodiker und andere Fachleute; Bewerbungen laufen über ein Antragsformular auf der Programmseite.


