Anthropic hat 309.815 anonymisierte Claude-Gespräche aus dem Mai 2026 ausgewertet und in einer eigenen Studie zum hauseigenen Chatbot klare Unterschiede im Kommunikationsstil festgestellt, je nach Modell und Sprache. Konkret heißt das: Dieselbe Anfrage kann bei Claude, abhängig von Version und Eingabesprache, spürbar anders beantwortet werden.
Im Mittelpunkt der Untersuchung standen keine Wissensfragen mit eindeutig richtiger Antwort. Anthropic schaute sich stattdessen offene, subjektive Prompts an, also Anfragen, bei denen Ton, Gewichtung und Urteilsstil stärker ins Gewicht fallen.
Vier Achsen für die Auswertung
Für die Analyse sortierte Anthropic die Antworten entlang von vier Verhaltensachsen ein: Zuvorkommenheit versus Vorsicht, Wärme versus Strenge, Tiefe versus Kürze sowie Offenheit versus Ausführlichkeit.
So ließ sich erkennen, ob Claude eher bestärkend oder warnend reagiert, knapp oder ausführlich antwortet und insgesamt lockerer oder analytischer auftritt.
Sonnet 4.6 und Opus 4.7 mit unterschiedlichen Schwerpunkten
Besonders klar zeigten sich die Unterschiede zwischen den Modellen. Sonnet 4.6 beschreibt Anthropic als wärmer und zuvorkommender.
Die Antworten fielen dort tendenziell schneller aus, wirkten ermutigender und waren stärker darauf angelegt, Nutzer in ihrer Richtung zu unterstützen.
Opus 4.7 lag nach den Ergebnissen von Anthropic am anderen Ende des Spektrums. Dieses Modell zeigte mehr Vorsicht, mehr Strenge und mehr Tiefe.
Laut Studie markierte es Risiken häufiger, stellte Annahmen öfter infrage und ging auch ohne ausdrückliche Aufforderung kritischer auf mögliche Probleme ein.
Auch die Sprache verändert Claudes Antworten
Noch auffälliger war in der Auswertung der Einfluss der Sprache. In Hindi und Arabisch wirkte Claude am wärmsten und oft besonders höflich, teilweise auch humorvoller.
Englisch und Russisch fielen dagegen rigider und skeptischer aus.
Auf den einzelnen Achsen zeigte Englisch nach Angaben von Anthropic unter anderem die höchste Vorsicht und die größte Tiefe. Arabisch war im Vergleich dazu besonders stark von Deferenz und Kürze geprägt.
Es ändert sich also nicht nur die Wortwahl. Auch die Haltung des Chatbots kann sich je nach Sprache verschieben.
Was das für Sie bedeutet
Für Nutzer ist die praktisch wichtigste Erkenntnis recht einfach: Die erste Antwort von Claude sollte nicht automatisch als endgültig gelten.
Bei offenen Fragen, Entscheidungen oder Formulierungen können Sie denselben Prompt noch einmal stellen, mit einem anderen Modell oder in einer anderen Sprache. Das kann Ihnen unter Umständen kritischere oder ausgewogenere Rückmeldungen liefern.
Anthropic weist allerdings selbst darauf hin, dass noch offen ist, wie diese Abweichungen zu bewerten sind. Sie könnten eine sinnvolle Anpassung an sprachliche und kulturelle Erwartungen sein. Genauso gut könnten sie bei wichtigen Entscheidungen auf eine problematische Inkonsistenz hindeuten.
Einschränkung: nur Legacy-Modelle aus Mai 2026
Die Daten stammen aus dem Mai 2026 und beziehen sich mit Sonnet 4.6, Opus 4.6 und Opus 4.7 auf ältere Versionen, die Anthropic inzwischen selbst als Legacy-Modelle einordnet.
Eine vergleichbare öffentliche Werte-Analyse für neuere Versionen wie Sonnet 5 oder Opus 4.8 gibt es bislang nicht.
Downloads: Download Claude für iOS und Android