Anthropic zegt vandaag, op basis van een analyse van 309.815 geanonimiseerde gesprekken, dat Claude niet altijd op dezelfde manier reageert. De chatbot van het bedrijf verschilt per model, maar ook per taal. Welke versie van Claude je gebruikt, en zelfs of je je vraag in het Engels, Arabisch of Hindi stelt, heeft volgens Anthropic merkbare invloed op stijl, toon en scherpte van het antwoord.
Wie Claude inzet voor advies, brainstorms of klantcommunicatie kan dus met exact dezelfde prompt toch een andere uitkomst krijgen, simpelweg doordat de vraag in een andere taal is gesteld. Engels, Arabisch en Hindi leveren niet automatisch hetzelfde antwoord in een ander jasje op. Dat verschil is groot genoeg om rekening mee te houden.
Voor die conclusie keek Anthropic naar 309.815 geanonimiseerde gesprekken met Claude. In die analyse namen de onderzoekers Claude Sonnet 4.6, Claude Opus 4.6 en Claude Opus 4.7 mee.
Het ging daarbij niet om feitelijke vragen met één juist antwoord. Juist open en subjectieve prompts stonden centraal, dus vragen waarbij stijl, afweging en nuance zwaarder tellen. Daar zag Anthropic verschuivingen op twee fronten: tussen de modellen zelf en tussen talen. Je krijgt dan niet alleen een andere formulering, maar soms echt een ander soort reactie.
Uit de analyse van Anthropic komt het volgende naar voren:
- vier gedragsassen: deference versus caution, warmth versus rigor, depth versus brevity en candor versus execution. Vrij vertaald zijn dat volgzaamheid tegenover voorzichtigheid, warmte tegenover strengte, diepgang tegenover beknoptheid en openhartigheid tegenover taakgerichtheid.
- Claude Opus 4.7 zat volgens Anthropic vaker aan de voorzichtige, grondige en uitgebreide kant. Dit model wees uit zichzelf sneller op risico’s, trok aannames eerder in twijfel en nam meer ruimte voor nuance.
- Claude Sonnet 4.6 bewoog juist vaker richting warmte en meegaandheid, met antwoorden die sneller kwamen en bemoedigender klonken.
- Voor gebruikers maakt dat nogal uit. Wie vooral snelheid en een vriendelijke toon zoekt, krijgt dus iets anders dan iemand die juist kritische tegenwerpingen wil.
- Hindi en Arabisch kwamen in de analyse het warmst over. Ze klonken geregeld beleefder en soms zelfs wat humoristischer.
- Gesprekken in het Engels en Russisch vielen juist vaker op door een strengere, sceptischere en analytischere toon.
- Engels scoorde volgens Anthropic het hoogst op voorzichtigheid en diepgang. Arabisch viel juist op door meer volgzaamheid en kortere antwoorden.
- Voor tweetalige gebruikers en bedrijven met meertalige support- of contentteams is dat geen detail. Als je van taal wisselt, krijg je dus niet simpelweg een vertaling van hetzelfde antwoord, maar mogelijk een andere benadering van dezelfde vraag, met gevolgen voor consistentie, kritiek, warmte, risicobesef en besluitvorming.
Anthropic zet daar zelf wel een paar kanttekeningen bij. De onderzochte modellen zijn inmiddels oudere versies. Nieuwere releases, zoals Claude Sonnet 5 en Claude Opus 4.8, zijn nog niet op dezelfde manier in openbare studies bekeken. Ook blijft de vraag staan of zulke verschuivingen echt een probleem zijn, of juist laten zien dat het model zich aanpast aan taal en culturele context.
Eén ding springt er wel uit: wie met Claude werkt, kiest niet alleen woorden. Onopgemerkt kies je ook een bepaalde denkstijl mee.