Nieuwe studies uit 2024 laten zien dat systemen als ChatGPT van OpenAI vaak redeneren vanuit een westers moreel kader. Dat is niet alleen iets voor academische discussies. Wie zulke systemen gebruikt voor morele afwegingen, advies of samenvattingen van gevoelige onderwerpen, loopt het risico antwoorden te krijgen die stilzwijgend doen alsof de waarden van Europa en Noord-Amerika overal gelden.
Het PNAS-onderzoek uit 2024, samen met vervolgonderzoek onder leiding van Cornell University, wijst op het volgende:
- In het PNAS-onderzoek uit 2024 werden GPT-3.5, GPT-4 en GPT-4o van OpenAI vergeleken met antwoorden van meer dan 90.000 mensen uit 48 landen. Daaruit kwam naar voren dat deze modellen vaak uitkomen bij een WEIRD-perspectief: Western, Educated, Industrialized, Rich and Democratic. Met die term bedoelen onderzoekers een moreel kader dat vooral past bij westerse samenlevingen.
- Diezelfde onderzoekers waarschuwen ook voor iets anders: zulke systemen beschrijven dat wereldbeeld mogelijk niet alleen, maar behandelen het impliciet ook als norm. Je merkt dat in de toon van antwoorden, in wat een chatbot prioriteit geeft en in de manier waarop dilemma’s worden uitgelegd.
- Het PNAS-onderzoek laat verder zien dat morele prioriteiten tussen culturen vaak verkeerd worden ingeschat. Taalmodellen geven waarden die in westerse samenlevingen relatief zwaar wegen, zoals zorg en gelijkheid, geregeld meer nadruk dan terecht is.
- Tegelijk krijgen waarden die elders juist zwaarder kunnen tellen, zoals zuiverheid of rituele normen, in datzelfde onderzoek minder gewicht.
- Volgens de onderzoekers heeft dat heel concrete gevolgen voor publiekscommunicatie over gezondheid, contentmoderatie, internationale klantenservice en mentale ondersteuning. Een chatbot die sterk is gevormd door westerse normen zal bijvoorbeeld individuele grenzen en autonomie vooropzetten, terwijl in andere samenlevingen familieplicht en collectieve verantwoordelijkheid juist belangrijker kunnen zijn.
- Een belangrijke verklaring ligt in de trainingsdata, zo blijkt uit het PNAS-onderzoek. Een groot deel daarvan bestaat uit Engelstalige internetinhoud, waarin een westerse culturele lens sterk aanwezig is. Veel samenlevingen, vooral in het mondiale zuiden, zijn online minder zichtbaar of verschijnen vooral door de blik van buitenstaanders.
- Daardoor leren modellen niet alleen minder over lokale waarden, zeggen deze onderzoekers, maar nemen ze ook morele stereotypen over. Zodra je vragen stelt over gevoelige sociale of culturele kwesties, groeit daarmee de kans op scheve of al te simpele antwoorden.
- Een mogelijke uitweg is zogeheten culturele prompting. Daarbij vraag je het systeem expliciet te antwoorden vanuit een specifieke culturele context. Een onderzoek onder leiding van Cornell University meldde dat deze aanpak de culturele vertekening in ChatGPT-antwoorden verminderde voor een meerderheid van de meer dan 100 onderzochte landen.
- Maar ook dat is geen definitieve oplossing. De onderzoekers benadrukken dat menselijke waarden geen universeel en vast pakket vormen. In plaats van één moreel raamwerk centraal te zetten, pleiten zij voor pluralistische afstemming, met ruimte voor verschillende tradities en denkkaders, waaronder niet-westerse filosofieën als Ubuntu.
Er blijven bovendien forse blinde vlekken bestaan. Het debat wordt nog vaak teruggebracht tot westers tegenover niet-westers, terwijl de verschillen binnen regio’s juist enorm kunnen zijn.
Ook veel talen, lokale gemeenschappen en inheemse perspectieven zijn in het vervolgonderzoek van Cornell University nog nauwelijks in kaart gebracht. En hoe goed oplossingen als culturele prompting buiten onderzoekssettings standhouden, is nog altijd niet duidelijk.
Eén conclusie staat na het PNAS-onderzoek en het vervolgwerk van Cornell University in elk geval al behoorlijk stevig overeind: wie systemen als ChatGPT cultureel neutraal noemt, kijkt vermoedelijk zelf al door diezelfde westerse bril.