Um estudo publicado em 2024 na revista científica PNAS (Proceedings of the National Academy of Sciences) indica que o ChatGPT, da OpenAI, e outros grandes modelos de linguagem estão longe de ser neutros quando a conversa entra no campo da moralidade. Segundo os pesquisadores, esses sistemas tendem a reproduzir valores mais comuns em sociedades ocidentais, o que levanta uma dúvida séria sobre a forma como respondem a usuários de culturas diferentes.
E o problema não fica no nível de um viés abstrato. Quando ferramentas digitais passam a intermediar conversas sobre saúde mental, moderação de conteúdo ou orientação para situações do dia a dia, elas podem sugerir respostas que parecem razoáveis em alguns países, mas batem de frente com normas e tradições de outros. Para chegar a essa conclusão, os autores compararam respostas dos modelos GPT-3.5, GPT-4 e GPT-4o com dados de mais de 90.000 participantes distribuídos por 48 países.
O padrão, dizem os pesquisadores, apareceu de forma consistente: os modelos se aproximaram de uma perspectiva moral classificada como WEIRD, sigla em inglês para ocidental, educada, industrializada, rica e democrática.
Em termos práticos, isso quer dizer o seguinte. De acordo com os autores, esses sistemas costumam dar peso demais a valores mais fortes em contextos ocidentais, como cuidado e igualdade, e peso de menos a outros que ocupam um lugar maior em diferentes regiões, como pureza. Para a equipe do estudo, esse descompasso sugere que respostas com aparência de equilíbrio podem, na verdade, carregar uma lente cultural bem específica.
Uma explicação central, segundo os autores, está nos dados usados no treinamento. Boa parte do material disponível publicamente vem da internet em inglês e de ambientes digitais dominados por países ocidentais, então os modelos absorvem essa visão de mundo com muito mais força do que perspectivas menos representadas. Isso ajuda a entender por que um chatbot pode aconselhar alguém a priorizar limites individuais e autonomia pessoal em situações nas quais dever familiar, harmonia coletiva ou lealdade ao grupo pesam mais.
Em países do Leste Asiático, por exemplo, esse tipo de resposta pode soar inadequado, ou até ofensivo, para quem vive em um contexto moral diferente daquele já embutido no sistema.
Os efeitos desse viés tendem a aparecer justamente onde o assunto é mais delicado. Em saúde pública, mensagens formuladas a partir de uma lógica cultural estreita podem perder eficácia. Em plataformas online, decisões de moderação podem ler costumes locais de forma errada. E, em interações internacionais, os sistemas podem acabar reforçando estereótipos quando deveriam facilitar entendimento.
Há ainda uma dimensão geopolítica. Segundo os autores e outros especialistas, se os valores de países menos representados continuarem sendo mal compreendidos por essas ferramentas, nações do Sul Global podem permanecer à margem não só do desenvolvimento tecnológico, mas também das normas sociais embutidas nesses produtos. Os autores e outros especialistas apontam alguns caminhos para reduzir o problema. Um deles é o chamado “prompt cultural”, em que o sistema recebe contexto explícito sobre o país ou a tradição moral relevante antes de responder.
Estudos recentes indicam que essa abordagem reduz distorções na maior parte de mais de 100 países testados. Outras propostas passam por bases de dados mais inclusivas, desenvolvimento participativo com comunidades locais e estruturas éticas capazes de lidar com a pluralidade moral.
No fundo, o ponto é este: não existe um conjunto único de valores humanos que sirva da mesma maneira para o planeta inteiro. Se esses sistemas querem falar com o mundo, vão ter de aprender a refletir o mundo real com bem mais nuance.