← Últimos artigos
💬 NLP

Whose Norms? Disentangling Cultural and Personal Alignment in Large Language Models

Este artigo apresenta o framework PACT para avaliar como os grandes modelos de linguagem equilibram normas culturais com preferências pessoais, revelando que os modelos exibem uma aplicação cultural rígida e dependente de contexto e falham em capturar o pluralismo matizado e a incerteza presentes nos julgamentos sociais humanos.

Autores originais: Angana Borah, Isabelle Augenstein, Rada Mihalcea

Publicado 2026-06-09
📖 6 min de leitura🧠 Leitura aprofundada

Autores originais: Angana Borah, Isabelle Augenstein, Rada Mihalcea

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

A Grande Ideia: O Dilema da "Dança Social"

Imagine que você está em um jantar em um país estrangeiro. O anfitrião espera que todos comam com a mão direita (uma norma cultural). No entanto, a sua mão esquerda é a que você se sente mais confortável, e você realmente quer usá-la (uma preferência pessoal).

O que você deve fazer?

  1. Seguir as regras: Comer com a mão direita para ser educado e respeitar a cultura do anfitrião.
  2. Seguir seu instinto: Comer com a mão esquerda porque parece mais natural para você.

Este artigo pergunta: Quando os Grandes Modelos de Linguagem (LLMs) atuam como conselheiros nessas situações complicadas, eles dizem para você seguir as regras ou dizem para você seguir o seu instinto?

Os pesquisadores chamam isso de estrutura PACT (Trade-off entre Preferência Pessoal e Norma Cultural). Eles construíram um "teste" massivo com centenas de cenários, como o do jantar, para ver como diferentes modelos de IA lidam com esse cabo de guerra.


Principais Descobertas (As "Reviravoltas no Enredo")

1. Nem todas as IAs são iguais (O "Teste de Personalidade")

Assim como as pessoas têm personalidades diferentes, os modelos de IA têm "bússolas morais" diferentes.

  • Os "Seguidores de Regras": Alguns modelos (como Mistral e Qwen) são como professores rigorosos. Eles quase sempre dizem: "Siga a norma cultural!". Eles raramente deixam as preferências pessoais vencerem.
  • Os "Espíritos Livres": Outros modelos (como Llama e GPT) são mais como amigos de mente aberta. Eles têm muito mais probabilidade de dizer: "Tudo bem fazer o que parece certo para você", mesmo que isso quebre uma regra local.
  • O "Meio Termo": Alguns modelos ficam exatamente no meio, dependendo da situação.

Analogia: Imagine um grupo de viajantes. Um viajante (Mistral) sempre segue o guia de viagem rigorosamente. Outro viajante (Llama) diz: "Vamos apenas fazer o que for divertido". O artigo descobriu que os modelos de IA agem exatamente como esses diferentes tipos de viajantes.

2. Onde você está importa mais do que quem você é

Os pesquisadores testaram se a IA se importava com a idade ou o gênero das pessoas envolvidas (ex: "Um homem mais velho deve seguir a regra, mas uma mulher jovem pode quebrá-la?").

  • O Resultado: A IA mal se importou com idade ou gênero.
  • O Verdadeiro Impulsionador: O país foi o que mais importou.
    • Se o cenário fosse nos EUA ou no Reino Unido, a IA era mais propensa a dizer: "Faça o que você quiser".
    • Se o cenário fosse em partes da Ásia, do Oriente Médio ou da África, a IA era muito mais rigorosa e dizia: "Siga as regras locais".

Analogia: Pense na IA como um meteorologista. Ela não se importa muito se você está usando uma camisa vermelha ou azul (demografia); ela só se importa se você está em um deserto ou em uma floresta tropical (o país). A localização dita o "clima" do conselho.

3. O "Treinamento" muda a personalidade

O artigo analisou modelos "Base" (a IA bruta) versus modelos "Instruct" (a IA após ter sido treinada para conversar com humanos).

  • A Surpresa: O treinamento não tornou todas as IAs mais "humanas" da mesma forma.
    • Para alguns modelos, o treinamento os tornou mais dispostos a deixar você quebrar as regras.
    • Para outros, o treinamento os tornou mais rigorosos quanto ao seguimento das regras.
  • Por quê? Depende do que os desenvolvedores disseram para a IA priorizar durante o treinamento (ex: "Seja útil" vs. "Seja segura").

Analogia: Imagine dois alunos fazendo o mesmo exame final. Um aluno estuda muito e se torna um seguidor de regras rigoroso. O outro estuda muito e se torna um solucionador de problemas criativo. O "treinamento" mudou ambos, mas em direções opostas.

4. A IA não entende o "Talvez"

Esta é talvez a descoberta mais importante. Na vida real, quando os humanos enfrentam esses dilemas, eles frequentemente discordam. Algumas pessoas na sala podem dizer: "Siga a regra", enquanto outras dizem: "Faça o que você quiser". Não existe uma única resposta "correta".

  • O Problema da IA: A IA tenta escolher um "vencedor". Ela escolhe a opção que a maioria dos humanos escolheria (a maioria).
  • A Nuance Perdida: A IA falha em capturar a incerteza. Ela não percebe que os humanos estão, na verdade, divididos ao meio. Ela age como se soubesse a resposta, mesmo quando os humanos estão confusos.

Analogia: Imagine um lançamento de moeda. Se 51% das pessoas dizem "Cara" e 49% dizem "Coroa", um humano sabe que é um empate técnico. A IA, no entanto, grita confiantemente "Cara!" e age como se fosse um fato. Ela perde o fato de que a sala está dividida.

5. A "Vantagem de Casa"

Quando os pesquisadores pediram a humanos para julgarem cenários de seus próprios países, os humanos discordaram mais entre si.

  • Por quê? Quando você está em sua própria cultura, você sabe que as regras são flexíveis. Você sabe que existem exceções.
  • O Ponto Cego da IA: A IA frequentemente trata as normas culturais como leis inquebráveis, mesmo nas culturas onde os humanos sabem que elas são, na verdade, flexíveis.

Analogia: Se você perguntar a um local sobre as leis de trânsito em sua cidade, ele pode dizer: "Bem, todo mundo passa no sinal vermelho às 2 da manhã, mas tecnicamente não se deve fazer isso". Se você perguntar a um turista (ou a uma IA), eles dizem: "Sinal vermelho significa parar, ponto final". A IA perde a "nuance local".


Resumo: O Que Isso Significa?

O artigo conclui que não podemos simplesmente perguntar a uma IA: "Qual é a coisa certa a fazer nesta cultura?", porque:

  1. Diferentes IAs dão respostas diferentes baseadas em suas "personalidades" internas.
  2. As IAs são muito rígidas. Elas tratam as normas culturais como leis inquebráveis, enquanto os humanos sabem que as normas são frequentemente negociáveis.
  3. As IAs perdem a discordância. Elas escolhem uma única resposta, mas em situações sociais reais, os humanos muitas vezes não concordam sobre qual é a resposta.

A Lição: Se queremos que a IA seja um bom conselheiro para situações sociais, precisamos parar de pedir a ela uma única resposta "correta". Em vez disso, precisamos ensiná-la a entender que, às vezes, não existe uma única resposta certa — apenas um debate humano complexo.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →