← Últimos artigos
💬 NLP

By Their Fruits You Will Know Them: Comparing Formalizations of Law by the Decisions They Encode

Este artigo apresenta um método para comparar sistematicamente formalizações jurídicas enumerando e verbalizando casos limite em que elas discordam, revelando que a similaridade estrutural não garante consistência comportamental e que formalizações geradas por LLMs podem produzir divergências distintas e juridicamente significativas.

Autores originais: Julius Vernie, Matthias Grabmair

Publicado 2026-05-26
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Julius Vernie, Matthias Grabmair

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você tem uma receita muito complicada para uma regra jurídica, escrita em uma linguagem ligeiramente vaga. Você pede a nove chefs especialistas diferentes (os modelos de IA) que traduzam essa receita em um fluxograma rigoroso, passo a passo, que um robô possa seguir.

O problema é: mesmo que os chefs usem os mesmos ingredientes e escrevam os passos em uma ordem similar, eles podem interpretar secretamente algumas instruções-chave de forma diferente. Um chef pode achar que "adicionar sal" significa "uma pitada", enquanto outro acha que significa "uma xícara". Se você apenas olhar para seus fluxogramas lado a lado, eles podem parecer 90% idênticos. Mas se você fornecer ao robô uma combinação específica e complicada de ingredientes, o robô de um chef pode dizer "Sirva este prato", enquanto o do outro diz "Jogue isso fora".

Este artigo trata de uma nova maneira de encontrar essas discordâncias ocultas antes que alguém se machuque.

O Problema Central: "Pelos Seus Frutos Os Conhecereis"

O título vem de um antigo ditado: você não pode julgar uma árvore apenas pela sua aparência; você precisa provar o fruto. No mundo da IA e do direito, a "árvore" é a regra formal (o fluxograma), e o "fruto" é a decisão que ela toma em um caso específico.

Os autores argumentam que simplesmente comparar a estrutura de duas regras jurídicas geradas por IA não é suficiente. Duas regras podem parecer quase idênticas no papel, mas produzir resultados completamente opostos em cenários da vida real. Eles queriam uma maneira de encontrar sistematicamente os "casos extremos" — as situações estranhas e específicas onde duas interpretações diferentes da mesma lei por IAs entram em conflito.

O Método: Um Processo de Detetive em Três Passos

Os pesquisadores construíram um fluxo de trabalho para capturar essas discordâncias, que chamam de "Pelos Seus Frutos". Eis como funciona, usando uma analogia simples:

1. A Tradução (Formalização)
Primeiro, eles pegaram 10 leis diferentes da UE (como o GDPR ou o AI Act) e pediram a 9 modelos de IA de ponta diferentes que transformassem cada lei em uma "árvore de decisão". Pense nisso como pedir a nove arquitetos diferentes que desenhem uma planta baixa para a mesma casa com base em uma descrição vaga.

2. A Criação de Mapas (Correspondência)
Em seguida, eles precisaram comparar as plantas baixas. Mas os arquitetos usaram rótulos diferentes para os mesmos cômodos. Um chamou de "A Cozinha", outro chamou de "Área de Cozinhar". Os pesquisadores usaram uma IA para atuar como tradutor, correspondendo os nós (os passos) nas diferentes árvores que representam o mesmo conceito jurídico. Eles construíram um "mapa compartilhado" de onde as árvores se sobrepõem.

3. O Teste de Estresse (SAT Solver e Casos Extremos)
Esta é a parte mágica. Uma vez que eles tiveram o mapa compartilhado, usaram uma ferramenta matemática (um SAT solver) para atuar como um engenheiro de teste de estresse. Eles perguntaram: "Qual é o conjunto absolutamente menor e mais estranho de fatos que faria essas duas plantas baixas darem respostas diferentes?"

A ferramenta encontrou esses "casos extremos" — as combinações específicas de fatos onde as regras divergem. Por exemplo, ela pode descobrir que as regras só discordam se um robô for usado pela polícia e os dados foram coletados legalmente mas não para um propósito médico específico.

4. A Narrativa (Verbalização)
Finalmente, a matemática bruta (que parece uma lista de variáveis "Verdadeiro/Falso") é entediante e difícil de entender para humanos. Então, eles usaram outra IA para transformar esses problemas matemáticos em histórias curtas e realistas.

  • Em vez de: "Entrada A=Verdadeiro, Entrada B=Falso, Entrada C=Verdadeiro."
  • Eles obtêm: "Uma empresa vende um sistema de reconhecimento facial à polícia para identificar raça. Os dados foram coletados legalmente, mas o sistema não é usado para filtragem."

O Que Eles Encontraram

Quando realizaram esse experimento em 10 leis da UE e 9 modelos de IA, descobriram algumas coisas surpreendentes:

  • As Aparências Enganam: Houve quase nenhuma conexão entre o quão semelhantes as regras pareciam estruturalmente e com que frequência discordavam sobre o resultado. Dois modelos poderiam ter 95% de estruturas correspondentes, mas ainda assim discordar em 50% dos casos extremos.
  • Drama Jurídico Real: Os "frutos" (os casos extremos) revelaram discordâncias genuínas e profundas sobre como a lei deveria ser interpretada.
    • Exemplo: No tópico de IA que categoriza pessoas por raça para trabalho policial, os modelos de IA se dividiram igualmente. Metade disse que é estritamente proibido; a outra metade disse que é permitido se os dados foram coletados legalmente. Isso não foi um erro de computador; espelhou um debate real e contínuo entre especialistas jurídicos humanos sobre o que a lei realmente significa.
  • Erros Ocultos: O método também pegou erros claros. Um modelo de IA adicionou acidentalmente uma regra extra que tornava uma condição jurídica muito mais difícil de cumprir do que a lei pretendia. O "fruto" (o caso extremo) expôs esse erro imediatamente.

A Conclusão

O artigo conclui que, para entender verdadeiramente se uma IA está interpretando a lei corretamente, você não pode apenas olhar para seu código ou seu fluxograma. Você precisa testá-la contra cenários específicos e complicados.

Seu método atua como um holofote, iluminando os momentos exatos em que diferentes interpretações da lei por IAs colidem. Ele transforma diferenças matemáticas abstratas em histórias concretas que advogados humanos podem ler, entender e debater. Não diz qual IA está "certa" (isso é trabalho de especialistas humanos), mas garante que você saiba exatamente onde e por que elas estão discordando.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →