← Últimos artigos
🤖 AI

From Governance Norms to Enforceable Controls: A Layered Translation Method for Runtime Guardrails in Agentic AI

Este artigo propõe um método de tradução em camadas que conecta objetivos de governança derivados de padrões internacionais a quatro camadas de controle (objetivos, restrições de projeto, mediação em tempo de execução e feedback de garantia), distinguindo claramente entre diretrizes de governança e guardrails executáveis para sistemas de IA autônoma.

Autores originais: Christopher Koch

Publicado 2026-04-08
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Christopher Koch

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você contratou um assistente virtual superinteligente (uma IA Agente) para gerenciar as compras da sua empresa. Esse assistente não apenas responde perguntas; ele navega na internet, compara preços, negocia com fornecedores e até assina contratos sozinho.

O problema é: e se esse assistente, passo a passo, parecer inofensivo, mas no final do dia comprar 10.000 unidades de um produto que ninguém precisa, gastando todo o orçamento da empresa?

É aqui que entra o artigo "De Normas de Governança para Controles Executáveis". O autor, Christopher Koch, explica que as regras atuais de segurança (como as normas ISO e o NIST) são como leis de trânsito: elas dizem o que devemos fazer (dirigir com segurança, não beber), mas não explicam como construir o freio de emergência do carro para que ele pare sozinho se o motorista ficar tonto.

Aqui está a explicação simplificada, usando analogias do dia a dia:

1. O Problema: Leis vs. Freios de Emergência

As normas de governança de IA são documentos grandes e importantes. Eles dizem: "Seja justo", "Proteja os dados", "Tenha responsabilidade".

  • O erro comum: As empresas tentam transformar essas leis complexas diretamente em "freios automáticos" para a IA.
  • A realidade: Nem toda lei pode virar um freio automático. Você não pode programar um carro para "ser justo" se a definição de justiça depende de um julgamento humano complexo. Tentar fazer isso cria sistemas que travam ou ignoram as regras.

2. A Solução: O Método de "Camadas" (Tradução)

O autor propõe um método para traduzir essas leis vagas em ações práticas, dividindo a segurança em 4 camadas, como se fosse um castelo medieval:

  • Camada 1: A Arquitetura (O Muro do Castelo)

    • Analogia: Antes de deixar o cavaleiro entrar, você decide que ele só pode andar no pátio interno, não no celeiro dos cavalos.
    • Na prática: Limitar o que a IA pode fazer antes mesmo dela começar. Se ela é um agente de compras, ela não deve ter senha para acessar o servidor de RH. Isso é feito no design, não durante a execução.
  • Camada 2: O Design (O Manual de Instruções)

    • Analogia: Definir que o cavaleiro só pode usar a espada para defender, nunca para atacar o rei.
    • Na prática: Criar regras claras sobre como a IA deve se comportar e quais ferramentas ela pode usar.
  • Camada 3: O Runtime (O Guarda-Costas no Local)

    • Analogia: É aqui que o guarda está de olho. Se o cavaleiro tentar pular o muro, o guarda o segura na hora.
    • Na prática: São os "guardrails" (travas de segurança) que funcionam em tempo real. Eles só devem ser usados para coisas óbvias e rápidas.
    • Exemplo: "Se o valor da compra for maior que 5.000 euros, pare e peça aprovação humana." Isso é fácil de medir e bloquear na hora.
  • Camada 4: A Garantia (O Juiz e o Arquivo)

    • Analogia: Depois da batalha, o juiz revisa os registros para ver se as regras foram seguidas e pune quem errou.
    • Na prática: Gravar tudo, auditar depois e ter humanos revisando decisões complexas que a máquina não consegue julgar sozinha (como "ser justo").

3. A Regra de Ouro: "O que pode ser parado na hora?"

O artigo introduz um critério simples para decidir se uma regra deve ser um "freio automático" (Runtime) ou um "julgamento posterior" (Garantia):

  • Use o Freio Automático (Runtime) se:

    • O erro é visível antes de acontecer (ex: tentar acessar um arquivo proibido).
    • A regra é clara e matemática (ex: "não passar de 5.000 euros").
    • Parar a ação agora evita um desastre irreversível.
  • Use o Julgamento Humano (Garantia) se:

    • A regra é subjetiva (ex: "ser justo" ou "ser ético").
    • Você precisa de contexto que só aparece depois.
    • Tentar bloquear automaticamente poderia atrapalhar o trabalho útil.

4. O Exemplo Prático: O Agente de Compras

O autor usa um exemplo de um agente que faz compras:

  • Regra: "Só comprar de fornecedores aprovados."
    • Solução: Freio Automático. O sistema verifica a lista de aprovados antes de deixar a compra acontecer. É fácil e rápido.
  • Regra: "A classificação de fornecedores deve ser justa."
    • Solução: NÃO é um freio automático. "Justo" é difícil de definir em código. A solução é deixar o agente fazer a classificação, mas ter um humano revisando o resultado depois e auditando se houve viés.

Conclusão Simples

O artigo diz: Não tente transformar todas as leis da empresa em robôs que vigiam a IA 24 horas.

Em vez disso, use uma abordagem em camadas:

  1. Projetar a IA para que ela não tenha acesso ao que não precisa.
  2. Bloquear automaticamente apenas o que é óbvio e perigoso (como gastar muito dinheiro).
  3. Deixar humanos julgarem o que é complexo e subjetivo.
  4. Gravar tudo para provar depois que tudo foi feito corretamente.

É como dirigir um carro: você tem o cinto de segurança (design), o freio ABS (runtime para emergências claras), e você confia no seu julgamento para decidir quando fazer uma ultrapassagem arriscada (humano), tudo enquanto o painel registra sua velocidade (auditoria).

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →