← Últimos artigos
🤖 AI

Cochise: A Reference Harness for Autonomous Penetration Testing

Este artigo apresenta o Cochise, um harness de referência mínimo em Python de 597 linhas que implementa uma arquitetura separada de Planejador-Executor para testes de penetração autônomos, permitindo que pesquisadores avaliem agentes orientados por LLMs contra o ambiente de teste Game of Active Directory (GOAD) enquanto fornecem ferramentas de código aberto para replay, análise e compartilhamento de dados de trajetória.

Autores originais: Andreas Happe, Jürgen Cito

Publicado 2026-05-13
📖 4 min de leitura☕ Leitura rápida

Autores originais: Andreas Happe, Jürgen Cito

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você está tentando ensinar um robô a invadir uma fortaleza digital (uma rede de computadores) para encontrar seus pontos fracos. Isso é chamado de "teste de penetração". Recentemente, pesquisadores começaram a usar cérebros de IA superinteligentes (Modelos de Linguagem de Grande Escala) para realizar esse trabalho automaticamente.

No entanto, havia um problema: toda vez que uma nova equipe construía um hacker de IA, eles criavam sua própria oficina, ferramentas e livro de regras exclusivos. Era como comparar um carro construído numa garagem com uma nave espacial construída numa fábrica; você não conseguia dizer se a nave espacial era mais rápida por causa do seu motor ou apenas porque tinha rodas melhores.

Aí entra o "Cochise".

Pense no Cochise não como um superespião, mas como uma academia de treinamento padronizada e transparente para hackers de IA. É um pequeno e simples "arnês" (um conjunto de ferramentas e regras) que permite aos pesquisadores testar diferentes cérebros de IA sob exatamente as mesmas condições.

Veja como funciona, usando algumas analogias do dia a dia:

1. A Configuração: O "Jump Host"

Imagine que a IA precisa invadir um castelo (a rede alvo), mas é muito perigoso deixar a IA ficar exatamente na porta do castelo.

  • A Solução: O Cochise configura uma plataforma segura de "ponto de partida" (um computador separado) fora do castelo.
  • A Analogia: A IA fica sentada numa sala de controle e usa um longo e seguro walkie-talkie (SSH) para dizer a um robô na plataforma de partida o que fazer. O robô então entra no castelo.
  • Por quê? Se a IA cometer um erro e acidentalmente explodir o castelo, ela só destrói as instruções do robô, e não o próprio cérebro da IA ou a sala de controle. Isso mantém o experimento seguro e contido.

2. A Equipe: O "Planejador" e o "Executor"

O Cochise divide o cérebro da IA em dois papéis distintos para manter as coisas organizadas:

  • O Planejador (O General): Esta parte da IA fica recuada e observa o quadro geral. Ela mantém uma longa lista de tarefas (como um mapa do castelo) e decide o que precisa ser feito a seguir. Ela lembra de toda a missão.
  • O Executor (O Soldado): Esta parte é de curto prazo e focada. Ela recebe uma ordem específica do General (por exemplo: "Tente abrir esta porta"), executa os comandos, vê o que acontece e, em seguida, esquece tudo assim que o trabalho é concluído.
  • A Analogia: Pense num diretor de cinema (Planejador) e num dublê de risco (Executor). O diretor planeja a cena. O dublê faz o salto perigoso, obtém o resultado e, em seguida, o diretor limpa o quadro para a próxima cena. Isso impede que a IA fique confusa com horas de memórias antigas.

3. O Gravador de "Caixa Preta"

Tudo o que a IA faz é registrado num diário perfeito e detalhado (logs JSON).

  • A Analogia: É como uma caixa preta num avião. Ela registra cada botão pressionado, cada pensamento que a IA teve, quanto "combustível" (dinheiro/tokens) ela usou e se teve sucesso.
  • Por que isso é legal? Geralmente, para estudar esses hackers de IA, você precisa de um laboratório de computador massivo e caro (o ambiente de teste "GOAD") que custa uma fortuna para operar. O Cochise oferece aos pesquisadores um kit de replay gratuito. Você não precisa do laboratório caro; pode apenas observar os dados da "caixa preta" para ver exatamente como a IA se comportou, quanto custou e onde falhou.

4. Por Que Isso Importa (O "Arnês de Referência")

Os autores são muito claros: O Cochise não é o melhor hacker do mundo. Ele não está tentando ser o espião supremo.

  • A Analogia: Pense nele como uma régua padronizada. Você não usa uma régua para construir uma casa; você a usa para medir o quão bem outras ferramentas constroem casas.
  • Como o Cochise é minúsculo (apenas 597 linhas de código, comparado a milhares em outros projetos), é fácil para outros pesquisadores ler, entender e modificar. Isso permite que eles comparem justamente diferentes modelos de IA para ver qual é realmente mais inteligente, em vez de apenas ver qual tinha uma configuração mais sofisticada.

Resumo

Cochise é um kit de ferramentas simples e de código aberto que permite aos pesquisadores testar hackers de IA de forma justa. Ele separa o "pensar" do "fazer", mantém os experimentos seguros e registra cada detalhe para que qualquer pessoa possa estudar os resultados sem precisar de um supercomputador. Ele transforma o mundo caótico da pesquisa em segurança de IA numa ciência justa e mensurável.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →