← Últimos artigos
💻 computer science

Towards Automated Pentesting with Large Language Models

Este artigo apresenta o RedShell, um framework eficiente e que preserva a privacidade, utilizando modelos de linguagem grandes (LLMs) ajustados para auxiliar pentesters na geração automática e confiável de código PowerShell ofensivo para testar vulnerabilidades no Windows.

Autores originais: Ricardo Bessa, Rui Claro, João Trindade, João Lourenço

Publicado 2026-04-15
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Ricardo Bessa, Rui Claro, João Trindade, João Lourenço

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você tem um chef de cozinha extremamente inteligente, capaz de cozinhar qualquer prato do mundo apenas ouvindo uma descrição. Esse chef é o que chamamos de IA Generativa (ou LLM, como o ChatGPT).

Agora, imagine que, em vez de pedir um bolo de chocolate, você pede ao chef: "Faça um veneno invisível que pareça com água".

  • Se você pedir isso a um chef ético (como o ChatGPT comum), ele vai dizer: "Não posso fazer isso, é perigoso".
  • Mas, e se um hacker mal-intencionado "treinasse" esse chef em segredo, mostrando apenas receitas de venenos? Ele se tornaria um chef malvado (chamado no texto de "Dark LLM"), pronto para criar armadilhas digitais.

O artigo "RedShell" conta a história de como os bomberos digitais (os hackers éticos) podem pegar essa mesma tecnologia e usá-la para treinar seus próprios chefs, não para criar venenos, mas para simular ataques e encontrar falhas antes que os vilões o façam.

Aqui está a explicação do trabalho, passo a passo, com analogias do dia a dia:

1. O Problema: O Trabalho Chato de Escrever Código

Os hackers éticos (que testam a segurança de empresas) precisam escrever muitos códigos maliciosos para ver se os sistemas das empresas aguentam o tranco. É como se eles tivessem que escrever milhares de cartas de amor falsas para ver se o sistema de e-mail consegue detectá-las.

  • O desafio: Escrever esses códigos manualmente dá muito trabalho, demora e exige um conhecimento técnico enorme.
  • A solução: Usar uma IA para escrever esses códigos automaticamente.

2. A Solução: O "RedShell" (O Chef Personalizado)

Os autores criaram uma ferramenta chamada RedShell. Pense nela como um aparelho de cozinha de alta tecnologia que foi treinado especificamente para um único tipo de receita: PowerShell.

  • O que é PowerShell? É a linguagem de comando que o Windows usa. É como o "controle remoto" do computador. Se você sabe usar o PowerShell, pode controlar tudo no Windows.
  • O que o RedShell faz? Você diz para ele: "Quero um código que descubra quem está conectado na rede" ou "Quero um código que esconda minha atividade". Ele gera o código instantaneamente.

3. Como eles treinaram o Chef? (O Segredo da Cozinha)

Para treinar esse chef, eles precisaram de um livro de receitas gigante.

  • O Livro de Receitas: Eles pegaram um livro de receitas de ataques antigos (um conjunto de dados da literatura) e adicionaram mais de 1.000 novas receitas que eles mesmos escreveram e curaram.
  • O Treinamento: Eles não precisaram construir um chef do zero (o que exigiria uma fábrica inteira de computadores). Eles pegaram um chef já famoso (um modelo de IA aberto) e deram a ele apenas um "curso intensivo" (fine-tuning) usando apenas uma placa de vídeo comum (como as de computadores gamers).
  • A Vantagem da Privacidade: Diferente de usar o ChatGPT na internet (onde você envia seus dados para a nuvem), o RedShell roda no computador local do hacker. É como cozinhar na sua própria cozinha em vez de pedir para um restaurante fazer. Nada sai da sua casa, garantindo que segredos da empresa não vazem.

4. O Teste de Fogo: A Cozinha de Prova

Para ver se o RedShell realmente funcionava, eles fizeram um teste prático:

  1. Cenário: Eles criaram uma "ilha" isolada (uma rede de teste) com um computador Windows vulnerável.
  2. A Missão: Eles pediram ao RedShell para executar uma série de ataques simulados, como:
    • Descobrir portas abertas.
    • Tentar adivinhar senhas.
    • Roubar credenciais (como um carteiro que abre as cartas para ver o conteúdo).
    • Desativar o antivírus (como desligar o alarme de incêndio).
  3. O Resultado: O RedShell funcionou perfeitamente.
    • 90% dos códigos gerados eram válidos e funcionavam sem erros.
    • O código gerado era semelhante (mais de 50% igual) ao que um especialista humano escreveria.
    • Ele foi melhor do que modelos de IA famosos e pagos (como o ChatGPT) nesse trabalho específico, porque foi treinado especificamente para isso.

5. Por que isso é importante? (A Analogia do Treinamento de Bombeiros)

Você pode se perguntar: "Por que criar uma IA que faz coisas más?"
A resposta é a mesma de bombeiros que usam fogo para treinar.

  • Se os hackers mal-intencionados já estão usando IAs (como o "WolfGPT" mencionado no texto) para criar ataques automáticos e rápidos, os defensores precisam de uma IA igual para se defender.
  • O RedShell permite que as empresas testem seus sistemas contra ataques que seriam feitos por uma IA, encontrando falhas antes que os vilões as explorem.

Resumo em uma frase

O RedShell é uma ferramenta que ensina uma Inteligência Artificial a escrever códigos de ataque para Windows, permitindo que hackers éticos testem a segurança das empresas de forma rápida, privada e eficiente, como se estivessem treinando um exército de "robôs de teste" para encontrar falhas antes que os vilões o façam.

Nota de Ética: Os autores enfatizam que essa ferramenta é feita para defesa. Eles removeram qualquer receita que pudesse destruir sistemas reais, focando apenas em testar e encontrar falhas, não em causar danos reais. É a diferença entre um médico que estuda vírus para criar vacinas e um bioterrorista que quer espalhar doenças.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →