← Últimos artigos
🌀 nonlinear sciences

Ant swarm functional control via stigmergic Reinforcement Learning agents

Este artigo propõe um novo framework utilizando agentes de Aprendizado por Reforço de treinamento centralizado e execução descentralizada que interagem com um enxame de formigas exclusivamente através de um campo de feromônios compartilhado para deslocar com sucesso a transição de fase do sistema e induzir a formação de trilhas ordenadas em regimes tipicamente dominados pelo caos.

Autores originais: Alessio Pitteri, Andrea Guizzo, Laura Ferrarotti, Bruno Lepri, Riccardo Gallotti

Publicado 2026-07-21
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Alessio Pitteri, Andrea Guizzo, Laura Ferrarotti, Bruno Lepri, Riccardo Gallotti

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine um mundo onde milhões de pequenos atores independentes se movem sem um chefe, um mapa ou um plano mestre. Este é o reino dos sistemas complexos, um ramo da ciência que estuda como regras simples seguidas por indivíduos podem criar padrões massivos e organizados a partir do caos. Pense em um bando de pássaros rodopiando no céu, um congestionamento se formando em uma rodovia ou um cardume de peixes virando em uníssono. Nenhuma dessas criaturas tem um maestro; elas apenas reagem aos seus vizinhos e ao ambiente. Um dos exemplos mais famosos disso é a colônia de formigas. As formigas não têm plantas para seus ninhos ou trilhas de comida. Em vez disso, elas usam uma linguagem química chamada feromônios. Conforme uma formiga caminha, ela deixa um rastro de odor minúsculo. Outras formigas sentem esse rastro e têm maior probabilidade de segui-lo, o que torna a trilha mais forte, o que atrai ainda mais formigas. É uma dança de auto-organização onde o próprio ambiente atua como a memória e o guia.

Mas aqui está a parte complicada: às vezes essa dança dá errado. Se as formigas estiverem muito distraídas pelo ruído ou não conseguirem sentir o cheiro bem o suficiente, as trilhas se dissolvem e a colônia cai em um caos onde todos vagam sem rumo. Cientistas há muito se perguntam: se não podemos controlar cada formiga individualmente, podemos dar um empurrãozinho para trazer todo o sistema de volta à ordem? Esta é a questão da controlabilidade funcional. Não se trata de forçar cada formiga a marchar em linha reta; trata-se de encontrar uma maneira de guiar suavemente todo o enxame para que os belos padrões organizados surjam naturalmente, mesmo quando as condições parecem excessivamente bagunçadas para que o façam por conta própria.


Neste artigo, uma equipe de pesquisadores decidiu tentar um novo truque para consertar um enxame de formigas caótico: eles introduziram um esquadrão de formigas robôs "inteligentes" treinadas por inteligência artificial. Eles não programaram esses robôs com um conjunto estrito de regras. Em vez disso, usaram uma técnica chamada Aprendizado por Reforço (RL - Reinforcement Learning). Você pode pensar nisso como treinar um cachorro, mas em vez de um petisco, o "cachorro" recebe um "high-five" digital toda vez que faz algo que ajuda o grupo. Os pesquisadores montaram uma simulação onde um grande grupo de formigas "normais" (modeladas a partir de formigas biológicas reais) vagava por aí, às vezes formando trilhas limpas e outras vezes apenas se perdendo em um embaralhamento caótico.

Nesse meio, eles lançaram uma pequena população de "agentes inteligentes". Estes não eram apenas formigas normais; eram agentes especiais que podiam deixar um rastro de odor muito mais forte que os outros. Mas aqui está a mágica: eles não sabiam para onde ir. Eles tinham que aprender. Usando o algoritmo de Aprendizado por Reforço, os agentes inteligentes jogaram milhares de partidas de "pega-pega de formiga", tentando diferentes movimentos. Cada vez que se moviam de uma forma que ajudava as formigas normais a formar uma linha longa e fina (uma "trilha"), eles recebiam uma recompensa. Sempre que causavam uma bagunça ou um bloco gigante e amontoado, não recebiam nada. Com o tempo, os agentes inteligentes aprenderam uma estratégia secreta: aprenderam exatamente como se mover para criar as condições perfeis para que as formigas normais as seguissem.

Os resultados foram surpreendentemente eficazes. Em simulações onde as formigas normais deveriam estar confusas ou barulhentas demais para jamais formar uma trilha, a presença desses agentes inteligentes mudou tudo. Os pesquisadores descobriram que os agentes inteligentes podiam deslocar a "transição de fase" do sistema. Em termos da física, uma transição de fase é como a água se transformando em gelo; é o momento em que um sistema muda de um estado (caos) para outro (ordem). O artigo mostra que os agentes inteligentes empurraram esse ponto de inflexão, permitindo que trilhas organizadas se formassem em situações onde elas normalmente não existiriam.

No entanto, o artigo é cuidadoso ao apontar o que isso não é. Não é uma varinha mágica que conserta tudo. Os pesquisadores testaram explicitamente uma teoria que poderia parecer óbvia: "Talvez os agentes inteligentes funcionem apenas porque deixam mais cheiro?". Eles realizaram um experimento de controle onde adicionaram formigas extras que deixavam muito cheiro, mas se moviam aleatoriamente, assim como as normais. O resultado? Não funcionou. As trilhas não se formaram. Isso prova que o segredo não era apenas o cheiro extra; era o movimento inteligente dos agentes inteligentes. Eles tinham que saber para onde ir para construir a trilha.

O estudo também descobriu uma zona "Goldilocks" (equilibrada) para o número de agentes inteligentes. Você não precisa de um exército. Os pesquisamadores descobriram que ter apenas 10 agentes inteligentes entre 330 formigas totais (cerca de 3%) era o suficiente para começar a ver trilhas, e 30 agentes (cerca de 9%) era o suficiente para fazer o trabalho de forma confiável. Adicionar mais não ajudou muito além disso. Mas há um limite: se o ambiente for muito ruidoso e as formigas normais forem muito "surdas" ao cheiro, nem mesmo os agentes de IA mais inteligentes podem forçar o sistema a se organizar. O artigo sugere que, embora este método seja poderoso, ele possui limites.

Em suma, este artigo demonstra que você pode ensinar um pequeno grupo de agentes impulsionados por IA a agir como "maestros" para um enxame caótico. Ao aprender a deixar o cheiro certo nos lugares certos, eles podem guiar um grupo massivo de agentes simples para formar estruturas complexas e organizadas, mesmo quando as probabilidades estão contra eles. É uma simulação, não um formigueiro da vida real ainda, mas sugere um futuro fascinante onde podemos usar alguns robôs inteligentes para ajudar a gerenciar o tráfego, organizar multidões ou até guiar enxames de drones, tudo ao ensinar-lhes como dar o toque certo no ambiente para permitir que a ordem emerja do caos.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →