← Últimos artigos
🤖 AI

ASPIRE: Agentic /Skills Discovery for Robotics

O ASPIRE é um sistema de aprendizagem contínua que escreve e refina autonomamente programas de controle robótico através de um ciclo iterativo de execução, diagnóstico de falhas e busca evolutiva, resultando em uma biblioteca de habilidades reutilizáveis que supera significativamente métodos anteriores em tarefas perturbadas, bimanuais e de longo horizonte, ao mesmo tempo em que possibilita a generalização zero-shot e a transferência sim-to-real.

Autores originais: Runyu Lu, Yubo Wu, Ethan Kou, Letian Fu, Wenli Xiao, Ajay Mandlekar, Yinzhen Xu, Guanya Shi, Ken Goldberg, Ang Chen, Mosharaf Chowdhury, Yuke Zhu, Linxi "Jim" Fan, Guanzhi Wang

Publicado 2026-07-02
📖 6 min de leitura🧠 Leitura aprofundada

Autores originais: Runyu Lu, Yubo Wu, Ethan Kou, Letian Fu, Wenli Xiao, Ajay Mandlekar, Yinzhen Xu, Guanya Shi, Ken Goldberg, Ang Chen, Mosharaf Chowdhury, Yuke Zhu, Linxi "Jim" Fan, Guanzhi Wang

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

A Grande Ideia: Ensinando Robôs a "Aprender com Seus Erros" Como um Humano

Imagine que você está ensinando um robô muito inteligente, mas muito literal, a cozinhar o jantar.

  • O Jeito Antigo: Você escreve uma receita rigorosa (código). Se o robô derruba uma colher, ele para, você tem que reescrever a receita manualmente e tentar novamente. Se a colher estava escorregadia, você tem que reescrever a receita para cada vez futura que ele usar uma colher. O robô esquece tudo assim que o trabalho termina.
  • O Jeito ASPIRE: O robô tenta cozinhar. Quando ele derruba a colher, ele não apenas para. Ele observa exatamente por que a derrubou (o cabo estava escorregadio? Ele apertou demais?). Ele corrige a receita imediatamente. Então, ele escreve uma "Dica de Mestre" em um caderno compartilhado: "Ao segurar colheres escorregadias, aperte com mais força e levante lentamente." Na próxima vez que cozinhar, ou mesmo quando um robô diferente tentar cozinhar, ele verifica o caderno primeiro.

ASPIRE (Agentic Skill Programming through Iterative Robot Exploration) é um sistema que permite aos robôs escreverem seu próprio código, depurarem suas próprias falhas e construírem uma "biblioteca de truques" permanente que os torna mais inteligentes a cada dia.


Como Funciona: As Três Ferramentas Mágicas

O artigo descreve o ASPIRE como uma equipe de três trabalhadores trabalhando juntos em um ciclo:

1. O "Super-Depurador" (Mecanismo de Execução do Robô)

A maioria dos robôs apenas te diz: "Eu falhei". Eles não dizem por que.
O mecanismo do ASPIRE é como uma câmera de segurança de alta tecnologia que grava cada pequeno movimento que o robô faz.

  • A Analogia: Imagine que você está tentando estacionar um carro em uma vaga apertada. Um robô normal apenas diz: "Colisão!". O mecanismo do ASPIRE mostra o vídeo: "Você virou o volante cedo demais e o para-choque traseiro bateu na parede".
  • O que ele faz: Ele fornece ao robô um "trace" (um registro detalado) de exatamente onde a percepção falhou, onde o plano deu errado ou onde o braço ficou preso. Isso permite que o robô diagnostique o problema sozinho, em vez de apenas adivinhar.

2. O "Caderno Compartilhado" (Biblioteca de Habilidades)

No passado, se um robô aprendesse a abrir uma gaveta específica, esse conhecimento morria quando a tarefa terminava.
O ASPIRE mantém uma biblioteca crescente de "Habilidades".

  • A Analogia: Pense nisso como um livro de receitas de "Truques de Vida" (Life Hacks).
    • Entrada 1: "Se o robô não consegue alcançar o objeto porque uma mesa está no caminho, tente aproximar-se pela lateral em vez de ir direto de frente."
    • Entrada 2: "Se o robô vir duas tigelas, olhe para a da esquerda primeiro."
  • O que ele faz: Quando o robô corrige um erro, ele não salva apenas a correção; ele salva o padrão. Se ele encontrar um problema semelhante mais tarde (mesmo com um robô diferente ou um objeto diferente), ele busca o "Truque de Vida" no caderno e o utiliza imediatamente. É assim que ele fica mais rápido e melhor com o tempo.

3. A "Sessão de Brainstorming" (Busca Evolutiva)

Às vezes, um robô fica preso em um loop, tentando a mesma ideia ruim repetidamente.
O ASPIRE usa um método chamado "Busca Evolutiva".

  • A Analogia: Imagine que você está tentando consertar um cano com vazamento. Em vez de apenas apertar o parafuso uma vez, você tenta 10 chaves diferentes, 5 ângulos diferentes e 3 tipos de fita todos ao mesmo tempo. Você vê qual funciona melhor, mantém aquela e então tenta melhorar aquela.
  • O que ele faz: O sistema gera muitas versões diferentes do código do robô ao mesmo tempo. Ele testa todas elas, mantém as vencedoras e descarta as perdedoras. Isso ajuda o robô a escapar de "loops locais" e encontrar soluções criativas que um humano talvez não pensasse.

O Que Eles Realmente Alcançaram (Os Resultados)

O artigo testou este sistema em três tipos de desafios, e os resultados foram impressionantes:

  1. O Teste da "Cozinha Bagunçada" (LIBERO-Pro):

    • Cenário: O robô tinha que mover objetos, mas os objetos foram movidos para lugares aleatórios, ou as instruções foram levemente alteradas (ex: "pegue a xícara vermelha" vs. "pegue a xícara azul").
    • Resultado: O ASPIRE teve sucesso 77% mais vezes do que os métodos anteriores. Ele não apenas memorizou o lugar; ele aprendeu a habilidade de encontrar e agarrar coisas, independentemente de onde estivessem.
  2. A "Entrega entre Dois Braços" (Robosuite):

    • Cenário: Um robô com dois braços tinha que passar um objeto de uma mão para a outra. Isso é incrivelmente difícil porque o tempo e a física são complicados.
    • Resultado: Métodos anteriores tiveram sucesso apenas 20% das vezes. O ASPIRE saltou para 92%. Ele aprendeu a "dança" de passar o objeto através de tentativa e erro.
  3. O "Dia Longo em Casa" (BEHAVIOR-1K):

    • Cenário: O robô tinha que realizar uma longa cadeia de tarefas, como "Vá para a cozinha, encontre um refrigerante, abra a geladeira, coloque-o dentro".
    • Resultado: O ASPIRE foi 32% melhor que o próximo melhor método. Como ele possui uma biblioteca de habilidades, ele não precisa reaprender como abrir uma geladeira toda vez; ele apenas consulta a habilidade "Abrir Geladeira".

A "Transferência Mágica": Da Simulação para a Vida Real

Uma das partes mais legais do artigo é a Transferência Sim-to-Real (Simulação para Real).

  • A Configuração: O robô aprendeu todas as suas habilidades em um videogame (simulação). Depois, eles colocaram o sistema em um robô físico real que era diferente e tinha sensores diferentes.
  • O Resultado: Mesmo que o robô real fosse diferente, os "Truques de Vida" da simulação ainda funcionaram.
    • Exemplo: O robô aprendeu no jogo que "se você tentar empurrar uma gaveta de frente, ela trava". Ele aplicou essa mesma lógica à gaveta real.
    • Impacto: Isso reduziu a quantidade de "pensamento" (processamento de computador) que o robô real precisava fazer em quase 10 vezes para algumas tarefas. Provou que habilidades aprendidas em um mundo virtual podem ajudar um robô real no mundo real.

Resumo

ASPIRE é um sistema que impede que os robôs sejam "repetidores burros" e os transforma em "aprendizes contínuos".

  • Ele dá a eles olhos para ver exatamente por que falharam (Mecanismo de Execução).
  • Dá a eles uma memória para salvar suas correções para depois (Biblioteca de Habilidades).
  • Dá a eles um cérebro para tentar muitas soluções ao mesmo tempo (Busca Evolutiva).

O artigo afirma que, ao fazer isso, os robôs podem resolver tarefas complexas e desordenadas muito mais rápido do que antes, e o conhecimento que eles ganham em uma situação ajuda-os a ter sucesso em situações completamente novas.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →