← Neueste Arbeiten
🤖 AI

ASPIRE: Agentic /Skills Discovery for Robotics

ASPIRE ist ein kontinuierliches Lernsystem, das autonom Robotersteuerungsprogramme durch eine iterative Schleife aus Ausführung, Fehlerdiagnose und evolutionärer Suche schreibt und verfeinert, was zu einer wiederverwendbaren Skill-Bibliothek führt, die vorangegangene Methoden bei gestörten, bimanualen und langfristigen Aufgaben signifikant übertrifft und gleichzeitig Zero-Shot-Generalisierung sowie Sim-to-Real-Transfer ermöglicht.

Ursprüngliche Autoren: Runyu Lu, Yubo Wu, Ethan Kou, Letian Fu, Wenli Xiao, Ajay Mandlekar, Yinzhen Xu, Guanya Shi, Ken Goldberg, Ang Chen, Mosharaf Chowdhury, Yuke Zhu, Linxi "Jim" Fan, Guanzhi Wang

Veröffentlicht 2026-07-02
📖 6 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Runyu Lu, Yubo Wu, Ethan Kou, Letian Fu, Wenli Xiao, Ajay Mandlekar, Yinzhen Xu, Guanya Shi, Ken Goldberg, Ang Chen, Mosharaf Chowdhury, Yuke Zhu, Linxi "Jim" Fan, Guanzhi Wang

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Die große Idee: Robotern beibringen, wie ein Mensch „aus Fehlern zu lernen“

Stellen Sie sich vor, Sie bringen einem sehr intelligenten, aber sehr wörtlich nehmenden Roboter bei, wie man das Abendessen kocht.

  • Der alte Weg: Sie schreiben ein striktes Rezept (Code). Wenn der Roboter einen Löffel fallen lässt, stoppt er; Sie müssen das Rezept manuell umschreiben und es dann erneut versuchen. Wenn der Löffel rutschig war, müssen Sie das Rezept für jeden zukünftigen Fall umschreiben, in dem er einen Löffel benutzt. Der Roboter vergisst alles, sobald die Aufgabe erledigt ist.
  • Der ASPIRE-Weg: Der Roboter versucht zu kochen. Wenn er den Löffel fallen lässt, stoppt er nicht einfach. Er schaut genau hin, warum er ihn fallen ließ (war der Griff rutschig? Hat er zu fest zugegriffen?). Er korrigiert das Rezept sofort. Dann schreibt er einen „Profi-Tipp“ in ein gemeinsames Notizbuch: „Wenn man rutschige Löffel hält, fester zupacken und langsam anheben.“ Wenn er das nächste Mal kocht, oder sogar wenn ein anderer Roboter versucht zu kochen, schaut er zuerst in das Notizbuch.

ASPIRE (Agentic Skill Programming through Iterative Robot Exploration) ist ein System, das es Robotern ermöglicht, ihren eigenen Code zu schreiben, ihre eigenen Fehler zu debuggen und eine permanente „Bibliothek voller Tricks“ aufzubauen, die sie jeden Tag klüger macht.


So funktioniert es: Die drei magischen Werkzeuge

Das Paper beschreibt ASPIRE als ein Team aus drei Arbeitern, die gemeinsam in einer Schleife arbeiten:

1. Der „Super-Debugger“ (Robot Execution Engine)

Die meisten Roboter sagen Ihnen nur: „Ich habe versagt.“ Sie sagen Ihnen nicht warum.
ASPIRES Engine ist wie eine High-Tech-Überwachungskamera, die jede noch so kleine Bewegung des Roboters aufzeichnet.

  • Die Analogie: Stellen Sie sich vor, Sie versuchen, ein Auto in eine enge Parklücke zu manövrieren. Ein normaler Roboter sagt nur: „Crash!“ ASPIRES Engine zeigt Ihnen das Video: „Sie haben das Lenkrad zu früh eingeschlagen, und die hintere Stoßstange hat die Wand berührt.“
  • Was es tut: Es liefert dem Roboter einen „Trace“ (ein detailliertes Protokoll) darüber, wo genau die Wahrnehmung versagt hat, wo der Plan schiefging oder wo der Arm stecken blieb. Dies ermöglicht es dem Roboter, das Problem selbst zu diagnostizieren, anstatt zu raten.

2. Das „Gemeinsame Notizbuch“ (Skill Library)

Früher galt: Wenn ein Roboter gelernt hatte, wie man eine bestimmte Schublade öffnet, starb dieses Wissen mit dem Ende der Aufgabe.
ASPIRE führt eine wachsende Bibliothek von „Skills“ (Fähigkeiten).

  • Die Analogy: Denken Sie an dies wie ein Kochbuch voller „Life Hacks“.
    • Eintrag 1: „Wenn der Roboter ein Objekt nicht erreichen kann, weil ein Tisch im Weg steht, versuche es seitlich statt frontal.“
    • Eintrag 2: „Wenn der Roboter zwei Schüsseln sieht, schaue zuerst auf die linke.“
  • Was es tut: Wenn der Roboter einen Fehler behebt, speichert er nicht nur die Korrektur, sondern das Muster. Wenn er später auf ein ähnliches Problem stößt (selbst mit einem anderen Roboter oder einem anderen Objekt), zieht er den „Life Hack“ aus dem Notizbuch und wendet ihn sofort an. So wird er mit der Zeit schneller und besser.

3. Die „Brainstorming-Sitzung“ (Evolutionary Search)

Manchmal gerät ein Roboter in eine Endlosschleife und versucht immer wieder dieselbe schlechte Idee.
ASPIRE nutzt eine Methode namens „Evolutionary Search“ (Evolutionäre Suche).

  • Die Analogie: Stellen Sie sich vor, Sie versuchen, ein undichtes Rohr zu reparieren. Anstatt nur einmal die Schraube festzuziehen, probieren Sie gleichzeitig 10 verschiedene Schlüssel, 5 verschiedene Winkel und 3 verschiedene Arten von Klebeband aus. Sie sehen, was am besten funktioniert, behalten das beste Ergebnis und versuchen dann, dieses zu verbessern.
  • Was es tut: Das System generiert gleichzeitig viele verschiedene Versionen des Roboter-Codes. Es testet sie alle, behält die Gewinner und verwirft die Verlierer. Dies hilft dem Roboter, aus „lokalen Schleifen“ auszubrechen und kreative Lösungen zu finden, auf die ein Mensch vielleicht nicht gekommen wäre.

Was sie tatsächlich erreicht haben (Die Ergebnisse)

Das Paper testete dieses System bei drei Arten von Herausforderungen, und die Ergebnisse waren beeindruckend:

  1. Der „Messy Kitchen“-Test (LIBERO-Pro):

    • Szenario: Der Roboter musste Objekte bewegen, aber die Objekte wurden an zufällige Stellen verschoben oder die Anweisungen wurden leicht geändert (z. B. „nimm den roten Becher auf“ vs. „nimm den blauen Becher auf“).
    • Ergebnis: ASPIRE war 77 % häufiger erfolgreich als bisherige Methoden. Es hat nicht nur den Ort auswendig gelernt, sondern die Fähigkeit, Dinge zu finden und zu greifen, egal wo sie sich befinden.
  2. Die „Zwei-Arm-Übergabe“ (Robosuite):

    • Szenario: Ein Roboter mit zwei Armen musste ein Objekt von einer Hand in die andere übergeben. Das ist unglaublich schwierig, da Timing und Physik kompliziert sind.
    • Ergebnis: Bisherige Methoden waren nur zu 20 % erfolgreich. ASPIRE sprang auf 92 %. Es lernte den „Tanz“ der Übergabe durch Versuch und Irrtum.
  3. Der „Lange Tag zu Hause“ (BEHAVIOR-1K):

    • Szenario: Der Roboter musste eine lange Kette von Aufgaben erledigen, wie „Gehe in die Küche, finde eine Limonade, öffne den Kühlschrank, stelle sie hinein.“
    • Ergebnis: ASPIRE war um 32 % besser als die nächstbeste Methode. Da es eine Bibliothek von Skills besitzt, musste es nicht jedes Mal neu lernen, wie man einen Kühlschrank öffnet; es rief einfach den „Kühlschrank öffnen“-Skill ab.

Die „Magie“ des Transfers: Von der Simulation ins echte Leben

Einer der coolsten Teile des Papers ist der Sim-to-Real Transfer.

  • Das Setup: Der Roboter lernte all seine Fähigkeiten in einem Videospiel (Simulation). Dann setzten sie ihn auf einen echten physischen Roboter, der anders aussah und andere Sensoren hatte.
  • Das Ergebnis: Obwohl der echte Roboter anders war, funktionierten die „Life Hacks“ aus der Simulation trotzdem.
    • Beispiel: Der Roboter lernte im Spiel, dass „wenn man versucht, eine Schublade frontal zu drücken, sie klemmt“. Er wandte dieselbe Logik auf die echte Schublade an.
    • Auswirkung: Dies reduzierte die Menge an „Denkarbeit“ (Rechenleistung), die der echte Roboter für einige Aufgaben benötigte, um fast um das Zehnfache. Es bewies, dass in einer virtuellen Welt gelernte Fähigkeiten einem echten Roboter in der realen Welt helfen können.

Zusammenfassung

ASPIRE ist ein System, das Roboter davon abhält, „dumme Wiederholer“ zu sein, und sie statalldessen in „kontinuierliche Lerner“ verwandelt.

  • Es gibt ihnen Augen, um genau zu sehen, warum sie gescheitert sind (Execution Engine).
  • Es gibt ihnen ein Gedächtnis, um ihre Korrekturen für später zu speichern (Skill Library).
  • Es gibt ihnen ein Gehirn, um viele Lösungen gleichzeitig auszuprobieren (Evolutionary Search).

Das Paper behauptet, dass Roboter durch diesen Ansatz komplexe, chaotische Aufgaben viel schneller lösen können als bisher, und dass das Wissen, das sie in einer Situation gewinnen, ihnen hilft, in völlig neuen Situationen erfolgreich zu sein.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →