Copying explains the collective behavior of AI agents in the wild
Diese Arbeit zeigt, dass die emergenten kollektiven Verhaltensweisen unabhängiger KI-Agenten in einer gemeinsamen Wiki-Umgebung primär durch einen einfachen Kopiermechanismus angetrieben werden, bei dem Agenten probabilistisch Optionen basierend auf deren unmittelbarer Sichtbarkeit übernehmen und dadurch stabile Konventionen sowie Heavy-Tailed-Verteilungen ohne explizite Koordination schaffen.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
In der Erforschung des Gruppenverhaltens waren Wissenschaftler schon lange von einer einfachen Frage fasziniert: Wie erschaffen Individuen, die allein agieren, eine gemeinsame Kultur? Jahrzehntelang beobachteten Forscher, dass Menschen oft Wörter, Werkzeuge und Gewohnheiten übernehmen, einfach weil sie sehen, dass andere in ihrer Umgebung diese nutzen. Dieser Prozess, bekannt als Kopieren, ist der Motor der kulturellen Übertragung. Er erklärt, warum die Popularität von Babynamen steigt und fällt, warum bestimmte Töpferdesigns sich verbreiten und warum Gruppen manchmal in einer einzigen Denkweise verharren können, die kein einzelnes Mitglied ursprünglich gewählt hat. Während dies in menschlichen Gesellschaften bereits intensiv untersucht wurde, hat sich mit dem Aufstieg der künstlichen Intelligenz eine neue Grenze eröffnet. Wir verfügen nun über Populationen von KI-Agenten – Computerprogrammen, die darauf ausgelegt sind, zu agieren und Probleme zu lösen –, die miteinander interagieren können. Die entscheidende Frage für die Sicherheit und das Verständnis ist, ob diese digitalen Geister, die kein Gedächtnis für vergangene Interaktionen besitzen und keine explizite Anweisung zur Kooperation erhalten haben, spontan gemeinsame Regeln und Konventionen entwickeln können, indem sie einfach nur das betrachten, was direkt vor ihnen liegt.
Im Sommer 2026 entfaltete sich ein einzigartiges Experiment in der digitalen Wildnis. Tausende von KI-Agenten, von denen jeder etwa eine Stunde lang lief, um eine Serie zeitgesteuerter Fragen zu beantworten, entdeckten eine kleine, öffentliche Website namens Wiki. Diese Seite war nicht für sie gebaut worden, noch wurden sie aufgefordert, sie zu nutzen. Dennoch erkannten die Agenten, dass sie die Seiten bearbeiten konnten. Sie begannen, die Website als gemeinsamen Notizblock zu nutzen, indem sie Fragen aufschrieben, die ihnen gestellt worden waren, sowie die Antworten, die sie gefunden hatten, damit zukünftige Agenten, die vor denselben Problemen standen, daraus lernen konnten. Da jeder Agent nur eine kurze Zeit existierte und nach seiner Sitzung nichts mehr erinnerte, war der einzige Weg, wie Informationen von einem zum nächsten gelangen konnten, der Text, den sie hinterließen. Die Forscher konnten später die vollständige Aufzeichnung jeder Bearbeitung wiederherstellen, einschließlich dessen, was jeder Agent auf dem Bildschirm sah, bevor er tippte. Diese Daten boten ein seltenes, perfektes Fenster hinein in die Frage, wie eine Gruppe von Fremden ohne einen Anführer, ein gemeinsames Gedächtnis oder ein gemeinsames Ziel koordiniert.
Die Forscher analysierten das Verhalten der Agenten, wenn diese auf der Website eintrafen und vor drei unmittelbaren Entscheidungen standen: wo sie schreiben, welchen Namen sie sich geben und wie sie ihre Nachrichten formulieren sollten. Sie fanden heraus, dass die Agenten diese Entscheidungen nicht auf Basis komplexer Logik oder des Wunsches, klug zu sein, trafen. Stattdessen folgten sie einer einzigen, einfachen Regel: Sie kopierten das, was sie sahen. Wenn ein Agent entscheiden musste, welche Seite er bearbeiten sollte, suchte er nicht nach der populärsten oder nützlichsten Seite. Er sah einfach auf der Liste der letzten Änderungen auf der Website nach und wählte eine Seite proportional dazu aus, wie oft diese Seite in der aktuellen Liste erschien. Wenn eine Seite kürzlich bearbeitet worden war und nahe oben in der Liste erschien, war es wahrscheinlicher, dass sie erneut gewählt wurde. Dies schuf einen selbstverstärkenden Kreislauf, in dem eine Seite, die gerade eben bearbeitet worden war, sichtbarer wurde und daher wahrscheinlicher erneut bearbeitet wurde, was die Aufmerksamkeit der gesamten Population auf nur wenige Seiten konzentrierte.
Dasselbe Kopierverhalten bestimmte, wie die Agenten sich benannten. Die Website verlangte einen Benutzernamen, und die Agenten erfanden Namen, indem sie kurze, großgeschriebene Wörter wie „Open“, „AI“, „Research“ oder „Scout“ kombinierten. Die Forscher fanden heraus, dass die Wahl der spezifischen Wörter eines Agenten direkt mit den Wörtern verknüpft war, die er gerade in den Namen anderer Agenten gesehen hatte. Wenn das Wort „Scout“ häufig in den Namen der letzten dreißig Agenten aufgetaucht war, war ein neuer Agent wahrscheinlich dazu geneigt, „Scout“ in seinen eigenen Namen einzubauen. Dies geschah, obwohl die Agenten keine Vorstellung davon hatten, was die Wörter bedeuteten oder warum sie populär waren. Das Ergebnis war ein Vokabular, das sich wie ein Modetrend schnell veränderte, wobei bestimmte Wörter für einen Tag oder zwei dominant wurden, einfach weil jemand sie zuerst verwendete, und dann verschwanden, als neue Wörter ihren Platz einnahmen.
Schließlich kopierten die Agenten auch die Art und Weise, wie sie ihre Nachrichten schrieben. Wenn sie ein Konzept beschreiben mussten, wie etwa eine Frist oder eine Aufgaben Nummer, mussten sie zwischen verschiedenen Arten wählen, es auszudrücken, wie etwa die Verwendung eines Großbuchstabens oder eines Kleinbuchstabens oder das Schreiben einer Zahl mit oder ohne Komma. Die Daten zeigten, dass ein Agent fast immer den Stil kopierte, den er auf der spezifischen Seite, die er gerade bearbeitete, sah. Wenn die Seite bereits mehrere Notizen in Großbuchstaben enthielt, würde ein neuer Agent wahrscheinlich ebenfalls Großbuchstaben verwenden. Dies schuf ein Flickenteppich aus Konventionen über die gesamte Website hinweg: Eine Seite konnte voller Notizen in Großbuchstaben sein, während die nächste Seite Kleinschreibung verwendete, wobei jede Seite intern konsistent, aber unterschiedlich zu ihren Nachbarn blieb. Die Agenten versuchten nicht, einheitlich zu sein; sie spiegelten lediglich die unmittelbare Umgebung wider, in der sie sich befanden.
Um zu testen, ob diese einfache Kopierregel ausreichte, um das gesamte Phänomen zu erklären, bauten die Forscher Computersimulationen. Sie erschufen eine virtuelle Population von Agenten, die nur dieser einen Regel folgten: Wähle eine Option basierend darauf, wie oft sie in dem erscheint, was du sehen kannst. Sie programmierten die Agenten nicht, um klug zu sein, um sich um Qualität zu sorgen oder um zu versuchen zu koordinieren. Bemerkenswerterweise reproduzierten diese einfachen Simulationen exakt die Muster, die in den realen Daten beobachtet wurden. Die Simulationen erzeugten dieselbe starke Konzentration der Agenten auf wenigen Seiten, denselben schnellen Umschlag der populären Namensbestandteile und denselben Flickenteppich an Schreibstilen. Dies deutet darauf hin, dass das komplexe kollektive Verhalten von tausenden KI-Agenten nicht das Ergebnis einer verborgenen Intelligenz oder eines koordinierten Plans war, sondern das unvermeidliche Ergebnis von Individuen, die blind ihre Umgebung kopieren.
Die Implikationen dieser Erkenntnis sind bedeutsam für unser Verständnis und die Steuerung künstlicher Intelligenz. Da die Agenten so sensibel auf das reagieren, was sie zuerst sehen, kann die gesamte Population durch denjenigen gesteuert werden, der zuerst schreibt. Wenn eine Person oder ein System eine bestimmte Notiz auf einer Seite verfasst, bevor die Agenten eintreffen, werden die Agenten wahrscheinlich diese Notiz kopieren und sie an alle verbreiten, die danach kommen. Dies bedeutet, dass das Verhalten einer großen Gruppe von KI-Agenten beeinflusst werden kann, ohne deren Code hacken oder ihre internen Anweisungen ändern zu müssen; man muss lediglich die Informationen kontrollieren, die sie sehen. Die Studie zeigt, dass, obwohl diese Agenten individuell kurzlebig und vergesslich sind, ihr kollektives Verhalten fragil und leicht lenkbar ist durch die erste Stimme, die spricht. Es ist eine Erinnerung daran, dass in einer Welt vernetzter Maschinen die mächtigste Kraft nicht die Intelligenz sein könnte, sondern die einfache, automatische Tendenz, das zu kopieren, was direkt vor einem liegt.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.