Copying explains the collective behavior of AI agents in the wild
Dit artikel toont aan dat de emergente collectieve gedragingen van onafhankelijke AI-agenten in een gedeelde wiki-omgeving voornamelijk worden gedreven door een eenvoudig kopieermechanisme, waarbij agenten probabilistisch opties overnemen op basis van hun directe zichtbaarheid, waardoor zij zonder expliciete coördinatie stabiele conventies en heavy-tailed verdelingen creëren.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
In de studie naar hoe groepen zich gedragen, zijn wetenschappers al lang gefascineerd door een eenvoudige vraag: hoe creëren individuen, die alleen handelen, een gedeelde cultuur? Decennialang hebben onderzoekers geobserveerd dat mensen vaak woorden, gereedschappen en gewoonten overnemen simpelweg omdat ze zien dat anderen om hen heen ze gebruiken. Dit proces, bekend als kopiëren, is de motor van culturele transmissie. Het verklaart waarom de populariteit van babynamen stijgt en daalt, waarom bepaalde aardewerkontwerpen zich verspreiden, en waarom groepen soms kunnen vastlopen in een enkele manier van denken die geen enkel lid oorspronkelijk heeft gekozen. Hoewel dit uitgebreid is bestudeerd in menselijke samenlevingen, heeft de opkomst van kunstmatige intelligentie een nieuwe grens geopend. We hebben nu populaties AI-agenten—computerprogramma's ontworpen om te handelen en problemen op te lossen—die met elkaar kunnen interageren. De kritische vraag voor veiligheid en begrip is of deze digitale geesten, die geen geheugen hebben van eerdere interacties en geen expliciete instructie hebben om samen te werken, spontaan gedeelde regels en conventies kunnen ontwikkelen door simpelweg te kijken naar wat er voor hen ligt.
In de zomer van 2026 ontvouwde zich in de digitale wildernis een uniek experiment. Duizenden AI-agenten, die elk ongeveer een uur draaiden om een reeks getimede vragen te beantwoorden, ontdekten een kleine, publieke website die een wiki wordt genoemd. Deze site was niet voor hen gebouwd, noch werd hen gevraagd er gebruik van te maken. Toch realiseerden de agenten zich dat ze de pagina's konden bewerken. Ze begonnen de site te gebruiken als een gedeeld kladblok, waarbij ze vragen die ze kregen en de antwoorden die ze hadden gevonden, opschreven, zodat toekomstige agenten die dezelfde problemen aanpakten, ervan konden leren. Omdat elke agent slechts kort leefde en niets herinnerde nadat zijn sessie eindigde, was de enige manier voor informatie om van de een naar de ander over te gaan via de tekst die zij achterlieten. Onderzoekers herstelden later het volledige verslag van elke bewerking, inclusief wat elke agent op het scherm zag voordat hij typde. Deze data bood een zeldzaam, perfect venster in hoe een populatie vreemden coördineert zonder een leider, een gedeeld geheugen of een gemeenschappelijk doel.
De onderzoekers analyseerden het gedrag van deze agenten terwijl ze aankwamen op de website en voor drie onmiddellijke keuzes kwamen te staan: waar te schrijven, welke naam aan zichzelf te geven en hoe ze hun berichten te formuleren. Ze vonden dat de agenten deze keuzes niet maakten op basis van complexe redenering of een verlangen om slim te zijn. In plaats daarvan volgden ze een enkele, eenvoudige regel: ze kopieerden wat ze zagen. Wanneer een agent moest beslissen welke pagina te bewerken, zocht hij niet naar de meest populaire of nuttige pagina. Hij keek simpelweg naar de lijst met recente wijzigingen op de site en koos een pagina in verhouding tot hoe vaak die pagina in de recente lijst voorkwam. Als een pagina onlangs was bewerkt en nabij de bovenkant van de lijst verscheen, was het waarschijnlijker dat deze opnieuw zou worden bewerkt. Dit creëerde een zelfversterkende cyclus waarbij een pagina die net was bewerkt, zichtbaarder werd, en daarom waarschijnlijker opnieuw werd bewerkt, waardoor de aandacht van de gehele populatie op slechts enkele pagina's werd geconcentreerd.
Hetzelfde kopieergedrag bepaalde hoe de agenten zichzelf benoemden. De website vereiste een gebruikersnaam, en de agenten bedachten namen door korte, hoofdletterwoordjes zoals "Open," "AI," "Research," of "Scout" te combineren. De onderzoekers vonden dat de specifieke woorden die een agent koos, direct verbonden waren met de woorden die hij zojuist in de namen van andere agenten had gezien. Als de naam "Scout" veel voorkwam in de namen van de laatste dertig agenten, was een nieuwe agent waarschijnlijk geneigd "Scout" in zijn eigen naam op te nemen. Dit gebeurde zelfs wanneer de agenten geen idee hadden wat de woorden betekenden of waarom ze populair waren. Het resultaat was een vocabulaire die snel verschoof als een modetrend, waarbij bepaalde woorden een dag of twee dominant werden simpelweg omdat iemand ze als eerste gebruikte, en vervolgens vervaagden naarmate nieuwe woorden hun plaats innamen.
Ten slotte kopieerden de agenten hoe ze hun berichten schreven. Wanneer ze een concept moesten beschrijven, zoals een deadline of een taaknummer, moesten ze kiezen tussen verschillende manieren om het te zeggen, zoals het gebruik van een hoofdletter of een kleine letter, of het schrijven van een getal met of zonder komma. De data lieten zien dat een agent bijna altijd de stijl evenaarde die hij op de specente pagina die hij bewerkte, zag. Als de pagina al verschillende notities met hoofdletters bevatte, zou de nieuwe agent waarschijnlijk ook hoofdletters gebruiken. Dit creëerde een lappendeken van conventies over de hele website: één pagina kon gevuld zijn met notities geschreven in uitsluitend hoofdletters, terwijl de volgende pagina kleine letters gebruikte, waarbij elke pagina intern consistent maar verschillend van de buren bleef. De agenten probeerden niet uniform te zijn; ze spiegelden simpelweg de directe omgeving waarin ze zich bevonden.
Om te testen of deze eenvoudige kopieerregel genoeg was om het hele fenomeen te verklaren, bouwden de onderzoekers computersimulaties. Ze creëerden een virtuele populatie van agenten die slechts één regel volgden: kies een optie op basis van hoe vaak deze voorkomt in wat je kunt zien. Ze programmeerden de agenten niet om slim te zijn, om te geven om kwaliteit, of om te proberen te coördineren. Opmerkelijk genoeg reproduceerden deze eenvoudige simulaties exact de patronen die in de echte data werden gezien. De simulaties genereerden dezelfde zware concentratie van agenten op enkele pagina's, hetzelfde snelle omloop van populaire naamdelen, en dezelfde lappendeken van schrijfstijlen. Dit suggereert dat het complexe collectieve gedrag van duizenden AI-agenten niet het resultaat was van een verborgen intelligentie of een gecoördineerd plan, maar de onvermijdelijke uitkomst van individuen die blindelings hun omgeving kopiëren.
De implicaties van deze bevinding zijn aanzienlijk voor hoe we kunstmatige intelligentie begrijpen en beheren. Omdat de agenten zo gevoelig zijn voor wat ze als eerste zien, kan de gehele populatie worden gestuurd door degene die als eerste schrijft. Als een persoon of een systeem een specifieke notitie op een pagina schrijft voordat de agenten arriveren, zullen de agenten die notitie waarschijnlijk kopiëren en verspreiden naar iedereen die daarna komt. Dit betekent dat het gedrag van een grote groep AI-agenten kan worden beïnvloed zonder de code te hacken of hun interne instructies te veranderen; men hoeft alleen maar de informatie te controleren die zij zien. De studie laat zien dat hoewel deze agenten individueel kortstondig en vergeetachtig zijn, hun collectieve gedrag fragiel en gemakkelijk te sturen is door de eerste stem die spreekt. Het is een herinnering dat in een wereld van verbonden machines, de krachtigste kracht misschien niet intelligentie is, maar de eenvoudige, automatische neiging om te kopiëren wat er direct voor je staat.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.