← Nieuwste papers
🤖 AI

Unpredictability dissociates from structured control in language agents

Dit artikel toont aan dat bij taalagenten stochastische onvoorspelbaarheid geen vervanging kan zijn voor gestructureerde controlemechanismen die redenen, geheugen en zelftoestand koppelen aan actiekeuze, omdat gerichte laesies aan deze gestructureerde componenten de prestaties consistent verslechteren terwijl varianten met hoge stochastische variabiliteit falen in het repliceren van gestructureerde koppeling tussen actie en veld over uitgebreide benchmarks.

Oorspronkelijke auteurs: Jia Xiao

Gepubliceerd 2026-05-12
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Jia Xiao

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

De Grote Vraag: Is "Chaos" hetzelfde als "Controle"?

Stel je voor dat je een poppenspel bekijkt.

  • Scenario A: De poppenspeler trekt aan de draden met een duidelijk plan. De pop beweegt om specifieke redenen (herinnering aan het verhaal, een beslissing om te stoppen, of een regel om te volgen).
  • Scenario B: De pop wordt gewoon door een windvlaag heen en weer geslingerd. Het beweegt wild en onvoorspelbaar, maar het heeft geen plan, geen herinnering en geen reden voor waar het als volgende naartoe gaat.

Lange tijd gingen mensen ervan uit dat als een computerprogramma (een "AI-agent") op een wilde, onvoorspelbare manier handelde, het moest "denken" of zichzelf moest "controleren". Dit artikel vraagt zich af: Is dat waar?

De onderzoekers zeggen nee. Ze ontdekten dat het feit dat een AI onvoorspelbaar is (zoals de door de wind geslingerde pop), niet betekent dat het gestructureerde controle heeft (zoals de poppenspeler). Sterker nog, echte controle vereist specifieke interne "organen" zoals geheugen, redenering en het vermogen om "nee" te zeggen (remming).

Het Experiment: Het "Laesie"-Lab

Om dit te bewijzen, bouwden de onderzoekers een speciale AI-agent die werkt als een mens met een "controlepaneel". Ze konden specifieke delen van het brein van de agent aan- of uitzetten, net als een chirurg die een "laesiestudie" uitvoert (delen van het brein verwijderen om te zien wat er gebeurt).

Ze hadden twee hoofdversies van de agent:

  1. De "Gestructureerde" Agent: Deze had al zijn tools aan. Het had een Redenering-module (om uit te leggen waarom het iets koos), een Geheugen-module (om gebeurtenissen uit het verleden te onthouden), een Zelfstatus-module (om zijn doelen bij te houden) en een Veto-module (om zichzelf te stoppen van het maken van een slechte keuze).
  2. De "Chaos"-Agent: Deze had de modules voor Redenering, Geheugen, Zelf en Veto uitgeschakeld. In plaats daarvan verhoogden ze de "temperatuur" (willekeur) om het wild en onvoorspelbaar te laten gokken.

De Analogie:
Denk aan de Gestructureerde Agent als een chef die een recept volgt, het eten proeft en beslist om zout toe te voegen of te stoppen met koken.
Denk aan de Chaos-agent als een blender die op maximale snelheid draait. Hij gooit ingrediënten overal vandaan (onvoorspelbaar), maar hij "kookt" niets; hij maakt alleen maar een puinhoop.

Wat Ze Vonden

De onderzoekers lieten deze agenten 7 verschillende soorten taken uitvoeren (zoals een verhaal vertellen, een keuze maken of een feit onthouden) en controleerden meer dan 74.000 interacties. Dit is wat er gebeurde:

1. Chaos is geen Controle
De "Chaos"-agent was inderdaad veel moeilijker te voorspellen. Het sprong meer rond. Echter, het slaagde er niet in om te handelen als een gecontroleerde agent. Het onthield zijn doelen niet, veranderde zijn mening niet op basis van nieuwe redenen en kon zichzelf niet stoppen van het maken van fouten.

  • Het Resultaat: Onvoorspelbaar zijn maakte de agent niet slimmer of meer onder controle. Het maakte het gewoon willekeurig.

2. De "Post-Hoc"-Truc
Sommige mensen zouden kunnen zeggen: "Misschien controleert de Chaos-agent zichzelf wel, het schrijft zijn redenen gewoon na het maken van een keuze."
Om dit te testen, dwongen de onderzoekers de Chaos-agent om redenen, herinneringen en veto-beslissingen op te schrijven na dat het had gehandeld, alleen maar om te zien of het leek alsof het onder controle was.

  • Het Resultaat: Zelfs wanneer het gedwongen werd om een verhaal te schrijven over waarom het iets deed, kwamen de acties van de Chaos-agent niet overeen met het verhaal. De "redenen" waren slechts decoratie, niet de echte oorzaak van de actie.

3. De "Beperkte Actie"-Test
Om helemaal zeker te zijn, haalden ze alle mooie tekst weg en keken ze alleen naar de uiteindelijke beslissing (bijvoorbeeld "Kies Optie A" of "Stop"). Ze gaven de agenten een geheime test: "Als ik de reden verander, moet jij je keuze veranderen. Als ik je een nep-reden geef, moet je het negeren."

  • Het Resultaat: De Gestructureerde Agent slaagde. Het veranderde zijn keuze wanneer de reden veranderde en negeerde nep-redenen. De Chaos-agent faalde jammerlijk; het kon de regels van logica of geheugen niet volgen.

De "Blinddoek"-Controle**

Om zeker te zijn dat ze niet bevooroordeeld waren, keken drie menselijke experts naar 1.200 voorbeelden zonder te weten welke agent welke was. Ze waren bijna perfect het eens (96% overeenstemming) dat de Gestructureerde Agent de enige was die daadwerkelijk "onder controle" was.

De Grenzen (Wat het Artikel Niet Zei)

Het artikel is zeer voorzichtig met wat het beweert. Het zegt niet:

  • Dat AI nooit onder controle kan zijn.
  • Dat willekeur nutteloos is.
  • Dat dit van toepassing is op elke AI ter wereld.

In plaats daarvan zegt het: In het specifieke type AI-agent dat ze bouwden, creëerde het simpelweg willekeuriger (stochastischer) maken van de AI geen echte, gestructureerde controle. Je kunt een "wilde gok" niet vervangen door een "overwogen beslissing".

De Conclusie

Als je wilt dat een AI echt onder controle is – in staat om te onthouden, te redeneren en zichzelf te stoppen – moet je die specifieke onderdelen erin bouwen. Je kunt niet zomaar de "willekeurigheidsknop" omdraaien en hopen dat het uitvindt hoe het slim moet zijn. Onvoorspelbaarheid is niet hetzelfde als intelligentie.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →