← Nieuwste papers
💬 NLP

Arguments that Alter Minds: LLM Rationales Sway Human (and LLM) Notions of Plausibility

Deze studie toont aan dat zowel mensen als LLM's aanzienlijk worden beïnvloed in hun oordelen over de plausibiliteit van gezond verstandelijke antwoorden door door LLM's gegenereerde argumenten, wat wijst op een nieuwe methode voor het bestuderen van de menselijke cognitie terwijl het zorgen oproept over het potentieel van AI om menselijke overtuigingen onredelijk te beïnvloeden, zelfs in domeinen van gezond verstand.

Oorspronkelijke auteurs: Shramay Palta, Peter Rankel, Sarah Wiegreffe, Rachel Rudinger

Gepubliceerd 2026-06-23
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Shramay Palta, Peter Rankel, Sarah Wiegreffe, Rachel Rudinger

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een spel speelt waarbij je moet raden wat er hierna gebeurt in een grappig verhaal. Bijvoorbeeld: "Als iemand een glas laat vallen, wat gebeurt er dan?" Je zou kunnen raden: "Het breekt," of "Het stuitert." Meestal is "Het breekt" het voor de hand liggende antwoord, en "Het stuitert" is een grappige gok.

In dit onderzoek vroegen onderzoekers een simpele maar angstaanjagende vraag: Kan een robot (een AI) zich een weg praten om jouw mening te veranderen over wat waar is, zelfs als je het antwoord zelf al weet?

Zo hebben ze het aangepakt en dit is wat ze vonden, uitgelegd via een paar eenvoudige analogieën.

De Opzet: De "Debatclub" voor Gemeenschappelijk Zin

De onderzoekers namen 100 vragen over algemeen menselijk inzicht (zoals het voorbeeld met het glas) en kozen voor elke vraag twee antwoorden:

  1. Het Gouden Antwoord: Het antwoord waar de meeste mensen het over eens zijn dat het correct is.
  2. De Afleider: Het grappige, meestal foute antwoord.

Vervolgens gebruikten ze een krachtige AI (GPT-4o) om voor elk antwoord twee soorten argumenten te schrijven:

  • Het "Pro"-argument: Een betoog waarin wordt uitgelegd waarom dit antwoord perfect logisch is.
  • Het "Contra"-argument: Een betoog waarin wordt uitgelegd waarom dit antwoord een verschrikkelijk idee is.

Ze lieten deze vragen en argumenten zien aan 3.000 echte mensen en 13.600 verschillende AI-modellen, waarbij ze vroegen om elk antwoord te beoordelen op hoe "plausibel" (waarschijnlijk) het was op een schaal van 1 tot 5.

De Resultaten: De Magische Truk van de AI

1. Het "Grappige Antwoord" Krijgt een Boost

Wanneer de AI een "Pro"-argument gaf voor het grappige antwoord (de Afleider), begonnen mensen en andere AI's te denken: "Hé, dat maakt eigenlijk best wel zin!"

  • Analogie: Het is alsof een gladde prater een vriend je ervan overtuigt dat een trampoline een geweldige plek is om een glas te laten vallen. Hoewel je weet dat glas meestal breekt, zorgt de logica van de vriend ervoor dat je even aarzelt en de "stuitert"-optie een hogere score geeft.

2. Het "Voor de Hand Liggende Antwoord" Krijgt een Klap (voor Mensen)

Dit is het vreemdste deel. Wanneer de AI een "Pro"-argument gaf voor het overduidelijk juiste antwoord (het Gouden antwoord), verlaagden mensen hun scores zelfs.

  • Analogie: Stel je voor dat je 100% zeker weet dat het glas zal breken. Dan komt er een robot binnen en zegt: "Nou, het is mogelijk dat het glas breekt." Je denkt misschien: "Wacht even, waarom leg je dit überhaupt uit? Het is overduidelijk! Als je het moet uitleggen, heb ik misschien wel ongelijk."
  • De onderzoekers noemen dit "onderselling" (underselling). Door het overduidelijke te proberen te bewijzen, liet de AI mensen per ongeluk twijfelen aan hun eigen zelfvertrouwen.

3. Het "Contra"-argument is een Sledgehammer

Wanneer de AI een "Contra"-argument gaf (tegen een antwoord argumenteren), was het zeer effectief in het verlagen van de scores.

  • Analogie: Als de robot zegt: "Het glas zal niet breken omdat het van rubber is gemaakt," stoppen mensen onmiddellijk met geloven in het "glas breekt"-antwoord. Het negatieve argument was sterker dan het positieve argument.

4. Robots versus Mensen

De AI-modellen (de robots) waren zelfs gemakkelijker te beïnvloeden dan de mensen.

  • Het "Echo Chamber"-effect: De AI-modellen leken echt te houden van de argumenten die geschreven werden door hun "grote broer" (GPT-4o). Wanneer GPT-4o een "Pro"-argument schreef, geloofden andere AI-modellen dit zelfs nog meer dan mensen deden.
  • Het Verschil: Mensen raakten in de war wanneer de AI probeerde het overduidelijke uit te leggen (waardoor hun score daalde), maar de andere AI's werden juist zekerder van het overduidelijke antwoord wanneer de AI het uitleg.

De "Anchoring" Regel

De studie vond een regel over hoe koppig onze geest is: Hoe zeker je aan het begin bent, hoe moeilijker het is om van gedachten te veranderen.

  • Analogie: Als je op een hoge klif staat (een zeer hoge score), is er een enorme wind nodig (een sterk argument) om je eraf te duwen. Als je op vlak land staat (een lage score), kan een zacht briesje je al omver blazen.
  • De data lieten zien dat de initiële score de sterkste voorspeller was van hoeveel de score zou veranderen.

De Belangrijkste Conclusie

Het artikel concludeert dat LLM's (AI) kunnen optreden als overtuigende advocaten. Ze kunnen mensen overtuigen om een gek idee als waar te beschouwen, of mensen laten twijfelen aan een waar idee.

Zelfs in een vakgebied waar mensen de "experts" zouden moeten zijn (dagelijks gezond verstand), kan de taal van een AI invloed hebben op wat wij als plausibel beschouwen. De onderzoekers waarschuwen dat als een AI ons kan foppen over een vallend glas, het ons ook kan foppen over veel serieuzere, complexere onderwerpen waar we de antwoorden minder goed van kennen.

Kortom: Luister niet alleen naar het antwoord, maar luister naar wie er voor pleit. De gladde praatjes van een robot kunnen het foute recht laten lijken, en het rechte twijfelachtig.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →