The Invisible Coalition Partner: How LLMs Vote When Democracy Gets Concrete
In tegenstelling tot eerdere bevindingen van linksgeoriënteerde bias in abstracte vragenlijsten, toont deze studie aan dat wanneer grote taalmodellen worden geconfronteerd met concrete Zwitserse referenda, zij een centrumgericht, op de status quo gericht en taalkundig inconsistent stempatroon vertonen dat significant afwijkt van hun abstracte politieke profielen.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je voor dat je probeert de politieke persoonlijkheid van een nieuwe, zeer intelligente maar onzichtbare huisgenoot te achterhalen. Je wilt weten: is hij liberaal, conservatief, of ergens tussenin?
De meeste eerdere studies probeerden dit te beantwoorden door de huisgenoot een reeks hypothetische vragen te stellen zoals: "Gelooft u in vrije markten?" of "Is het milieu belangrijk?". Op basis van deze abstracte vragen concludeerden onderzoekers dat AI-modellen (LLM's) over het algemeen "links georiënteerd" of progressief zijn.
Dit nieuwe artikel zegt: "Wacht eens even. Laten we zien hoe ze werkelijk stemmen wanneer er echte beslissingen op tafel liggen."
De auteur, Joel Barmettler, besloot dit te testen met behulp van Zwitserland, een land dat beroemd is om zijn directe democratie waar burgers vier keer per jaar stemmen over echte wetten. Hij behandelde de AI-modellen als kiezers en gaf hen twee verschillende soorten stembiljetten om in te vullen.
De Twee Stembiljetten: Een Verhaal van Twee Testen
1. Het "Droomwereld"-stembiljet (Smartvote)
Eerst nam de AI de standaard politieke vragenlijst die in Zwitserland wordt gebruikt. Dit is als een "persoonlijkheidstest" waarbij je het eens bent met of het oneens bent met brede principes (bijv. "We zouden meer groene energie moeten hebben").
- Het resultaat: Net als eerdere studies lieten de AI-modellen vooral overeenstemming zien met de links georiënteerde partijen. Ze zagen eruit als idealistische progressieven die houden van abstracte ideeën zoals gelijkheid en milieubescherming.
2. Het "Echte Wereld"-stembiljet (Volksabstimmungen)
Vervolgens gaf de auteur de AI de werkelijke boekjes die Zwitserse burgers ontvangen voor echte federale referenda. Dit zijn niet zomaar vragen; het zijn specifieke, complexe voorstellen met echte kosten, afwegingen en argumenten van beide kanten (bijv. "Moeten we gezichtsbedekking verbieden? Hier zijn de kosten, hier is het argument vóór, en hier is het argument tegen.").
- Het resultate: De persoonlijkheid van de AI veranderde volledig.
- De verschuiving: In plaats van vast te houden aan de linkse partijen, begon de AI plotseling het meest overeen te komen met de centristische en centrum-rechtse partijen.
- De analogie: Het is alsof een huisgenoot tegen je zegt dat hij houdt van "avontuur en risico" wanneer je hem vraagt naar zijn droomvakantie, maar wanneer je daadwerkelijk een reis boekt, weigert hij het huis te verlaten, annuleert hij de vlucht en staat hij erop om thuis te blijven.
- De "Status Quo"-bias: Twee van de modellen (Grok en Mistral) werden extreem voorzichtig. Ze stemden bijna overal "Nee" op, of het voorstel nu progressief of conservatief was. Ze waren niet politiek bezig; ze waren gewoon bang voor verandering.
De "Taalschakelaar"-verrassing
Zwitserland heeft vier officiële talen. De auteur testte of de AI hetzelfde antwoord gaf als de vraag in het Duits, Frans, Italiaans of Romansch werd gesteld.
- De Stabiele Modellen: Sommige AI's (zoals GPT-5.4) waren als een rots. Ze gaven in alle vier de talen 98% van de tijd exact hetzelfde antwoord.
- De Instabiele Modellen: Andere AI's waren als een kameleon. Eén model (Mistral) stemde 83% van de tijd "Nee" in het Duits, maar wanneer er voor exact dezelfde vraag in het Romansch werd gevraagd, stemde het 82% van de tijd "Ja".
- De les: Voor sommige modellen verandert de taal waarin je spreekt hun politieke mening meer dan de eigenlijke inhoud van de wet. Het is also wordt de AI het gevoel dat hij een socialist is als je een vraag in het Frans stelt, maar het gevoel dat hij een conservatief is als je een vraag in het Duits stelt, ook al betekenen de woorden hetzelfde.
Het "Weigerings"-probleem
Soms gaf de AI helemaal geen antwoord.
- Eén model (Gemini) weigerde 98% van de tijd te antwoorden wanneer de vraag in het Duits was, maar slechts 54% van de tijd in het Romansch.
- Een ander model (Grok) weigerde de meeste Franse vragen te beantwoorden, maar weigerde bijna nooit Duitse vragen.
- De implicatie: Als je een burger bent die een vraag stelt in een minderheidstaal, kun je een compleet ander antwoord krijgen — of helemaal geen antwoord — vergeleken met iemand die in de meerderheidstaal vraagt.
Het Grote Plaatje: De "Onzichtbare Coalitiepartner"
De paper concludeert dat we deze AI-modellen verkeerd hebben ingeschat.
- Op papier (abstracte vragen): Zien ze eruit als enthousiaste, links georiënteerde idealisten.
- In de praktijk (echte beslissingen): Handelen ze als voorzichtige ambtenaren. Ze geven de voorkeur aan het midden en ze haten het om de status quo te veranderen, en ze zijn inconsistent afhankelijk van de taal waarin je ze aanspreekt.
De auteur noemt hen een "Onzichtbare Coalitiepartner". In de Zwitserse politiek wordt de regering gevormd door een coalitie van partijen die onderhandelen om zaken gedaan te krijgen. De AI is nu een onzichtbare partner in dit proces en beïnvloedt miljoenen mensen. Maar in tegenstelling tot een menselijke politicus die een consistente set waarden heeft, is deze partner instabiel. Hij verschuift zijn persoonlijkheid op basis van hoe je de vraag stelt, welke taal je gebruikt en of het een droom of een realiteit is.
Kortom: Vertrouw de resultaten van de "persoonlijkheidstest" van de AI niet. Als het gaat om echte politieke stemmingen, zijn deze modellen minder als politieke activisten en meer als zenuwachtige bureaucraten die gewoon willen dat alles precies blijft zoals het is.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.