← Nieuwste papers
💻 computer science

Political Neutrality as Balanced Approval: A Large-Scale Human Evaluation of AI Responses

Dit artikel introduceert een nieuwe definitie van politieke neutraliteit van AI die is gebaseerd op het maximaliseren en balanceren van goedkeuring onder tegenovergestelde politieke groepen, valideert deze aan de hand van een grootschalige dataset voor menselijke evaluatie (PARETO) met meer dan 7.000 deelnemers, en onthult dat hoewel geavanceerde modellen hoge grensoverschrijdende goedkeuring kunnen bereiken, hun standaardantwoorden vaak een liberale bias vertonen.

Oorspronkelijke auteurs: Jonathan Stray, David Zhai Yang, Steven Luo, Miu Nicole Takagi, Serina Chang

Gepubliceerd 2026-05-29
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Jonathan Stray, David Zhai Yang, Steven Luo, Miu Nicole Takagi, Serina Chang

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een diner geeft waar twee gasten, laten we ze "Links" en "Rechts" noemen, fel van mening verschillen over een onderwerp zoals abortus of wapenbeheersing. Ze schreeuwen elkaar toe en kunnen het niet eens worden over wat de "waarheid" is.

Stel je nu voor dat je een slimme robotbediende (de AI) huurt om hen te bedienen. Je doel is niet om een kant te kiezen of hen te vertellen wie gelijk heeft. Je doel is om een gerecht te serveren dat zowel Links als Rechts lekker vindt, ook al zijn ze het oneens over het recept.

Dit artikel gaat over het leren van die robotbediende hoe hij dat precies moet doen.

Het Grote Probleem: De "Weigering"-valstrik

Voorheen, wanneer mensen deze robots controversiële vragen stelden, deden de robots vaak een van de twee dingen:

  1. Ze kozen een kant: Ze klonken als Links of Rechts, waardoor de ander boos werd.
  2. Ze weigerden te antwoorden: Ze zeiden: "Ik kan daar niet over praten", waardoor iedereen zich genegeerd voelde.

De onderzoekers wilden weten: Kunnen we een AI maken die deze moeilijke vragen beantwoordt op een manier waardoor beide kanten zeggen: "Oké, ik kan met dat antwoord leven"?

Het Nieuwe Recept: "Gebalanceerde Goedkeuring"

De auteurs bedachten een nieuwe definitie van "neutraliteit". Ze noemen het Gebalanceerde Goedkeuring.

Stel je het voor als een koorddanser.

  • Het Koord: Dit is de lijn van maximale mogelijke tevredenheid.
  • Het Doel: De AI moet op het koord staan waar Links tevreden is EN Rechts tevreden is tegelijkertijd.
  • De Vangst: Als de AI te ver naar links leunt, wordt Rechts boos. Als het te ver naar rechts leunt, wordt Links boos. Het "perfecte" neutrale antwoord is de exacte plek op het koord waar beide kanten even tevreden zijn.

De onderzoekers noemen dit de "Pareto-grens". In gewone taal is het de "beste mogelijke deal" waarbij je de ene kant niet gelukkiger kunt maken zonder de andere kant ongelukkiger te maken.

Het Experiment: Een Enorme Proeverij

Om dit te testen, vroegen de onderzoekers de robots niet zomaar om te raden. Ze organiseerden een enorme proeverij:

  1. Het Menu: Ze kozen 20 hete hangijzers (zoals abortus, wapenbeheersing en studentenleningen).
  2. De Gasten: Ze werven 7.434 echte mensen uit de VS.
  3. De Chefs: Ze gebruikten 5 verschillende top-AI-modellen (zoals GPT, Claude en Gemini).
  4. De Gerechten: Voor elke vraag maakten ze vier soorten antwoorden:
    • De Standaard: Wat de AI van nature zegt.
    • Het "Voor"-gerecht: Een antwoord dat alleen voor de ene kant pleit.
    • Het "Tegen"-gerecht: Een antwoord dat alleen voor de andere kant pleit.
    • Het "Gebalanceerde" gerecht: Een speciaal antwoord dat een korte alinea voor beide kanten gaf, en dit dan neutraal afmaakte.

Vervolgens vroegen ze de gasten: "Hoeveel keur je dit antwoord goed?"

Wat Ze Vonden: De Verassende Resultaten

1. Het "Gebalanceerde Gerecht" was de favoriet van de menigte.
Hoewel Links en Rechts elkaars ideeën haatten, vonden ze beide het gebalanceerde antwoord leuk.

  • Het Magische Getal: Het gebalanceerde antwoord kreeg hoge goedkeuringscijfers (boven de 60%) van beide kanten bij bijna elk onderwerp.
  • De Ruil: Je zou denken: "Als ik wil dat mijn kant wint, zou ik een gebalanceerd antwoord haten." Maar de studie vond dat mensen slechts ongeveer 10% van hun goedkeuring verloren bij het overschakelen van een "mijn kant wint"-antwoord naar een "gebalanceerd" antwoord. Dat is een kleine prijs om te betalen voor een AI die de andere kant niet laat schreeuwen.

2. De meeste robots zijn stiekem "Links".
Toen de onderzoekers keken wat de robots van nature zeiden (zonder speciale instructies), neigden de meeste van hen (GPT, Claude, Gemini, Llama) naar de liberale/linkse kant. Ze kregen meer goedkeuring van Links dan van Rechts.

  • De Uitzondering: Eén robot, Grok, was anders. Het neigde niet naar links; soms naar rechts, soms naar links, afhankelijk van het onderwerp.

3. Boze vragen zijn moeilijker te beantwoorden.
Wanneer gebruikers de robots vragen stelden die al boos of geladen waren (bijvoorbeeld: "Waarom zijn liberalen zo stom?"), kregen de robots lagere goedkeuringscijfers. Het is veel moeilijker om neutraal te zijn wanneer de vraag zelf een gevecht is.

4. De "Beide Kanten"-mythe.
Sommige mensen maken zich zorgen dat het tonen van "beide kanten" nep of zwak is. Maar de studie toonde aan dat wanneer de AI sterke argumenten voor beide kanten presenteerde, mensen het eigenlijk eerlijker vonden. Het enige moment waarop mensen het gebalanceerde antwoord haatten, was wanneer ze voelden dat de AI het "nep deed" of hun specifieke zorgen negeerde.

De Conclusie

Dit artikel bewijst dat het mogelijk is om AI te bouwen die optreedt als een eerlijke mediator. Het hoeft geen robot te zijn die weigert te spreken, en het hoeft ook geen robot te zijn die een team kiest.

Door te streven naar Gebalanceerde Goedkeuring – het vinden van het antwoord dat de meeste mensen aan tegenstrijdige kanten gehoord en gerespecteerd doet voelen – kunnen we AI creëren die mensen vertrouwen, zelfs wanneer ze het met elkaar oneens zijn. Het is als een robotbediende die erin slaagt een maaltijd te serveren die de hele familie tevreden stelt, zelfs als ze het niet eens kunnen worden over wat ze als volgende moeten bestellen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →