← Nieuwste papers
💬 NLP

Can AI Truly Represent Your Voice in Deliberations? A Comprehensive Study of Large-Scale Opinion Aggregation with LLMs

Dit paper introduceert DeliberationBank, een groot menselijk onderbouwd dataset, en het bijbehorende DeliberationJudge-model om de vertegenwoordiging van minderheidsperspectieven in door AI gegenereerde samenvattingen van publieke deliberaties nauwkeuriger te evalueren dan met bestaande LLM-beoordelaars.

Oorspronkelijke auteurs: Shenzhe Zhu, Shu Yang, Michiel A. Bakker, Alex Pentland, Jiaxin Pei

Gepubliceerd 2026-03-23
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Shenzhe Zhu, Shu Yang, Michiel A. Bakker, Alex Pentland, Jiaxin Pei

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een enorme vergadering hebt met 3.000 mensen. Iedereen heeft een mening, een verhaal of een idee. Nu moet iemand al die duizenden stemmen samenvatten tot één helder verslag dat de overheid kan gebruiken om beslissingen te nemen.

Dat is een enorme klus. Vroeger deden mensen dit handmatig, maar dat kost te veel tijd en geld. Nu hopen we dat Kunstmatige Intelligentie (AI) dit voor ons kan doen. Maar hier zit een groot probleem: AI is vaak een beetje lui en neigt naar de "meeste" mening, waardoor de kleine, stille stemmen (de minderheden) verdwijnen.

Deze paper, getiteld "Can AI Truly Represent Your Voice in Deliberations?", is als het ware een grote, eerlijke test om te zien of AI dit wel goed kan, en hoe we het kunnen verbeteren.

Hier is de uitleg, vertaald naar alledaagse taal:

1. Het Probleem: De "Stille Meerderheid" vs. De "Luie AI"

Stel je een vergaderzaal voor. Als je vraagt: "Wat vinden jullie van belastingen?", dan roepen 90% van de mensen iets over "te duur" en 10% zegt "het is nodig voor goede wegen".
Als je een AI vraagt om dit samen te vatten, zal de AI waarschijnlijk zeggen: "Iedereen vindt belastingen te duur." De AI negeert die 10% omdat ze "te klein" lijken. In de echte wereld is dat gevaarlijk, want die 10% heeft misschien een cruciaal idee dat we nodig hebben.

Bovendien, als we de AI zelf laten oordelen over hoe goed haar samenvatting is ("Hoe eerlijk was je?"), is dat alsof je de dief vraagt of hij gestolen heeft. De AI is vaak niet eerlijk in haar eigen beoordeling.

2. De Oplossing: De "Deliberation Bank" (Een enorme testbank)

De auteurs van dit onderzoek hebben een gigantische testbank gebouwd, genaamd DELIBERATIONBANK.

  • Het Experiment: Ze hebben 10 verschillende maatschappelijke vragen bedacht (zoals "Zijn influencers een echt beroep?" of "Moeten we tarieven invoeren?").
  • De Mensen: Ze hebben 3.000 echte Amerikanen gevraagd om hun mening te geven.
  • De AI's: Vervolgens lieten ze 18 verschillende AI-modellen (zoals GPT-5, Claude, Gemini) deze meningen samenvatten.
  • De Menselijke Jury: Ze hebben 4.500 andere mensen ingehuurd om te kijken of die samenvattingen eerlijk waren. Deze mensen kregen een vraag, een eigen mening, en een AI-samenvatting, en moesten beoordelen: "Zie jij jouw mening terug in dit verslag?"

Dit is als het bouwen van een enorme "proefkeuken" waar je 18 verschillende koks (AI's) laat koken met dezelfde ingrediënten, en 4.500 proeverij-gasten laat oordelen of het gerecht eerlijk is.

3. De Nieuwe "Rechter": DELIBERATIONJUDGE

Het grootste probleem was: hoe oordelen we 750 samenvattingen snel en goed? Als we dat allemaal door mensen laten doen, duurt het jaren. Als we een andere AI laten oordelen, is die vaak onbetrouwbaar.

De oplossing? Ze hebben een speciale, slimme AI-rechter gebouwd: DELIBERATIONJUDGE.

  • Hoe werkt het? In plaats van een enorme, dure AI die alles kan (en vaak fouten maakt), hebben ze een kleinere, gespecialiseerde AI getraind op de antwoorden van die 4.500 menselijke juryleden.
  • De Metafoor: Stel je voor dat je een grote, dure chef-kok hebt die alles kan, maar die vaak vergeet wat de klant echt wil. In plaats daarvan train je een jonge, scherpe kokkelspecialist die alleen maar kijkt naar "Is dit gerecht eerlijk?". Die specialist is 100 keer sneller, goedkoper, en luistert veel beter naar wat de menselijke proeverijen zeggen.
  • Het Resultaat: Deze nieuwe rechter is veel beter in het detecteren van oneerlijkheid dan de grote AI's die we nu gewend zijn.

4. Wat Vonden Ze? (De Verbluffende Bevindingen)

Toen ze alle AI's met deze nieuwe rechter testten, kwamen ze op drie belangrijke dingen:

  1. AI's zijn vaak "lui" met minderheden: De AI's neigen er bijna altijd toe om de meningen van de meerderheid te laten domineren. De "stille" of "andersdenkende" meningen worden vaak genegeerd of verkleind. Het is alsof de AI denkt: "Ik zal maar zeggen wat de meeste mensen zeggen, dat is veiliger."
  2. Groot is niet altijd beter: Je zou denken dat de grootste, duurste AI's (zoals GPT-5) het beste zijn. Dat klopt deels, maar het verschil met kleinere modellen is soms klein. Soms is een kleinere, slimmer getrainde AI juist eerlijker.
  3. De "Minderheid" is ingewikkeld: Ze ontdekten twee soorten minderheden:
    • De "Ik voel me eenzaam"-groep: Mensen die zeggen "Ik denk dat ik de enige ben die dit vindt" (zelfgerapporteerd).
    • De "Ik ben raar"-groep: Mensen die een heel vreemd of uniek argument hebben, maar die zelf niet beseffen dat ze uniek zijn.
    • Het probleem: De AI mist beide groepen, maar om verschillende redenen. De eerste groep wordt genegeerd omdat ze onzeker klinken; de tweede groep wordt genegeerd omdat hun woorden niet passen in het "standaardpatroon" dat de AI kent.

Conclusie: Wat betekent dit voor ons?

De boodschap van dit onderzoek is: AI is een krachtig hulpmiddel, maar we kunnen het nog niet blindelings vertrouwen om democratische beslissingen te samenvatten.

Als we AI gebruiken om de stem van het volk te horen, moeten we oppassen dat we niet alleen het geschreeuw van de meerderheid horen en de fluisterende stemmen van de minderheid verliezen.

De auteurs hebben met hun DELIBERATIONBANK (de testbank) en DELIBERATIONJUDGE (de slimme rechter) een nieuw gereedschap gemaakt. Hiermee kunnen ontwikkelaars in de toekomst AI's testen en verbeteren, zodat ze niet alleen snel zijn, maar ook eerlijk en inclusief. Het is als het geven van een eerlijkheidstest aan AI, zodat het in de toekomst een betere "vertaler" wordt voor de hele samenleving, niet alleen voor de meerderheid.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →