← Nieuwste papers
💬 NLP

Council Mode: Mitigating Hallucination and Bias in LLMs via Multi-Agent Consensus

Dit artikel introduceert de 'Council Mode', een multi-agent consensusframework dat hallucinaties en bias in grote taalmodellen vermindert door parallelle queryverwerking via diverse modellen en een gestructureerde synthese, wat resulteert in aanzienlijk betere prestaties op benchmarks zoals HaluEval en TruthfulQA.

Oorspronkelijke auteurs: Shuai Wu, Xue Li, Yanna Feng, Yufang Li, Zhijun Wang

Gepubliceerd 2026-04-06
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Shuai Wu, Xue Li, Yanna Feng, Yufang Li, Zhijun Wang

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

De "Raadsvergadering"-Manier om AI-fouten te voorkomen

Stel je voor dat je een zeer moeilijke vraag hebt, bijvoorbeeld: "Wat was de exacte reden voor de val van het Romeinse Rijk en hoe zou dat vandaag gebeuren?"

Als je dit vraagt aan één enkele kunstmatige intelligentie (een AI), is het alsof je dit vraagt aan één enkele expert. Die expert is slim, maar kan zich vergissen, iets vergeten, of een vooroordeel hebben. Soms "hallucineert" de AI: hij verzonnet een feit dat klinkt alsof het waar is, maar het is helemaal niet waar.

De auteurs van dit paper (Shuai Wu en zijn team) hebben een slimme oplossing bedacht die ze "Council Mode" noemen. Laten we dit uitleggen met een paar alledaagse vergelijkingen.

1. Het Probleem: De "Enige Expert"

Stel je voor dat je een jurist, een historicus en een dokter nodig hebt. Als je maar één persoon vraagt om al deze rollen te spelen, is de kans groot dat hij ergens een fout maakt.

  • Hallucinaties: De AI verzonnet feiten (zoals een expert die zeker is van iets dat hij niet weet).
  • Vooroordelen: De AI heeft bepaalde denkpatronen die niet altijd eerlijk of neutraal zijn.

Bij moderne AI's (zoals die met een "MoE"-architectuur) wordt dit nog erger. Het is alsof die ene expert eigenlijk een team van duizenden kleine specialisten in zijn hoofd heeft, maar er wordt maar één willekeurige specialist per vraag ingeschakeld. Soms is dat de verkeerde specialist voor de vraag.

2. De Oplossing: De "Raadsvergadering" (Council Mode)

In plaats van één expert te vragen, roepen ze een vergadering bij elkaar. Ze sturen je vraag niet naar één AI, maar naar drie verschillende, zeer slimme AI's van verschillende bedrijven tegelijkertijd.

Het proces verloopt in drie stappen, net als een goed georganiseerde vergadering:

Stap 1: De Portier (De Triage)

Niet elke vraag heeft een vergadering nodig. Als je vraagt: "Hoi, hoe gaat het?", is dat triviaal.

  • De analogie: Een slimme portier kijkt naar je vraag. Is het een simpele groet? Dan geeft hij direct het antwoord zonder de vergaderzaal in te gaan. Dit bespaart tijd en geld.
  • Is het een moeilijke vraag? Dan gaat de portier de deur openen voor de vergadering.

Stap 2: De Parallelle Expertgroep

Nu wordt de vraag gestuurd naar drie verschillende "super-experts":

  1. Een expert van OpenAI (GPT-5.4).
  2. Een expert van Anthropic (Claude Opus 4.6).
  3. Een expert van Google (Gemini 3.1 Pro).
  • De analogie: Het is alsof je drie verschillende detectives stuurt om dezelfde zaak te onderzoeken. Omdat ze allemaal een andere achtergrond hebben en andere boeken hebben gelezen, maken ze waarschijnlijk niet dezelfde fouten. Als Detective A een fout maakt, heeft Detective B misschien de juiste informatie.

Stap 3: De Voorzitter (De Synthese)

Dit is het meest belangrijke deel. De drie detectives komen niet gewoon bij elkaar om te stemmen ("wie heeft het meeste gelijk?"). Nee, er is een slimme voorzitter (een vierde AI) die hun verslagen leest.

De voorzitter doet drie dingen:

  1. Zoekt overeenkomsten: Waar zijn ze het allemaal over eens? (Dit is waarschijnlijk waar).
  2. Identificeert meningsverschillen: Waar zeggen ze iets anders? (Hier moet de voorzitter oordelen wie het waarschijnlijkst gelijk heeft).
  3. Bewaart unieke inzichten: Als één detective iets bijzonders heeft gevonden dat de anderen niet zagen, houdt de voorzitter dit ook vast.

De voorzitter schrijft dan een eindrapport dat niet alleen het antwoord geeft, maar ook uitlegt waar de experts het over eens waren en waar ze het niet over eens waren.

Waarom werkt dit beter?

Stel je voor dat drie mensen een raadsel moeten oplossen.

  • Als ze allemaal hetzelfde denken (zoals drie kopieën van dezelfde AI), maken ze waarschijnlijk allemaal dezelfde fout.
  • Maar als ze verschillend denken (zoals drie verschillende AI-modellen), is de kans dat ze alle drie tegelijk een onzin-verzonnen feit bedenken, extreem klein.

De auteurs hebben dit getest en de resultaten zijn indrukwekkend:

  • Minder fouten: De "Raadsvergadering" maakt 36% minder hallucinaties dan de beste enkele AI.
  • Meer waarheid: Het antwoord is veel betrouwbaarder en eerlijker.
  • Minder vooroordelen: Omdat ze verschillende perspectieven combineren, is het eindresultaat veel neutraal.

Het Nadeel: Snelheid

Is er een prijs voor deze perfectie? Ja, tijd.
Het duurt langer om drie experts te raadplegen en een voorzitter te laten nadenken dan om één expert direct te laten antwoorden.

  • De analogie: Het is als het verschil tussen iemand direct op straat iets vragen (snel, maar misschien niet accuraat) en een vergadering beleggen met drie experts (duurt langer, maar het antwoord is gegarandeerd beter).

Conclusie

De "Council Mode" is een slimme manier om AI's slimmer en betrouwbaarder te maken door ze te laten samenwerken in plaats van ze alleen te laten werken. Het is alsof je niet meer vertrouwt op één stem, maar op een wijze raad die samen het juiste antwoord vindt.

Dit onderzoek laat zien dat de toekomst van betrouwbare AI niet ligt in het maken van één gigantische, perfecte machine, maar in het slimme samenbrengen van verschillende slimme machines.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →