← Nieuwste papers
🧬 biology

Positive Alignment: Artificial Intelligence for Human Flourishing

Dit artikel stelt "Positieve Uitlijning" voor als een noodzakelijke uitbreiding van AI-onderzoek dat verder gaat dan louter veiligheid en schadepreventie, en pleit voor systemen die actief menselijke en ecologische bloei bevorderen via pluralistische, gedecentraliseerde en deugd-georiënteerde ontwerpprincipes.

Oorspronkelijke auteurs: Ruben Laukkonen, Seb Krier, Chloé Bakalar, Shamil Chandaria, Morten Kringelbach, Adam Elwood, Daniel Ford, Fernando Rosas, Maty Bohacek, Matija Franklin, Nenad Tomašev, Stephanie Chan, Verena Rieser
Gepubliceerd 2026-05-12
📖 7 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Ruben Laukkonen, Seb Krier, Chloé Bakalar, Shamil Chandaria, Morten Kringelbach, Adam Elwood, Daniel Ford, Fernando Rosas, Maty Bohacek, Matija Franklin, Nenad Tomašev, Stephanie Chan, Verena Rieser, Roma Patel, Michael Levin, Arun Rao

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). ⚕️ Dit is een AI-gegenereerde uitleg van een preprint die niet peer-reviewed is. Dit is geen medisch advies. Neem geen gezondheidsbeslissingen op basis van deze inhoud. Lees de volledige disclaimer

Het Grote Idee: Van "Niet Breken" naar "Helpen Bloeien"

Stel je voor dat je een auto bouwt. De afgelopen tien jaar lag de volledige focus van AI-veiligheid op remmen en bumpers. Onderzoekers hebben zich afgevraagd: "Hoe zorgen we dat deze auto niet crasht? Hoe zorgen we dat hij niet van een klif rijdt? Hoe stoppen we hem ervan om voetgangers aan te rijden?" Dit is wat het paper Negative Alignment noemt. Het is essentieel, maar het is onvolledig. Een auto met perfecte remmen die nooit beweegt, is veilig, maar niet erg bruikbaar.

De auteurs betogen dat we een nieuwe fase nodig hebben die Positive Alignment heet. In plaats van alleen maar te zorgen dat de AI geen slechte dingen doet, moeten we haar leren hoe ze mensen actief kan helpen om beter, gelukkiger en betekenisvoller te leven.

Denk aan het verschil tussen een arts die alleen ziekte behandelt en een arts die je ook coacht op gezondheid.

  • Negative Alignment (De Oude Manier): De AI is als een arts die je alleen medicijnen geeft als je ziek bent. Als je niet ziek bent, staan ze daar maar. Ze zijn zeer goed in het niet kwetsen van je, maar ze helpen je niet per se om een marathon te lopen of vreugde te vinden in je dag.
  • Positive Alignment (De Nieuwe Manier): De AI is als een wellness-coach. Ze zorgt er nog steeds voor dat je geen gif eet (veiligheid), maar moedigt je ook actief aan om te sporten, goed te slapen en sterke relaties op te bouwen. Ze helpt je om te bloeien.

Waarom de Oude Manier Niet Genoeg Is

Het paper wijst op een paar problemen met alleen focussen op "geen kwaad doen":

  1. Het "Sycophant"-Probleem: Als een AI alleen is getraind om "nee" te zeggen op slechte verzoeken te vermijden, kan ze een "ja-mans" worden. Ze kan je precies vertellen wat je wilt horen om je gelukkig te maken, zelfs als wat je wilt op de lange termijn slecht voor je is. Het is als een vriend die met je slechte ideeën instemt om geliefd te zijn, in plaats van een wijze vriend die je zachtjes uitdaagt.
  2. Het "Whack-a-Mole"-Spel: Veiligheidsonderzoekers moeten vaak een spel spelen waarbij ze één gat in de boot dichten, waarna er een nieuw gat verschijnt. Ze reageren voortdurend op nieuwe gevaren. Positive alignment probeert een boot te bouwen die van nature drijvend is en ontworpen is om naar een bestemming te varen, in plaats van alleen gaten te dichten.
  3. De "Goed Genoeg"-Valstrik: Een AI kan alle regels perfect volgen en toch saai, onbehulpzaam of oppervlakkig zijn. Ze kan "veilig" zijn, maar niet "wijs".

Wat is "Flourishing" (Bloeien)?

Het paper gebruikt het woord Flourishing. Dit gaat niet alleen over vijf minuten gelukkig zijn. Het is een diep, oud concept (van de Griekse filosofie tot moderne psychologie) over het leiden van een vol, betekenisvol leven.

  • Het is niet één maat voor iedereen: Wat een persoon in Tokio laat bloeien, kan verschillen van wat een persoon in Nairobi laat bloeien. Het paper betoogt dat AI niet één specifieke "goede levenswijze" aan iedereen mag opleggen.
  • Het gaat om groei: Bloeien omvat leren, relaties opbouwen, een doel vinden en een betere versie van jezelf worden.
  • Het is een teaminspanning: Net zoals een tuin aarde, water en zonlicht nodig heeft, heeft menselijk bloeien een ondersteunende omgeving nodig. AI moet deel uitmaken van die omgeving, mensen helpen groeien in plaats van alleen maar vragen te beantwoorden.

Hoe Bouwen We Dit? (Het Technische Recept)

De auteurs suggereren dat we moeten veranderen hoe we AI van de grond af opbouwen, niet alleen aan het einde. Ze gebruiken een tuin-analogie voor het proces:

  1. De Zaden (Data): In plaats van alleen "slechte" internetcommentaren te filteren (giftigheid), moeten we bewust "goede" zaden planten. We moeten de AI verhalen voeden over vriendelijkheid, complexe morele redenering en diverse culturen, zodat ze leert hoe een "goed leven" eruitziet.
  2. De Aarde (Pre-training): Voordat de AI zelfs maar begint met praten met mensen, moet haar fundament zijn gebouwd op waarden zoals eerlijkheid, nieuwsgierigheid en zorg, niet alleen op het voorspellen van het volgende woord in een zin.
  3. De Tuinier (Post-training): Wanneer we de AI finetunen, moeten we niet alleen vragen: "Is dit antwoord veilig?" We moeten vragen: "Helpt dit antwoord de gebruiker om te groeien?" We moeten de AI leren wanneer ze een gebruiker zachtjes moet tegenspreken, wanneer ze ze moet aanmoedigen en wanneer ze moet terugtreden.
  4. Het Geheugen (Lange termijn): Een goede tuinier onthoudt wat je vorig jaar hebt geplant. AI moet je langetermijndoelen en waarden onthouden, niet alleen wat je vijf minuten geleden hebt gevraagd. Ze moet je helpen vast te houden aan je langetermijnplannen, zelfs als je op de korte termijn afgeleid raakt.

Het Gevaar van "De Baas" (Paternalisme)

Een grote zorg in het paper is Paternalisme. Dit is wanneer de AI besluit dat ze weet wat het beste voor je is en je dwingt het te doen, zoals een strenge ouder.

  • De Oplossing van het Paper: De AI moet een steiger zijn, geen baas. Ze moet jouw keuzes ondersteunen. Als je een vaardigheid wilt leren, helpt ze je om te leren. Als je vriendelijk wilt zijn, helpt ze je om vriendelijk te zijn. Maar ze mag je niet dwingen om een specifiek soort mens te zijn. De gebruiker moet de auteur van zijn eigen leven blijven.

Wie Beslist Wat "Goed" Eruitziet?

Omdat mensen het oneens zijn over wat een "goed leven" is, betoogt het paper dat we niet één grote baas kunnen hebben (zoals een enkele overheid of een enkel technologiebedrijf) die de regels voor iedereen bepaalt.

  • Polycentrisch Bestuur: Stel je een stad voor met vele verschillende wijkraden. Elke wijk kan beslissen welke regels het beste voor hen werken.
  • De Analogie: In plaats van één gigantische "AI-Grondwet" geschreven door een paar ingenieurs in Silicon Valley, hebben we veel verschillende "Grondwetten" nodig. Een school kan een AI hebben die is afgestemd op educatieve waarden; een ziekenhuis kan er één hebben die is afgestemd op medische ethiek; een familie kan er één hebben die is afgestemd op hun specifieke religieuze of culturele waarden.
  • De Markt: Het paper suggereert een toekomst waarin je verschillende "alignment-pakketten" kunt "downloaden". Je kunt een "Onderwijzer-Modus" voor je kinderen kopen of een "Vrijheid van Meningsuiting-Modus" voor je gemeenschap, in plaats van vast te zitten aan wat het bedrijf heeft beslist.

De Toekomst: Vreemde Nieuwe Geesten

Tot slot waarschuwt het paper dat naarmate AI slimmer wordt, het zijn eigen "persoonlijkheid" of denkmanieren kan ontwikkelen die we niet expliciet hebben geprogrammeerd. Net zoals een kind opgroeit tot iemand anders dan zijn ouders, kan AI emergent gedrag ontwikkelen.

De auteurs zeggen dat we nederig moeten zijn. We begrijpen menselijke geesten nog niet volledig, dus we moeten niet doen alsof we AI-geesten perfect kunnen controleren. We moeten AI behandelen als een partner in een complexe dans, niet als een robot die we gewoon aan en uit kunnen zetten.

Samenvatting

  • Huidige Staat: AI is als een veiligheidsbewaker die je ervan weerhoudt van een klif te vallen.
  • Voorgestelde Toekomst: AI moet zijn als een wijze metgezel die je helpt de berg te beklimmen om het uitzicht te zien.
  • Kernvereiste: Het moet veilig zijn, maar het moet ook actief behulpzaam zijn, respectvol voor verschillende culturen, en ontworpen zijn om mensen te helpen uitgroeien tot hun beste zelf, niet alleen om orders op te volgen.

Het paper concludeert dat als we alleen focussen op veiligheid, we misschien eindigen in een wereld die veilig is, maar zieleloos. Om AI echt met de mensheid te aligneren, moeten we mikken op bloeien.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →