← Nieuwste papers
📄 other

AI versus Expert Feedback on Ethical Decision-Making in Medical Students: A Pilot Randomized Controlled Feasibility Trial with Exploratory Educational Outcomes

Deze pilot gerandomiseerde gecontroleerde studie toont aan dat door AI gegenereerde feedback een haalbaar en acceptabel alternatief is voor feedback van een expertpanel voor medische ethiekeducatie, waarbij vergelijkbare of potentieel superieure voorlopige resultaten worden getoond ondanks basale onbalansen en de noodzaak voor grotere bevestigende studies.

Oorspronkelijke auteurs: Tuğba İş Kara, Yavuz Selim Kıyak

Gepubliceerd 2026-07-25
📖 6 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Tuğba İş Kara, Yavuz Selim Kıyak

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je de medische faculteit voor als een enorme, risicovolle trainingsgrond waar toekomstige artsen niet alleen leren hoe ze botten breken, maar ook hoe ze door de rommelige, grijze gebieden van het menselijk leven navigeren. Het is een plek waar studenten moeten leren balanceren tussen regels, gevoelens en moeilijke keuzes—zoals beslissen wie een schaars middel krijgt of hoe je een familie slecht nieuws brengt. Decennialang was de beste manier om deze "ethische spieren" te trainen het laten beoordelen van de keuzes van een student door een menselijke expert, zoals een wijze coach, die vervolgens uitlegt waarom een beslissing goed of slecht was. Maar hier is de crux: het is ontzettend moeilijk om voor elke student genoeg wijze coaches te vinden, en het kost hen een enorme hoeveelheid tijd.

Maak kennis met Kunstmatige Intelligentie (AI), de digitale hersenen die met lichtsnelheid kunnen chatten, schrijven en puzzels oplossen. De grote vraag die onderzoekers stellen is: kan dit digitale brein fungeren als een vervanging voor de menselijke coach? Kan een AI specifiek feedback genereren die studenten helpt om betere ethische keuzes te maken, net zo goed als een panel van echte menselijke experts? Dit gaat er niet om de mens volledig te vervangen, maar om te zien of een "door mensen beoordeelde AI" een schaalbare sidekick kan zijn, die dezelfde begeleiding biedt zonder de faculteit uit te putten. Als dit werkt, zou dit kunnen betekenen dat elke medisch student een persoonlijke ethiek-tutor krijgt, ongeacht hoe groot de klas is.


De Grote Feedback-showdown: Menselijke Coaches versus AI-Assistenten

In een recente pilotstudie zetten onderzoekers een fascinerend experiment op om te zien of het advies van een robot de moed kan bezamen tegenover een kamer vol menselijke experts. Ze verzamelden 56 zesdejaars geneeskundestudenten—eigenlijk stagiairs die op het punt staan af te studeren—en verdeelden hen in twee teams. Beide teams speelden hetzelfde ethische videospel genaamd de "Concordance of Judgment Learning Tool" (CJCT). Denk aan dit hulpmiddel als een simulatie waarin studenten geconfronteerd worden met lastige scenario's, een keuze maken, en vervolgens feedback krijgen over hoe hun keuze zich verhoudt tot wat experts zouden doen.

De twist? De twee teams kregen hun feedback van verschillende bronnen. Eén groep ontving aantekeningen geschreven door een panel van 25 menselijke experts. De andere groep ontving aantekeningen gegenereerd door een AI, maar met een vangnet: de output van de AI werd eerst gecontroleerd en goedgekeurd door menselijke experts om er zeker van te zijn dat de AI niet hallucineerde of vreemd deed. Het doel was om te zien of de AI-groep net zo goed kon leren als de menselijke groep.

De Resultaten: Een Verrassende (Maar Voorzichtige) Voorsprong voor de AI

Wanneer de studenten een test aflegden genaamd de Objective Structured Video Examination (OSVE)—wat een soort videoquiz is waarbij ze de juiste ethische zet in een scène moeten herkennen—waren de resultaten een beetje een achtbaan.

Eerst was er een hobbel bij de startlijn. Voordat de training zelfs begon, scoorde de AI-groep al hoger dan de menselijke groep. Het was alsoom een race te beginnen waarbij één team al vijf meter voorop stond. De gemiddelde startscore van de AI-groep was 23,32, terwijl de menselijke groep op 19,36 begon. Dit was geen klein gat; het was een aanzienlijk verschil.

Na de training verbeterden beide groepen. De AI-groep eindigde met een gemiddelde score van 27,29, en de menselijke groep kwam uit op 23,32. Wanneer de onderzoekers een statistische truc gebruikten om te corrigeren voor die voorsprong (het verschil in nulmeting), leek de AI-groep nog steeds de winnaar te zijn. De gecorrigeerde berekening suggereerde dat de AI-feedback een boost van ongeveer 4,50 punten zou hebben gegeven vergeleken met de menselijke feedback.

Echter, de onderzoekers zijn zeer voorzichtig met het vieren van de overwinning. Wanneer zij keken naar de mate van verbetering per student (de verandering van begin tot eind), waren de twee groepen identiek. Beide groepen verbeterden met precies 3,96 punten. Het was een nek-aan-nekrace. Dit suggereert dat de AI-groep weliswaar hoger eindigde in scores, maar dat ze misschien gewoon beter waren aan het begin, in plaats van dat de AI hen iets leerde wat de mensen hen niet konden leren.

Wat betreft de andere tests?

De studie controleerde ook twee andere zaken: de Script Concordance Test (SCT), die meet hoe goed studenten omgaan met onzekerheid, en een schaal genaamd BIAS, die kijkt of studenten bepaalde denkfouten of vooroordelen hebben. Op deze gebieden lagen de AI en de mensen nek aan nek. Er was geen enkel verschil. De AI versloeg de mensen niet, maar verloor ook niet. Het presteerde net zo goed, of misschien gewoon even "gemiddeld", als de menselijke experts.

Het Oordeel van de Studenten

De studenten die drie maanden later feedback gaven, leken van de ervaring te genieten. Van de 21 die reageerden, zei een enorme 95,2% dat zij deze training zouden aanbevelen aan andere geneeskundestudenten. Ze vonden de scenario's realistisch en vonden dat het hen hielp om sneller over ethische kwesties na te denken. Een grote hindernis die zij echter noemden, was dat het in de echte wereld moeilijk is om een baas of een senior arts uit te dagen, zelfs wanneer je weet dat zij ethisch onjuist handelen.

De Kern van het Verhaal

Dus, heeft de AI gewonnen? De studie suggereert dat AI-gegenereerde feedback haalbaar en acceptabel is. Het is niet mislukt; sterker nog, het vertoonde geen enkele teken dat het slechter was dan menselijke experts. De data suggereren zelfs dat het misschien iets beter is in het helpen van studenten bij het rechtvaardigen van hun beslissingen, maar de onderzoekers waarschuwen ons om dit met een korrel zout te nemen. Omdat de AI-groep met hogere scores begon en de groepen klein waren, kunnen we niet met zekerheid zeggen of de AI de superieure docent is.

Beschouw deze studie als een succesvolle algemene repetitie. Het bewees dat een AI-coach, onder supervisie van mensen, de show kan draaien zonder het systeem te laten crashen. Maar om te weten of het echt de MVP is, hebben we een groter stadion, meer spelers en een eerlijkere startlijn nodig. Voor nu is de AI een veelbelovende sidekick, klaar om menselijke experts te helpen de volgende generatie artsen te leren hoe ze het juiste doen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →