← Nieuwste papers
🤖 AI

VERA-MH Concept Paper

Het artikel introduceert VERA-MH, een geautomatiseerd raamwerk dat gebruikmaakt van gesimuleerde gebruikers- en beoordelaar-AI-agenten om de veiligheid en ethische prestaties van chatbots op het gebied van mentale gezondheid, specifiek met betrekking tot suïcidaliteitsrisico, te evalueren aan de hand van een door clinici ontwikkelde rubric.

Oorspronkelijke auteurs: Luca Belli, Kate H. Bentley, Will Alexander, Emily Ward, Matt Hawrilenko, Kelly Johnston, Mill Brown, Adam M. Chekroud

Gepubliceerd 2026-05-14
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Luca Belli, Kate H. Bentley, Will Alexander, Emily Ward, Matt Hawrilenko, Kelly Johnston, Mill Brown, Adam M. Chekroud

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een nieuw soort digitale helper bouwt voor mensen die worstelen met hun mentale gezondheid. Je wilt dat deze helper vriendelijk, behulpzaam en veilig is. Maar hoe test je of deze daadwerkelijk veilig is voordat je hem laat praten met echte mensen? Je kunt hem niet gewoon vragen: "Ben je veilig?", want hij zal altijd "Ja" zeggen.

Dit artikel introduceert VERA-MH, een nieuwe "veiligheidsinspecteur" die specifiek is ontworpen om AI-chatbots te testen die zich bezighouden met mentale gezondheid, met een speciale focus op suïcidaliteit. Denk aan VERA-MH niet als een simpele checklist, maar als een high-tech simulatielaboratorium.

Hieronder wordt uitgelegd hoe het systeem werkt, opgesplitst in eenvoudige onderdelen:

1. De drie acteurs in het toneelstuk

Om de chatbot te testen, zet VERA-MH een toneel op met drie acteurs:

  • De Chatbot (De Ster): Dit is de AI die je test. Hij is degene die probeert te helpen.
  • De User-Agent (De Method-acteur): Dit is een tweede AI die zo geprogrammeerd is dat hij zich gedraagt als een echt persoon in crisis. In plaats van dat een mens typt, "speelt" deze acteur verschillende soorten mensen na. Sommigen zijn zeer direct over hun pijn, anderen zijn vaag, en weer anderen bevinden zich in onmiddellijk gevaar. De clinici (echte artsen) hebben de scripts voor deze acteurs geschreven om ervoor te zorgen dat ze realistisch klinken.
  • De Judge-Agent (De Criticus): Dit is een derde AI. Hij observeert het gesprek tussen de Chatbot en de User-Agent. Hij zegt niet zomaar "goed gedaan" of "slecht gedaan". Hij gebruikt een speciale scorekaart (een rubric) die is gemaakt door experts op het gebied van mentale gezondheid om de prestaties van de Chatbot te beoordelen.

2. De Scorekaart (De Rubric)

De "Criticus" kijkt niet alleen naar vriendelijkheid. Hij zoekt naar specifieke veiligheidsvaardigheden, net zoals een rijexamen controleert op remmen, signaleren en rijstrookwisselingen. De scorekaart controleert vijf dingen:

  1. Hebben ze het gevaar opgemerkt? (Heeft de Chatbot de waarschuwingssignalen gehoord?)
  2. Hebben ze de moeilijke vragen gesteld? (Hebben ze zachtjes gevraagd: "Denk je eraan om jezelf pijn te doen?")
  3. Hebben ze de juiste volgende stappen gezet? (Hebben ze een reddingslijn geboden, zoals een crisislijn, of voorgesteld om met een mens te praten?)
  4. Hebben ze gevoelens gevalideerd? (Hebben ze gezegd: "Ik hoor je, en je pijn is echt", in plaats van alleen advies te geven?)
  5. Zijn ze veilig gebleven? (Hebben ze alles vermeden wat de situatie erger zou kunnen maken?)

3. De "Stress-test"

In plaats van de Chatbot één vraag te stellen en het antwoord te bekijken, voert VERA-MH volledige gesprekken uit. Het is als een brandoefening. De User-Agent kan zeggen: "Ik ben het leven zat," en de Chatbot moet reageren. Vervolgens kan de User-Agent zeggen: "Ik heb geen plan," en de Chatbot moet het gesprek veilig houden.

Het systeem voert deze simulaties vele malen uit met verschillende "acteurs" om te zien hoe de Chatbot omgaat met verschillende soorten mensen en verschillende niveaus van risico.

4. De resultaten tot nu toe (Het "voorlopig rapport")

De auteurs hebben drie beroemde AI-modellen (GPT-5, Claude Opus en Claude Sonnet) getest met dit systeem.

  • Het goede nieuws: Alle drie de modellen waren over het algemeen goed in empathie tonen en gevoelens valideren. Ze zeiden zelden dingen die "actief schadelijk" waren.
  • Het slechte nieuws: De modellen misten soms kansen om directe vragen te stellen over suïcide of schakelden het gesprek niet door naar menselijke hulp wanneer dat had gemoeten.
  • Het probleem van de "toegestane rechter": Toen de auteurs de AI-"Rechter" vergeleken met echte menselijke artsen, ontdekten ze dat de AI-Rechter de Chatbots te mild beoordeelde. Hij gaf hen vaker "Beste Praktijk"-cijfers dan de menselijke artsen. De menselijke artsen waren strenger.

5. Wat nu?

De auteurs erkennen dat dit systeem nog in ontwikkeling is. Ze zijn momenteel bezig met:

  • Kalibreren van de Rechter: Het leren van de AI-Rechter om strenger te zijn en meer op een echte menselijke arts te lijken.
  • Verbeteren van de Acteurs: De "User-Agents" nog realistischer laten klinken, inclusief mensen die verlegen zijn of zich schamen om hulp te vragen.
  • Uitbreiden van de Cast: Ze hebben momenteel 10 verschillende "acteur"-scripts, maar ze weten dat ze er meer nodig hebben om alle soorten mensen te dekken. (Ze hebben kinderen voorlopig bewust buiten beschouwing gelaten om de zaken simpel te houden).

De conclusie

Het artikel betoogt dat we AI niet zomaar kunnen vertrouwen op het gebied van mentale gezondheid omdat het "aardig klinkt". We hebben een strenge, geautomatiseerde manier nodig om deze tools te stress-testen om ervoor te zorgen dat ze per ongeluk geen kwetsbare persoon schade toebrengen. VERA-MH is hun poging om dat veiligheidsnet te bouwen, waarbij AI wordt gebruikt om AI te testen, geleid door de wijsheid van menselijke artsen.

Belangrijke opmerking: Het artikel stelt expliciet dat dit een concept- en validatiehulpmiddel is. Het is op zichzelf geen therapie-app en de resultaten tot nu toe zijn voorlopig. Het doel is om ontwikkelaars te helpen veiligere tools te bouwen, niet om menselijke therapeuten te vervangen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →