← Nieuwste papers
📄 animal behavior and cognition

Reward predictability shapes decision making states and exploitative control in marmosets

Deze studie vestigt een geautomatiseerd, niet-invasief home-cage-platform voor marmoosetachtigen en maakt gebruik van reinforcement learning-modellering om aan te tonen dat beloningsvoorspelbaarheid gedragsstaten reorganiseert, waardoor foutcorrectie wordt aangescherpt en de exploitatieve controle tijdens besluitvorming wordt verbeterd.

Oorspronkelijke auteurs: Mastro, K. J., Stanwicks, L., Schoenbeck, E., Melain, A., Johnson, M., Sabatini, B. L., Stevens, B.

Gepubliceerd 2026-07-02
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Mastro, K. J., Stanwicks, L., Schoenbeck, E., Melain, A., Johnson, M., Sabatini, B. L., Stevens, B.

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ⚕️ Dit is een AI-gegenereerde uitleg van een preprint die niet peer-reviewed is. Dit is geen medisch advies. Neem geen gezondheidsbeslissingen op basis van deze inhoud. Lees de volledige disclaimer

Stel je voor dat je door een bos loopt op zoek naar de lekkerste bessen. Soms weet je precies waar het beste struikgewas is, dus blijf je dat pad volgen en blijf je plukken (dit is exploitatie). Andere keren dwaal je misschien af om een nieuw gebied te controleren, voor het geval er een verborgen, nog betere plek wacht om gevonden te worden (dit is exploratie).

Dit artikel gaat over hoe marmoosetjes — kleine, sociale apen die erg slim zijn en op sommige manieren genetisch sterk op mensen lijken — ontdekken wanneer ze vast moeten houden aan wat ze weten en wanneer ze iets nieuws moeten proberen.

Hier is het verhaal van wat de onderzoekers hebben gedaan en gevonden, eenvoudig uitgelegd:

1. De nieuwe "sportschool" voor apen
Het bestuderen van hoe deze apen beslissingen nemen, was voorheen moeilijk. Het vereiste vaak dat ze uit hun natuurlijke omgeving werden gehaald, dat hun watertoevoer werd beperkt om ze dorstig te maken voor beloningen, en dat ze in korte, stressvolle intervallen werden getest.
De onderzoekers bouwden een nieuwe, geautomatiseerde "sportschool" in de eigen leefkooien van de apen. Het is als een hoogtechnologische touchscreen-gameconsole die de apen kunnen spelen wanneer ze willen en zo lang als ze willen, zonder stress of waterbeperkingen. Dit stelde hen in staat om de natuurlijke besluitvormingsgewoonten van de apen over een lange periode te bestuderen.

2. De trainingsspelletjes
De apen speelden een reeks spelletjes op het scherm:

  • Reversal Learning (Omgekeerd leren): Stel je een spel voor waarbij een rode knop altijd een traktatie geeft, maar dan plotseling veranderen de regels en geeft de blauwe knop de traktatie in plaats daarvan. De apen moesten leren om van strategie te wisselen.
  • De "Two-Armed Bandit": Dit was de laatste, moeilijkste test. Het was als een gokkast met twee hendels. Soms leverde één hendel vaker een beloning op, maar de regels waren lastig en veranderden willekeurig. Er waren geen aanwijzingen of hints die hen vertelden welke hendel beter was; ze moesten het zelf uitzoeken door simpelweg te proberen.

3. Hoe de apen denken (De "mentale modi")
De onderzoekers gebruikten computermodellen om de hersenen van de apen te begrijpen. Ze ontdekten dat de apen niet zomaar willekeurige keuzes maken; ze schakelen tussen twee duidelijke "mentale modi":

  • De "Blijf-erbij"-modus (Exploitatie): Wanneer de aap zelfverzekerd is, houdt hij vast aan de keuze die meestal werkt.
  • De "Probeer-alles"-modus (Exploratie): Wanneer de aap onzeker is, begint hij verschillende opties te testen om nieuwe informatie te verzamelen.

4. De grote ontdekking: Voorspelbaarheid verandert het spel
De meest interessante bevinding ging over hoe voorspelbaar de beloningen waren.

  • Wanneer de wereld voorspelbaar was (Deterministisch): Als een foute keuze altijd betekende dat er geen traktatie kwam, besefte de aap zijn fout onmiddellijk. Het was alsof er een lampje aanging; ze corrigeerden hun koers zeer snel.
  • Wanneer de wereld onvoorspelbaar was (Probabilistisch): Als een foute keuze soms nog steeds een traktatie opleverde (door puur geluk), waren de apen trager in het beseffen dat ze een fout maakten.

De studie toonde aan dat wanneer de omgeving voorspelbaar is, de apen meer tijd doorbrengen in de "Blijf-erbij"-modus en hun fouten veel sneller corrigeren. Wanneer zaken chaotisch en onvoorspelbaar zijn, brengen ze meer tijd door in de "Probeer-alles"-modus.

In een notendop
Dit artikel geeft ons een nieuwe manier om te kijken naar hoe deze apen leren en beslissen. Het laat zien dat hun hersenen specifieke "schakelaars" hebben voor exploratie en exploitatie, en hoe de duidelijkheid van de regels van het spel (voorspelbaar versus willekeurig) volledig bepaalt hoe ze deze schakelaars omzetten. Het is een blauwdruk voor het begrijpen van de mechanica van slimme besluitvorming bij een soort die zeer dicht bij ons staat.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →