Humans use a dual policy to improve inferences during epistemic information seeking
Die Studie zeigt, dass Menschen beim reinen Wissenserwerb eine zweistufige Strategie anwenden, bei der sie zunächst durch wiederholtes Testen („Streaking") und anschließend durch unsicherheitsgesteuerte Exploration ihre Inferenzgenauigkeit verbessern, was über das klassische Belohnungsbasierte Explorations-Exploitations-Modell hinausgeht.