Humans use a dual policy to improve inferences during epistemic information seeking
À travers trois études et une modélisation computationnelle, cette recherche démontre que les humains améliorent leurs inférences en épistémologie grâce à une politique à double phase combinant un échantillonnage systématique initial (« streaking ») et une exploration guidée par l'incertitude, une stratégie distincte du compromis classique exploration-exploitation centré sur la récompense.