← Neueste Arbeiten
📄 animal behavior and cognition

Environmental volatility amplifies Pavlovian control in decision-making

Unter Verwendung eines modifizierten Pavlovian-to-Instrumental-Transfer-Paradigmas zeigt diese Studie, dass Umweltvolatilität die Entscheidungskontrolle hin zu belohnungsprädiktiven Reizen verschiebt, indem sie Pavlovsche Mechanismen verstärkt, welche eine stabile Alternative zu rechenintensiven instrumentellen Aktualisierungen bieten und die Wahlentropie je nach dem Ergebnis entweder erhöhen oder verringern können.

Ursprüngliche Autoren: Danti, C., Degni, L. A. E., Mattioni, L., Badioli, M., Starita, F., Cartoni, E., Garofalo, S., Di Pellegrino, G.

Veröffentlicht 2026-09-16
📖 6 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Danti, C., Degni, L. A. E., Mattioni, L., Badioli, M., Starita, F., Cartoni, E., Garofalo, S., Di Pellegrino, G.

Originalarbeit lizenziert unter CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ⚕️ Dies ist eine KI-generierte Erklärung eines Preprints, das nicht peer-reviewed wurde. Dies ist kein medizinischer Rat. Treffen Sie keine Gesundheitsentscheidungen auf Grundlage dieses Inhalts. Vollständigen Haftungsausschluss lesen

Jeden Tag fungieren unsere Gehirne als ständige Rechenmaschinen, die die wahrscheinlichen Ergebnisse unserer Handlungen abwägen, um zu entscheiden, was als Nächstes zu tun ist. Wenn Sie einen Knopf drücken und eine Belohnung erhalten, lernen Sie, ihn erneut zu drücken; wenn Sie ihn drücken und nichts erhalten, hören Sie auf. So navigieren wir durch eine Welt, in der Ursache und Wirkung normalerweise stabil bleiben. Aber die reale Welt ist selten so stabil. Manchmal ändern sich die Regeln ohne Vorwarnung. Ein Pfad, der gestern noch zur Sicherheit führte, kann heute in Gefahr führen. Wenn die Umgebung unvorhersehbar wird, steht das Gehirn vor einem schwierigen Problem: Die Informationen, auf die es sich verlässt, um kluge Entscheidungen zu treffen, werden verrauscht und unzuverlässig. In diesen Momenten hoher Unsicherheit muss unser Geist entscheiden, ob er weiter versucht, die neuen Regeln zu verstehen, oder ob er auf ein einfacheres, älteres System zurückgreift, das automatisch auf Signale in der Umgebung reagiert.

Die Frage, wie wir zwischen sorgfältiger Berechnung und automatischer Reaktion wechseln, steht im Mittelpunkt einer neuen Studie von Forschern der Universität Bologna und des Nationalen Forschungsrates Italiens. Sie wollten verstehen, was passiert, wenn die Welt chaotisch wird. Insbesondere untersuchten sie, ob eine instabile, unvorhersehbare Umgebung uns wahrscheinlicher dazu bringt, unsere eigenen Berechnungen zu ignorieren und stattdessen der Anziehung vertrauter Reize zu folgen. Stellen Sie sich eine Person vor, die durch einen Wald geht, in dem sich die Wegmarkierungen ständig bewegen; schließlich hört sie vielleicht auf, die Karte zu lesen, und folgt stattdessen einfach dem Duft einer Blume, der normalerweise zu Wasser führt, selbst wenn die Karte sagt, dass das Wasser woanders ist. Die Forscher wollten herausfinden, ob ein solcher Wechsel beim Menschen stattfindet, wenn die Umgebung volatil ist, und ob dieser Wechsel die eigentliche Natur unserer Entscheidungsfindung verändert.

Um die Antwort zu finden, entwarf das Team ein computerbasiertes Spiel, das einer Spielautomaten-Maschine glich. Im ersten Teil des Experiments lernten fünfzig gesunde Freiwillige, dieses Spiel unter zwei verschiedenen Bedingungen zu spielen. In der Bedingung mit „geringer Volatilität“ war die Maschine vorhersehbar: Ein Hebel gab die meiste Zeit eine Belohnung, der andere nur selten. Die Regeln blieben über einen langen Zeitraum gleich. In der Bedingung mit „hoher Volatilität“ änderten sich die Regeln häufig und ohne Vorwarnung. Der Hebel, der normalerweise gut war, wurde plötzlich schlecht, und der schlechte wurde gut, manchmal fünfmal in einer einzigen Sitzung. Die Teilnehmer mussten diese wechselnden Muster allein durch das Beobachten der Ergebnisse ihrer Entscheidungen lernen. Wie erwartet, fanden die Menschen es viel schwieriger, die wechselnden Regeln zu meistern. Ihre Entscheidungen waren weniger präzise, und sie wirkten unsicherer darüber, welchen Hebel sie wählen sollten.

Nachdem die Teilnehmer die Regeln des Spielautomaten gelernt hatten, gingen sie zu einer zweiten Phase über, in der ihnen Bilder von Lebensmittelbelohnungen gezeigt wurden. Sie lernten, dass bestimmte Bilder vorhersagten, welches Lebensmittel erscheinen würde. Dies war eine Phase des passiven Lernens, in der sie die Bilder und die Ergebnisse lediglich beobachteten, ohne Hebel zu drücken. Dies erzeugte eine starke Verbindung in ihren Köpfen zwischen einem spezifischen Bild und einem spezifischen Lebensmittel. Schließlich brachten die Forscher die beiden Teile zusammen. Die Teilnehmer kehrten zum Spielautomaten zurück, aber diesmal erschien ein Bild über den Hebeln, bevor sie wählen mussten. Das Bild konnte entweder den Hebel anzeigen, der derzeit die beste Wahl war, oder es konnte auf den Hebel deuten, der derzeit die schlechteste Wahl war. Die Forscher beobachteten dann, ob die Teilnehmer eher dazu neigten, bei dem Hebel zu bleiben, der in letzter Zeit am meisten ausgezahlt hatte, oder ob sie sich von dem Bild leiten ließen, das sie ansteuerte.

Die Ergebnisse zeigten ein klares und überraschendes Muster. Wenn die Teilnehmer das Spiel in der stabilen, gering-volatilen Umgebung gelernt hatten, hatten die Bilder nur sehr wenig Effekt. Sie ignorierten die Bilder weitgehend und hielten sich an den Hebel, der ihnen derzeit die besten Belohnungen brachte. Wenn sie das Spiel jedoch in der chaotischen, hoch-volatilen Umgebung gelernt hatten, übernahmen die Bilder die Kontrolle. Wenn ein Bild auf den Hebel deutete, der derzeit die schlechteste Wahl war, folgten die Teilnehmer der Gruppe mit hoher Volatilität dem Bild viel häufiger als die Teilnehmer der stabilen Gruppe. Sie gaben die Strategie auf, die ihnen in der Vergangenheit Erfolg gebracht hatte, und ließen sich vom Reiz steuern. Dies geschah, obwohl das Bild irrelevant für die aktuellen Regeln der Maschine war. Das Gehirn, überwlastet durch die ständigen Veränderungen, hatte sein Vertrauen von der eigenen Berechnung auf das einfachere Signal verlagert.

Die Forscher untersuchten auch, wie konsistent die Entscheidungen der Teilnehmer waren. Sie maßen die „Entropie“ der Entscheidungen, eine Methode, um zu beschreiben, wie stark das Verhalten einer Person von Moment zu Moment variiert. In der Hoch-Volatilitäts-Gruppe wurden die Entscheidungen der Teilnehmer, wenn das Bild und die beste Wahl nicht übereinstimmten, viel erratischer. Es schien, als stünden sie im Konflikt zwischen den beiden Systemen und schwankten zwischen dem Folgen des Bildes und dem Folgen der Regeln hin und her. Dieser interne Konflikt erzeugte ein verrauschtes, unvorhersehbares Verhaltensmuster. Doch die Geschichte änderte sich in einem zweiten Experiment, das darauf ausgelegt war, zu testen, was passiert, wenn das Feedback stoppt. In dieser Version entfernten die Forscher das Belohnungs-Feedback während bestimmter Teile des Tests. Oh der Rückmeldung, um ihre Berechnungen zu aktualisieren, hatte das instrumentelle System nichts mehr, womit es arbeiten konnte. In diesem Zustand wurden die Teilnehmer nicht einfach nur erratisch; sie wurden starr konsistent. Sie folgten dem Bild jedes einzelne Mal, selbst wenn es zur falschen Entscheidung führte. Der Konflikt verschwand, weil das Gehirn aufgehört hatte zu rechnen und sich vollständig dem Reiz ergeben hatte.

Diese Befunde legen nahe, dass Umweltvolatilität nicht nur Verwirrung oder Rauschen in unser Verhalten bringt. Stattdessen verändert sie aktiv, wie unser Gehirn verschiedene Arten von Informationen gewichtet. Wenn die Welt stabil ist, verlassen wir uns auf unsere Fähigkeit, aus unseren Handlungen zu lernen. Wenn die Welt unvorhersehbar wird, scheint unser Gehirn zu entscheiden, dass das Verfolgen jeder Änderung zu kostspielig und riskant ist. Stattdessen überträgt es die Kontrolle auf das einfachere, reizgesteuerte System, das auf Signale in der Umgebung reagiert. Dieser Wechsel ist kein Versagen des Lernens, sondern eine strategische Anpassung. Das Gehirn erkennt, dass in einer chaotischen Welt die alten Regeln verschwunden sind und das einzige Stabile das Signal ist. Dieser Mechanismus hilft zu erklären, warum Menschen in instabilen oder stressigen Situationen impulsiver oder stärker von unmittelbaren Reizen getrieben sein können – ein Muster, das bei Erkrankungen wie Sucht und zwanghaften Störungen zu beobachten ist. Die Studie zeigt: Wenn sich die Karte ständig ändert, hören wir auf, sie zu lesen, und beginnen, dem Duft zu folgen.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →