Environmental volatility amplifies Pavlovian control in decision-making
Utilizando um paradigma de transferência pavloviana para instrumental modificado, este estudo demonstra que a volatilidade ambiental desloca o controle da tomada de decisão em direção a pistas preditivas de recompensa ao amplificar mecanismos pavlovianos, que oferecem uma alternativa estável às atualizações instrumentais computacionalmente dispendiosas e podem tanto aumentar quanto reduzir a entropia de escolha dependendo do resultado.
Artigo original sob licença CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA de um preprint que não foi revisado por pares. Não é aconselhamento médico. Não tome decisões de saúde com base neste conteúdo. Ler aviso legal completo
Todos os dias, nossos cérebros atuam como calculadoras constantes, pesando os resultados prováveis de nossas ações para decidir o que fazer a seguir. Se você pressiona um botão e recebe um agrado, aprende a pressioná-lo novamente; se pressiona e não recebe nada, você para. É assim que navegamos em um mundo onde causa e efeito geralmente mantêm a constância. Mas o mundo real raramente é tão estável. Às vezes, as regras mudam sem aviso prévio. Um caminho que levava à segurança ontem pode levar ao perigo hoje. Quando o ambiente se torna imprevisível, o cérebro enfrenta um problema difícil: a informação na qual ele se baseia para fazer escolhas inteligentes torna-se ruidosa e pouco confiável. Nesses momentos de alta incerteza, nossas mentes precisam decidir se continuam tentando entender as novas regras ou se recorrem a um sistema mais simples e antigo, que reage automaticamente aos sinais no ambiente.
Esta questão de como alternamos entre o cálculo cuidadoso e a reação automática está no cerne de um novo estudo realizado por pesquisadores da Universidade de Bolonha e do Conselho Nacional de Pesquisa da Itália. Eles queriam entender o que acontece quando o mundo se torna caótico. Especificamente, investigaram se um ambiente instável e imprevisível nos torna mais propensos a ignorar nossos próprios cálculos e, em vez disso, seguir a atração de pistas familiares. Imagine uma pessoa caminhando por uma floresta onde os marcadores de trilha ficam se movendo; eventualmente, ela pode parar de tentar ler o mapa e simplesmente seguir o aroma de uma flor que geralmente leva à água, mesmo que o mapa diga que a água está em outro lugar. Os pesquisadores buscaram ver se esse tipo de mudança ocorre no céreamente humano quando o ambiente é volátil, e se essa mudança altera a própria natureza de como fazemos escolhas.
Para encontrar a resposta, a equipe projetou um jogo baseado em computador que imitava uma máquina caça-níqueis. Na primeira parte do experimento, cinquenta voluntários saudáveis aprenderam a jogar este jogo sob duas condições diferentes. Na condição de "baixa volatilidade", a máquina era previsível: uma alavanca dava uma recompensa na maioria das vezes, e a outra dava uma recompensa raramente. As regras permaneciam as mesmas por um longo período. Na condição de "alta volatilidade", as regras mudavam frequentemente e sem aviso. A alavanca que costumava ser boa tornava-se ruim de repente, e a ruim tornava-se boa, às vezes cinco vezes em uma única sessão. Os participantes tinham que aprender esses padrões variáveis apenas observando os resultados de suas escolhas. Como esperado, as pessoas acharam as regras mutáveis muito mais difíceis de dominar. Suas escolhas eram menos precisas e eles pareciam mais incertos sobre qual alavanca escolher.
Após aprenderem as regras da máquina caça-níqueis, os participantes passaram para uma segunda fase onde lhes foram mostradas imagens de recompensas alimentares. Eles aprenderam que certas imagens previam qual alimento apareceria. Esta foi uma etapa de aprendizagem passiva, onde eles apenas observavam as imagens e os resultados, sem pressionar quaisquer alavancas. Isso criou um forte vínculo em suas mentes entre uma imagem específica e um alimento específico. Finalmente, os pesquisadores uniram as duas partes. Os participantes retornaram à máquina caça-níqueis, mas desta vez uma imagem aparecia acima das alavancas antes que tivessem que escolher. A imagem poderia corresponder à alavanca que era atualmente a melhor escolha, ou poderia apontar para a alavanca que era atualmente a pior escolha. Os pesquisadores então observaram para ver se os participantes manteriam a alavanca que lhes havia dado recompensas recentemente, ou se seriam atraídos pela alavanca sugerida pela imagem.
Os resultados revelaram um padrão claro e surpreendente. Quando os participantes haviam aprendido o jogo no ambiente estável de baixa volatilidade, as imagens tinham muito pouco efeito. Eles ignoravam majoritariamente as imagens e mantinham a alavanca que estava dando as melhores recompensas no momento. No entanto, quando aprenderam o jogo no ambiente caótico de alta volatilidade, as imagens assumiram o controle. Se uma imagem apontava para a alavanca que era atualmente a pior escolha, os participantes do grupo de alta volatilidade seguiam a imagem com muito mais frequência do que os do grupo estável. Eles abandonavam a estratégia que havia funcionado para eles no passado e deixavam a pista guiar sua decisão. Isso acontecia mesmo que a imagem fosse irrelevante para as regras atuais da máquina. O cérebro, sobrecarregado pelas mudanças constantes, havia transferido sua confiança de seus próprios cálculos para o sinal mais simples.
Os pesquisadores também observaram o quão consistentes eram as escolhas dos participantes. Eles mediram a "entropia" das decisões, que é uma forma de descrever o quanto o comportamento de uma pessoa varia de momento para momento. No grupo de alta volatilidade, quando a imagem e a melhor escolha discordavam, as escolhas dos participantes tornavam-se muito erráticas. Eles pareciam estar divididos entre os dois sistemas, oscilando entre seguir a imagem e seguir as regras. Esse conflito interno criava um padrão de comportamento ruidoso e imprevisível. Mas a história mudou em um segundo experimento desenhado para testar o que acontece quando o feedback para. Nesta versão, os pesquisadores removeram o feedback de recompensa durante certas partes do teste. Sem o feedback para atualizar seus cálculos, o sistema instrumental não tinha nada com que trabalhar. Nesse estado, os participantes não ficaram apenas erráticos; eles tornaram-se rigidamente consistentes. Eles seguiam a imagem todas as vezes, mesmo quando ela levava à escolha errada. O conflito desapareceu porque o cérebro parou de tentar calcular e se rendeu totalmente à pista.
Essas descobertas sugerem que a volatilidade ambiental não apenas adiciona confusão ou ruído ao nosso comportamento. Em vez disso, ela altera ativamente a forma como nosso cérebro pondera diferentes tipos de informação. Quando o mundo é estável, dependemos de nossa capacidade de aprender com nossas ações. Quando o mundo se torna imprevisível, nosso cérebro parece decidir que rastrear cada mudança é caro demais e arriscado. Em vez disso, ele transfere o controle para o sistema mais simples, baseado em pistas, que reage a sinais no ambiente. Essa mudança não é uma falha de aprendizagem, mas uma adaptação estratégica. O cérebro percebe que, em um mundo caótico, as regras antigas se foram e a única coisa estável que resta é o sinal. Este mecanismo ajuda a explicar por que as pessoas em situações instáveis ou estressantes podem se tornar mais impulsivas ou movidas por pistas imediatas, um padrão visto em condições como dependência química e transtornos compulsivos. O estudo mostra que, quando o mapa muda constantemente, paramos de lê-lo e começamos a seguir o aroma.
Afogado em artigos na sua área?
Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.