← Últimos artigos
💰 quantitative finance

Overparametrized models with posterior drift

Este artigo demonstra que a deriva posterior degrada significativamente a precisão das previsões fora da amostra de modelos de aprendizado de máquina superparametrizados, particularmente nos mercados financeiros onde ocorrem mudanças de regime, aconselhando finalmente cautela ao utilizar grandes modelos lineares para previsões do mercado de ações devido à sua sensibilidade às escolhas de parâmetros e a subperíodos.

Autores originais: Guillaume Coqueret, Martial Laguerre

Publicado 2026-05-13
📖 6 min de leitura🧠 Leitura aprofundada

Autores originais: Guillaume Coqueret, Martial Laguerre

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

A Visão Geral: O "Chef Superconfiante"

Imagine que você é um chef tentando aprender uma receita secreta para a sopa perfeita (prever retornos do mercado de ações).

No mundo do aprendizado de máquina moderno, há uma ideia popular chamada "Dupla Queda". Ela sugere que, se você tornar sua receita incrivelmente complexa — adicionando centenas de especiarias, ervas e ingredientes secretos (parâmetros) —, sua sopa pode realmente ficar melhor do que uma simples, mesmo que você não tenha ingredientes suficientes para todos. Isso é chamado de superparametrização.

Um estudo famoso (Kelly et al., 2024) afirmou que, para prever os mercados de ações, "mais é mais". Eles disseram que usar modelos massivos e complexos com milhares de variáveis era a chave para vencer o mercado.

Este artigo diz: "Espere um minuto. Isso só funciona se o mundo permanecer o mesmo."

Os autores argumentam que, no mundo real, a "receita" do mercado de ações muda constantemente. Eles chamam isso de Deriva Posterior. É como se o chef aprendesse a receita em janeiro, mas, em julho, os ingredientes tivessem mudado, o tempo estivesse diferente e os gostos dos clientes tivessem se alterado. Se você continuar cozinhando com a receita antiga e complexa, sua sopa ficará terrível.


Conceito Chave 1: A "Deriva" (O Alvo em Movimento)

Na estatística, existem duas maneiras pelas quais um modelo pode falhar:

  1. Mudança de Covariância: Os ingredientes que você recebe mudam (por exemplo, você costumava receber tomates, agora recebe batatas).
  2. Deriva Posterior: A relação entre os ingredientes e o prato final muda.

O Foco do Artigo: Os autores focam na Deriva Posterior.

  • Analogia: Imagine que você aprende que "adicionar sal deixa a sopa salgada". Essa é uma regra estável. Mas, no mercado de ações, a regra pode ser: "Em 2010, taxas de juros altas significavam que as ações subiriam. Em 2020, taxas de juros altas significavam que as ações cairiam."
  • Os "carregamentos" (as regras ou coeficientes que o modelo aprende) estão derivando. O modelo aprende as regras do passado, mas o futuro segue regras diferentes.

Conceito Chave 2: A "Armadilha da Complexidade"

O artigo investiga o que acontece quando você usa um modelo supercomplexo (um com mais parâmetros do que pontos de dados) em um mundo onde essas regras estão derivando.

  • A Descoberta: Quando as regras mudam (deriva), modelos complexos tornam-se extremamente frágeis.
  • A Analogia: Pense em um modelo complexo como um carro de corrida de alto desempenho com 1.000 peças personalizadas e ajustadas. Ele vence facilmente em uma pista suave e previsível (um mercado estável). Mas, se a pista se transformar repentinamente em um campo lamacento com pedras móveis (deriva posterior), aquele carro de corrida cai espetacularmente. Um caminhão simples e robusto (um modelo simples) pode não ser tão rápido, mas lida muito melhor com a lama.

Os autores descobriram que o desempenho desses modelos complexos depende inteiramente de quando você os testa.

  • Em um período de 15 anos, o modelo complexo pode deixá-lo rico (um retorno mensal de 7%).
  • Em outro período de 15 anos, pode fazê-lo perder quase tudo (um retorno de -50%).
  • O retorno "médio" esconde essa volatilidade aterrorizante.

Conceito Chave 3: O Problema do "Sinal-Ruído"

O artigo explica que os dados financeiros são "ruidosos". O sinal verdadeiro (a razão real pela qual as ações se movem) é muito fraco.

  • A Analogia: Imagine tentar ouvir um sussurro (o sinal) em um estádio barulhento (o ruído).
  • Se o estádio estiver quieto (regras estáveis), um modelo complexo pode filtrar o ruído e ouvir o sussurro.
  • Se as regras do estádio mudarem (deriva), o modelo complexo fica confuso. Ele começa a amplificar o ruído e os sussurros errados. Os autores mostram que, nesses casos, um modelo complexo pode realmente performar pior do que apenas chutar ou ignorar os dados completamente.

O Dilema da "Largura de Banda"

Os pesquisadores testaram uma ferramenta específica chamada Recursos de Fourier Aleatórios (RFFs), que é uma maneira de fazer dados simples parecerem complexos. Eles tiveram que escolher um parâmetro de "largura de banda" (pense nisso como o "nível de zoom" ou a "sensibilidade" do modelo).

  • Baixa Largura de Banda (Alta Sensibilidade): O modelo é muito sensível a pequenas mudanças. Ele encontrou retornos enormes em alguns períodos, mas caiu em outros. Foi uma montanha-russa.
  • Alta Largura de Banda (Baixa Sensibilidade): O modelo suavizou o ruído. Foi mais consistente, mas os retornos foram tão baixos (próximos de zero) que não valiam o risco.

A Conclusão: Não há um "ponto ideal". Você não pode apenas escolher uma configuração que funcione para sempre.

A Verificação da Realidade do "Investidor de 15 Anos"

Os autores analisaram o que acontece se um investidor médio mantiver uma estratégia por 15 anos (um horizonte típico de aposentadoria).

  • O Resultado: Os retornos foram drasticamente diferentes dependendo de quais 15 anos você escolheu.
    • Se você escolhesse 2005–2019, a estratégia complexa parecia um gênio.
    • Se você escolhesse 1975–1989, parecia um desastre.
  • A Lição: Você não pode confiar em um único "backtest" (um teste de desempenho passado) para dizer se um modelo complexo funcionará no futuro. O modelo é muito sensível à época específica em que foi treinado.

Resumo dos Conselhos dos Autores

O artigo conclui com um aviso para qualquer pessoa tentando prever o mercado de ações usando modelos de IA sofisticados e massivos:

  1. Seja Cauteloso: Apenas porque um modelo é complexo e "inteligente" não significa que funcionará quando a economia mudar.
  2. Observe a Deriva: O maior inimigo não é a falta de dados; é o fato de que a relação entre indicadores econômicos e preços de ações muda ao longo do tempo.
  3. A Simplicidade Vence (Às Vezes): Embora modelos complexos possam funcionar, eles são frequentemente arriscados demais para o investidor médio porque seu desempenho é tão instável. Uma abordagem mais simples e robusta pode ser mais segura, mesmo que perca parte do potencial de alta.

Em resumo: O artigo argumenta que a "magia" dos modelos superparametrizados se desfaz quando o mundo muda. No mercado de ações, o mundo sempre muda. Portanto, confiar nesses modelos complexos para investimentos de longo prazo é um jogo de azar com apostas muito altas e resultados imprevisíveis.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →