← Últimos artigos
🤖 machine learning

Towards Reliable Zero-Shot Crowd Forecasting: Evaluating Time Series Foundation Models for Special Event Pedestrian Forecasting

Este artigo avalia a eficácia de modelos fundacionais de séries temporais pré-treinados para a previsão probabilística de multidões em regime zero-shot durante eventos especiais infrequentes, demonstrando sua capacidade de fornecer estimativas pontuais confiáveis e quantificação de incerteza sem a necessidade de retreinamento local extensivo.

Autores originais: Ziteng Li, Yanan Xin, Tina Comes, Serge Hoogendoorn

Publicado 2026-07-21
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Ziteng Li, Yanan Xin, Tina Comes, Serge Hoogendoorn

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você esteja tentando prever o tempo para um piquenique que só acontece uma vez a cada cinco anos. Você não pode simplesmente olhar para o tempo do ano passado porque, bem, não houve piquenique no ano passado. Você também não pode esperar até o dia para começar a aprender os padrões. Este é o mundo complicado da previsão "zero-shot": fazer palpites inteligentes sobre o futuro quando você tem quase nenhum dado passado para estudar. Normalmente, os computadores precisam "comer" montanhas de dados históricos para aprender a prever coisas como o tráfego ou multidões. Mas e se você pudesse usar um cérebro de computador superinteligente que já leu a "enciclopédia" do tempo e dos padrões de milhões de outros lugares e apenas perguntasse a ele: "Ei, o que vai acontecer aqui?". Esta é a promessa dos "modelos de fundação". Eles são como estudantes universais que já fizeram o dever de casa sobre um bilhão de tópicos diferentes, de modo que podem entrar em uma nova sala de aula e começar a ensinar imediatamente, sem precisar de um livro didático.

Agora, imagine um enorme festival marítimo em Amsterdã, o evento SAIL, que atrai 2,5 milhões de pessoas. A cidade precisa saber exatamente onde as multidões estarão nos próximos 30 minutos para abrir portões extras, enviar mais policiais ou liberar um caminho para uma ambulância. Mas como este evento é raro, a cidade não possui anos de dados para treinar um robô personalizado. Eles precisam de uma previsão que não seja apenas um palpite único (como "serão 500 pessoas"), mas uma gama de possibilidades com uma rede de segurança (como "será entre 400 e 600, mas cuidado, pode haver um pico para 800"). Este artigo é um teste de direção no mundo real para ver se esses "estudantes universais" pré-treinados conseguem realmente lidar com o caos de um evento de multidão massivo e único sem travar ou dar conselhos perigosos.

Os pesquisadores organizaram uma corrida entre dois dos modelos de IA de viagem no tempo mais inteligentes disponíveis: TimesFM e Chronos-2. Eles não treinaram esses modelos com dados de Amsterdã; em vez disso, eles os lançaram diretamente no meio do festival SAIL2025 para ver como eles se sairiam em um cenário "zero-shot". Pense nisso como entregar a um chef que nunca cozinhou em uma cozinha específica uma receita nova e estranha e ver se ele consegue preparar uma refeição deliciosa sem antes provar os ingredientes.

Os resultados foram surpreendentemente claros. O modelo Chronos-2 acabou sendo a estrela do show. Ele conseguiu prever o fluxo de multidões com uma "janela de segurança" confiável de cerca de 30 a 45 minutos de antecedência. No mundo do controle de multidões, ter um aviso de 30 minutos é como ter um superpoder; dá aos gestores tempo suficiente para realmente movimentar as pessoas ou abrir saídas de emergência antes que um gargalo se torne um desastre. O Chronos-2 foi particularmente bom em "rolar" suas previsões para frente, o que significa que, conforme novos dados chegavam a cada 90 segundos, ele atualizava sua previsão suavemente sem ficar confuso.

No entanto, o artigo também encontrou algumas peculiaridades interessantes. Embora o Chronos-2 tenha sido o campeão geral, o TimesFM na verdade fez um trabalho melhor durante as horas silenciosas e de baixa densidade de público (como tarde da noite) e em áreas onde os números da multidão eram muito pequenos e constantes. É como se o TimesFM fosse um bibliotecário calmo e constante que é ótimo em prever as horas silenciosas de uma biblioteca, enquanto o Chrono-2 é um treinador de esportes de alta energia que se destaca quando o jogo fica caótico e acelerado.

Uma das coisas mais críticas que o artigo descobriu é como esses modelos lidam com "dados ausentes". Imagine se uma câmera parasse de funcionar por uma hora, deixando um espaço vazio na contagem da multidão. Os pesquisadores descobriram que o Chronos-2 reagiu a essa informação ausente ampliando sua "rede de segurança". Em vez de adivinhar um número específico com confiança, ele disse: "Eu não sei exatamente, então a gama de possibilidades agora é enorme". Isso é um recurso, não um erro! Em situações críticas de segurança, é muito melhor para um modelo dizer "não tenho certeza, tenha cuidado" do que dar um palpite errado com confiança. O TimesFM, por outroore, não ampliou tanto sua rede, o que poderia ser mais arriscado se os dados ausentes escondessem um surto repentino.

O estudo também analisou o "custo" de usar esses modelos. Eles rodaram tudo em um laptop padrão, sem placas de vídeo sofisticadas. A boa notícia? Ambos os modelos foram incrivelmente rápidos, levando menos de meio segundo para prever uma hora no futuro. Isso significa que eles poderiam facilmente rodar em computadores comuns da cidade para ajudar a gerenciar multidões em tempo real. A memória que utilizavam também era gerenciável, embora o Chronos-2 precisasse de um pouco mais de potência para "acordar" e começar a pensar.

No fim, o artigo sugere que, para gerenciar eventos raros e massivos como o festival SAIL, o Chronos-2 é a escolha mais confiável, especialmente quando você precisa lidar com mudanças repentinas e dados ausentes. Sugere que nem sempre precisamos construir um novo robô personalizado para cada evento; às vezes, só precisamos encontrar o especialista pré-treinado certo que possa entrar em cena e realizar o trabalho. Os pesquisadores também introduziram um novo conjunto de "boletins de notas" para esses modelos, focando não apenas no quão próximo o palpite estava, mas em quão estável era a previsão ao longo do tempo e o quão honesto o modelo era sobre sua incerteza. Isso é um grande avanço porque, no gerenciamento de multidões, saber quando você não sabe é tão importante quanto saber a resposta.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →