← Últimos artigos
💻 computer science

Artificial intelligence for oral history and disaster experience: a systematic mapping study

Este estudo de mapeamento sistemático revisa 35 estudos primários para analisar como a inteligência artificial está transformando a história oral de arquivos estáticos em campos dinâmicos e interativos, destacando avanços significativos na transcrição e análise ao mesmo tempo em que enfatiza desafios éticos críticos e a necessidade de abordagens centradas no ser humano e informadas pelo trauma.

Autores originais: Ahmad Azarsa, Ali Asgary, Maleknaz Nayebi, Sean Holman

Publicado 2026-09-08
📖 6 min de leitura🧠 Leitura aprofundada

Autores originais: Ahmad Azarsa, Ali Asgary, Maleknaz Nayebi, Sean Holman

Artigo original sob licença CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Durante décadas, as histórias da experiência humana — sobreviventes de guerras, testemunhas de desastres, anciãos preservando tradições esquecidas — foram capturadas em fitas e discos, armazenadas em arquivos como gravações estáticas. Essas histórias orais são vitais porque detêm a verdade emocional e a perspectiva pessoal que os documentos oficiais muitas vezes perdem. No entanto, uma barreira massiva esteve por muito tempo entre essas vozes e as pessoas que precisam ouvi-las: a extrema dificuldade de transformar horas de palavra falada em texto pesquisável. Para um pesquisador ou um curador de museu, ouvir cada minuto de cada gravação para encontrar uma memória específica é uma tarefa que pode levar uma vida inteira. Este gargalo deixou vastas coleções de testemunhos humanos trancadas, acessíveis apenas para aqueles com tempo para ouvir. Agora, um novo campo está emergindo onde a inteligência artificial está sendo usada para desbloquear esses arquivos, não apenas para transcrever palavras, mas para compreender os sentimentos, os padrões e os silêncios dentro delas.

Uma equipe de pesquisadores de universidades do Canadá realizou recentemente uma revisão abrangente para ver exatamente como essa tecnologia está sendo aplicada. Eles examinaram trinta e cinco estudos publicados entre 2004 e 2025, observando cada etapa de como uma história falada se torna um registro digital. O trabalho deles revela que, embora os computadores tenham se tornado notavelmente bons na tarefa mecânica de transformar fala em texto, o desafio mais profundo reside em preservar o significado humano por trás dessas palavras. Os pesquisadores descobriram que o campo está se movendo rapidamente da transcrição simples para a análise complexa, embora obstáculos éticos significativos permaneçam em relação a como lidamos com memórias sensíveis e quais vozes são verdadeiramente ouvidas.

A revisão começou mapeando a jornada de uma história oral, que os autores dividiram em quatro estágios distintos: criação, arquivamento, análise e exibição. No estágio de criação, onde a história é contada pela primeira vez, o uso de inteligência artificial ainda é raro. A maioria dos estudos nesta área explora ideias experimentais, como o uso de programas de computador para entrevistar pessoas ou a geração de diálogos simulados para preencher lacunas no registro histórico. No entanto, a grande maioria da pesquisa foca no segundo estágio: o arquivamento. Aqui, a tecnologia teve seu impacto mais dramático. Ao usar sistemas avançados de reconhecimento de fala, os pesquisadores podem agora converter automaticamente milhares de horas de áudio em texto. Isso resolveu um problema crítico que outrora tornava grandes coleções inutilizáveis. A revisão observa que somente em 2024 e 2025, quase metade de toda a pesquisa neste campo foi publicada, sinalizando uma mudança de protótipos experimentais para ferramentas do mundo real que estão processando ativamente enormes acúmulos de gravações.

A geografia desta pesquisa conta uma história de duas abordagens diferentes. Nos Estados Unidos, onde arquivos massivos como o USC Shoah Foundation detêm milhões de testemunhos do Holocausto e de outros conflitos, o foco está no que o texto pode nos dizer sobre a psicologia humana. Pesquisadores lá estão usando programas de computador para analisar essas histórias em busca de sinais de trauma, como prever sintomas de estresse pós-traumático em sobreviventes dos ataques de 11 de setembro. Em contraste, um grupo de pesquisa na Europa Central, particularmente na Alemanha e na República Tcheca, é dedicado à engenharia em si. Essas equipes estão trabalhando para aperfeiçoar a tecnologia subjacente, garantindo que os computadores possam ouvir e transcrever a fala com precisão em diferentes idiomas, dialetos e condições de ruído. Enquanto o trabalho americano pergunta "o que esta história significa?", o trabalho europeu pergunta "como garantimos que o computador a ouça corretamente?".

Além de apenas escrever palavras, o terceiro estágio do fluxo envolve o uso de inteligência artificial para encontrar padrões e emoções dentro das histórias. A revisão descobriu que os pesquisadores estão cada vez mais usando essas ferramentas para agrupar narrativas semelhantes ou para detectar o peso emocional da voz de um falante. Alguns estudos vão além, analisando sons não verbais como respiração, pausas e silêncio. Esses sons muitas vezes carregam tanto significado quanto as palavras, indicando angústia ou hesitação que uma transcrição simples deixaria passar. O quarto estágio, a visualização, é onde essas histórias digitais são trazidas de volta ao público. Aqui, a inteligência artificial ajuda a criar experiências imersivas, como exposições de realidade virtual onde os visitantes podem caminhar por um espaço digital e interagir com os testemunhos, tornando a história imediata e pessoal.

Apesar desses saltos tecnológicos, os pesquisadores identificaram preocupações sérias que não podem ser ignoradas. A questão mais premente é o risco de perder o elemento "humano" da história. Quando um computador transcreve uma gravação, ele frequentemente remove as pausas, as respirações e os tremores emocionais em uma voz, reduzindo uma experiência humana complexa a um texto plano. Isso é particularmente perigoso ao lidar com histórias traumáticas, onde a maneira como algo é dito é tão importante quanto o que é dito. Há também o problema do viés. Os modelos de inteligência artificial usados para essas tarefas são frequentemente treinados em línguas padrão de alto recurso e dados. Quando esses modelos encontram histórias de comunidades indígenas, falantes de dialetos raros ou sobreviventes de conflitos culturais específicos, eles frequentemente falham em entender a nuance, às vezes interpretando mal o sentimento ou achatando o contexto cultural.

A revisão também destaca uma divisão crescente entre os historiadores que cuidam dessas histórias e os engenheiros que constroem as ferramentas. À medida que os arquivos dependem mais de sistemas complexos de "caixa preta" fornecidos por empresas comerciais, torna-se mais difícil para os historiadores entenderem como a tecnologia está classificando e recuperando informações. Essa falta de transparência levanta questões sobre quem controla a narrativa. Além disso, os pesquisadores apontam que o custo ambiental de treinar esses modelos de computador massivos é significativo, adicionando uma nova camada de consideração ética ao campo. Os autores enfatizam que, para a inteligência artificial ser verdadeiramente útil, ela deve ser guiada por uma abordagem de "humano no controle" (human-in-the-loop), onde especialistas humanos permanecem no comando do processo, garantindo que a tecnologia sirva à história em vez de distorcê-la.

Em última análise, esta revisão sistemática sugere que estamos em um ponto de virada. A tecnologia para tornar a história oral acessível a todos finalmente chegou, mas o caminho a seguir exige mais do que apenas um software melhor. Exige um equilíbrio cuidadoso entre a eficiência das máquinas e a responsabilidade ética de preservar a memória humana. Os pesquisadores concluem que o futuro deste campo depende do desenvolvimento de novas formas de medir o sucesso que vão além da simples precisão. Em vez de apenas contar quantas palavras um computador acertou, devemos aprender a avaliar se a tecnologia preservou a verdade emocional e a integridade cultural das histórias que ela ajuda a contar. Somente ao abordar esses desafios poderemos garantir que as vozes do passado não sejam apenas ouvidas, mas verdadeiramente compreendidas.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →