Artificial intelligence for oral history and disaster experience: a systematic mapping study
Diese systematische Mapping-Studie untersucht 35 Primärstudien, um zu analysieren, wie künstliche Intelligenz die Oral History von statischen Archiven in dynamische, interaktive Felder transformiert, wobei sie bedeutende Fortschritte in der Transkription und Analyse hervorhebt und gleichzeitig kritische ethische Herausforderungen sowie die Notwendigkeit von trauma-sensiblen, menschenzentrierten Ansätzen betont.
Originalarbeit lizenziert unter CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Seit Jahrzehnten werden die Geschichten menschlicher Erfahrung – Überlebende von Kriegen, Zeugen von Katastrophen, Ältere, die vergessene Traditionen bewahren – auf Tonband und Disk auf der Spur gehalten und als statische Aufnahmen in Archiven gespeichert. Diese Oral Histories sind lebenswichtig, da sie die emotionale Wahrheit und die persönliche Perspektive enthalten, die offizielle Dokumente oft vermissen lassen. Eine gewaltige Barriere steht jedoch seit langem zwischen diesen Stimmen und den Menschen, die sie hören müssen: die schiere Schwierigkeit, Stunden gesprochener Worte in durchsuchbaren Text zu verwandeln. Für einen Forscher oder einen Museumsleiter kann das Anhören jeder Minute jeder Aufnahme, um eine bestimmte Erinnerung zu finden, eine Aufgabe sein, die ein Leben lang dauern kann. Dieser Engpass hat dazu geführt, dass riesige Sammlungen menschlicher Zeugnisse weggeschlossen blieben, zugänglich nur für diejenigen, die die Zeit zum Zuhören haben. Nun entsteht ein neues Feld, in dem künstliche Intelligenz eingesetzt wird, um diese Archive zu erschließen – nicht nur, um Wörter zu transkribieren, sondern um die Gefühle, Muster und das Schweigen in ihnen zu verstehen.
Ein Team von Forschern aus kanadischen Universitäten hat vor kurzem eine umfassende Übersichtsarbeit durchgeführt, um genau zu untersuchen, wie diese Technologie angewendet wird. Sie untersuchten fünfunddreißig Studien, die zwischen 2004 und 2025 veröffentlicht wurden, und betrachteten jede Phase des Prozesses, in dem eine gesprochene Geschichte zu einem digitalen Datensatz wird. Ihre Arbeit zeigt, dass Computer zwar bemerkenswert gut in der mechanischen Aufgabe geworden sind, Sprache in Text zu verwandeln, die tiefere Herausforderung jedoch darin liegt, die menschliche Bedeutung hinter diesen Worten zu bewahren. Die Forscher stellten fest, dass sich das Feld rasch von der einfachen Transkription hin zur komplexen Analyse bewegt, wobei jedoch erhebliche ethische Hürden bestehen bleiben, wenn es darum geht, wie wir mit sensiblen Erinnerungen umgehen und wessen Stimmen wirklich gehört werden.
Die Übersicht begann mit der Kartierung der Reise einer Oral History, die die Autoren in vier verschiedene Phasen unterteilt haben: Erstellung, Archivierung, Analyse und Ausstellung. In der Phase der Erstellung, in der die Geschichte zum ersten Mal erzählt wird, ist der Einsatz künstlicher Intelligenz noch selten. Die meisten Studien in diesem Bereich untersuchen experimentelle Ideen, wie etwa die Verwendung von Computerprogrammen, um Menschen zu interviewen, oder das Erzeugen simulierter Dialoge, um Lücken in der historischen Aufzeichnung zu füllen. Die überwiegende Mehrheit der Forschung konzentriert sich jedoch auf die zweite Phase: die Archivierung. Hier hat die Technologie ihre dramatischsten Auswirkungen gezeigt. Durch den Einsatz fortschrittlicher Spracherkennungssysteme können Forscher nun tausende Stunden Audio automatisch in Text umwandeln. Dies hat ein kritisches Problem gelöst, das einst große Sammlungen unbrauchbar machte. Die Übersicht stellt fest, dass allein in den Jahren 2024 und 2025 fast die Hälfte der gesamten Forschung auf diesem Gebiet veröffentlicht wurde, was auf einen Wandel von experimentellen Prototypen hin zu realen Werkzeugen hindeutet, die aktiv massive Rückstände an Aufzeichnungen verarbeiten.
Die Geografie dieser Forschung erzählt eine Geschichte zweier unterschiedlicher Ansätze. In den Vereinigten Staaten, wo riesige Archive wie die USC Shoah Foundation Millionen von Zeugnissen aus dem Holocaust und anderen Konflikten beherbergen, liegt der Fokus darauf, was der Text uns über die menschliche Psychologie verraten kann. Forscher dort nutzen Computerprogramme, um diese Geschichten auf Anzeichen von Trauma zu untersuchen, wie etwa die Vorhersage von Symptomen posttraumatischer Belastungsstörungen bei Überlebenden der Anschläge vom 11. September. Im Gegensatz dazu widmet sich ein Cluster von Forschungsarbeiten in Mitteleuropa, insbesondere Deutschland und der Tschechischen Republik, selbst der Ingenieurskunst. Diese Teams arbeiten daran, die zugrunde liegende Technologie zu perfektionieren, um sicherzustellen, dass Computer Sprache in verschiedenen Sprachen, Dialekten und unter verrauschten Aufnahmebedingungen korrekt hören und transkribieren können. Während die amerikanische Arbeit fragt: „Was bedeutet diese Geschichte?“, fragt die europäische Arbeit: „Wie stellen wir sicher, dass der Computer sie korrekt hört?“
Über das bloße Aufschreiben von Worten hinaus beinhaltet die dritte Phase der Pipeline die Nutzung künstlicher Intelligenz, um Muster und Emotionen innerhalb der Geschichten zu finden. Die Übersicht ergab, dass Forscher zunehmereend diese Werkzeuge einsetzen, um ähnliche Narrative zusammenzugruppieren oder um die emotionale Gewichtung der Stimme eines Sprechers zu detektieren. Einige Studien gehen sogar noch weiter und analysieren nicht-verbale Laute wie Atmen, Pausen und Schweigen. Diese Laute tragen oft ebenso viel Bedeutung wie die Worte selbst und deuten auf Not oder Zögern hin, was eine einfache Transkription übersehen würde. Die vierte Phase, die Visualisierung, ist der Ort, an dem diese digitalen Geschichten wieder der Öffentlichkeit zugänglich gemacht werden. Hier hilft künstliche Intelligenz dabei, immersive Erlebnisse zu schaffen, wie etwa virtuelle Realitätsausstellungen, in denen Besucher durch einen digitalen Raum wandern und mit den Zeugnissen interagieren können, was die Geschichte unmittelbar und persönlich wirken lässt.
Trotz dieser technologischen Sprünge identifizierten die Forscher ernsthafte Bedenken, die nicht ignoriert werden können. Das dringlichste Problem ist das Risiko, das „menschliche“ Element der Geschichte zu verlieren. Wenn ein Computer eine Aufnahme transkribiert, streift er oft die Pausen, das Atmen und das emotionale Zittern in einer Stimme ab und reduziert eine komplexe menschliche Erfahrung auf flachen Text. Dies ist besonders gefährlich beim Umgang mit traumatischen Geschichten, bei denen die Art und Weise, wie etwas gesagt wird, genauso wichtig ist wie das, was gesagt wird. Es gibt auch das Problem der Voreingenommenheit (Bias). Die für diese Aufgaben verwendeten KI-Modelle werden oft auf Standard-Hochressourcen-Sprachen und -Daten trainiert. Wenn diese Modelle auf Geschichten aus indigenen Gemeinschaften, Sprecher seltener Dialekte oder Überlebende spezifischer kultureller Konflikte treffen, versagen sie oft beim Verständnis der Nuancen und interpretieren die Stimmung manchmal falsch oder glätten den kulturellen Kontext.
Die Übersicht hebt auch eine wachsende Kluft zwischen den Historikern, die sich um diese Geschichten kümmern, und den Ingenieuren, die die Werkzeuge bauen, hervor. Da Archive zunehmend auf komplexe „Black Box“-Systeme angewiesen sind, die von kommerziellen Unternehmen bereitgestellt werden, wird es für Historiker immer schwieriger zu verstehen, wie die Technologie Informationen sortiert und abruft. Dieser Mangel an Transparenz wirft Fragen darüber auf, wer die Erzählung kontrolliert. Darüber hinaus weisen die Forscher darauf hin, dass die ökologischen Kosten des Trainings dieser massiven Computermodelle erheblich sind, was der Forschung eine neue Ebene der ethischen Betrachtung hinzufügt. Die Autoren betonen, dass künstliche Intelligenz erst dann wirklich nützlich sein kann, wenn sie von einem „Human-in-the-loop“-Ansatz geleitet wird, bei dem menschliche Experten die Kontrolle über den Prozess behalten und sicherstellen, dass die Technologie der Geschichte dient, anstatt sie zu verzerren.
Letztendlich legt diese systematische Übersichtsarbeit nahe, dass wir an einem Wendepunkt stehen. Die Technologie, um die Oral History für jeden zugänglich zu machen, ist endlich vorhanden, aber der Weg nach vorn erfordert mehr als nur bessere Software. Er verlangt ein sorgfältiges Gleichgewicht zwischen der Effizienz von Maschinen und der ethischen Verantwortung, das menschliche Gedächtnis zu bewahren. Die Forscher kommen zu dem Schluss, dass die Zukunft dieses Feldes von der Entwicklung neuer Wege abhängt, Erfolg zu messen, die über die einfache Genauigkeit hinausgehen. Anstatt nur zu zählen, wie viele Wörter ein Computer richtig erfasst hat, müssen wir lernen zu bewerten, ob die Technologie die emotionale Wahrheit und die kulturelle Integrität der Geschichten bewahrt hat, die sie zu erzählen hilft. Nur indem wir diese Herausforderungen angehen, können wir sicherstellen, dass die Stimmen der Vergangenheit nicht nur gehört, sondern auch wirklich verstanden werden.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.