← Neueste Arbeiten
💬 NLP

Computational conceptual history of scientific concepts: From early digital methods to LLMs

Dieser Artikel verortet große Sprachmodelle innerhalb der breiteren Geschichte der computergestützten konzeptionellen Analyse in der Wissenschaftsgeschichte, -philosophie und -soziologie, indem er die Entwicklung von frühen digitalen Methoden hin zu modernen LLMs nachzeichnet, während er gleichzeitig kritisch untersucht, wie diese Technologien langjährige methodische Herausforderungen erben und neue Möglichkeiten für die Untersuchung wissenschaftlicher Konzepte bieten.

Ursprüngliche Autoren: Michael Zichert, Arno Simons

Veröffentlicht 2026-06-04
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Michael Zichert, Arno Simons

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, Sie versuchen zu verstehen, wie sich die Bedeutung eines bestimmten Wortes, wie zum Beispiel „Atom“ oder „Theorie“, in der Welt der Wissenschaft über die letzten 200 Jahre verändert hat. In der Vergangenheit hätte ein Historiker tausende Bücher und Abhandlungen manuell lesen und Notizen darüber machen müssen, wie das Wort verwendet wurde. Das ist so, als würde man versuchen, einen Wald zu kartieren, indem man jeden einzelnen Pfad selbst abläuft.

Dieses Papier ist ein Leitfaden für Historiker, die Computer nutzen möchten, um diese Kartierung schneller und in einem viel größeren Maßstab durchzuführen. Es vergleicht den „alten Weg“ der Nutzung von Computern (vor dem Aufstieg der modernen KI) mit dem „neuen Weg“ unter Verwendung von Large Language Models (LLMs), also der Technologie hinter ChatGPT.

Hier ist eine Aufschlüsselung ihrer Reise, unter Verwendung einfacher Analogien:

1. Der alte Weg: Die „statische Karte“ (Die Pre-LLM-Ära)

Vor der modernen KI nutzten Forscher digitale Werkzeuge, die wie statische, schwarz-weiße Karten funktionierten.

  • Wie es funktionierte: Sie untersuchten, wie oft Wörter zusammen auftauchen (wie etwa die Beobachtung, dass „Gravitation“ und „Apfel“ oft im selben Satz erwähnt werden) oder wie oft Wissenschaftler dieselben Arbeiten zitierten.
  • Das Problem: Diese Werkzeuge behandelten ein Wort so, als hätte es zu jedem Zeitpunkt nur eine einzige Bedeutung. Stellen Sie sich ein Wörterbuch vor, das sagt, dass das Wort „Bank“ nur einen Ort zur Aufbewahrung von Geld bezeichnet. Es vergisst, dass „Bank“ auch das Ufer eines Flusses bedeuten kann.
  • Das Ergebnis: Wenn ein wissenschaftliches Konzept mehrere Bedeutungen hatte (was sie oft haben), mittelte der Computer diese alle zu einem einzigen, verschwommenen Durchschnitt zusammen. Es war schwierig, die subtilen Verschiebungen in der Bedeutung zu erkennen, da die Werkzeuge zu starr waren.

2. Der neue Weg: Der „intelligente, kontextsensitive Begleiter“ (Die LLM-Ära)

Heute nutzen Forscher Large Language Models (LLMs). Betrachten Sie diese nicht als statische Karten, sondern als intelligente, kontextsensitive Begleiter, die einen Satz lesen und sofort die Nuancen verstehen können.

  • Kontext ist entscheidend: Im Gegensatz zu den alten Werkzeugen wissen LLMs, dass „Bank“ in einem Satz über Angeln etwas anderes bedeutet als in einem Satz über Finanzen. In der Wissenschaft bedeutet dies, dass der Computer unterscheiden kann, ob ein Physiker das Wort „Partikel“ verwendet, um ein winziges Materiestück zu beschreiben, oder ob er es metaphorisch gebraucht.
  • Zwei Arten von Begleitern:
    • Der Analytiker (Encoder-Modelle): Dies sind wie Super-schnelle Bibliothekare, die eine Bibliothek scannen und Ihnen sofort sagen können: „In den 1950er Jahren wurde dieses Wort zu 80 % im Sinne von X verwendet, aber in den 1990er Jahren hat es sich zu Y verschoben.“ Sie sind hervorragend darin, Veränderungen zu messen.
    • Der Schreiber (Decoder-Modelle): Dies sind wie kreative Assistenten. Man kann sie fragen: „Schreibe einen Satz, der zeigt, wie dieses Wort im Jahr 1920 verwendet wurde“, oder „Fasse zusammen, wie Wissenschaftler dieses Konzept in den 1980er Jahren definiert haben.“ Sie helfen dabei, Beispiele zu generieren oder Lücken zu füllen, wo historische Daten fehlen.

3. Die großen Herausforderungen: Es ist keine Magie

Die Autoren betonen vorsichtig, dass die harte Arbeit der Geschichte nicht verschwindet, nur weil wir diese leistungsstarken neuen Werkzeuge haben. Tatsächlich sind neue Probleme aufgetaucht:

  • Die „Garbage In, Garbage Out“-Regel: Wenn der Computer mit einer voreingenommenen oder unvollständigen Sammlung von Büchern trainiert wird, wird seine Karte falsch sein. Wenn die digitalen Archive nur Bücher aus den letzten 50 Jahren enthalten, kann der Computer die Geschichte der vorangegangenen 100 Jahre nicht erzählen.
  • Das „Black Box“-Rätsel: Bei den alten Werkzeugen konnte man genau nachvollziehen, wie die Mathematik funktionierte. Bei LLMs ist der Prozess oft eine „Black Box“. Wir kennen den Input und den Output, aber es ist schwieriger zu verstehen, warum die KI eine bestimmte Entscheidung getroffen hat. Dies macht es schwieriger, den Ergebnissen zu vertrauen, ohne sie doppelt zu überprüfen.
  • Worte vs. die reale Welt: Das Papier betont, dass wissenschaftliche Konzepte nicht nur aus Wörtern bestehen; sie sind an reale Werkzeuge, Experimente und Diagramme gebunden. Ein Computer, der nur Text liest, erkennt vielleicht nicht, dass sich ein Konzept geändert hat, weil ein neues Mikroskop erfunden wurde, selbst wenn sich das Wort selbst nicht geändert hat. Der Computer sieht den Text, aber er sieht nicht die Laborausrüstung.

4. Das Urteil: Ein Multi-Tool-Kit

Die Hauptschlussfolgerung des Papiers ist, dass LLMs mächtige Ergänzungen zum Werkzeugkasten eines Historikers sind, aber kein Ersatz für den Historiker selbst.

  • Verlassen Sie sich nicht auf nur ein Werkzeug: Man sollte nicht einfach eine KI fragen „Was bedeutet dieses Konzept?“ und die Antwort als absolute Wahrheit akzeptieren.
  • Der hybride Ansatz: Die beste Methode besteht darin, die KI zu nutzen, um tausende Dokumente zu scannen und interessante Muster aufzuspüren (wie ein Metalldetektor, der eine vergrabene Münze findet), und dann den menschlichen Historiker einzusetzen, um die Münze auszugraben, sie genau zu untersuchen und ihre historische Bedeutung zu erklären.
  • Die Zukunft: Die Autoren hoffen auf bessere Werkzeuge, die auch Bilder und Diagramme betrachten können, nicht nur Text, um ein vollständigeres Bild davon zu erhalten, wie Wissenschaft funktioniert.

Kurz gesagt: LLMs ermöglichen es Historikern, herauszuzoomen und den „Wald“ der wissenschaftlichen Sprache auf eine Weise zu sehen, die zuvor unmöglich war, indem sie Trends und Verschiebungen in der Bedeutung über Jahrhunderte hinweg aufspüren. Der Historiker muss jedoch dennoch derjenige bleiben, der die Bäume interpretiert, um sicherzustellen, dass der Computer sich nicht im Wald verirrt oder die Karte falsch interpretiert.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →