A Word-Level Digital Reader of the Prasthanatrayi with Sankara's Bhasya: Corpus, Method, and an Open, Offline Reading Aid for the Advaita Vedanta Canon
Dieses Paper stellt einen offenen, vollständig offline verfügbaren, einseitigen HTML-Digitalreader für die Prasthanatrayi und Shankaras Kommentare vor, der durch eine hybride Pipeline, die regelbasierte Segmentierung, Lexikon-Abfragen und LLM-gestützte Verifizierung mit menschlicher Überprüfung kombiniert, anklickbare, wortebene morphologische Analysen sowie Konkordanz-Suchfunktionen bereitstellt.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Stellen Sie sich vor, Sie versuchen, ein antikes, unglaublich dichtes Buch zu lesen, das in einer Sprache geschrieben wurde, in der der Autor niemals Leerzeichen zwischen den Wörtern gesetzt hat. Stattdessen fließen die Wörter zusammen wie ein Fluss und verändern ihre Form, je nachdem, was als Nächstes folgt. Zudem hat der Autor oft mehrere Ideen in einzelne, riesige „Wortblöcke“ gepackt (wie ein Koffer, der mit drei verschiedenen Outfits vollgestopft ist).
Dies ist die Herausforderung beim Lesen von Advaita Vedānta, einer bedeutenden Schule der indischen Philosophie. Seine Kerntexte (die Prasthānatrayī) werden von einem massiven Kommentar eines Gelehrten namens Śaṅkara begleitet. Für einen modernen Studenten oder selbst für einen erfahrenen Experten ist der Versuch herauszufinden, wo ein Wort endet und das nächste beginnt, wie der Versuch, einen Knoten aus Kopfhörerkabeln zu entwirren, während man die Augen verbunden hat. Wenn man die Wörter nicht trennen kann, kann man sie auch nicht im Wörterbuch nachschlagen, und die Bedeutung bleibt verborgen.
Tamal Maharaj hat ein digitales Werkzeug entwickelt, um dieses Problem zu lösen. Betrachten Sie es als eine „Intelligente Taschenlampe“ für diese antiken Texte. So funktioniert es, einfach erklärt:
1. Das Problem: Die „Wortsuppe“
Im Sanskrit verschmelzen Wörter. Zum Beispiel können zwei Wörter zu einem langen Strang verschmelzen.
- Der alte Weg: Man muss komplexe Regeln auswendig lernen, um den Strang manuell wieder in einzelne Wörter aufzuspalten, die Wurzel jedes Wortes zu finden und seine Grammatik zu bestimmen. Das erfordert jahrelange Ausbildung.
- Das neue Werkzeug: Sie öffnen eine einzige Datei auf Ihrem Computer (keine Internetverbindung erforderlich). Sie klicken auf jedes beliebige Wort im Text, und ein kleines Pop-up-Fenster zeigt Ihnen sofort:
- Die Zerlegung: Wie das verschmolzene Wort in Einzelteile zerfällt.
- Die Grammatik: Ist es ein Nomen? Ein Verb? In welchem Fall steht es?
- Die Bedeutung: Eine einfache englische Definition.
2. Das „Magische Wörterbuch“ (Die Konkordanz)
Normalerweise, wenn Sie nach einem Wort in einem Computer suchen, müssen Sie es exakt so eingeben, wie es auf der Seite erscheint. Aber in Sanskrit ist das Wort auf der Seite oft eine „getarnte“ Version des eigentlichen Wortes.
- Die Analogie: Stellen Sie sich vor, Sie suchen in einer Bibliothek nach „Katze“, aber das Buch führt nur „Kätzchen“, „Feline“ oder „Miau“ auf. Eine normale Suche würde nichts finden.
- Die Lösung: Dieses Werkzeug kennt den „echten Namen“ (das Lemma/Stammwort) eines jeden Wortes. Wenn Sie nach „Selbst“ (dem Stammwort) suchen, findet das Werkzeug jedes Mal, wenn dieses Wort erscheint, selbst wenn es als „des Selbst“, „zum Selbst“ oder versteckt innerhalb eines riesigen zusammengesetzten Wortes auftaucht. Es verwandelt das gesamte Buch in eine durchsuchbare Landkarte.
3. Wie es gebaut wurde: Das „Detektiv-Team“
Der Autor hat nicht einfach einen Computer raten lassen. Er hat ein mehrstufiges „Detektiv-Team“ aufgebaut, um Genauigkeit zu gewährleisten:
- Schritt 1: Die Regelbuch-Experten. Zuerst prüft das System eine massive, vorab geschriebene Liste bekannter Wortformen (wie ein Wörterbuch mit 927.000 Einträgen). Wenn das Wort auf der Liste steht, ist es sofort gelöst.
- Schritt 2: Der KI-Detektiv. Wenn das Wort knifflig oder unbekannt ist, tritt eine leistungsstarke KI (ein Large Language Model) ein, um eine beste Schätzung abzugeben.
- Schritt 3: Der Skeptiker. Hier ist der clevere Teil: Eine zweite KI wird eingestellt, die speziell dazu da ist, mit der ersten zu streiten. Ihre einzige Aufgabe ist es, nach Fehlern in der Schätzung der ersten KI zu suchen. Wenn die erste KI ihre Antwort nicht verteidigen kann, wird sie markiert.
- Schritt 4: Der menschliche Editor. Die „markierten“, schwierigen Wörter werden an einen echten menschlichen Experten (einen Sanskrit-Gelehrten) gesendet. Er korrigiert den Fehler einmalig.
- Das „Magische Overlay“: Sob: Die Korrektur des Menschen wird in einer speziellen Ebene gespeichert. Wenn der Computer das Werkzeug jemals neu aufbaut, wendet er die Korrektur des Menschen erneut an. Das bedeutet, das Werkzeug wird mit der Zeit intelligenter und präziser, je mehr Gelehrte es nutzen, und keine Korrektur geht jemals verloren.
4. Warum es wichtig ist
- Für Studenten: Es entfernt die Eintrittsbarriere. Man muss kein Grammatik-Magier sein, um diese grundlegenden Texte zu lesen; man muss nur klicken.
- Für Gelehrte: Es funget als „Konkordanz“. Anstatt das ganze Buch zu lesen, um jeden Hinweis auf ein Konzept zu finden, können Sie nach dem Stammwort des Konzepts suchen und so alle Instanzen davon über tausende von Seiten hinweg sofort sehen.
- Zugänglichkeit: Das gesamte Werkzeug ist nur eine einzige Datei. Sie benötigen keinen Server, keine App-Installation und keine Internetverbindung. Sie können es im Flugzeug mitnehmen, auf einen USB-Stick speichern und überall verwenden.
Das Wesentliche
Dieses Paper präsentiert eine Brücke zwischen alter Weisheit und moderner Technologie. Es erkennt an, dass Computer Fehler machen können, und nutzt daher ein „Human-in-the-Loop“-System, um sicherzustellen, dass das Endprodukt zuverlässig ist. Es verwandelt einen Text, der einst hinter einer Mauer komplexer Grammatik verschlossen war, in eine offene, interaktive und durchsuchbare Ressource für jeden, der bereit ist zu klicken und zu lernen.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.