Figurative Justice: Detecting metaphors in Hindi judgements with qualitative assessment and transformers
Dieses Papier stellt den Hindi Legal Metaphor Corpus (HiLeMe) und ein Transformer-basiertes Detektionsmodell vor, um den Mangel an Metapher-Analyse in ressourcenarmen Hindi-Rechtstexten zu adressen, mit dem Ziel, die richterliche Entscheidungsfindung zu entschlüsseln und automatisierte Werkzeuge für den Rechtsdiskurs auf andere indische Sprachen auszuweiten.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Die Sprache in einem Gerichtssaal ist selten nur ein neutrales Werkzeug zur Auflistung von Fakten. Während Gesetze oft als ein starrer Satz von Regeln imaginiert werden, die in klarer Tinte geschrieben sind, verlassen sich die Menschen, die sie schreiben und interpretieren – Richter, Anwälte und Gesetzgeber – häufig auf figurative Sprache, um abstrakte Ideen begreifbar zu machen. Sie sprechen von „Mauern“, die Kirche und Staat trennen, „Waagen“, die die Gerechtigkeit ausbalancieren, oder den „Wurzeln“ eines Vertrages. Dies sind nicht bloß dekorative Ausschmückungen; es sind mächtige kognitive Werkzeuge, die beeinflussen, wie rechtliche Konzepte verstanden, argumentiert und entschieden werden. Wenn ein Richter eine Situation als „Krieg“ beschreibt oder ein Recht als ein „Objekt“, tut er mehr als nur eine farbenfrohe Phrase zu verwenden; er rahmt die Realität des Falles ein und beeinflusst damit potenziell die Schwere einer Strafe oder die Interpretation eines Menschenrechts. Dies ist besonders kritisch in Sprachen wie Hindi, wo die Nuancen solcher Metaphern die gesamte Bedeutung eines rechtlichen Arguments verschieben können, doch bis jetzt hatte niemand einen Weg geschaffen, damit Computer diese automatisch in indischen Gerichtsdokumenten erkennen können.
Ein Team von Forschern aus Estland und Indien hat den ersten Schritt zur Lösung dieses Problems unternommen, indem sie einen spezialisierten Datensatz und ein Computermodell entwickelt haben, das darauf ausgelegt ist, Metaphern in Hindi-Rechtsurteilen zu finden. Ihre Arbeit mit dem Titel „Figurative Justice“ adressiert eine signifikante Lücke im Bereich der künstlichen Intelligenz. Während Computer sehr gut darin geworden sind, Englisch, Spanisch und andere bedeutende Sprachen zu lesen und zu verstehen, haben sie Schwierigkeiten mit „ressourcenarmen“ Sprachen wie Hindi, insbesondere wenn diese Sprachen in dem komplexen, hochriskanten Umfeld des Rechts verwendet werden. Die Forscher begannen damit, tausende Sätze aus echten Urteilen der Bezirksgerichte im indischen Bundesstaat Uttar Pradesh zu sammeln. Diese Dokumente wurden vollständig in Hindi verfasst und enthielten das Rohmaterial rechtlicher Argumentation. Um diesen Text begreifbar zu machen, setzten die Forscher sechs Rechtsexperten als menschliche Lehrer für den Computer ein. Diese Experten lasen die Sätze durch und markierten jeden Fall, in dem ein Wort in einem figurativen Sinne statt in seiner wörtlichen Bedeutung verwendet wurde, wobei sie einer strengen, etablierten Methode zur Identifizierung von Metaphern folgten. Dieser Prozess resultierte in einer neuen Sammlung von Daten, die die Forscher als „Hindi Legal Metaphor Corpus“ bezeichneten und die über 7.000 Sätze und nahezu 162.000 Wörter umfasst.
Mit diesen sorgfältig etikettierten Daten in der Hand trainierten die Forscher ein hochentwickeltes Computermodell, um den Unterschied zwischen wörtlicher und figurativer Sprache zu erkennen. Sie verwendeten eine Art künstlicher Intelligenz, die als „Transformer“ bekannt ist – ein System, das in der Lage ist, den Kontext von Wörtern innerhalb eines gesamten Satzes zu verstehen. Das Modell wurde mit den Hindi-Sätzen gefütert und darauf trainiert, vorherzusagen, ob ein spezifischer Teil des Textes eine Metapher enthielt. Die Ergebnisse zeigten, dass der Computer zwischen wörtlicher und figurativer Sprache mit einer Gesamtgenauigkeit von etwa 72 Prozent unterscheiden konnte. Dies ist ein vielversprechender Anfang und beweist, dass es möglich ist, einer Maschine beizubringen, die verborgenen Bedeutungsebenen in Hindi-Rechtstexten zu erkennen. Die Studie verdeutlicht jedoch auch die Schwierigkeit der Aufgabe. Wenn das Modell gezielt nach Metaphern suchte, lag es etwa die Hälfte der Zeit richtig, wenn es eine Vermutung anstellte, und es übersah mehr als zwei Drittel der tatsächlich im Text vorhandenen Metaphern. Dies deutet darauf hin, dass der Computer zwar offensichtliche Beispiele erkennen kann, aber immer noch Schwierigkeiten mit den subtilen, nuancierten und hochgradig kontextabhängigen Metaphern hat, die oft in rechtlichen Argumentationen vorkommen.
Die Forscher fanden heraus, dass die Herausforderung teilweise in der Natur der Rechtssprache selbst liegt, in der Metaphern oft tief in die Struktur des Arguments eingebettet sind, anstatt als offensichtliche Vergleiche hervorzustechen. In ihrer Analyse der Fehler, die das Modell machte, sahen sie, dass der Computer manchmal Standardbegriffe des Rechts mit Metaphern verwechselte und zu anderen Zeiten eine Metapher nicht erkannte, weil der Kontext zu komplex war. Die Studie beansprucht nicht, das Problem der Erkennung von Metaphern im Hindi-Recht gelöst zu haben, sondern vielmehr, die erste zuverlässige Karte des Geländes erstellt zu haben. Durch die Erstellung dieses Datensatzes und den Nachweis, dass ein Computermodell ein Basisniveau an Erfolg erreichen kann, hat das Team ein Fundament für zukünftige Arbeiten geschaffen. Ihre Ergebnisse legen nahe, dass wir, um gerichtliche Entscheidungen in Hindi wirklich zu verstehen und um sicherzustellen, dass die figurative Sprache, die von Richtern verwendet wird, die Ergebnisse nicht unbeabsichtigt beeinflusst, Werkzeuge benötigen, die zwischen den Zeilen lesen können. Diese Forschung öffnet die Tür für die Anwendung ähnlicher Techniken auf die anderen einundzwanzig gelisteten Sprachen Indiens, mit dem Ziel, die verborgene Macht rechtlicher Metaphern sichtbar und einer kritischen Überprüfung zugänglich zu machen.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.