AI-rithmetic
Diese Untersuchung zeigt, dass trotz fortgeschrittener mathematischer Fähigkeiten moderner KI-Modelle bei einfacher Addition mit zunehmender Stellenanzahl scheitern, wobei die Fehler primär auf Tokenisierungsprobleme (Fehlausrichtung der Operanden) oder mangelhaftes Übertragen zurückzuführen sind.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Warum sind Super-KIs eigentlich so schlecht in Mathe? 🧠➕🔢
Stell dir vor, du hast einen Freund, der die gesamte Weltliteratur auswendig kennt, Quantenphysik auf dem Niveau eines Nobelpreisträgers diskutieren kann und sogar komplexe philosophische Fragen löst. Aber sobald du ihn fragst: „Was ist 456 + 789?“, stammelt er, verliert den Faden und liefert dir ein völlig absurdes Ergebnis.
Genau das ist das Problem, das die Forscher von Google in ihrem neuen Paper „AI-rithmetic“ beschreiben. Sie haben festgestellt: Unsere modernsten KI-Systeme (wie GPT-5 oder Claude) sind zwar „Genies“ in der Theorie, aber „Schulschwächler“ in der Grundrechenart.
Das Problem: Das „Genie-Paradoxon“
Die Forscher haben die KIs mit riesigen Rechenaufgaben getestet – von kleinen Zahlen bis hin zu Zahlen mit 100 Stellen. Das Ergebnis war ernüchternd: Je länger die Zahlen werden, desto eher bricht das System zusammen. Es ist, als würde man einem hochintelligenten Professor ein extrem langes Gedicht vorlesen, bei dem er nach der zehnten Zeile plötzlich vergisst, in welcher Spalte er eigentlich lesen sollte.
Warum passieren diese Fehler? (Die zwei Hauptübeltäter)
Die Forscher haben herausgefunden, dass die Fehler nicht einfach „Zufall“ sind, sondern zwei ganz bestimmte Muster haben. Man kann sie sich wie zwei Arten von Flüchtigkeitsfehlern vorstellen:
1. Der „Verschiebe-Fehler“ (Misalignment) – Das verrutschte Lineal
Stell dir vor, du willst zwei lange Zahlen untereinander schreiben, um sie zu addieren. Aber statt die Einer-Stelle unter die Einer-Stelle zu schreiben, rutschst du mit dem Lineal ein Stück zur Seite. Plötzlich addierst du die Zehner mit den Einern.
- Warum passiert das? Die Forscher vermuten, dass das an der Art liegt, wie die KI Text „liest“ (das sogenannte Tokenization). Die KI sieht Zahlen nicht als einzelne Ziffern (1, 2, 3...), sondern oft als „Pakete“ (z. B. 123 als ein Block). Wenn diese Pakete unterschiedlich groß sind, „verrutscht“ die KI beim Rechnen – wie ein Kind, das beim Schreiben der Zahlen die Zeilen nicht sauber hält.
2. Der „Übertrag-Fehler“ (Close Carry) – Das vergessliche Gehirn
Das ist der klassische Fehler aus der Grundschule: Du rechnest und vergisst einfach, die „1“ für die nächste Spalte mitzunehmen.
- Warum passiert das? Die KI macht das nicht, weil sie die Mathematik nicht versteht, sondern weil sie wie ein „Wahrscheinlichkeits-Rechner“ arbeitet. Sie rät quasi, welches die nächste Ziffer sein könnte. Bei schwierigen Übergängen (wenn man eine 9 oder eine 10 „übertragen“ muss) verliert sie die Konzentration. Es ist, als würde man beim Kochen ein Rezept lesen und bei einem kritischen Schritt – „Gib jetzt eine Prise Salz dazu“ – kurz abgelenkt werden.
Was bedeutet das für die Zukunft?
Das Paper zeigt eine wichtige Lektion: Größer ist nicht gleich besser. Man kann eine KI nicht einfach nur „schlauer“ machen (mehr Daten, mehr Rechenpower), damit sie plötzlich perfekt rechnet. Das Problem liegt tiefer in ihrer „Bauweise“.
Die KI ist kein Taschenrechner, der nach festen Regeln arbeitet, sondern eher ein extrem begabter Geschichtenerzähler, der versucht, die Mathematik so nachzuahmen, wie sie in Büchern steht. Und ein Geschichtenerzähler ist eben kein Mathematiker.
Fazit: Wenn wir wollen, dass KIs wirklich zuverlässig werden, müssen wir ihnen nicht nur mehr Wissen geben, sondern ihnen ein „stabileres Lineal“ und ein „besseres Gedächtnis“ für die Details einbauen.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.