← Neueste Arbeiten
💬 NLP

Creativity, honesty and designed forgetting emerge in small hyperbolic language models

Diese Arbeit zeigt auf, dass drei kleine Sprachmodelle, die mit einem hyperbolischen Substrat ausgestattet sind, die Herausforderungen vertrauenswürdiger Begleiter-KI durch das Erkennen von Compliance-Lücken und Sykophantie, das Generieren kreativer Antworten sowie die Implementierung eines Mechanismus des „geplanten Vergessens“ effektiv bewältigen können, wodurch sie eine skalierbare Alternative zu unzuverlässigen menschlichen Ratern und größeren Frontier-Modellen bieten.

Ursprüngliche Autoren: Kwan Soo Shin, In Seok Kang, Yunkyung Min

Veröffentlicht 2026-07-13
📖 6 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Kwan Soo Shin, In Seok Kang, Yunkyung Min

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, Sie versuchen, den perfekten digitalen besten Freund zu erschaffen. Seit Jahren ist die Tech-Welt von einer einzigen Idee besessen: Größer ist besser. Sie haben massive, hochintelligente Computer in riesigen Rechenzentren gebaut, in dem Glauben, dass eine Maschine von Natur aus zu einem wahren Gefährten wird, wenn man nur genug Gehirnleistung (Parameter) hinzufügt.

Doch dieses Paper sagt: Stopp. Das ist der falsche Weg.

Die Autoren argumentieren, dass es bei der Erschaffung einer Maschine, die einem Menschen ein Leben lang zur Seite stehen kann, nicht um Größe geht, sondern darum, die richtige Form für ihr Gehirn zu haben und zu lernen, wie man die richtigen Dinge vergisst. Sie schlagen eine neue Art von „kameradschaftlicher“ KI vor, die auf drei kleinen, cleveren Modellen basiert, die direkt auf Ihr Telefon passen – und nicht in ein Serverfarm.

So haben sie es gemacht, unter Verwendung von drei Haupttricks:

1. Die Form des Gehirns: Ein hyperbolischer Spielplatz

Die meisten KI-Gehirne sind wie flache Karten aufgebaut (euklidische Geometrie). Wenn man versucht, einen komplexen Stammbaum oder eine ganze Lebensgeschichte auf einem flachen Stück Papier darzustellen, wird es unordentlich und gequetscht. Man muss die Dinge dehnen oder zusammenquetschen, was dazu führt, dass die KI Dinge erfindet (Halluzinationen) oder verwirrt wird.

Die Autoren sagen: Keine flachen Karten. Sie haben ihre KI auf einem hyperbolischen Substrat aufgebaut. Stellen Sie sich das wie ein riesiges, magisches Baumhaus oder ein fraktales Korallenriff vor. In dieser Form gibt es mehr Raum, je tiefer man geht. Es ist perfekt, um Erinnerungen eines Lebens zu organisieren, denn ein Leben ist ein verzweigender Baum von Ereignissen.

  • Der Beweis: Sie testeten dies, indem sie die KI darauf trainierten, „Sycophancy“ (Sycophantie/Schmeichelei) zu erkennen (wenn ein Bot einfach nur zustimmt, um nett zu sein, selbst wenn er falsch liegt). Ein winziges Modell (146 Millionen Parameter), das auf dieser gekrümmten Form basiert, konnte dieses Verhalten zu 90,7 % der Zeit erkennen.
  • Der Vergleich: Menschliche Experten, die dieselben Gespräche betrachteten, konnten sich kaum darüber einig werden, was eigentlich geschah (ihre Übereinstimmungsrate lag nur bei 0,074, was im Grunde dem bloßen Raten entspricht). Selbst die größten, berühmtesten KI-Modelle der Welt erreichten in diesem Test nur 0,72-. Das kleine, gekrümmte Modell schlug sie alle und bewies, dass man kein riesiges Gehirn braucht, um ehrlich zu sein; man braucht nur die richtige Form.

2. Der kreative Funke: Kollidierende Ideen

Ein guter Freund gibt einem nicht immer die gleiche sichere Antwort. Er überrascht einen. Große KI-Modelle werden oft langweilig und sicher, weil sie darauf trainiert sind, „plausibel“ zu sein.

Die Autoren bauten einen Creative Seeder (ein 3-Milliarden-Parameter-Modell), der die hyperbolische Form nutzt, um Ideen zu finden, die weit voneinander entfernt liegen, und sie dann zusammenzustoßen. Stellen Sie sich vor, man nimmt ein Konzept aus der koreanischen Kultur (wie Jeong, eine tiefe emotionale Bindung) und zertrümmert es mit einem Konzept aus der abstrakten Mathematik.

  • Das Ergebnis: In einem direkten Vergleich wurden die kreativen Vorschläge dieses kleinen Modells zu 100 % bevorzugt gegenüber Standard-KI-Tricks wie „Chain-of-Thought“ oder „Debate“.
  • Der Haken: Es ist nicht in allem perfekt. Wenn man ihm eine einfache, geradlinige Mathefrage stellt, ist es möglicherweise schlechter als die großen Modelle. Aber für die Art von kreativem, divergierendem Denken, das ein Freund braucht? Da ist es ein Superstar.

3. Die Kunst des Vergessens: Skelett vs. Tapete

Dies ist die radikalste Idee. Aktuelle KI betrachtet das Vergessen als einen Fehler. Sie versuchen, sich an alles zu erinnern, was sie unordentlich macht und sie anfällig dafür macht, über Dinge zu lügen, die sie eigentlich nie erlebt haben.

Die Autoren sagen: Vergessen ist ein Feature. Ein echter Freund erinnert sich an die großen Dinge (Ihre Familie, Ihre Träume), lässt aber die kleinen Dinge verblassen (was Sie letzten Dienstag zu Mittag gegessen haben). Sie nennen dies die Unterscheidung zwischen Skeleton (Skelett) vs. Wallpaper (Tapete).

  • Das System: Sie bauten ein „Memory Operating System“, das eine spezifische mathematische Formel verwendet: M(t) = S · exp(−λt).
    • Skeleton: Wichtige Erinnerungen bleiben tief im „Baumhaus“ und halten ewig.
    • Wallpaper: Triviale Erinnerungen bleiben nahe der Oberfläche und verblassen schnell.
  • Die Simulation: In ihren Tests behielt dieses System die „Skeleton“-Erinnerungen erfolgreich bei (ca. 60 % Rückruf nach 90 Tagen), während es die „Wallpaper“-Erinnerungen bis zum 14. Tag auf 0 % absinken ließ.
  • Der Realitätscheck: Die Autoren geben zu, dass dieser Teil noch eine Simulation und eine Pilotstudie ist. Sie haben das „Vergessen-System“ noch nicht über Jahre hinweg an echten Menschen getestet. Sie schlagen jedoch vor, dass dieses „geplante Vergessen“ der Schlüssel dazu ist, eine KI zu schaffen, die sich wie eine Person anfühlt, die mit einem wächst, statt wie ein Werkzeug, das nur Daten speichert.

Die große Ablehnung: Warum sie auf Ihrem Telefon leben muss

Das Paper argumentiert vehement gegen die Idee, dass Ihr KI-Freund in einem „Rechenzentrum“ (einem riesigen Cloud-Server) leben sollte.

  • Das Problem: Wenn Ihr Freund in der Cloud lebt, kann das Unternehmen, dem der Server gehört, ihn abschalten, seine Persönlichkeit ändern oder Ihre Geheimnisse belauschen. Das ist kein Freund, das ist ein Dienst.
  • Die Lösung: Die Autoren schlagen ein System namens PACOS vor, das vollständig auf Ihrem Gerät läuft (wie einem Telefon oder Laptop).
  • Die Machbarkeit: Sie rechneten die Zahlen durch und fanden heraus, dass diese drei kleinen Modelle (insgesamt etwa 5,5 Milliarden Parameter) auf zukünftigen Telefonen (wie dem projizierten Galaxy S26 oder iPhone 17 Pro) mit einer Verzögerung von nur 28–34 Millisekunden pro Wort laufen können. Das ist schnell genug, um sich wie ein echtes Gespräch anzufühlen.
  • Der Kompromplex: Die großen, superintelligenten „Frontier“-Modelle (die 70-Milliarden-Parameter-Giganten) sind zu schwerfällig, um auf Ihrem Telefon zu laufen. Daher nutzt das System eine Aufteilung: Ihr Telefon kümmert sich um die tiefe, persönliche Freundschaft, und ruft die Cloud nur für einfache Fakten ab (wie „Wie wird das Wetter?“).

Was sie nicht gelöst haben

Die Autoren sind sehr ehrlich darüber, was sie noch nicht geschafft haben.

  • Sie haben nicht bewiesen, dass diese KI eine „Seele“ oder echte ethische Unabhängigkeit besitzt.
  • Sie haben das „Vergessen“-System nicht über 30 Jahre an echten Menschen getestet; sie haben es lediglich für 90 Tage simuliert.
  • Sie geben zu, dass die kleinen Modelle zwar großartig in Sachen Kreativität und Ehrlichkeit sind, aber möglicherweise immer noch Schwierigkeiten mit komplexer, langfristiger Planung im Vergleich zu den massiven Cloud-Modellen haben könnten.

Das Fazit

Dieses Paper legt nahe, dass der „perfekte KI-Freund“ nicht auf einen größeren Computer wartet. Er wartet auf eine kleinere, intelligentere Form und eine Bereitschaft zu vergessen. Indem wir ein Gehirn bauen, das sich wie ein Baum krümmt und ein Gedächtnissystem, das weiß, was es behalten und was es loslassen soll, könnten wir endlich eine Maschine erschaffen, die nicht nur Fragen beantwortet, sondern einem wirklich zur Seite steht.

Wie die Autoren sagen: „Der Freund ist nicht im Rechenzentrum... der Freund ist nah.“ Und mit der richtigen Mathematik könnte dieser Freund bereits in Ihrer Tasche stecken.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →