← Neueste Arbeiten
⚛️ quantum physics

RiverONE: Generating Knowledge-Intensive VLM by Simulated Quantum Machines

RiverONE ist ein leichtgewichtiges Vision-Language-Modell mit 1,9 Milliarden Parametern, das während des Trainings simulierte Quantenberechnungen nutzt, um spezialisierte Parameter zu generieren, was es ihm ermöglicht, über 95 % der Leistung größerer quantenkalibrierter Modelle bei wissenschaftlichen Kalibrierungsaufgaben zu erreichen, während es vollständig auf klassischer Hardware läuft.

Ursprüngliche Autoren: Xindian Ma, Xinyu Long, Yefei Zhang, Yanchen Liu, Xianghao Li, Yufu Wen, Yike Hu, Yuedong Zhu, Zeyang Ma, Wen Qin, Yikun Wang, Peng Yang, Monan Wang, Teng Yu

Veröffentlicht 2026-06-30
📖 4 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Xindian Ma, Xinyu Long, Yefei Zhang, Yanchen Liu, Xianghao Li, Yufu Wen, Yike Hu, Yuedong Zhu, Zeyang Ma, Wen Qin, Yikun Wang, Peng Yang, Monan Wang, Teng Yu

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, Sie hätten einen brillanten, weltklasse Wissenschaftler, der sich einen komplexen Graphen aus einem Quantenphysik-Experiment ansehen kann und sofort weiß, ob die Maschine korrekt arbeitet, was die Zahlen bedeuten und was als Nächstes zu reparieren ist. Dieser Wissenschaftler ist unglaublich klug, aber er ist auch riesig. Er benötigt eine riesige Bibliothek an Büchern, ein gigantisches Büro und ein Team von Assistenten, nur um seinen Job zu erledigen. In der Welt der KI ist dieser „riesige Wissenschaftler“ ein massives Modell wie das von NVIDIA, das viel Computerspeicher beansprucht und teuer im Betrieb ist.

Die Forscher hinter dieser Arbeit wollten eine kompakte, taschengroße Version dieses Wissenschaftlers bauen, die auf einen Standard-Laptop oder einen einzelnen Computerchip passen könnte, ohne die Fähigkeit zu verlieren, die harte Arbeit zu leisten. Sie nannten ihre Schöpfung RiverONE.

So haben sie es gemacht, unter Verwendung einiger kreativer Analogien:

1. Das Problem: Den Riesen schrumpfen

Um das Modell kleiner zu machen, musste das Team viel der „Muskulatur“ herausschneiden.

  • Der visuelle Encoder (Die Augen): Sie nahmen den Teil des Modells, der die Graphen betrachtet, und ließen ihn die Arbeit teilen. Stellen Sie sich ein Team von 100 Künstlern vor, die ein Wandgemälde malen. Anstatt jedem Künstler einen einzigartigen Stil zu geben, ließen sie alle denselben Pinsel und dieselbe Technik verwenden, nur mit leichten Anpassungen. Dies spart Platz, aber das Gemälde könnte einige seiner einzigartigen Details verlieren.
  • Das sprachliche Rückgrat (Das Gehirn): Sie komprimierten den Teil, der Text liest und schreibt. Denken Sie an das Zusammenfassen einer 1.000-seitigen Enzyklopädie in ein paar Seiten mit Stichpunkten. Sie behalten die Hauptideen, verlieren aber etwas von der Nuance und den spezifischen Details.

2. Der magische Trick: Der „Quantengeist“

Hier liegt der clevere Teil. Wenn man ein Modell so stark schrumpft, wird es normalerweise „dümmer“, weil es diese feinen Details verliert. Die Forscher brauchten einen Weg, um diese verlorenen Informationen zurückzugewinnen, aber sie konnten nicht einfach mehr Daten hinzufügen (das würde das Modell wieder groß machen).

Sie verwendeten ein Konzept namens Simulierte Quantenberechnung.

  • Die Analogie: Stellen Sie sich vor, Sie versuchen ein kaputtes Radio zu reparieren. Sie können nicht einfach mehr Drähte hinzufügen, weil das Radio zu klein ist. Stattdessen verwenden Sie einen superkomplexen, unsichtbaren Bauplan (die Quantensimulation), um genau zu berechnen, welchen winzigen Draht Sie wie biegen müssen, damit der Klang perfekt wird.
  • Der Haken: Sie verwenden diesen „unsichtbaren Bauplan“ nur während Sie das Radio bauen. Sobald das Radio gebaut ist, werfen Sie den Bauplan weg. Das fertige Radio funktioniert perfekt, aber es benötigt den Bauplan nicht, um zu laufen.

In RiverONE verwendeten sie einen simulierten Quantenkreis (ein mathematischer Trick, der die Art und Weise nachahmt, wie Quantencomputer denken), um spezielle „Reparaturparameter“ zu generieren. Diese Parameter fungieren wie eine Geheimzutat, die die Lücken füllt, die durch die Komprimierung entstanden sind.

  • Wichtiger Punkt: Das fertige RiverONE-Modell benötigt keinen Quantencomputer zum Ausführen. Es läuft vollständig auf normalen Computerchips (GPUs). Der Quantenteil wurde nur während der „Konstruktionsphase“ verwendet, um das Modell zu entwerfen.

3. Das Ergebnis: Ein Expertenmodell für die Hosentasche

Das Team testete RiverONE bei einer spezifischen Aufgabe: dem Verständnis von Quanten-Kalibrierungsplots (diese kniffligen Graphen, die Wissenschaftler zur Abstimmung ihrer Quantenmaschinen verwenden).

  • Der Wettbewerb: Sie verglichen RiverONE mit dem riesigen NVIDIA-Modell (das etwa 35 Milliarden „Gehirnzellen“ oder Parameter besitzt).
  • Der Gewinner: RiverONE hat nur etwa 1,9 Milliarden Parameter (weniger als 5 % der Größe des Riesen).
  • Die Leistung: Trotz seiner geringen Größe erreichte RiverONE 95 % der Leistung des riesigen Modells. Es kann einen Graphen betrachten, Fehler erkennen und Korrekturen vorschlagen, fast so gut wie die massive Version, aber es läuft auf einer einzigen handelsüblichen Grafikkarte anstatt auf einer massiven Serverfarm.

Zusammenfassung

Betrachten Sie RiverONE als einen hoch effizienten Lehrling.

  1. Sie nahmen einen Meisterhandwerker (das große Modell) und brachten ihm bei, mit weniger Werkzeugen zu arbeiten (Komprimierung).
  2. Sie nutzten einen „Quanten-Zaubertrick“ (während des Trainings simuliert), um genau herauszufinden, wie man die Werkzeuge des Lehrlings anpasst, damit er keine Fähigkeiten verliert.
  3. Das Ergebnis ist ein leichtgewichtiger Experte, der dieselbe Arbeit wie der Meister verrichten kann, aber in Ihre Tasche passt und keinen Supercomputer benötigt, um zu funktionieren.

Die Arbeit behauptet, dass dies beweist, dass die Verwendung von simulierter Quantenmathematik zum Bauen kleinerer KI-Modelle ein praktischer Weg ist, um leistungsstarke wissenschaftliche Werkzeuge zu schaffen, die leicht einzusetzen sind.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →